OpenAI数学成果遭质疑,陶哲轩警示“证明消化不良”危机

科技区角 2026-10-09 10:30

【科技纵览】当人工智能试图以算力暴力破解人类智慧皇冠上的明珠时,一场关于学术伦理与研究范式的激烈辩论正在悄然上演。10月9日,据IT之家报道,OpenAI在GitHub平台公开了719份由AI生成的数学解答手稿。这些成果横跨372个数学结果族,触及数百项长期悬而未决的开放研究问题。然而,这份看似丰硕的成绩单,却因未能完全契合“数学与人工智能顾问小组”(AGMAI)设定的严谨标准,而陷入舆论漩涡。

回溯至10月6日,OpenAI最初上传的手稿总数为722份。但在次日,由于发现一处符号错误及其引发的连锁反应,官方紧急撤回了其中3份文件,最终定格在719份这一数字。尽管OpenAI声称在发布前曾咨询由普林斯顿高等研究院主导的AGMAI,并参考了其公开建议,但实际执行层面似乎存在落差。AGMAI此前明确呼吁,前沿AI实验室应停止在外界无法访问的专有模型上测试高难度数学题,并要求全面披露模型名称、提示词、推理链条、耗时及计算成本等关键信息。

遗憾的是,OpenAI此次行动仍依赖于黑盒般的专有模型,且在全部719份手稿中,仅有10份附带了完整的模型推理链。更令学界担忧的是可理解性问题。顾问小组强调,AI生成的证明必须便于数学家审查与学习。然而数据显示,约42%的证明未经过形式化处理,也缺乏将自然语言论证与形式化产物相连接的机器可读元数据。AGMAI随后声明,其咨询角色绝不构成对OpenAI获取或发布这些结果的背书,最终评判权仍在于数学界是否认可相关建议得到了充分落实。

这一事件迅速引爆了关于AI生成数学成果的透明度、形式化验证机制以及学术研究自主性的广泛争议。加州大学洛杉矶分校教授、2006年菲尔兹奖得主陶哲轩于10月7日在社交网络mathstodon上发表长文,表达了深切忧虑。这位被誉为“数学界莫扎特”的学者坦言,他并不排斥AI辅助研究,甚至一直是积极使用者,但他强烈反对将“用AI快速攻克著名难题”作为主要目标或商业展示手段。

陶哲轩指出,传统数学突破绝非仅仅“得到答案”那么简单。作者需通过报告、研讨与同行交流,使证明得以简化、解释并纳入教材,进而催生新问题与合作方向。相比之下,当前由提示者驱动AI自主解题的模式,往往在“解决”目标达成后便戛然而止,后续的理解、讨论与领域建设严重缺失。发布者甚至可能无力解释AI的输出或与领域互动。他将此现象称为数学界的“证明消化不良”:AI高速产出命题与证明,人类却来不及验证、吸收与教学,导致大量“无人能消化的证明”堆积。

尤为令人警惕的是,OpenAI倾向于将纳维–斯托克斯方程等千禧年难题作为模型能力的基准测试。在陶哲轩看来,这混淆了“解题速度/数量”与“数学理解/洞见”的本质区别。一旦问题被公开“解决”,其状态几乎不可逆转,即便后人想探索不同路径,已知答案的存在也会“污染”纯粹的探索过程。这种将开放问题视为可批量消耗资源的大规模“收割”,恐将使整个数学领域的土壤变得贫瘠,远不如传统研究方式那般肥沃且充满生机。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
黄仁勋站台“史上最强” Surface,微软要把 AI 工作站装进你的背包
报名通知 | 国际半导体前沿技术赋能AI与绿色交通高峰论坛
具身机器人、五轴机床、精密注塑,3大方案瞄准AI产业
微软MXC正式落地Win11,为AI Agent划定“安全围栏”
电力电子顶会三篇论文入选!联想×清华打通AI芯片垂直供电新路径
被OpenAI解雇后,三名安全研究员联名公开信曝光内幕
苹果新品全家桶大剧透,最大的个人 AI 终端是你家
Opus 5.5接入一切,OpenAI遭全硅谷围剿!谷歌马斯克集体叛变了
思尔芯将亮相2026 RISC-V中国峰会,以AI EDA加速RISC-V设计调试
懂车帝辟谣“内部整顿”截图:系AI伪造,将追究法律责任
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号