OpenAI 数学证明风暴挑战学术界,但数学家却不买账
OpenAI 数学证明风暴挑战学术界,但数学家却不买账 美国时间 10 月 6 日,OpenAI 在 GitHub 的 openai/math 仓库里一次性公开 722 篇数学手稿,按结果相关性归成 372 个"结果族",覆盖数论、几何、数学物理等 17 个领域。《经济学人》的评语是:这一天可能被
💡 你将学到
OpenAI 数学证明风暴挑战学术界,但数学家却不买账 美国时间 10 月 6 日,OpenAI 在 GitHub 的 openai/math 仓库里一次性公开 722 篇数学手稿,按结果相关性归成 372 个"结果族",覆盖数论、几何、数学物理等 17 个领域。《经济学人》的评语是:这一天可能被
OpenAI 数学证明风暴挑战学术界,但数学家却不买账
美国时间 10 月 6 日,OpenAI 在 GitHub 的 openai/math 仓库里一次性公开 722 篇数学手稿,按结果相关性归成 372 个"结果族",覆盖数论、几何、数学物理等 17 个领域。《经济学人》的评语是:这一天可能被记进数学史。这里面有希尔伯特第十问题的有理数域版本、推翻 Kaplansky 零因子猜想的反例,还有 9 月就刷过屏的纳维-斯托克斯方程证明。手稿上线不到 48 小时,数学界的反应从震惊转向了集体抵制。
官方口径下,这批成果便宜得吓人
按 OpenAI 自己的说法,这些结果来自一个尚未发布的内部模型,评估时被喂了 4000 道数学题,平均每个结果耗费相当于 ChatGPT Pro 订阅三个小时的算力。人类数学家几代人没啃下来的难题,摊到每个头上是三个小时的订阅费。722 篇里约 42% 配上了 Lean 形式化证明,能被计算机逐行验证,剩下的还在路上。
两天后,第一份勘误就来了
10 月 7 日,仓库更新首条日志:撤回 3 篇,修订 14 篇。原因小到离谱:霍奇猜想相关的一篇论文里,一类几何操作的符号被记成 +1,按论文自己的约定该是 -1。一正一负,本该抵消归零的计数变成了非零,整套论证塌了,依赖它的另外两篇跟着撤。手稿总数从 722 变成 719。OpenAI 强调撤的是证明,命题本身没被证伪,原稿留档可查。
数学界为什么不领情
发布当天,OpenAI 今年拉起的普林斯顿高等研究院顾问组(AGMAI)发了声明,九人组里有三位菲尔兹奖得主,措辞克制:这是大事,但顾问组的建议归建议,他们没有认可这些结果和发布过程。更狠的是陶哲轩牵头的人类数学协会(AHM),声明里直接写"没人求过你们解这些证明",敦促全球数学家停止与 OpenAI 合作。此前顾问组第一份报告划过红线:前沿 AI 公司不该在内部模型上擅自测试高深数学难题。OpenAI 没接。
得州大学奥斯汀分校的 Dana Moshkovitz 在这批文档里看到自己做了半辈子的 Unique Games 猜想"被证明",连夜读完,评价是:像吃了致幻剂的人写出来的东西。逻辑跳跃,堆砌结论,没有一条人能读通的推导。数学家的愤怒点也在这里:模型几天生成几百篇,人读一篇要几周,这批天书实际上是要全球学者免费当验题员。
719 篇里有多少能站住
现在没有答案。有形式化证明的 42% 可信度高,剩下 58% 按官方自己的说法处在不同验证阶段。9 月那篇流体力学证明,专家到现在还没读完。AHM 把这次发布定性为"展示力量,而非学术",话狠,但两天出一份勘误的节奏说明它至少说对了一半:这批手稿的成色,要数学界用几个月甚至几年称重。
| 指标 | 数字 |
|---|---|
| 发布手稿 | 722 篇(现为 719 篇) |
| 结果族 | 372 个,17 个领域 |
| Lean 形式化 | 约 42% |
| 评估题量 | 4000 道 |
| 单个结果算力 | 约合 ChatGPT Pro 3 小时 |
| 上线两天 | 撤回 3 篇,修订 14 篇 |
719 篇里最终能站住的会有多少?数学界还在阅卷。AI会颠覆现有学术界吗?曾经的学术界大拿肯定是不希望看到这事发生的。你怎么看这件事?评论区聊聊。
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
