不方便开声音?往下看图文版。
下面是视频旁白的全文。
你可能以为:电脑说它解开了一道数学难题,这题就算解开了。其实没那么简单。十月六号,OpenAI 把一大摞数学论文,放到了网上。一共七百二十二篇,都是一个没公开的 AI 写的。
他们给这个 AI 出了大约四千道题,都是数学家还没解开的。平均每个结果,它想了三个小时左右。里面有些题,一百多年前就有人问了。比如这一道。一根针,要在一块地上掉个头。这块地,最小能有多小?
一九一七年就有人问了。在平面上,答案出人意料:可以小到几乎没有面积。可到了立体的空间里,又冒出一个新问题:这块地方再小,能不能扁成一张纸?人类数学家去年才证明:不能。这摞论文里有一篇说:再多一个维度,它也证出来了。
那这道题,算解开了吗?先别急。想想考试。交卷很快,批卷才费工夫。现在,七百多份答卷,一下堆上了桌。好在有个帮手。有一种电脑程序,专门批数学证明。每一步都得写清楚,跳过一步,它就不给过。
这个程序,叫 Lean。七百多篇里,三百篇的主要结论,已经过了这一关。可它也有管不到的地方:它只查每一步对不对,不查题目抄没抄对。题目要是抄歪一点,步步都对,答的也是另一道题。新不新、有没有用,还得人来看。
第二天,十月七号,OpenAI 自己发了更正。有一篇论文里,一个正负号写反了。这一个错,连累三篇论文一起撤回。另外十四篇,也改了证明。数学家说,要好几个月,才看得清哪些真的新。
有人觉得,这对数学是好事。也有人说:先拿出收据来。AI 怎么做的,题目原话是什么,都摆出来。所以,电脑说解开了,算不算?现在的答案是:卷子交了,还在批。以前,数学里最难的是写出证明。以后最难的,也许是有人看得过来。
你最想让 AI 去解哪道难题?评论区说说。
你可能以为:电脑说它解开了一道数学难题,这题就算解开了。
其实没那么简单。美国时间 10 月 6 日,OpenAI 把一大摞数学论文放到了网上:一共 722 篇,全是它一个还没公开的 AI 写的。
他们给这个 AI 出了大约 4000 道数学家还没解开的题;平均每个结果,它想了三个小时左右。
一根针要在一块地上转一整圈掉个头,这块地最小能有多小?1917 年就有人问了。在平面上,答案出人意料:可以小到几乎没有面积。
到了立体的空间里,又冒出一个新问题:这块地方再小,能不能扁成一张纸?人类数学家 2025 年才证明:不能。
这摞论文里有一篇说:再多一个维度,它也证出来了。
想想考试:交卷几分钟,批卷可能要一整天。现在,七百多份答卷,一下子堆上了桌。
有一种电脑程序,专门批数学证明,叫 Lean。到 10 月 7 日,719 篇里,有 300 篇的主要结论已经过了它这一关,大约四成。
它只查每一步对不对。题目要是抄歪一点,步步都对,答的也是另一道题。
这个结果新不新、有没有用,还得人来看。
10 月 7 日,OpenAI 自己发了更正:有一篇论文里,一个正负号写反了。这一个错,连累三篇论文一起撤回;另外十四篇,也改了证明。
数学家说,要花好几个月,才看得清这里面哪些是真正的新东西。有人觉得公开出来对数学是好事;也有人说:先拿出“收据”——AI 到底怎么做的、题目原话是什么,都摆出来。
一个 AI 老在同一个地方出错,该修的往往不是它——让另一个 AI 回头翻旧账、提改哪一行,人点头才算数
同一个帮手升了级,九个地方的习惯变了——你半年前教它的话,有几句现在正好教反
2026 年 9 月刚露面的一种新 AI:它一个字都不跟你说话,只在印好的答题卡上涂格子,还标一句「我几成把握」——为什么它快 40–200 倍、为什么说它编不出来,以及「编不出来」不等于「不会选错」
以 2026 年 9 月新出的 Claude Opus 5.5 为例:五个 AI 考同一张九门课的卷子,每门考的是什么、它赢在哪输在哪,以及表底下那行小字为什么比分数还要紧