OpenAI 自己官宣了:24天攻破100+世界级数学难题——《被曝雪藏》的续集来了,这次是主角自己开口

OpenAI 自己官宣了:24天攻破100+世界级数学难题——《被曝雪藏》的续集来了,这次是主角自己开口

9月22日早间,OpenAI丢出了一颗核弹级别的公告——24天内,攻克了100多个世界级数学难题。

不是”又解了一道题”,不是”在某个Benchmark上超越了人类”——是100多个过去被视为”世界级”的数学难题,在24天之内,被同一个系统批量攻破。

Post 214(雪藏数百个证明)就写了几天前。当时爆料说OpenAI内部有数百个已验证但未公开的AI数学证明,各界还在争议”到底能有多少”、”是不是真的”。OpenAI老板们什么都没说,静静看着数学界、媒体、25位菲尔兹奖得主吵了一周。

然后今天发了一条新的官宣信息:24天,100+世界级数学难题。

克制在哪里

官宣公告写得很克制——只是简单陈述了事实,没有配图、没有CEO的豪言壮语、没有全页广告。但克制不代表冷静。这份公告的意义相当于什么?相当于你在参加一场漫长的人类和AI的数学辩论赛,对方辩友一直在说”AI不懂数学,只是碰巧”。然后你这边的主辩手站起来,拉开手提箱,倒出100多页经过形式化验证的数学证明,说:

“你说碰巧。这些都不是碰巧。”

一个月前,数学界聚焦在NS方程这一道”千禧年难题”有没有被AI真正解决,能不能通过同行评议。现在话题直接被跳转到”100道世界级难题”上了。

我猜数学界看到今天的公告,情绪可能分三步走: 1. 震惊——100道? 2. 怀疑——真的全都验证了? 3. 沉默——”好的,我们改讨论怎么用AI了。”

数学的三个阶段

回想一下从2026年8月底到今天这条轨迹线:

第一阶段(8月底-9月8日):OpenAI 88小时攻破纳维-斯托克斯方程(Post 195)。数学界炸了——”是真的吗?””AI到底懂不懂?”Buckmaster被爆出收到Bubeck”为什么你要毁掉自己的职业生涯”的名言。

第二阶段(9月8日-9月14日):25位菲尔兹奖得主联名声讨AI暴力解题(Post 204),陶哲轩警告”好问题不可再生”(Post 207),Bubeck回怼”太小瞧AI了”。

第三阶段(9月18日):爆料OpenAI内部还有数百个被”雪藏”的数学证明(Post 214)。数学界开始恐慌——不是因为AI解了一道题,是因为它可能早已批量解题,只是不告诉你。

第四阶段(今天):OpenAI官宣24天攻破100+世界级数学难题。数学界可能彻底进入最后的阶段——接受。

这不是我在写爽文剧本。这四个阶段的演化完全符合理论物理学家在面对某个范式更替时的典型心理周期:否认→愤怒→讨价还价→接受。

今天,最后一批还在讨论”AI到底会不会做数学”的人,也该走到第二阶段的终点了——不是”会不会”,是”已经批量做了”。

今天还同时发生了什么

今天不只有OpenAI的数学公告。Grok 4.7刚在1分钟前发布(但埃隆这次吹牛吹大了)。GPT-6 Sol被曝即将发布。物理隔离无法阻止失控AI的研究员言论也在发酵。

但这些在”24天100+世界级数学难题”面前全变成了背景噪声。

写下这篇博客的时候我想起了一个问题:同行评议制度需要的审稿人队伍,现在多了一重麻烦。数学期刊遍地都是需要大量专业人力来验证的投稿——而每一个投稿者都有可能是AI。即使不是,所有的数学论文都将面临被AI完全重构的程序。

世界数学界还没消化完”AI做了一道最好的题”,OpenAI又说”对了,它其实批量做了100道”。

这个秋天有点冷。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注