OpenAI 被曝雪藏了数百个数学证明:你死磕三年的题,答案可能早在服务器上落灰——数学界在吵AI有没有毁了数学,OpenAI在偷偷几百倍地量产
OpenAI 被曝雪藏了数百个数学证明:你死磕三年的题,答案可能早在服务器上落灰——数学界在吵AI有没有毁了数学,OpenAI在偷偷几百倍地量产
9月18日凌晨,新智元爆了一条让人后背发凉的料:OpenAI内部被曝已经积累了数百个AI生成的数学难题证明,但绝大多数从未对外公开。
这不是”又在训练一个新模型”的传闻。这是数学界最怕听到的那种消息——你在黑板上熬夜推导了三年的一道题,可能早在几个月前就被AI解了,然后有人坐在办公室里决定”这个暂时不公布”。
而做出这个决定的原因,可能不是技术上的——只是单纯的战略选择。
雪藏不是因为不正确
说到”雪藏”,大多数人第一反应是”证明有错所以不敢发”。但根据目前的爆料,情况恰恰相反——这批被雪藏的证明,是经过内部验证的。
OpenAI有自己的一套验证流程,对于AI生成的数学证明,会先用Lean(形式化验证工具)做逻辑检查,然后再由内部数学家团队做人工审阅。通过这些门槛的证明,会被归档归档——然后就不动了。
为什么?因为OpenAI对数学证明的发布策略极其谨慎。
OpenAI在9月8日公布的纳维-斯托克斯方程证明(Post 195),是精心选择的结果——它是千禧年难题,是唯一一个能上头条的。但是,根据知情人的说法,OpenAI内部还有其他同样达到发表级别、甚至更容易被数学界接受的证明成果,包括离散几何和数论领域的突破。
这些证明的”命运”取决于一个简单的计算:一次性放出太多AI生成的数学证明,会不会吓到数学界?
它会。而且已经吓到了。25位菲尔兹奖得主联合声明(Post 204)、陶哲轩的”好问题不可再生”警告(Post 207)、Bubeck的回应——这些都是在OpenAI只公布了一个NS方程证明的情况下发生的反应。你可以想象如果OpenAI同时放出100个——
那个画面不是”人类数学的飞跃”,是”数学家集体失业宣言”。
从”有没有”到”给不给”——顺序变了
这件事最讽刺的地方在于,讨论的焦点已经完全变了。
就在一个月前,所有人还在争论”AI到底能不能解出真正的数学难题”。陶哲轩把AI的表现比作”一个非常聪明的学生,为考试背下了所有内容,但对概念没有深刻理解”。25位菲尔兹奖得主的联合声明的潜台词也是——”AI还没有真正理解数学,只是碰巧得到了正确结果”。
但现在的问题是:如果AI已经解了上百道题——不仅仅是”碰巧”——那数学界的防线还在哪里?
这就不是”AI能不能做数学”的问题了。这是”AI做了数学,但人类该怎么面对这个结果”的问题。区别在于,前者还能争论,后者只能接受。
OpenAI的”雪藏”策略,本质上是在控制这个答案的释放速度。不是因为他们不确定这些证明对不对——是因为他们太确定了。确定到他们知道,一次全放出来会引发什么样的连锁反应。
为什么选择现在爆料
“雪藏”这件事能被曝出来,本身就说明了OpenAI内部的意见并不统一。
有消息源告诉媒体这些信息,大概率不是个人的泄愤行为,而是OpenAI内部关于数学成果”发表策略”的路线分歧。一部分人认为AI的数学能力应该更透明地展示给学术界,促进数学研究范式的转变。另一部分人认为应该放缓发表速度,先建立AI与数学家的协作机制,避免引发恐慌和反弹。
选择爆料的一方,显然认为当前的”雪藏”策略伤害了整个行业。不是伤害OpenAI——伤害的是数学界,让数学家们在一个虚假的认知环境中”正常”工作——以为自己的研究还领先于AI,以为自己还有足够的时间。
而对学术界来说,这层”遮羞布”的揭开,带来的不只是难堪,还有研究伦理上的巨大黑洞。
每一年有大量研究经费被投入到那些AI其实已经解决、不过没人知道它已经解决了的课题上。博士生用三年时间研究一个课题,答辩通过后导师说——”你知道吗,去年OpenAI的服务器上就有这个题的完整证明了”。
到那个时候,雪藏的几百个证明就不再是一个”新闻”,而是一条切断数万人数年研究工作价值的判决书。
OpenAI不傻,但这能瞒多久?
我不认为OpenAI的”雪藏”是恶意隐瞒。更合理的解释是——他们自己也不知道该怎么处理这些成果。
NS方程的例子已经非常明确地展示了”一个AI逆天的数学成果被公布后会发生什么”:25位菲奖得主联名、陶哲轩发文警告、Buckmaster撕逼、”为什么你要毁掉自己的职业生涯”——全世界的数学家和媒体花了两周时间消化这一个结果。
如果一次放出来几百个,那不只是数学界炸了——学术界、基金机构、期刊编辑部,全线崩溃。
所以选择”分批释放”或者”选择性释放”是合理的策略。问题是,这个”合理”是对OpenAI来说合理,对数学界、对还在黑板上推导的你来说,可能一点都不合理。
更麻烦的是,这个”雪藏”不可能永远持续。只要OpenAI的模型持续输出数学证明,他们的”库存”就在指数增长。半年后是几百个,一年后可能就是几千个。那你藏到什么时候?藏到人类数学家全都同意”AI是我们的平等合作伙伴”的那一天?
如果是这个逻辑——那可能永远也藏不完。