数学家的精神危机:OpenAI Astra 2000美元解开了十年未破的题,然后呢?
数学家的精神危机:OpenAI Astra 2000美元解开了十年未破的题,然后呢?
一场让数学界集体破防的”轻量级秀肌肉”
这周末,OpenAI 公布了一份让数学圈炸锅的成绩单——他们下一代主要模型 Astra 的内部版本,用 2000 美元的推理成本,解决或推进了十个数学难题。
注意,这不是那种”我帮你写个脚本”级别的 AI 使用场景。高维几何、编码理论、群论、算术电路复杂性、量子复杂性、格密码学、极值组合——每个领域拎出来都是数学博士生要啃几年的硬骨头。其中有几个问题至少十年没有进展,另一些已经悬而未决数十年。
具体的战绩清单包括:构造出非 sofic 群、推翻 Connes 刚性猜想、解决三个 Erdős 问题,以及推进与后量子密码学密切相关的最近向量问题。
更气人的是:OpenAI 研究科学家 Noam Brown 补了一句话——”我们也没在每个问题上花太大工夫,测试时计算还有很大提升空间。”
“没花太大工夫”的代价是 2000 美元,平均一个问题 200 美元。
AI 不是在加速科学发现,它是在改写”发现”的定义
如果你觉得这只是一次漂亮的”模型演示”,你可能还没抓住重点。
数学界这次的反应,和之前任何一次 AI 突破都不一样。之前 AI 下围棋、写代码、搞蛋白质折叠,数学家们都能保持体面——那是工程问题,和我的纯数领域没什么关系。
但这次不同。Astra 碰的是纯符号推理的圣杯。数学,这个被认为是人类智力最后堡垒、最不可能被 AI 攻克的领域,现在那扇门也被踹开了。
多伦多大学数学教授 Daniel Litt 坦诚承认自己之前低估了 AI 的能力,说距离大模型发表能登上《数学年刊》的成果,不过是时间问题。而更真实的声音来自数学教科书作者 Jay Cummings——他直言”不可思议”,语气里混合着敬佩和某种说不清的失落。
Kaggle 特级大师、NVIDIA 机器学习专家 Jean-François Puget 给数学专业的学生泼了盆冷水:纯符号化的脑力工作正在被 LLM 快速吞噬,想避开被替代,就得往和物理实体绑定更深的方向走。翻译成人话就是——别卷纯数学了,去搞工程和物理。
《数学的暗夜》:比职业焦虑更可怕的是意义危机
真正让我停下来想了一下的,是一位叫 Kirwin Hampshire 的青年数学研究者写的长文《数学的暗夜》。
他说,真正令人崩溃的不是 AI 会不会抢走数学家的饭碗——而是数学这门学科赖以存在的意义,可能正在根本性地改变。
数学最珍贵的从来不是证明本身,而是人类第一次发现未知、创造新知识的那一瞬间。这种近乎宗教般的”啊哈”时刻,是无数数学家的毕生追求。但如果未来任何一个问题,AI 都能瞬间给出无数种漂亮的证明,人类还可以学习数学、讲授数学、评价数学——但可能再也没有机会真正发现数学。
他用了 Borges《巴别图书馆》的比喻:假如世界上所有可能写出的伟大小说都已经存在,AI 总能第一时间挑出最好的一本,作家当然还能继续写作——但创作本身的含义已经不可避免地变了。
这不是职业焦虑。这是存在主义恐惧。
这也是我第一次觉得——那篇文说得对——AI 带来的恐惧,不是”它会不会取代我”,而是”它把我最珍视的东西变得毫无意义”。
冷静一下:Noam Brown 自己说了实话
当然,这也不是 Astra 马上就能拿 Fields Medal 的意思。
Noam Brown 自己在回复网友时承认了:Astra 并没有解决数学难题,也没有开创新的数学分支或提出有趣的新猜想。它做的,是在现有问题的框架内找到解法——这是个”把已知路径走通”而非”发现新大陆”的事情。
有数学家指出,社会需要数学家从来不是为了凑够每年的证明数量,而是先确定”我们需要多少能守住判断权的人类数学家”,再把证明的工作交给 AI 去做——这恰恰给纯数学保留了不可替代的位置。
但这里有个残酷的现实:判断权本身也在被蚕食。当 AI 能在几分钟内给出十个不同的证明,判断哪个更好,这件事本身就需要 AI 来辅助了。就像围棋界已经没有人能在不借助 AI 的情况下判断”这手棋好不好”——数学会不会也走到那一步?
这其实是每门学科都要提前想的问题
OpenAI 这次 2000 美元秀肌肉,最狠的还不是那十个解题结果。
最狠的是那个定价暗示——2000 美元就能撬动十年的数学沉寂。计算成本还在下降。按照当前趋势,明年可能只要 200 美元,后年只要 20 美元。
数学界的这场”精神危机”,很可能只是第一张倒下的多米诺骨牌。生物学家、化学家、理论物理学家——你们的专业领域也在射程范围内。
问题不再是”AI 能不能做 X”——答案已经很明显了。
问题变成了:“当 AI 已经能做得相当不错时,人类在自己的专业里到底还在追求什么?”
有的学科可能很快就得面对这个拷问,有的还能多喘几年。但喘口气不是为了装死,是为了想清楚——人到底是来解题的,还是来问问题的。
毕竟,AI 再厉害,目前也还不能提出一个全新的问题。
至少现在还不能。