AI正在疯狂收割数学难题 算力降维打击。2026年9月11日,得州星际之门超算中心的十万块GPU日夜运转,OpenAI发布了一项震惊学术界的研究成果。一万多个AI智能体仅用88小时就解决了克莱数学研究所悬赏90年的纳维-斯托克斯方程问题。这些AI不仅证明了该方程在特定条件下会出现预测流体无限速度的失效状态,还顺手拿走了百万美元奖金。
人类顶尖数学家对此感到非常沮丧。纽约大学的Tristan Buckmaster和Anthropic的Levent Alpöge花费近一年时间,刚取得简化版方程的突破,结果被这些AI超越。他们指责OpenAI未经授权使用了他们的未发表研究,但这种争议更像是旧时代手工作坊面对现代流水线技术时的无力反抗。
GPT-6 Astra的表现不仅依赖于算力,其算法也非常精准。同一天,Astra攻破了FrontierMath Tier 4的最后一道防线。这套由陶哲轩等六十多位菲尔兹奖得主设计的难题,去年七月推出时AI正确率不到百分之二。然而,一年零两个月后,Astra不仅解出了全部五十道题,解法还与人类教授的思路高度一致。Epoch AI最终宣布Tier 4彻底饱和。
布罗克曼在发布会上宣称“欢迎来到AGI时代”,这句话现在听起来充满了讽刺。Astra在抽象推理测试ARC-AGI-3中取得了99.9%的分数,远超人类平均水平的48%。它还能自己打开KiCad软件绘制电路板,并在ExploitBench上编写漏洞利用代码获得满分。处理长周期任务时,它能够跨上下文窗口做笔记并在关键决策点提问。人类苦等半个世纪的图灵梦想,就这样被大量GPU和并发Agent实现了。
我们曾经认为数学是人类智力的最后堡垒,但现在看来,这个堡垒并没有坚实的护城河。一万多个AI在88小时内进行了无数次试错和自我博弈,而人类大脑根本无法计算其复杂度。它们不需要灵感或顿悟,只需要算力堆叠和概率收割。当人类数学家还在为学术署名和规则争论时,AI已经通过饱和的榜单和破解的千禧年难题宣告了游戏规则的改变。旧世界的学术壁垒在绝对算力面前显得脆弱不堪。
我们还在纠结AI是否真正理解数学,而AI已经在思考下一个要攻克的百年难题。当人类引以为傲的直觉和灵感在八十八小时的暴力穷举和万次并发试错面前变得一文不值时,我们到底该拿什么来证明自己还没被淘汰?
