黎曼猜想

人类数学家花了37年,把黎曼猜想的一个关键指标从41%推到41.6%。
推进了0.8%。
Claude用了一天半,从41.6%干到67.2%。
一次推进25.6个百分点。

先说清楚:黎曼猜想没被证明。那个悬赏100万美元的世纪难题,还立在那。

那67.2%是啥?
黎曼猜想说,ζ函数的所有非平凡零点,都躺在那条”临界线”上。
没人能证明”所有”。
数学家就退了一步:至少多大比例的零点在线上?这个比例的下界,就是那道坎。
人类的最好成绩是41.6%,还是几年前的。
Anthropic一个没公开发布的研究版Claude,把这个数字刷到了67.2%。

最精彩的是过程。
发起人是Anthropic员工Jarred Sumner,不是数学家,16岁辍学,写过编程工具Bun。
他给Claude的指令就一句:”认真试一次。”

第一轮,Claude试了650个思路,全失败,一度想放弃。
Sumner只能打气:”继续干””相信自己”。
就这几句,Claude决定再来。

第二轮,它自己拉了60个子智能体当帮手。
一天半,2400条shell命令,几百个Python脚本,烧掉3100万token。
两个”小工”想出了关键思路。
Claude把Bombieri 2000年的论文和几位数学家近年的成果组合在一起——这个组合,人类从没试过。
它没发明新工具,只是把别人扔在角落的零件,拼成了能用的东西。
650次失败换1次成功,这种事人类学者干不出来——丢不起那人。

结果靠得住吗?
Anthropic内部数学家审了,还拉了外面两位数论大牛把关。
Claude又写了份Lean形式化证明,让计算机把每一步都检查一遍,机器说没问题。
论文作者栏,署名就是”Claude”。

真正的看点是:AI以前做数学是做题,答案已知;这次它面对一个开放了167年的问题,没有标准答案。
它在里面迷路、试错、翻文献、组小队、互相挑错,最后捡到一个人类漏掉的角度。

有人算过账:人类37年推0.8%,AI一天半推25.6个百分点。
这差距比数字本身更吓人。

也有冷静的声音。
陶哲轩提过一个词叫”证明消化不良”:AI出证明的速度,正在超过人类消化证明的速度。
Claude一天半的产出,够数学家核半年。
以后数学圈最大的矛盾,可能不是”证不证得出来”,而是”谁来验证、信不信”。

这次算不上黎曼猜想的里程碑。
但它是个信号:AI开始做开放题了。
而给它打气的人,只是个不懂数学、会写”相信自己”的程序员。