百年黎曼猜想被Claude破了新纪录!是个未公开新模型_滚动
2026-08-11 13:36:02 来源:硅星人 小 中
文章转载于量子位
作者:一水
【资料图】
不er,这竟然是真的??
刚刚,A社官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展。
什么概念?
这个数字上一次被人类往前推动,还是经过几代数学家接力、用几十年一点点磨出来的。
结果Claude这次虽然没打下终极Boss(A社:没有完全解决猜想),却在半路顺手刷新了一项长期纪录。
更离谱的是。
Claude完成这次研究,靠的是60个智能体、3100万输出Token。
以及,人类只能在一旁反复给它加油。。。
只能说,数学界最难绷的一幕出现了:
人类负责情绪价值,AI负责推进数学前沿(doge)。
1
没证明黎曼猜想,但把下界推高了一大截
黎曼猜想一度被喻为数学“猜想界皇冠”。
它由德国数学家黎曼在1859年提出,至今已难倒人类167年,谁能证明出来,就能拿走100万美元大奖。
用最不绕弯子的话说,它研究的是素数背后隐藏的规律。
都知道素数就是只能被1和自身整除的整数,比如2、3、5、7、11……
它们是构成整数的基础,但出现的位置看上去却毫无章法:
有时挨得很近,有时又隔着一大段。
为了找到其中的规律,黎曼研究了一个叫“黎曼ζ函数”的数学函数,这个函数有许多能让函数值变成0的“零点”。
黎曼猜测,其中所有“非平凡零点”,都排列在复平面上实部等于1/2的同一条直线上。
这就是黎曼猜想:
数学家之所以如此在意,是因为这些零点与素数分布紧密相关。
如果黎曼猜想成立,就意味着素数的分布虽然看起来随机,背后的波动却始终被限制在一个精确范围内。大量建立在“假设黎曼猜想成立”基础上的数学结论,也能获得真正可靠的地基。
过去一百多年里,数学家已经用计算机验证了海量零点,发现它们全都乖乖落在临界线上。
但验证再多,也只能说明“检查过的都对”,无法证明无限多个零点永远不会出现一个“叛徒”。
鉴于完整证明实在太难,于是数学家换了一条路线:
既然暂时证明不了“所有零点都在线上”,那能不能先证明“至少有一定比例的零点在线上”?
经过几代数学家接力,这个比例的已知下界被一点点推到了41.6%。
而Claude这次做的,就是把它一口气提高到了67.2%。
注意,这并不等于“黎曼猜想被证明了67.2%”,也不代表剩下32.8%的零点不满足猜想。
它的准确含义是:
虽然距离要求“全部零点都在线上”的黎曼猜想,仍然存在本质差距。
但对于一个被人类磨了几十年的长期纪录来说,从41.6%直接跳到67.2%,成绩已经足够扎眼。
1
方法揭秘
至于Claude怎么做到的,根据A社描绘的故事,开局就很“不讲武德”。
没办法,谁让A社员工Jarred一上来就把整个猜想的证明任务甩给了Claude:
Claude:我?黎曼猜想??(A社版奔波儿灞)
fine,虽然有亿点难,但谁让咱是给人类打工的,开干吧……
于是,在没有精心设计的解题路线,也没有数学家在旁边手把手指导的情况下,Claude先是一口气生成并尝试了650个思路。
结果,不出意外,喜提650连败。
按理说,到这里故事就该结束了,毕竟这可是从1859年悬到现在、无数顶级数学家都没能拿下的终极难题。
但Jarred仍不死心,他给Claude再次下了一个非常简单粗暴的指令:
再试一次。
没想到Claude很快就“开悟”了,因为它知道“摇人”了。
第二轮,Claude在Claude Code里拉起约60个子智能体,花了一天半时间,执行2400条Shell命令、写下数百个Python脚本,还围绕已知的黎曼ζ函数零点进行了数千次数值检验。
这60个智能体有的负责提出新思路,有的沿着重点方向继续推导,有的专门寻找反例,还有一批直接充当审稿人,负责给其他智能体挑错。
最终,有2个智能体竟然真的提出了关键数学思路。
眼见同伴如此给力,其他智能体也没偷懒:
13个负责提供辅助想法,30个探索了其他方向但没能成功,13个专门验证论证,最后2个帮忙把成果整理成论文。
而作为这支队伍里唯一的人类,Jarred的主要工作竟是不断发送鼓励??
就这么“哄”了一天半,Claude虽然没能证明黎曼猜想,却意外发现:
如果把几项已有数学成果重新组合起来,似乎可以突破一个停滞多年的纪录。
它将满足黎曼猜想的ζ函数零点比例下界,从41.6%直接推到了67.2%。
生活,真就处处充满意外之喜呗!!
为了确认自己不是“算嗨了”,Claude又拉来不同的子智能体交叉审稿、寻找反例,还从arXiv下载了54篇论文,检查这个结果是不是早就有人做过。
觉得还不够保险,它又从头独立证明了一遍。
A社:连Claude自己也对其发现感到惊讶,也许像我们许多人一样,Claude低估了AI的进步速度。
确认暂时没发现问题后,Claude主动提出:
写成论文,再找人类数论专家来验货。
随后,Anthropic内部两位数学家Levent Alpöge和Ralph Furman检查了这项结果。
Claude还和Anthropic员工Eric Easley一起,把证明写成了计算机可验证的Lean版本,并通过标准工具Comparator的测试。
此外,两位解析数论专家Brian Conrey和Dan Goldston也审阅了论文。
也就是说,从想出思路到交叉审稿、查重、复现、写论文、做形式化验证,Claude几乎把科研流程走了一遍。
当然,这还不等于完成了传统同行评审,更不意味着黎曼猜想被解决了。
Anthropic也明确表示,这套方法大概率无法直接通向完整证明。
但真正夸张的地方在于:
AI已经不只会做有标准答案的数学题了,面对一个没人知道答案的开放问题,它开始能够自己找方向、读论文、试错、挑漏洞,甚至拿出新的研究结果。
原本只是让Claude挑战一个几乎不可能完成的任务。
结果主线没通关,支线先爆出橙装了。
1
One More Thing
话说,不知道这个模型是不是传说中的Fable 5.1(或Fable 6)。
网上最近已经开始流传Fable 5.1的消息:
爆料称,它主要强化了长周期推理和智能体能力,可能已经完成内部测试,只是在等待合适的发布窗口。
还有人猜测,面对下一轮模型大战,A社可能直接跳过“5.1”,把版本号抬到Fable 6。
不过截至目前,这些说法既没有API型号、系统卡和Benchmark佐证,也没有得到Anthropic官方确认。
或许等OpenAI发布GPT-6就知道了。
螳螂捕蝉,黄雀在后,懂的都懂(doge)。
参考链接:[1]https://x.com/AnthropicAI/status/2086867246073401655?s=20[2]https://www.anthropic.com/research/riemann-zeta
点个“爱心”,再走 吧
相关文章
- 百年黎曼猜想被Claude破了新纪录!是个未公开新模型_滚动
- 热文:鹰普精密发布2026年中期业绩 股东应占溢利4.21亿港元同比增长21.6%
- 中国铁塔(00788.HK)上半年纯利增长30.1%至74.89亿元 中期息每股0.19122元 快播报
- 今日热议:国内金饰克价一夜大涨至1336元
- 通用汽车拟向三星SDI出售35亿美元美国电池合资企业半数权益
- 维宏股份涉税自查补缴近千万元 全额计入 2026 年损益拖累业绩 快消息
- 城堡证券:五大催化剂罕见共振,黄金正从反弹走向新一轮上攻阶段
- 以黑土养文学风骨 每日视讯
- 中锐股份:截至2026年7月31日,公司最新股东户数为44,095户|今日快看
- 8月10日科创板融资净买入排行榜:佰维存储融资净买入居首
- 市场震荡分化风格切换,大消费走强科技股承压
- 恒生指数高开0.24% 恒生科技指数涨0.27%|今日热讯
- 回报率如何控制买房决策更稳妥? 每日资讯
- 前国足主帅转投阿联酋,带着中国情报上任,9·23亚运反戈一击!
- 潮热治疗药物ABCL635中期试验取得积极结果 AbCellera Biologics(ABCL.US)应声大涨|当前看点
- 若昂-戈麦斯:我很少受到这么热烈的欢迎,希望为维拉赢得胜利|焦点报道
- 河北恒浩包装制品有限公司成立 注册资本10万人民币_当前热点
- 今日热闻!中企助力澳大利亚布局商用太阳能项目——中澳绿色能源合作不断深化
- 洁美科技:拟9.15亿元收购埃福思科技100%股权_新视野
- 江波龙(301308.SZ):拟4亿元-8亿元回购股份
- 心动公司(02400.HK)8月10日回购794.55万港元,已连续40日回购 热推荐
- 铖昌科技:上半年净利润同比增长34.72%_精彩看点
- [快讯]盛弘股份公布半年报 扣非净利润同比增加50.45%|每日消息
- 国能日新证券事务代表池雨坤荣获金麒麟·优秀证代荣誉
- 生意社瓦楞原纸8月10日均差继续负向缩小为-21.05元/吨
- 生意社锑8月10日均差继续负向缩小为-900.00元/吨_观察
- 前沿热点:丝路视觉(300556):丝路转债回售的第三次提示性公告
- 当前焦点!生意社:8月10日华北地区醋酸行情弱势下行
- 莱茵河水位过低或中断航运 航道“一分为二”
- TMT50ETF招商: 招商基金管理有限公司旗下部分基金增加世纪证券有限责任公司为场内申购赎回代办券商的公告 当前热门
热文推荐
排行推荐
通用汽车拟向三星SDI出售35亿美元美国电池合资企业半数权益
维宏股份涉税自查补缴近千万元 全额计入 2026 年损益拖累业绩 快消息
城堡证券:五大催化剂罕见共振,黄金正从反弹走向新一轮上攻阶段



