这竟然是真的?刚刚,Anthropic官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展。它将满足黎曼猜想的黎曼ζ函数零点比例下界,从41.6%提高到了67.2%。要知道,这一数字此前人类曾耗费数十年、接力打磨才勉强推至如此高度。这次Claude虽然没能攻克终极难题(Anthropic明确表示未完全解决),却在半路刷新了一项长期纪录。更令人惊叹的是,Claude完成这项研究仅靠60个智能体和3100万输出Token,而作为“指挥官”的人类,竟然只能在一旁不断给它加油:“继续Claude,相信你自己。”
黎曼猜想被誉为数学界的“皇冠明珠”,由德国数学家黎曼于1859年提出,至今已难倒人类167年,谁能证明出来,就能拿走100万美元大奖。简单来说,它研究的是素数分布背后的规律。素数是构成整数的基础(如2、3、5、7、11…),但它们出现的位置看似毫无章法。黎曼为此引入了黎曼ζ函数,并猜测其所有“非平凡零点”都排列在复平面实部等于1/2的直线上。这一猜想之所以重要,是因为这些零点与素数分布紧密相关。若成立,意味着素数虽看似随机,实则波动被严格限制。尽管数学家已验证了海量零点,但这只能证明“检查过的都对”,无法断言无限多个零点不会出现“叛徒”。
鉴于完整证明难度极高,数学家转而求其次,试图证明“至少有一定比例的零点位于临界线上”。经过几代人的接力,这一比例的下界曾被一点点推到了41.6%。而Claude此次所做的,就是将这一下限直接提升至67.2%。需注意,这并不意味着黎曼猜想被证明了67.2%,也不代表剩下的32.8%零点不满足条件。准确而言,Claude证明了“至少67.2%的非平凡零点位于临界线上”。虽然距离“全部零点都在线上”的目标仍有本质差距,但这一成绩对于一项长期纪录而言,已足够耀眼。
Claude是如何做到的?据Anthropic描述,过程可谓“不讲武德”。研究员Jarred一开始直接将证明黎曼猜想的任务甩给了Claude。Claude起初显然被难住了,尝试了650种思路后全部失败。但Jarred不死心,再次下令“再试一次”。这一次,Claude学会了“摇人”,在Claude Code中拉起了约60个子智能体。这支队伍花了一天半时间,执行了2400条Shell命令,编写了数百个Python脚本,并对已知零点进行了数千次数值检验。智能体们分工明确:有的提出新思路,有的沿重点方向推导,有的专门寻找反例,还有的充当“审稿人”挑错。最终,有2个智能体找到了关键突破口,其余的则辅助验证、整理论文。而作为“指挥官”的Jarred,主要工作竟是不断发送鼓励:“继续Claude,相信你自己。”
为了确保结果准确,Claude拉来不同子智能体交叉审稿、寻找反例,并从arXiv下载了54篇论文进行查重。它还独立从头证明了一遍。在确认无误后,Claude主动提出撰写论文,并邀请了Anthropic内部及外部多位数学专家进行验货。它甚至将证明过程写成了计算机可验证的Lean版本,并通过了标准工具测试。从提出思路、查重、复现到撰写论文、形式化验证,Claude几乎走完了完整的科研流程。Anthropic也明确表示,该方法虽无法直接通向完整证明,但标志着AI已不再局限于做有标准答案的数学题,面对开放性问题,它已具备了自主找方向、试错、挑漏洞并产出新研究的能力。
最后,有人好奇,这会不会是传说中的Fable 5.1或Fable 6。近期有传闻称,新版本强化了长周期推理和智能体能力,可能已完成内部测试。不过目前这些说法尚未得到官方确认,或许等到OpenAI发布GPT-6时,我们就能见分晓了。
