**AI数学巅峰对决:OpenAI首发十题,Anthropic24小时后半数回敬**

本周末,OpenAI与Anthropic两大AI巨擘,在数学的前沿阵地展开了一场短兵相接的较量。8月1日,OpenAI研究员Sébastien Bubeck宣布,其未公开的下一代主力模型“Astra”,一口气证明了10项前沿数学成果,并附上了10份Lean证书和逐题思路复盘。

这10道题看似不起眼,实则分量极重。它们的主要结论至少10年无人推动,不少甚至搁置了几十年,是货真价实的开放难题。Epoch AI旗下FrontierMath的负责人Elliot Glazer直言,光是“非索菲克群”这一篇,就足以入选数学界公认的权威期刊《数学年刊》。这一消息在AI圈引发轰动,有人当场惊呼“数学奇点已经到来”。

面对挑战,Anthropic反应迅速。不到24小时,研究员Levent Alpöge在Bubeck的帖子下回应:“我用Fable完成了一半。”他补充称,复现的是OpenAI榜单上的第4至8项,共5项。实验条件十分严格:完全自主、通用提示词、全程无网络,并特意加设了防护以防止OpenAI的解法泄露进上下文。虽然Levent尚未放出Fable的完整证明细节,但若属实,OpenAI凭借未公开模型抢得的首发优势,仅保住了24小时。而追上来的Fable,却是Anthropic早已公开、人人可调用的模型。

**01、首发“保鲜期”缩至24小时**

网友Chubby转发评论道:“公开可用的Fable,复现了Astra一半成果。”有人调侃,OpenAI似乎只抢到了一个“首发”。过去,数学成果的优先权之争通常以年为单位,从构思到发表,中间隔着漫长的投稿与审稿周期。如今,Astra在未正式发布前公布的成果,在24小时内便被一个公开模型追平了一半。首发的含金量依然存在,但保质期已大大缩短。不少网友已高呼“数学奇点”已至,两大巨头也紧紧咬住了彼此。

**02、2000美元背后,是更昂贵的研发账单**

OpenAI还披露了一个数字:找到这10项解法的成本不到2000美元。研究员Noam Brown解释,这对应的是成功运行所需的token,按Sol API价格折算的边际推理成本。但这只是冰山一角。在这之外,还有Astra本身的训练研发、无数试错失败的问题、人类将论证整理成249页论文的工时、将每个证明形式化成Lean的成本,以及最后外部数学家审查的成本。Noam也承认,他们尝试过其他重大问题,甚至千禧年大奖难题一个都没拿下。即便如此,2000美元仍将AI解出一道前沿难题的边际成本打到了地板。有人甚至调侃,OpenAI是不是明天会再公布10项数学突破,或者等到下周一次性发100项。

**03、从“刷榜”到“互相验货”**

Fable重做Astra的同一批题目,比普通的“刷榜”更有意义。刷榜测的是已知答案,比谁分高;而这两个模型在无网络、防泄漏的条件下,各自独立抵达同一个前沿结论,测试的是完全不同的东西:这个结果到底可不可靠,能不能被独立复现。这更像是一场同行评审。目前Levent只是在社交媒体上“作出声明”,尚未放出那5项证明的PDF、提示词、运行日志或Lean证书。

网友Haider质疑:就算是真的,为什么要用Fable去复现Astra,而不是直接拿它去解新的开放问题?事实上,Fable并非只会蹭热度,它也会解新题。7月,Levent就用Fable给出了Jacobian猜想的三维反例,事后还有专人写了一份7页的代数验证材料,确认那个显式映射确实推翻了三维及更高维的猜想。

**04、绝大多数人看不懂的成果,谁来验收?**

这10项成果到底有多重要,绝大多数人很难判断。Ethan Mollick一语道破:对地球上几乎每一个人来说,这不只是超出能力,而是超出理解范围。我们只能相信专业数学家告诉我们它厉不厉害。代码、图片、聊天,普通人还能亲手体验AI强在哪。可非索菲克群的存在、Connes刚性猜想的反例、量子平行重复定理,这些只有极少数专家看得懂。AI能力越往科学前沿走,公众能依靠的就越不是亲身体验,而是一条长长的信任链。

数学家Thomas Bloom提醒,这些成果用的是上百年积累的数学理论、数学家亲手搭好的形式化系统,把它简单描述成“AI取代了数学家”,并不诚实。他给出的标准是:这份证明,有没有教给我们关于这个问题的新东西?所以真正的问题来了:当AI能低成本、批量地生产前沿数学证明,我们到底该拿什么衡量它的成果?答案也许不在它的产出端,而在验收端:一份证明能不能被读懂、被核对、被判断出分量,才能最终决定它的真实价值。

最稀缺的能力,正在从“做出证明”转向“看懂并验收证明”。当AI一夜之间就能证出十道难题,真正的考验才刚开始:证明造得越快,我们的验证,还追得上吗?

最新快讯

2026年08月04日

10:40
据土耳其伊赫拉斯通讯社8月3日报道,鼓狮财经8月4日消息,一艘土耳其货船在黑海遭遇无人机袭击。该船当时正从土耳其萨姆松港驶往俄罗斯新罗西斯克港,船上载有新鲜蔬果。 袭击导致货船起火,造成4名船员受伤,其中3人伤势严重。遇袭地点距离新罗西斯克港约20海里,该船悬挂喀麦隆国旗。目前,船上全部23名船员已被俄海军安全转移至新罗西斯克港。 土耳其海事总局尚未确认袭击...
10:39
近日,AI编程赛道同时落下两记“重锤”,标志着行业竞争进入新阶段。业内观点认为,AI编程已度过技术陡峭期,国内外大模型厂商正展开“近身肉搏”。 7月31日,DeepSeek-V4-Flash正式版API上线,价格持续下探。其中缓存命中每百万Token仅需0.02元,未命中1元,输出2元。紧随其后,7月30日,OpenAI也挥出价格屠刀,大幅下调GPT-5.6...
10:39
周一,亚马逊股价录得4.58%的涨幅,市值历史性地突破3万亿美元大关,使其成为继英伟达、Alphabet、微软和苹果之后,全球第五家达成这一里程碑的上市公司。 拉长观察时间轴可以发现,亚马逊从2024年6月突破2万亿市值到如今站上3万亿,仅耗时两年多;而此前从1万亿攀升至2万亿,则跨越了六个年头。第三个万亿的跨越速度远超前两个阶段,其核心驱动力在于人工智能从...
10:39
AI的主战场正从数字空间全面切换至物理世界。以英伟达为代表的全球产业领袖、头部科研机构与投资机构纷纷达成共识,物理AI的“ChatGPT时刻”已然到来。AI正借由人形机器人、AI眼镜、低空装备、航天载荷及工业感知设备深度介入现实,完成感知、推理与实体执行的全链路闭环。这正如5.4亿年前的寒武纪生命大爆发,当下AI硬件产业正迎来一个无标准答案、无统一范式的创新...
10:07
腾讯今年凭借 WorkBuddy 成功实现逆袭,这让某些竞争对手颇为焦虑。就在不久前,字节跳动将飞书的产品团队并入豆包,负责市场拓展的 GTM 团队也整合进了火山引擎。但这并不意味着飞书表现不佳,恰恰相反,这是字节为即将到来的行业大洗牌做好的充分准备。 去年,各大厂商还在疯狂抢占程序员桌面,开发各种 Coding Agent。但这半年,风向变了,产品名称集体...
10:07
AI竞赛的新瓶颈似乎转移到了建筑工地。在密歇根州塞林镇的清晨,数百名电工和建筑工人准时到岗,随后连续工作十小时,一周七天。他们正在建设的是OpenAI“星际之门”项目的最新园区,一座耗资160亿美元的超大规模数据中心。 麦肯锡预测,仅针对AI基础设施扩张,美国在2023年至2030年间就需要额外培养13万名电工、24万名建筑工和15万名施工主管。劳工统计局预...
10:00
随意打开抖音、B站或快手等社交平台,AI生成的视频正源源不断地涌入推荐流。从古风仙侠到神兽志怪,再到科幻机甲,各类题材呈现井喷之势,创作者数量与内容密度也在飞速增长。然而,刷得久了不难发现,许多内容已沦为“换汤不换药”的量产模式。相似的运镜、雷同的设定,让观众难免产生审美疲劳。但偶尔,你也会被某条视频深深吸引,看完后久久不愿划走。在这个技术狂飙突进的时代,反...
09:59
《科创板日报》8月4日讯,昨日美股云服务巨头集体大涨。亚马逊收涨4.58%,时隔61个交易日再创历史新高,市值突破3万亿美元大关。此外,谷歌、微软涨幅均超4%,Meta上涨逾6%,甲骨文更是录得单日超9%的涨幅。此次股价飙升的背后,折射出市场对各大云厂商AI变现能力的普遍认可。 此前,亚马逊公布二季度财报,其云业务AWS净销售额达422.3亿美元,超过分析师...
09:59
从6月的狂热巅峰跌落至8月的绝望谷底,韩国股市在短短两个月内经历了一场史无前例的金融风暴。这场危机的导火索究竟是什么?单只股票杠杆ETF这一“金融创新”产品,如何引发了波及政治、社会与资本市场的多重危机?本文将深度复盘这一动荡历程。 “汉江水温”不再仅仅是玩笑。这场崩盘并非简单的周期性调整,而是由杠杆ETF每日再平衡机制引发的流动性螺旋。为了维持2倍杠杆,基...
09:31
据鼓狮财经8月4日报道,当地时间8月3日,美国国务院已通知国会,计划关闭包括驻格林纳达圣乔治使馆、日本名古屋领事馆、印尼棉兰领事馆、喀麦隆杜阿拉使馆分支机构以及加拿大温尼伯领事馆在内的5处驻外机构。知情人士透露,这一计划并非源于特定的地缘政治事件,而是特朗普政府为落实“美国优先”议程,进一步缩减外交体系及控制成本的一部分。此前,白宫管理和预算办公室曾主张关闭...
09:31
鼓狮财经8月4日报道,以色列国防军3日发表声明称,在8月2日对加沙地带的空袭行动中,成功击毙了两名哈马斯武装人员。声明透露,其中一人系哈马斯“努赫巴”部队指挥官,该人员曾参与2023年10月7日针对以色列的袭击;另一人则为哈马斯“达拉杰-图法营”的指挥官。本消息援引自央视新闻。
09:29
苹果终于不堪重负,给自己的Bug赏金计划加上了“冷静期”。面对海量的漏洞报告,苹果安全团队显得捉襟见肘,只能无奈地关闭了接收窗口。 Bug赏金计划始于2016年,旨在邀请安全研究人员提交苹果软硬件及服务中的漏洞,经确认后给予现金奖励。随着奖池不断扩充,2025年10月,苹果宣布重大升级:发现最严重漏洞的研究人员最高可获得500万美元(约3375万人民币)的赏...