**十大「菲尔兹奖级」成果,AI证明全过程公开**

OpenAI今日重磅发布了一份长达62页的「核心手稿」,详细展示了模型的完整推演过程。官方正式确认,完成这一惊人突破的正是「下一代主力模型」。若按照GPT-5.6 Sol的API计费标准计算,烧掉的所有Token成本仅为2000美元。AI证明手稿一经发布,全网再次沸腾。众人纷纷猜测,这绝大概率就是传说中的「GPT-6」!更有网友惊叹,仅花费2000美元竟解锁了十个历史级成就。

**01、GPT攻克十大世纪难题,成本仅两千美元**

两天前,OpenAI内部员工发布博客,直言下一代模型Astra攻克了十大数学难题。一张清单图震惊了所有人,涵盖了高维球体堆积、二元码与球面码、群论、Connes刚性猜想、算术电路下界、量子并行重复、最近向量问题、Ehrhart体积猜想、多色Ramsey数以及极值图论。当时,官博挂出了249页的论文合集和一整套Lean 4形式化证书。直到今天,一份名为《How the Ideas Came Together》的62页手稿正式公开。这份笔记由AI模型独立撰写,OpenAI团队全程未插手。AI阅读了原始的CoT及最终成文的数学论文,针对每一道题重构了四个关键环节:哪些想法最初指出了可行路径;哪些看似有分量的方法撞上了障碍;何种视角切换让底层结构显露出来;决定性的洞察是如何构成完整论证的。

**02、全网热议难题:高维球体堆积,46年未有突破**

在十道题中,全网关注度最高的是高维球体堆积问题。抛开高深的名字,问题本身通俗易懂:往一个箱子里塞一堆同样大小的球,最多能塞多满?三维空间的答案早已确认为水果摊「垒橙子」的堆法。但到了几百维、上千维,人类只能给出一个「上界」,即最多不可能超过多少。这个上界的指数卡在0.5991,从1978年起46年未有实质推进。而Astra将其推至0.6044005442916776954……,密度上界写成2的负0.6044次方加o(1)次方d。关键是它是如何突破的?首先,Astra在推演中确定了Cohn–Elkies线性规划方法的极限。AI最初尝试用Cauchy–Schwarz不等式去估计函数的负质量,做了很久只能做到半径根号d除以2倍根号pi。卡住后,AI给出了判断:障碍并非常数优化不到位,而是全局范数根本记不住负质量落在哪里。于是,Astra决定更换视角:改用Mellin变换外加调和测度。为何选择它?因为对径向函数,傅里叶变换本质上是Hankel变换,其核只依赖空间半径和频率半径的乘积。在Mellin变换一侧,这件事就变成了极其简单的操作:反射并加上显式相位。这里有个精妙之处:该相位因子在实轴上模长恒等于1,在实轴上看不出端倪,但向复平面外延拓时,携带的正是范数不等式丢失的高维信息。推到极限时,调和测度收敛成一个logistic密度,其对数位势精确等于digamma函数,积分出来正好是log(π/2)。1/π这个阈值正是由此而来。有个细节特别能说明AI思路清晰:调和测度的总质量是(1−σ)/2,不是1。手稿特意注明:若太早把这个核换成概率密度,会改变指数常数。下界拿到后,还需构造一个真正达到它的函数。高斯提供了正确的傅里叶对称性,但鞍点位置不对。做法是乘上一个偶函数形变,让鞍点移动而不破坏对称性。将可用阻尼吃满后,得到一个「理想剖面」。其鞍点位移积分靠Wallis乘积算出,正好等于负二分之一log(π/2)。这个数将高斯的半径1除以根号(2π)精确搬到了1/π。手稿中还有一个具体细节:构造辅助函数时,远处需补一块正阻尼。这块补丁必须加在一整段区间上,不能加在单点上,因为加在单点会撞上共振频率。

**非sofic群,难点在于「多」与「一」**

第二道热题是27年无人构造出的「非sofic群」。曼彻斯特大学数学家Thomas Bloom直言,在构造类成果中,这比之前的单位距离猜想反例更重大。「sofic群」这一概念由阿贝尔奖得主、俄罗斯数学家Mikhail Gromov于1999年提出。通俗来讲,一个群是否sofic,问的是这个无限大的、抽象结构,能否被一堆「足够大的有限洗牌操作」近似地模拟出来?Astra给出了一个显式构造,答案为:存在一个无限的、有限表现的「非sofic群」。手稿中最有价值的部分,是它写清了真正卡住的地方——Kun定理给出许多个扩张图,而Kun–Thom定理要的是一个。「多」和「一」之间的鸿沟是整章核心难点。AI将其称为「关键的错配」。它给出了一个干脆的例子说明为何不能随便挑一台:在两份完全相同的Q集合并起来上,「交换两份」这个操作与扩张的K作用精确交换,但它不保持任何一个分量。这意味着那些「近似中心的东西」可以在分量之间来回跳跃,根本抓不住。在此之前还有一条更早的弯路:想把property (T)直接转成混合性。这需要一个lazy或者反二部的平均集,因为一个二部图可以在负1附近有谱,尽管它在1处有Kazhdan间隙。修正平均确实治好了谱问题,但治不了「到底选哪个分量」。为此,Astra先试了一版方案:把组件大小取对数、在随机平移的网格上分箱,再换成有界中位数比较。但这条路失败了,AI通过经验总结得出:要平均的,永远是分量规模的一个有界单调函数,绝不能是无界的规模本身。因此,最终版本以这个「本质原则」进行了重写。在每个环境扩张分量A里,取一个顶点加权的中位数m_A,然后定义f(x) = M(x) 除以 (M(x) 加上 m_A),M是分量规模。这个f永远在0和1之间,且1/2恰好是每个A上的中位数。f的好处在于,它把一个失控的量变成了受控的量。关键在于生成元是置换——只挪位置、不增不减,走一圈总变化必然为零;而每步最多掉一点点,两边就都被压成可忽略。再按高度切开、对小的一侧用扩张性,两头一夹:f几乎处处等于1/2。也就是同一范围里所有块的规模被夹得几乎一样大,这样才能一一对应。最终收尾时,还剩一小片区域。Astra的处理很反直觉:挑一片尽可能大的坏区域整个扔掉——正因为挑的是最大的那片,才反过来证明它其实小到可以忽略。Gromov的问题,27年后有了答案。

**03、「奇点」降临,倒计时**

第一时间,OpenAI强化学习大佬Mo Bavarian发了一段长帖。开头第一句话便是:这真是一个「超现实」时刻。2021年,他和OpenAI团队放出一个GSM8K数据集——8500道小学数学应用题,简单到仅用两到八步就能做完。GPT-2/3那个年代,AI确实连小学数学题都做不稳,起草邮件勉强够用。然而短短几年,大规模RL狂飙突进,曾经那些看似不可逾越的「技术死胡同」,被逐一击碎。这个时间跨度,短得离谱。Mo Bavarian表示,「对我而言,这一刻,比任何时候都更像奇点前夜」。几年前,AI还在小学应用题里跌跌撞撞。如今,2000美元的Token,就能换来十份可能写进数学史的答案。「奇点前夜」,或许并没有那么遥远。

最新快讯

2026年08月04日

15:06
鼓狮财经8月4日讯,据深圳市房地产信息平台统计,7月份深圳新建商品房成交量为3773套。这一数据较上月环比下跌35.2%,但同比仍上涨19.3%。其中,住宅成交2664套,环比下跌6.8%,同比涨幅达32.5%。 若拉长时间周期,今年1至7月全市新房累计成交35104套,同比微增0.7%。住宅方面累计成交21935套,同比下降10.6%,跌幅较上半年已有所收...
15:06
鼓狮财经8月4日讯,国内商品期货市场今日多数收涨。涨幅方面,硅铁涨超3%,多晶硅涨超2%;沪银、20号胶、菜油、生猪、橡胶、玻璃、沪镍及焦煤等品种涨幅均超1%。跌幅方面,集运欧线领跌,跌幅超3%;乙二醇与原油紧随其后,跌幅超2%;红枣、燃料油及尿素跌幅也均超1%。
15:06
鼓狮财经8月4日讯,8月3日,美国国防部宣布与诺斯罗普·格鲁曼公司及洛克希德·马丁公司签署两项框架协议,旨在提升“爱国者先进能力-3”(PAC-3)导弹及“萨德”反导系统的产能。五角大楼声明强调,此次协议通过扩大关键拦截部件的生产规模,预计可使PAC-3导弹产量增加两倍,萨德系统产量增加三倍,以此稳固拦截器系统的供应链。声明进一步指出,协议将为PAC-3导弹...
14:35
鼓狮财经8月4日讯,据俄罗斯国防部通报,俄太平洋舰队已于当天起在日本海、鄂霍次克海及西北太平洋水域启动大规模军事演习。此次演习阵容庞大,投入兵力逾1.3万人,参演舰艇约60艘,涵盖水面舰艇、潜艇及保障船只,另有30余架飞机、直升机及无人系统协同作战。 演习旨在全面检验舰队指挥员在责任区内指挥兵力集群及执行非常规作战任务的能力,并重点演练高精度武器与新型装备的...
14:34
韩国股市近期波动加剧且呈现分化态势。周二早盘,韩国综合股价指数(KOSPI)走势如同“W”型震荡,盘中一度暴跌近3%,随后迅速拉升并转涨逾1%,重回6300点关口上方。午后指数虽有所回落,但尾盘再次发力,最终涨幅超过1%。相比之下,KOSDAQ指数表现更为强劲,受机构投资者连续净买入推动,盘中强势反弹并触发熔断机制,暂停了程序化交易。这是该指数连续第三个交易...
14:07
7月28日,一份名为“Pacing the Frontier”的请愿书引发了全球AI行业的震动。OpenAI、Anthropic等硅谷顶尖AI企业的1346名核心员工(截至8月4日数据)联名签署,呼吁美国政府推动国际合作,研发必要的技术与治理工具,以控制自动化AI研发的节奏。在全球AI发展如火如荼的当下,这封请愿书的出现,似乎带有一种强行给狂奔的AI踩下刹车...
14:07
Claude Fable 5 这次真的在 AI 编程榜单上制造了断层领先!就在刚刚更新的 MirrorCode 排行榜中,Claude Fable 5 以 64% 的成功率再次登顶。紧随其后的 GPT-5.6 Sol 分数仅为它的三分之一。排在第四的 GPT-5.5 表现更为惨淡,不仅成绩只有 10%,甚至被自家前辈 GPT-5.4 远远甩在身后。更令人意外...
14:07
DeepSeek V4 Flash引发的价格风暴仍在持续。用V4 Flash开发太空射击游戏仅需7分钱,制作CS游戏也只要5毛钱。说实话,我感到有些震惊。半年前,你敢相信7分钱就能玩3D游戏,5毛钱就能玩CS吗?全球开发者已经为之疯狂。这哪里是什么AI社区,简直就是天堂。OpenCode平台的数据显示,仅在8月1日一天,DeepSeek Flash就在其平台...
14:04
鼓狮财经8月4日电,高盛亚太区首席股票策略师Timothy Moe表示,该行依然看好近期遭遇重挫的韩国股市,并维持对Kospi指数12000点的目标位。Moe在接受采访时指出,若市场波动能够平息,基本面因素将重新发挥主导作用,且当前的基本面极具吸引力。他指出,目前韩国股市的市盈率仅为5倍,显著被低估,这反映出市场普遍不看好半导体存储器周期的持续性。然而,高盛...
14:03
2026年,黄金依旧是全球资本市场的核心资产。年初金价一度攀升至每盎司5405美元,随后回落至4000美元附近震荡。长期支撑因素依然存在,但高利率与强美元带来的调整压力也在,这意味着金价将进入中枢上移与波动幅度同步扩大的阶段。这种环境对黄金生产商总体利好,但并非所有企业都能同等受益。金价是外部条件,企业能否将其转化为利润,取决于实际产量、单位成本、可开采储量...
13:22
过去两周,大模型行业的定价逻辑被两股力量同时撬动。7月17日,月之暗面发布Kimi K3。这款拥有2.8万亿参数MoE架构的模型,输出定价达到100元/百万token,较前代(K2.6/K2.7的27元)大幅上涨超3.5倍。尽管价格高昂,其定价仍不到Anthropic旗舰Fable 5的一半。发布后,外网开发者社区迅速炸开,大量对比帖与吐槽涌现,有人直言“已...