2026 年 5 月 20 日,OpenAI 发布的一则公告震动了整个数学界。他们公布了一个尚未公开的 AI 模型,推翻了匈牙利数学家保罗·埃尔德什在 1946 年提出的一个猜想。这是人工智能首次产出具有历史意义的数学证明 —— 而且不是在什么边缘问题上凑数,而是在一个困扰了数学界 80 年的经典问题上,找到了前人未曾想到的反例。几周之内,人类数学家基于 AI 的思路做出了进一步改进。几天之内,相关技术就被用来解决其他重要问题。8 月 1 日,OpenAI 又宣布:他们名为 Astra 的模型,一口气拿下了 10 项数学进展,其中包括埃尔德什提出的另外三个问题的解答。普林斯顿大学的诺加·阿隆 —— 一个在几十年职业生涯中亲手解决过几十个埃尔德什问题的数学家 —— 评价道,这些模型「正在极大地改变数学研究的方式。」如果不熟悉埃尔德什是谁,这一切听起来可能只是「AI 又赢了一次」。但为什么偏偏是他的问题,成了全球最强 AI 公司的核心竞技场?要理解这件事,得先从埃尔德什这个人说起。

01、一个拎着手提箱的怪人

保罗·埃尔德什是历史上最多产的数学家之一。他一生发表了超过 1500 篇论文,与 500 多位合作者共同工作过。但他最特别的不是数量,而是生活方式。他没有固定住所,没有固定工作,几乎一无所有。他拎着一只手提箱,在朋友家里蹭住,从一个大学漂到另一个大学,走到哪算哪。他把大部分收入捐了出去,财务由一位朋友帮忙打理。他只穿丝绸。他避免和人身体接触。他对权威深感不信任,把上帝称为「最高法西斯」。他用持续的安非他命摄入来驱动自己源源不断的数学产出。他还有个习惯:到处抛出数学问题。在论文里、在信里、在闲聊中,他会随手写下一个问题,然后在旁边标注一个金额 —— 10 美元、25 美元,有时候几千美元。第一个解决问题的人可以拿到这笔钱。他自掏腰包。1996 年,埃尔德什在华沙参加一个数学会议时因心脏病发作去世。但他的问题没有死。爱荷华州的一个非营利基金会承诺继续兑现他的悬赏。而现在,这些问题的解决方案,正在以另一种货币来计价 —— 每个问题消耗多少 token。一个反权威的流浪者留下的遗产,成了世界上最强大的科技公司的公关武器。

02、一个网站,意外成了 AI 的试验场

如果没有一个叫托马斯·布卢姆的英国数学家,这一切可能不会发生。布卢姆在曼彻斯特大学,研究算术组合学。他从小就喜欢埃尔德什的风格,但一直有个烦恼:埃尔德什的问题散落在各处,哪些被解决了、哪些还悬着,根本搞不清楚。2023 年初,他决定把这些问题尽可能收集到一个列表里。本来是自己用,但他觉得如果随时随地都能访问会更方便,于是他做了一个网站 —— erdosproblems.com。有意思的是,他写这个网站的 Python 代码,用的是 ChatGPT。那时候,大语言模型能帮他写个网站已经挺了不起了。至于用它来做数学?那还是遥远的事。布卢姆不光收集问题。埃尔德什有时候表述问题的方式含糊不清,布卢姆会仔细找出每个问题最合理的版本。他不断添加,受众逐渐增长。到 2025 年 8 月,他已经编目了近 1000 个问题。然后他做了一件小事:加了评论区。自此,一个社区真正被建立起来了。

03、客服小哥和菲尔兹奖得主

评论区里发生的事情,堪称互联网普世价值的最佳典范。不管你有没有终身教职,不管你在不在顶尖大学,甚至不管你是不是数学家 —— 只要你有好想法,你就能找到人合作。沃特·范·多恩是网站上第四活跃的评论者。他的正式工作,用他自己的话说,是「为一家被其他公司雇佣来做客户服务支持的公司」工作。但他也不是纯业余 —— 十年前,他差点在比利时鲁汶大学完成数学硕士。2024 年,看到大语言模型的能力飞速增长,他请了六个月假,专注做数学。他当时的想法是:「现在我仍然比 AI 更擅长数学,但谁知道一年后、两年后、五年后会怎样?如果我想完成这些项目,现在就是时候了。」2025 年 10 月,范·多恩在埃尔德什问题 1102 的页面下留了第一条评论。11 月初,他不依赖 AI,找到了一些进展,分享在了评论区。当天晚些时候,有人回复说他在论证中发现了一个缺陷。两人迅速交锋,范·多恩说服了对方。「我现在明白你的论证了。漂亮!」那位数学家回复道。那位数学家叫陶哲轩,加州大学洛杉矶分校教授。陶哲轩和埃尔德什的缘分可以追溯到他还是个 10 岁小孩的时候 —— 那时候他见过埃尔德什本人。2015 年,他 Polymath5 项目合作者一起解决了埃尔德什偏差问题,「赢」走了 500 美元奖金。

04、圣诞节的乌龙

2025 年夏天,凯文·巴雷托和利亚姆·普莱斯在一个 AI 爱好者 Discord 服务器上成了朋友。巴雷托在剑桥读本科,普莱斯学过一些数学但没读完就离开了。12 月,他们确信最新的 AI 模型能搞定一些埃尔德什问题,于是开始成批地把问题喂给模型。他们很快发现了一个窍门:如果你直接告诉 GPT-5.2「这个问题还没人解出来」,它就没什么进展。但如果你换个说法 —— 让它以为问题比实际更容易 —— 效果就好得多。圣诞节早上,巴雷托在网站上发了一个证明,宣称这是「LLM 完全自主解决埃尔德什问题的首个案例」。几个小时后,有人指出:埃尔德什本人在 1977 年的一篇论文里就已经给过答案了。巴雷托很坦率地认了错,然后写了句话:「我正式请求网站所有成员更加重视对目前标记为未解问题的文献检索。作为一个已经两次犯过这种错误的人,这相当令人沮丧。」但他们没放弃。2026 年 1 月 4 日,他们用 GPT-5.2 Pro 解决了另一个问题(埃尔德什 728),这次确实没人能找到已有的证明。巴雷托还用了另一个叫 Aristotle 的 AI 工具来验证逻辑成立。普莱斯摸索出了一套方法论:先让 AI 给一个解法,然后把解法喂给一个新的 AI 实例让它检查,反复迭代,直到得到看起来可行的方案。这其实就是很多公司在内部做的事情 —— 他们管这叫 harness 或 scaffold,只不过普莱斯是手工完成的。

05、一个无法回避的问题

这里有个微妙的问题。按普莱斯自己的评估,他没有足够的数学功底来验证 AI 给出的最终解法是否正确。他需要找真正懂行的人来把关。在巴雷托的帮助下,他们找到了。普莱斯和巴雷托最终成为了陶哲轩、斯坦福的 Jared Duker Lichtman 等人 2026 年 5 月发表的一篇论文的共同作者 —— 那篇论文解决了一个更重要的埃尔德什问题。布卢姆对此有担忧。「一个大问题是 AI 被很多不是数学家的人大量使用,他们没有深厚的数学背景,也没有能力验证输出结果,」他说。「他们追求推进速度,让他们的 AI 进行核验,成果规模不断扩张。如今我们看到越来越多这种 100 到 200 页的论文。『我解决了这个定理;我让 AI 生成了证明、检查了证明并写了论文。』但没有人类读过它,也没有人类会去读它。」

06、当大公司开始入场

2026 年初,大公司开始入场。1 月,Google DeepMind 一个 24 人的团队用 Gemini 系统性地评估了布卢姆数据库里 700 个标记为「开放」的猜想,解决了其中 4 个,还找到了 9 个被遗忘的旧解答。5 月,DeepMind 另一个 21 人的团队宣布解决了 353 个问题中的 9 个,「每个问题的成本为几百美元」。然后是 5 月 20 日。OpenAI 宣布找到了「单位距离」问题的反例。这个问题说起来很简单:如果你在平面上放置 n 个点,有多少对点之间的距离恰好为 1?近 80 年来,数学家们认为最佳的解决方案大致类似于方形网格(这也很符合我们的直觉),OpenAI 的大模型推翻了这一信念,发现了一个全新的构造族,其性能更优。这是人工智能首次自主解决了一个数学领域的核心著名未解问题。为了做到这一点,它还用到了一个叫「代数数论」的数学分支的工具。剑桥大学和法兰西学院的蒂姆·高尔斯 —— 菲尔兹奖得主 —— 在评论中写道:「如果这篇论文是由人类撰写并提交给 《数学年刊》的,而我被要求给出一个快速意见,我会毫不犹豫地建议接受。以前没有任何 AI 生成的证明接近这个水平。」论文的作者栏只写了一个公司名字:OpenAI。

07、埃尔德什问题为什么那么受 AI 机构欢迎?

原因有好几个。第一,埃尔德什的问题集中在数论、组合学和图论。这几个数学领域,恰好是大型语言模型最擅长的。它们的问题往往可以用简洁的语言描述,不需要太多背景知识就能理解,但背后又藏着深刻的结构。第二,难度跨度大。有些问题相对容易,有些难得离谱。这正好适合一种能力参差不齐的新技术 —— 水平不够就先挑软的捏,水平上来了再啃硬骨头。第三,布卢姆的网站给了所有人一个现成的入口。问题集中、状态清晰、还能讨论。对于需要 benchmark 的 AI 公司来说,这简直是天然的测试场。用 Lichtman 的话说:「这种任何人都可以访问的单一资源库 —— 各个实验室意识到,它完全可以作为一项基准测试。」

08、当 AI 比人强的时候

诺加·阿隆在职业生涯中解决过几十个埃尔德什问题。现在他不做了。「一旦 AI 开始解决它们,就没有意义了,」他说。陶哲轩也退出了埃尔德什问题社区,专注于其他工作。范·多恩倒是很清醒。他说 LLM「在思考和做数学方面显然比我强。我根本比不上当前的 AI 系统。」但他也指出,「我最终写的证明更简单、更通用,也比 ChatGPT 想出的东西更容易让其他人读懂。」然后他说了一段话:「如果你想弹钢琴,你不会雇一台弹得比你好的钢琴演奏机器。你会弹钢琴是因为你喜欢弹钢琴。我享受思考数字、做数学、写论文。我不会雇一台替我做论文的机器。」2026 年 7 月,多伦多大学的雅各布·齐默尔曼被授予菲尔兹奖 —— 数学界的最高荣誉。就在同一天,他宣布离开学术界,加入 OpenAI。阿隆说,一些一流的数学家离开学术界去 AI 公司,不仅因为钱,更因为「或许这里才是真正的发展方向。」一个流浪了一辈子的数学家,留下了一堆标着价格的问题。几十年后,这些问题成了 AI 的竞技场,把一个客服小哥和菲尔兹奖得主拉到了同一个评论区里。埃尔德什如果还在,大概也会觉得这很有趣。

最新快讯

2026年08月18日

16:43
鼓狮财经8月18日电,美股盘前,存储板块普遍走弱,此前该板块连续多日大涨。美光科技下跌3%,SK海力士下跌3.16%,闪迪下跌4.03%,西部数据下跌3.71%,希捷科技下跌3.22%。
16:42
鼓狮财经8月18日电,日本驻俄罗斯大使武藤显8月18日被召见至俄罗斯外交部,停留25分钟后离开,未对媒体发表任何评论。 (CCTV国际时讯)
16:42
鼓狮财经8月18日电,美银一项调查显示,投资者对全球股票的配置敞口达到近五年最高水平,多数受访者预判经济将持续增长。本次调查开展时间为8月7日‑8月13日,共访问180名受访者,管理资产总规模5250亿美元。净56%的受访者当前超配全球股票,为2021年11月以来最高。策略师迈克尔・哈特内特在研报中写道,创纪录的56%受访者预判经济将实现“不着陆”状态;72...
16:42
鼓狮财经8月18日讯国内人形机器人头部企业宇树科技确定于8月19日正式登陆科创板。而在其背后也站着不少港股上市公司的身影。 据发行公告,宇树科技发行价定为150.8元/股,对应发行市值610亿元。而据招股书显示,美团-W(03690.HK)通过汉海信息、Galaxy Z和成都龙珠三家附属企业合计持有宇树科技发行前总股本的9.65%。 本次发行后,美团系持股...
16:11
鼓狮财经8月18日讯,据韩国方面消息,驻韩美军司令泽维尔·布伦森当天访问韩国国防部,与韩方就缩减美韩联合军演规模进行沟通。据悉,韩美原定于17日至27日举行“乙支自由之盾”大规模联合军演。此前,美国总统特朗普于16日在社交媒体发文称,已要求美国国防部大幅削减此类军演的规模。(央视新闻)
16:11
鼓狮财经8月18日讯,美银调查显示,能源价格回落与通胀缓和显著提振了基金经理的乐观情绪,多数人认为欧洲未来一年陷入衰退的可能性微乎其微。数据显示,97%的受访基金经理预计未来12个月欧洲经济将避免衰退,这一比例创下自2007年以来的新高。此外,35%的受访者预计未来数月欧洲经济增速将加快。在股市情绪方面,53%的受访者认为未来1至3个月欧洲股市将呈上涨态势。...
16:10
鼓狮财经8月18日讯,据美东时间周一媒体报道,知情人士透露,特斯拉计划最早于本月内在得州奥斯汀举办Cybercab的公开发布活动。 Cybercab是特斯拉专为自动驾驶出租车服务打造的双座无人驾驶电动车,采用无方向盘、无踏板的极简设计,完全依赖自动驾驶系统运行。该车型于2024年10月首次对外公布概念样车。Robotaxi是一种依托AI、传感器和高精地图,无...
16:10
A股三大指数今日收盘涨跌互现。截至收盘,上证指数微涨0.19%,深证成指下跌0.56%,创业板指下跌0.93%,北证50指数大涨2.67%,科创50指数上涨0.11%。全市场成交额达到24198亿元,较上一交易日增加173亿元,但全市场仍有超过3200只个股下跌。 板块方面,农业股表现最为活跃,掀起涨停潮;半导体、宇树机器人概念及工业金属板块走势强劲;油气、...
15:39
据台湾《经济日报》报道,台湾地区功率半导体厂商正酝酿第三波价格调整,预计最快将于10月针对非合约产品实施,涨幅在10%至15%之间。业界普遍看好台半、强茂、德微等厂商在下半年实现销量与价格的双重增长。 据供应链分析,今年以来功率半导体行业已历经两轮调价,上半年平均涨幅达15%至20%。AI服务器功耗的激增导致缺货严重,成为推动台厂在10月启动第三波调价的核心...
15:39
商业社会正步入一个新纪元,即便公司宣告破产,其数据却可能在巨头的人工智能模型中获得“赛博永生”。据美国破产法庭文件披露,谷歌以1000万美元的报价击败人工智能训练数据巨头Mercor,成功中标,将接手破产企业精神航空的大量数据,用于训练其AI模型。 根据协议,精神航空将向谷歌移交包括超过1亿封电子邮件、5亿条微软Teams聊天记录、3000万行代码及开发元数...
15:39
隔夜美股市场中,存储芯片与光通信AI概念股表现强劲,逆势上扬。其中,铠侠ADR涨幅超过13%,闪迪涨近9%,Coherent涨幅也超过7%。 8月18日亚洲早盘,日韩股市开局表现亮眼。韩国KOSPI指数开盘飙升逾2%,一举站上7100点,其中SK海力士股价涨近8%,三星电子涨幅超过4%。 然而,转折来得猝不及防。盘中,日韩股市突然直线跳水。韩国KOSPI指数...