**GPT-6与Doug即将来袭,OpenAI对决Anthropic,谷歌DeepMind陷动荡**
10万亿参数的GPT-6(代号Astra)即将于本月发布!就在刚刚,X平台上传来惊人消息。据AI内幕记者ChrisGPT爆料,尽管面临政府审查的压力,GPT-6仍将于8月正式面世。这便是昨天OpenAI紧急暂停发布的模型Astra。
9个月前,OpenAI开始重新分配计算资源,意识到Anthropic在预训练领域已取得领先,公司感到了紧迫感!据估计,GPT-4的参数量约为1.8万亿。如果Astra的参数真的达到10万亿,那将是GPT-4的5倍以上。无论如何,OpenAI在预训练规模上都投入了前所未有的资源。
别急,后面还有大动作。ChrisGPT紧接着曝出,年底将有一款代号为“Doug”的“史诗级巨兽”登场。它不仅是OpenAI迄今为止规模最大的一次预训练模型,据称其能力让Fable看起来像个原始产物。但Doug并不是GPT-6。由于需要先完成预训练并进行大量网络安全测试,它可能最迟在11月之前发布。
巧的是,最近OpenAI总裁Greg转发了一篇X推文,提到GPT-4是在四年前8月8日完成训练的。业界猜测,GPT-4参数1.8万亿,四年后的GPT-6参数达到10万亿,在数量级上实现了恐怖的跃升!可以推测,GPT-6将涌现出难以想象的逻辑推理和泛化能力。
关于“Doug”这个名字,知名机构SemiAnalysis此前也曾提及。根据爆料信息,Doug的算力底座极其豪华。前沿信息大V Pankaj Kumar指出,Doug大概率是使用英伟达尚未全面铺开的下一代Vera Rubin芯片进行训练的。综合来看,OpenAI正在下一盘很大的棋:8月份先用10万亿的GPT-6来炸场,吸引住用户;到年底,再甩出Doug这枚巨兽,赢下AI领域的霸主宝座。
正与Boris大战的Tibo也预告了8月的决战。多方人士爆料,OpenAI下一代模型将采用全新预训练基础(超越此前约4T token的「Spud」),规模约10T,上下文可能达到1.5M token,对标Anthropic的Mythos/Fable。现在局面很清楚了:Astra的发布时间因安全暂停有所推迟,但Anthropic没打算等。Anthropic正准备在8月发布Fable 5.1,定价与Fable 5持平,直接对标Astra。Anthropic很可能采用的是「田忌赛马」战术:Opus 5之所以发布时刻意留力,就是为了把Fable 5.1当作伏兵,等GPT-6一亮相,立刻跟上截击。
谁将成为大模型霸主?这个问题在8月变得前所未有地焦灼。突破「预训练之墙」:OpenAI绝地反击。
为什么Doug如此重要?因为它指向了整个行业都不敢面对的一个现实:自从2024年5月发布GPT-4o以来,OpenAI已经超过两年没有完成下一代前沿模型的全规模预训练。o1、o3、GPT-5到GPT-5.5,本质上都是在GPT-4o时代的底座上做后训练、强化学习和推理计算。GPT的「发动机」,已经两年没换了。因为严重的预训练瓶颈,Orion等项目都因为表现不及预期被降级了。
但是!OpenAI从未放弃预训练这条核心主线。去年底发布的Gemini 3,彻底让奥特曼下定决心换「发动机」。紧接着,代号Garlic的新预训练模型就浮出水面。据称,首席研究官Mark Chen告诉团队,公司已经解决了预训练中的关键问题。但Garlic更像是一次验证实验,Doug才是放大到更大规模后的真正产物。他们很可能克服了性能退化的瓶颈,搞定了万卡甚至十万卡集群的稳定性,才导致了Doug的诞生。长期以来,SemiAnalysis一直在强调:Scaling Laws依然有效。o1系列证明:模型在「推理时间」上可以不断Scaling。而王者归来的Doug则宣告:在基础的「预训练」维度上,只要算力和数据跟得上,Scaling Laws仍然能创造奇迹!
三巨头只剩两个。如今,御三家只剩两个。8月5日,谷歌的AI版图塌了一角。干了27年的首席科学家Jeff Dean与三位核心研究员一起出走创业。同一天,诺奖得主哈萨比斯卸任DeepMind CEO,退居董事长。Alphabet股价当天跌超4%。DeepMind,已经不再是一个前沿实验室了。发明Transformer的地方,正在给对手输送顶级研究员。不久前,硅谷还是ASI「三巨头」,如今,赛道上只剩OpenAI和Anthropic。
如今,Anthropic手上是Fable 5,OpenAI手上是连续迭代的5.5、5.6,以及即将到来的6。现在,OpenAI手上有两张牌:8月的Astra,和年底的Doug。过去两年,OpenAI证明了旧发动机还能再榨出很多马力。当发动机换代,这套已经被调到极限的体系,还能把车推到多快?这个答案,年底的Doug即将揭晓。
