此刻便提前预告——中秋与国庆这13天的长假,极有可能成为今年人工智能领域最为激烈、最为火爆的“决战周”。各位朋友,请暂时放下休假和睡眠的念头,找好椅子躺平备战吧。“基模决战周”真的要来了!!
硅谷这边早已暗流涌动。擂台中央,OpenAI月初刚发布了GPT-6 Astra,这款模型仿佛提前为通用人工智能(AGI)举行了庆功宴,气势逼人。而Anthropic、谷歌、马斯克的Grok几乎都有新动作传出。
最先坐不住的自然是Anthropic(A社)。路透社证实,Anthropic正在考虑推出新模型,社区呼声最高的是Claude Opus 5.2和Fable 5.2。此前,开发者发现Claude Code在复杂任务中表现异常,随后发现请求被静默重定向至新版本。最戏剧性的是,9月17日晚间,Opus-Next(疑似Opus 5.2)的灰测通道突然关闭,导致活跃账号归零,引发社区恐慌,但仅一天后便重新开放。Anthropic此举意在应对OpenAI的冲击,因为GPT-6 Astra已占据了约13%的企业AI支出,而Claude Fable仅为8%。
更有节目效果的是谷歌。Arena中突然出现了一个名为“gemini-3.8-flash”的模型,虽然名字普通,但测试者迅速发现其异常,推测其为Gemini 4 Pro的隐身代号。其输出质量惊人:不仅能画出带动作和光照的鹈鹕骑自行车,还能用代码在10分钟内绘制出细节繁复的PS5矢量图,甚至构建了可交互的3D体素宝塔场景。在侧视家猫的对比测试中,其轮廓和空间关系表现优异,在Reddit上获得了大量好评。尽管谷歌尚未官宣,但下一代Gemini离我们已不远。
马斯克同样按捺不住。此前有网友询问Grok 4.7进展,马斯克回复“还需要几天时间烹饪”。按照他的风格,这很可能是一场“黄雀在后”的压轴大戏。
国内赛场同样硝烟弥漫。阶跃星辰率先发牌,发布了新一代旗舰模型Step 5 Preview。该模型采用稀疏MoE架构,总参数达600B,激活参数27B,支持百万级上下文。在权威评测中,其得分44分,位列全球开源前三,且单任务成本仅为Claude Opus 5的八分之一。
Kimi的谜底也已呼之欲出。其官方账号发布了一串数字,经与圆周率对比,这串数字正是π去掉“3.1”后的部分,暗示新版本代号极有可能为“K3.1”。
DeepSeek也早已埋下伏笔。在9月10日的V4.1 Flash发布中,官方文档明确提到,在V4.1 Pro上线前,部分请求将被路由至V4.1 Flash。这预示着V4.1 Pro已存在,且极有可能在国庆假期窗口期发布。
阿里Qwen同样在赶路。8月底开源的Qwen3.8-Flash-Next被官方定义为Qwen4底层架构的早期预览,意在邀请社区提前测试。这意味着Qwen4系列也已蓄势待发。
如今,太平洋两岸的AI选手已严阵以待。无论假期是否有新模型发布,从业者恐怕都难逃加班的命运。关于AI取代工作和自我进化的讨论暂且搁置,我们这个行业,向来是有人铆足劲冲击行业高度,有人则被迫在加班中等待被替代。十一假期,Are you ready?
