重磅消息传来,科技圈仿佛发生了“火星撞地球”般的大震动。刚刚,DeepSeek V4 Pro 正式版震撼发布!查看基准测试数据,其表现令人咋舌,直接对标闭源界的顶级模型 Fable。在 HLE、Terminal Bench、Cybergym 以及 DeepSWE 等多项 Agent 能力测试中,V4 Pro 几乎全方位碾压 Opus 4.8,无限逼近 Fable 5,甚至在部分榜单上实现了反超。这充分展示了后训练技术的巨大威力。
01、DeepSeek V4 Pro 正式版发布
遗憾的是,官方博客尚未同步更新,我们暂时无法深入探究其内部机制。不过,API 平台已经先行一步完成了更新。目前,开发者可以直接调用 V4 Pro 的完整版本,模型名为 DeepSeek-V4-Pro-0813。
在定价方面,V4 Pro 依然保持着极高的性价比,与之前的 Pro 预览版基本持平:百万 tokens 输入价格为 3 元,命中缓存价格为 0.025 元,百万 tokens 输出价格为 6 元。可以说,DeepSeek 再次开启了“梁文锋”式的价格战周期。
然而,此次更新并非全是好消息。网友实测发现,模型的思维链输出变得异常晦涩,甚至有些像“山顶洞人”说话,难以理解。虽然系统提示词仍能识别,但中间夹杂了大量非人类语言的字符,导致可读性大幅下降。这或许是模型为了性能优化而采用的策略,类似于 GPT 隐藏思维链的方式,旨在通过压缩 Token 消耗来提升效率。但代价是,模型的写作能力可能受到了一定影响。在 Agent 狂飙突进的时代,这种牺牲写作能力以换取 Coding 优势的做法已成大趋势。不过,在编程能力方面,V4 Pro 正式版无疑交出了一份合格的答卷。国产开源阵营中,又多了一个紧逼闭源的超级模型。
02、One More Thing
说实话,许久未见到如此激动人心的场景了。深夜赶稿结束的我,仿佛目睹了一场科技界的“原子弹爆炸”,兴奋得瘫软在椅子上(开玩笑的)。
回到正题,过去几个月,中国开源模型阵营仿佛开了挂一般,接连发布新模型,紧追 Anthropic 和 OpenAI 的步伐。从 GLM 5.2 的神级后训练能力,到 Kimi K3 对标 Fable 级别,再到点燃开源与闭源论战、老黄亲自站台,中国开源界一直在高歌猛进。随后,“梁文锋”带着 V4 Flash 亮相,虽然未主打 SOTA,但凭借极低的 API 成本掀起了一股低价风暴。
大家常说,DeepSeek 就像一把斩杀线,拿着除草机在后面追赶同行,同行们拼了命地往前跑。跑输了意味着营收归零,跑赢了也未必有奖励。但这一次,DeepSeek 的定位发生了转变。V4 Pro 完全体上线,其目标不再仅仅是性价比,而是直指 SOTA(最先进水平)的王冠。2025 年春节的 DeepSeek,王者归来。
