全网苦等三个月,DeepSeek V4 正式版终于要来了。据传发布时间最早在明日,最迟不过这几天。目前,已有部分用户拿到了 V4(GA)的灰度测试权限。该版本包含两个分支:DeepSeek V4 Flash 和 DeepSeek V4 Pro。
大家最关心的是如何验证自己是否已获得灰度资格。博主 AiBattle 提供了一个民间“验货口诀”:观察思维链的首词。如果模型思考过程的开口是“I’m”或“I’ll”,而非老版本的“Let me”,那么恭喜,你大概率已经用上了 V4 GA 版。
在 Fable 5 与 GPT-5.6 Sol 持续角力的当下,开源 AI 大招备受瞩目。开发者 Pankaj Kumar 体验后总结道:V4 整体表现接近 Opus 4.8 级别,编码能力直追 GPT-5.6 Sol;Agent 能力大幅增强,3D 和 SVG 生成质量显著提升。不过,完成同一任务时,V4 的迭代轮数比 Fable 5 多。他认为,V4 在生态位上可能打不过新发布的 Kimi K3,但价格优势巨大。如果性能与价格匹配,或许会再次上演“DeepSeek 时刻”。
首轮测试 Demo 已流出。外界评价褒贬不一:有人认为 V4 已能打平 Claude 5,但也有开发者指出 Pro 版与 Flash 版差距不大。演示内容丰富,包括由 V4 Pro 生成的 3D 模拟射击游戏(攻城弩车打靶)、Minecraft 与 No Man’s Sky 混合风格的 HTML 游戏,以及经典的“割绳子”游戏。此外,还有 Xbox 手柄的 SVG 测试和各类游戏生成 Demo。
真正的看点在于价格。DeepSeek 首次引入“峰谷计费”机制。据邮件通知,GA 发布后同步调整 API 定价。DeepSeek V4 Pro:百万输出 Token 平时 0.87 美元,高峰 1.74 美元,缓存未命中输入 0.435 美元。DeepSeek V4 Flash 定价更狠:百万输出 0.28 美元,高峰 0.56 美元,缓存命中输入仅需 0.0028 美元。这位“价格屠夫”第一次给自己的算力装上了计价器。这对个人用户影响不大,但对那些让 Agent 在工作时间不间断运行的团队来说,成本核算需重新计算。好在缓存命中价格极低,通过错峰处理批量任务,成本依然可控。相比 Fable 5 百万输出定价 50 美元,V4 性价比依旧极高,性能达到 Opus 级,SWE-bench Verified 测试中仅比 Claude Opus 4.6 Max 低 0.2 个百分点,价格却只有对方的七分之一。当然,Opus 在长上下文检索和部分专业推理方面仍占优。
值得一提的是,deepseek-chat 和 deepseek-reasoner 这两个老模型名将于 7 月 24 日正式下线。无论 V4 是否能成为“全项第一”,全网苦等的靴子终于落地。从目前流出的信息看,V4 靠纯性能掀桌子的难度不小,但 DeepSeek 的核心策略始终如一:将 Opus 级的能力,价格压到七分之一。在动辄百万 Token 几十美元的巨头面前,即便装上了“峰谷计价器”,V4 依然是那个极具杀伤力的“价格屠夫”。
