全网苦等了三个月,DeepSeek V4 正式版可能最早明天发布,最迟这几天内。目前,部分用户已获得 DeepSeek V4(GA)灰度测试的权限。目前共有两个版本:DeepSeek V4 Flash 和 DeepSeek V4 Pro。DeepSeek V4“满血版”终于要来了。
大家最关心的莫过于如何确认自己是否获得了灰度测试资格。博主 AiBattle 提供了一个民间“验货口诀”:查看思维链(CoT)中的第一人称代词。如果模型的思考过程以“I’m”或“I’ll”开头,而不是旧版本的“Let me”,那么恭喜你,你很可能已经用上了 V4 GA 版!
在 Fable 5 与 GPT-5.6 Sol 持续角力的当下,全网对这一开源 AI 大招的期待值已拉满。开发者 Pankaj Kumar 在体验后率先对 V4 的性能做出了中肯的总结:整体性能接近 Opus 4.8 级别,编码能力直逼 GPT-5.6 Sol;Agent 能力大幅增强,3D 和 SVG 生成质量显著提升;在处理相同任务时,V4 所需的迭代轮数比 Fable 5 更多。他表示,从目前的生态定位来看,V4 很可能打不过刚发布的 Kimi K3,但价格会显著更低。如果这种性能配合这种价格,那可能又会迎来一次“DeepSeek时刻”。
首轮测试已出。如今,DeepSeek V4(GA)的首轮测试演示开始外流。外界对此褒贬不一:有人认为它已经能持平 Claude 5,但部分开发者指出,Pro 版并未比 Flash 版领先太多。
以下是由 V4 Pro 生成的一款 3D 模拟射击游戏演示,核心玩法是操控攻城弩车进行打靶训练,基础的 UI 功能也已完备。V4 正式版打造了一款《我的世界》与《无人深空》的混合 HTML 游戏,可玩度相当高。下方这款经典的“割绳子”游戏,也是由 V4 一次性生成的。下方还有 V4 生成的其他演示,包括 Xbox 手柄 SVG 测试和游戏生成。
再造“DeepSeek时刻”,最大的变数是价格。所有爆料都指向同一个说法:性能可能不是第一,但价格会显著更低。上个月底,DeepSeek 向所有 API 用户发了一封邮件,称将于 7 月中旬上线 V4 正式版。GA 发布后将同步调整 API 定价,引入“峰谷计费”。
deepseek-v4-pro:百万输出 tokens 平时 0.87 美元,高峰 1.74 美元;缓存未命中的输入平时 0.435 美元。deepseek-v4-flash 更狠:百万输出 0.28 美元,高峰 0.56 美元,缓存命中的输入 0.0028 美元。
也就是说,那个从不涨价的“价格屠夫”第一次给自己的算力装上了计价器。这对个人用户影响不大,但对那些将 Agent 挂在工作时间不间断运行的团队来说,这是一笔需要重新计算的账。好在缓存命中的价格依然极低,将批量任务、评测跑分、数据生成安排在非高峰时段,成本还能压回去。
不过,相较于 Fable 5 百万输出定价 50 美元,V4 在性价比上依旧是最香的。毕竟,性能也达到了 Opus 级。V4 预览版发布时,官方自测的 SWE-bench Verified 中,DeepSeek-V4-Pro-Max 距 Claude Opus 4.6 Max 仅差 0.2 个百分点,价格却只有对方的七分之一。但在长上下文检索、专业软件工程和部分知识推理评测中,Opus 仍保持领先。
顺带提一句,deepseek-chat 和 deepseek-reasoner 这两个老模型名将于 7 月 24 日正式下线。
不管怎样,全网苦等三个月的这只“靴子”终于要落地了。从目前流出的信息看,V4 很可能不会是那个“全项第一”的模型。Fable 5 和 GPT-5.6 Sol 在前,Kimi K3 在侧,V4 想靠纯性能掀桌子,难度不小。但 DeepSeek 从来打的就不是这张牌。真正的看点是那条被反复验证的老路径:把 Opus 级的能力,价格压到七分之一。毕竟,在动辄百万 Token 几十美元的巨头面前,哪怕是装上了“峰谷计价器”,V4 依然是大杀四方的“价格屠夫”。
