全网等待了三个月,DeepSeek V4正式版有望在明日或近期发布。目前部分用户已提前获得V4灰度测试权限,主要包含DeepSeek V4 Flash和DeepSeek V4 Pro两个版本。
**如何确认是否获得测试资格?**
博主AiBattle给出了一个民间“验货口诀”:查看思维链中的第一人称代词。如果模型的思考过程以“I’m”或“I’ll”开头,而非旧版的“Let me”,那么恭喜你,大概率已用上V4 GA版。
**性能评测与竞品对比**
在Fable 5与GPT-5.6 Sol持续角力的当下,全网对开源AI的期待值拉满。开发者Pankaj Kumar体验后总结:V4整体表现接近Opus 4.8级别,编码能力直追GPT-5.6 Sol,Agent能力大幅增强,3D和SVG生成显著变好。不过,完成同一任务V4所需的迭代轮数比Fable 5多。他表示,从生态位来看V4大概率打不过刚发布的Kimi K3,但价格会显著更低。若性能与价格匹配,可能再次引发“DeepSeek时刻”。
**Demo展示与外界评价**
目前V4首轮测试Demo已流出,外界评价褒贬不一。有人认为已能对标Claude 5,也有开发者指出Pro版并未比Flash版领先太多。Demo展示了多款游戏:攻城弩车射击训练、类似《我的世界》与《无人深空》的混合HTML游戏、经典《割绳子》游戏,以及Xbox手柄SVG测试。
**引入“峰谷计费”重塑价格优势**
价格是V4最大的看点。DeepSeek将引入“峰谷计费”。Pro版输出tokens百万平时0.87美元,高峰1.74美元;输入缓存未命中平时0.435美元。Flash版更激进:输出百万平时0.28美元,高峰0.56美元,输入缓存命中仅0.0028美元。这是“价格屠夫”首次给自己的算力装上计价器。对个人用户影响不大,但对全天候运行Agent的团队是实打实的成本考量。利用缓存命中的极低价格,在非高峰期跑批量任务仍能控制成本。相比Fable 5百万输出定价50美元,V4在性价比上依旧是最香的,性能也达到了Opus级。
**总结与展望**
V4预览版自测SWE-bench Verified中,DeepSeek-V4-Pro-Max距Claude Opus 4.6 Max仅差0.2个百分点,价格却只有对方的七分之一。但在长上下文检索、专业软件工程和部分知识推理评测中,Opus仍保持领先。此外,deepseek-chat和deepseek-reasoner两个老模型名将于7月24日正式下线。
不管怎样,全网苦等三个月的这只“靴子”终于要落地了。从目前信息看,V4大概率不是全项第一的模型。但DeepSeek打的不是纯性能牌,而是将Opus级能力压到七分之一价格。在动辄百万Token几十美元的巨头面前,V4依然是那个大杀四方的“价格屠夫”。
