大模型行业中,DeepSeek素以“价格屠夫”著称,如今却准备涨价了。8月6日,DeepSeek在用户后台发布公告,宣布计划近期上调API服务定价,并特别提醒用户此次“预计涨幅较大”,建议合理安排使用需求和充值金额。这一消息引发广泛关注,毕竟在过去两年Token价格战中,DeepSeek始终是那个带头掀桌子的人。如今率先将Token价格打下来,却主动宣布大幅涨价,颇有价格战发起者鸣金收兵的意味。无独有偶,8月7日路透社报道,阿里计划向旗下千问推出的下一代开源大模型的大型商用用户收取营收分成。此前,只有在阿里云平台调用模型才收费,但如果客户将模型部署在自有数据中心则可免费使用。随着Kimi K3等开放权重模型开始采取分成模式,开源大模型似乎即将告别“免费的午餐”。
在讨论涨价前,我们不妨先看看DeepSeek现在的价格有多便宜。DeepSeek官方数据显示,DeepSeek-V4-Flash的缓存命中输入价格为每百万Token 0.02元,未命中为1元,输出为2元;性能更强的DeepSeek-V4-Pro价格分别为0.025元、3元和6元。此前预告的峰谷定价机制(高峰期价格翻倍)虽未实施,但仅看标准价格,DeepSeek-V4-Flash已便宜得惊人。海外研究机构Artificial Analysis测试显示,DeepSeek-V4-Flash完成一轮综合基准测试的平均成本仅约0.03美元。对比之下,Kimi K3约为0.86美元,OpenAI GPT-5.6 Sol约为1.86美元,Anthropic Claude Fable 5更是达到3.15美元。DeepSeek-V4-Flash的成本甚至不到部分海外旗舰模型的百分之一。虽然模型能力存在差异,从榜单看DeepSeek V4 Flash 0731 Max与Fable 5相差11分,但当价格差距扩大到百倍时,情况便截然不同。大多数任务并不需要极致性能,DeepSeek的价格比成绩相近的Gemini 3.6 Flash High低90%,用“物美价廉”形容毫不为过。因此,DeepSeek强调“预计涨幅较大”自然让开发者感到紧张。
特别是在Agent时代,AI执行任务早已不是简单的一问一答。以编程为例,Agent可能需要读取代码库、生成计划、调用工具、运行测试、修正错误并再次验证,可能涉及几十甚至上百轮模型调用。在Agent模式下,Token消耗呈指数级增长,当每日消耗达到几十亿甚至万亿级别时,即便Token价格上涨几毛钱,账单也可能激增几十万元。这可能是DeepSeek最初低估了Agent的Token消耗量,导致服务器算力被迅速榨干。从测试数据看,DeepSeek V4 Flash 0731 Max是个实打实的“话痨”,完成相同测试用了2.1亿Token,而Gemini仅用了5900万Token。若能降低输出量,成本还能再降50%。此外,低价也导致许多开发者用AI处理简单的手动任务,挤占了复杂任务的算力资源,造成服务拥堵。
DeepSeek为何涨价?原因在于新发布的DeepSeek V4 Flash 0731 Max在Agent能力上显著提升,导致调用量飙升。根据OpenRouter数据,DeepSeek-V4-Flash最近一周处理量达约6.6万亿Token,虽环比下降10%,但仍位列全球第一,且占据约58%的Token份额。从6月12日到8月6日,累计处理量达约97万亿Token,完成会话超1000万次。这意味着DeepSeek正面临巨大的算力压力,服务器频繁过载,甚至出现“服务繁忙”的提示。此前DeepSeek曾计划实施峰谷定价,但因服务器几乎没有“谷底”而搁置。中国用户用完时,美国用户刚起床,导致全天候满负荷运转。DeepSeek目前的定价可能连收支平衡都难维持,甚至有业内人士猜测其在进行补贴。这种低价策略虽然吸引开发者,但也带来了算力浪费和拥堵问题。
涨价在预料之中,当时降价时也用了“限时”字样。站在行业角度,靠补贴抢市场无法持久,AI企业必须考虑收支平衡。即使涨价,DeepSeek的性价比依然很高。至于Token价格战是否结束?小雷认为并非如此,而是进入了新阶段。过去两年价格战仅比拼Token价格,未来则将更加综合。不同模型完成同一任务消耗Token数量不同,这会影响最终成本。此外,模型速度、稳定性和可用性也成为企业考量的重点。随着AI深入行业底层,企业更看重稳定、快速的服务。DeepSeek通过涨价“劝退”低端用户、提升高价值用户体验,是合理的商业选择。未来AI企业将通过更具性价比的模型、更稳定的服务争夺B端市场,真正的商业化大战才刚刚打响。
