本周二晚间,DeepSeek 开放平台发布公告,宣布将调整 V4-Flash 系列大模型 API 定价,此次下调被业内视为“喜闻乐见”之举。
此次调整的具体细节如下:闲时价格统一为输入(缓存命中)0.02元、输入(缓存未命中)1元、输出 4元(单位均为元/百万token)。高峰时段(北京时间周一至周五 9:00–12:00、14:00–18:00)价格维持闲时的两倍,即缓存命中 0.04元、缓存未命中 2元、输出 8元。V4-Pro 系列价格保持不变,新方案将于北京时间 9 月 10 日 12:00 正式生效。
回顾此前 8 月 17 日的涨价情况,此次降价虽让输入侧价格回调至涨价前水平,但输出侧价格仍为涨价前的两倍。若按高峰时段计算,新高峰价相比涨价前分别为 2 倍、2 倍和 4 倍。因此,用户能否真正回到过去“放开了用”的状态,取决于三个变量:缓存命中率、输入输出比例以及任务可错峰的程度。鉴于 DeepSeek API 通常具备较高的缓存命中率,对于长上下文、固定系统提示词或 Agent 循环调用等场景,此次降价将带来显著的成本优势;而对于以生成输出为主的场景,感受则相对有限。
值得注意的是,本次降价并非孤立事件。昨天下午,DeepSeek 在官方交流群宣布开启 V4.1 Flash 中间版本内测。新模型名为 deepseek-v4.1-flash-expires-on-0910,base_url 不变,每账号限流 20 并发,计费暂与 V4 Flash 相同。该模型支持原生多模态、推理速度极快,且官方表示通过架构升级降低了成本。由于模型名称中包含“expires-on-0910”,这意味着该版本将于 9 月 10 日自动下线,与降价生效日重合。
9 月作为前沿 AI 公司密集发力的月份,DeepSeek 的 V4.1 正式版如果能够带来明显的能力跃升,并配合此次降价,或许可以再次引爆一波使用热潮。
