长久以来,硅谷厂商主导着全球大模型的定价权。DeepSeek 凭借性能与价格的双重优势,在海外开发者市场形成了显著的挤压效应。这几天,社交媒体上一张 AI 漫画图广为流传,虽然人物是梁文锋,但经过漫画化处理后,其形象酷似超人,被海外网友戏称为“海外开发者眼中的梁文锋”。这幅漫画所表达的深意在于,就在上周末,DeepSeek V4 Flash 正式上线,以极致的性价比扭转了全球开发者的 AI 使用格局。

海外独立大模型评测社区 Artificial Analysis 在实测上百款大模型后,绘制出一张图表,DeepSeek V4 Flash 成为了这条曲线中的分界线。OpenRouter 最新周度统计数据显示,DeepSeek V4 Flash 登顶平台模型调用量榜首,V4 Pro 稳居榜单前五。全球开发者正持续将生产环境推理流量大规模迁移至这家中国 AI 企业。OpenCode CEO Jay(贾亚库马尔)也在 8 月 1 日发文称,DeepSeek V4 Flash 上线后,其使用量单日增长了 30%,新订阅用户也增长了 30%。

长期以来,全球大模型市场的规则由硅谷巨头书写。OpenAI、Anthropic 和谷歌划定了性能标尺,并牢牢掌控定价话语权,居高不下的推理成本筑起了 AI 创业的高门槛。海外开发者想要稳定优质的大模型服务,似乎只能被动接受闭源大厂的报价。如今,行业格局迎来了不可逆的拐点。依托持续迭代的模型能力、极致压缩的云端 API 定价,DeepSeek 在全球开发者市场划出了一条清晰的“斩杀线”。

所谓“斩杀线”,不单单指性能分水岭,更是性能与价格的平衡临界值:在同一能力梯队中,定价显著高于 DeepSeek 的模型将持续流失中小开发者;性能弱于 DeepSeek、成本却更高的产品,其生存空间将快速萎缩。最新周期的 OpenRouter 公开 Token 调用数据显示,DeepSeek V4 Flash 拿下了平台单模型调用量第一名,紧随其后的是小米 MiMo V2.5、腾讯 Hy3、DeepSeek V4 Pro 和智谱 GLM 5.2。汇总全部国产模型的总调用规模,更是连续多周超越美国厂商闭源模型的总和。其中,访问流量中美国和欧洲开发者占比接近半数,大量 Agent 自动化项目、代码辅助工具及长文本处理应用,已主动将默认模型切换至 DeepSeek。

与之形成鲜明对比的是,Claude 主流版本和 Gemini 旗舰模型的调用增速持续放缓,传统海外闭源头部模型的市场份额不断收缩。多名海外 AI 初创创始人在 X 平台公开复盘,称团队全线迁移至 DeepSeek 后,月度推理成本下降了 60% 至 85%。对于尚未盈利、现金流紧绷的小微 AI 公司而言,这样巨大的成本差异足以决定项目的生死存亡。市场逐步分化为两个圈层:大型跨国企业出于数据合规、供应链风险的考量,依旧倾向采购 OpenAI、谷歌等本土厂商服务;但灵活度更高、对成本极度敏感的中小开发者群体,已经开启了大规模迁徙。

不少行业观察者认为,OpenRouter 的数据撕开了一层行业面纱:过去很多团队选择硅谷大厂模型,并非认定其性能无可替代,而是长期缺乏性价比足够高的备选方案。当具备一线梯队能力的低价模型出现,需求侧的选择立刻发生转向。当然,第三方聚合平台的数据存在天然边界,流量高低不等同于企业营收规模,大量调用集中在低价 Flash 轻量化版本,且平台样本无法代表政企大客户市场。但不可否认的是,开发者群体是 AI 产业创新的源头,抓住开发者,就抓住了未来应用生态生长的根基。

DeepSeek 在发布 V4 Flash 当日,Artificial Analysis 实测了 128 款大模型。“斩杀线”一词由此而来,开发者们普遍认为,单纯低价没有竞争力,单纯高性能也难以撬动存量市场;只有模型达到准一线性能,同时价格形成断层优势,才能持续对竞品形成挤压效应。

复盘 DeepSeek 的定价策略演变,可以清晰看见它如何一步步构筑价格壁垒。2026 年 5 月,DeepSeek V4 Pro 宣布永久降价 75%,将短期促销转为长期基准定价,击穿当时全球高端推理模型的价格底线;随后 V4 Flash 正式上线,叠加对话缓存机制和峰谷差异化定价策略,缓存命中场景的输入 Token 成本进一步下探。横向对比当前主流大模型公开云端 API 定价(以百万 Token 美元计价),差距一目了然:DeepSeek V4 Flash 输出定价为 0.28 美元/百万 token;即便经过多轮调价的 GPT 5.6 Luna,输出定价约 1.2 美元/百万 token。Claude Sonnet、Gemini 等同档位旗舰模型,定价普遍高出 DeepSeek 数倍甚至近十倍。

这组数据催生海外开发者社群达成共识:绝大多数面向 C 端和中小 B 端的商业场景,为微小幅度的性能提升承担数十倍推理成本,不存在商业可行性。任何落在这条“斩杀线”之上的竞品,只剩下两条出路:主动大幅下调定价,或是彻底放弃普惠开发者市场,聚焦预算充足、重视供应链稳定的高端企业客户。面对流量持续分流,OpenAI 紧急下调 GPT 系列模型定价;欧洲厂商 Mistral 重新调整商业化方案,依靠开源免费策略搭配云端优惠守住开发者底盘;一众中小型开源模型服务商被迫重新核算成本,放弃依靠高 API 毛利盈利的幻想。

更为关键的是,DeepSeek 在行业内以低价著称由来已久。其走的不是价格战补贴策略,而是通过底层持续的工程优化,如高效推理架构、动态 KV 缓存、流量峰谷调度和长文本优化方案,共同压低单 Token 推理成本。梁文锋在内部表示,低价策略让更多开发者可以使用 DeepSeek,这在内部很受鼓舞。性价比“斩杀线”带来的则是全新行业命题:大模型竞争的核心标尺正在迁移。过去行业比拼参数量、训练算力和 Benchmark 跑分;现在开发者最先核算的指标是“单位成本能够换取多少有效输出”。

性能与价格的数据最终落地为真实的社区口碑。X、Reddit r/LocalLLaMA 板块、HackerNews、LMSYS 竞技场构成了海外舆论主战场,其中 X 平台上大量一线开发者和 AI 创业者持续发布实测内容,推动 DeepSeek 的热度持续发酵,舆论呈现清晰分层。巧妙的是,就在 DeepSeek V4 Flash 正式版发布前一天,OpenAI 刚刚官宣 GPT 5.6 Luna 的 API 降价 80%,第二日,有评论者贴出 DeepSeek 的图片,也有人感谢中国大模型,称是中国大模型让 OpenAI 恐慌起来,有利于开发者。不少个人开发者表达对 DeepSeek 的好感,不仅在于性价比高,也在于响应速度快,使用体验“丝滑”。华尔街分析师观点倒是略有分歧,乐观派认为 DeepSeek 掀起的价格竞争加速了 AI 应用落地,降低了全球创新门槛;悲观派则担忧持续价格战压缩全行业利润,削弱企业长期投入模型研发的资金。

DeepSeek 划出的这条性价比“斩杀线”,本质上代表两条全球大模型发展路线的正面碰撞。一条是以硅谷巨头为代表的路线:重金训练闭源旗舰模型,维持较高毛利,重心面向大型企业客户,依靠高价值 ToB 订单获取收益,优先冲击能力上限,对普惠开发者市场定价变动反应相对滞后。另一条是以 DeepSeek 为代表的路线:依靠工程优化压缩推理成本,兼顾开源生态与云端服务,走薄利多销路线,优先抢占开发者群体,依靠规模效应摊薄成本,以性价比快速扩大全球市场份额。两条路线没有绝对对错,但 DeepSeek 的崛起证明一个核心事实:大模型竞争不再单纯比拼烧钱规模。算力投入只是基础,推理效率、商业化定价和生态策略,同样能够改写市场份额。

这场由性价比开启的全球大模型洗牌远未结束。价格竞争只是序幕,接下来,模型能力迭代、全球化服务能力、合规解决方案以及商业化盈利模式的长期比拼,才决定谁能站稳脚跟。就在本周一,MiniMax 正式开源通用视频模型 H3,势要在多模态领域复刻 DeepSeek 的效果;同日,阿里巴巴千问 Qwen 3.8-Max 大模型也正式上线,参数量达 2.4 万亿,这是 Qwen 家族迄今最强大的模型,模型权重将于下周开源。对于全球数百万 AI 开发者而言,最直观的变化已经发生:选择变多,成本下降,创新的门槛正在被不断压低。

最新快讯

2026年08月03日

18:54
2026年8月1日,OpenAI扔出了一枚重磅消息。它的下一代主力模型Astra——目前还只是一个内部版本——在数学和理论计算机科学领域取得了十项重大突破。这些成果覆盖高维几何、编码理论、群论、算子代数、量子复杂度、格密码学和极值组合学等多个方向。每道题都是开放超过十年、核心进展长期停滞的硬骨头。 消息一出,数学圈的反应不是欢呼,而是...
18:54
Genspark 最成功的 Agent,或许就是 Genspark 自己。它只需执行一项长程任务:让世界相信它从来只是一家来自 Palo Alto 的美国 AI 公司。 2026年7月24日,英伟达联合创始人与 CEO 黄仁勋(Jensen Huang)破天荒地在社交媒体开通了账号,发布的第一条推文即震撼了整个人工智能界。 ...
18:54
今年夏天,具身智能赛道迎来历史性时刻,宇树科技科创板IPO审核生效,并于8月5日开始询价,10日开始申购。从3月份正式提交IPO申请到注册生效,宇树全程仅用时104天,创下科创板预先审阅机制落地以来最快审核纪录。这家成立于2016年的公司,以约420亿元的发行估值,即将成为“A股人形机器人第一股”。 然而,资本市场的另一侧,硬科技股“上市即...
18:54
2026年春天,一位传统制造业的老板找到我说:  "周围所有人都在聊AI,ChatGPT、DeepSeek、Agent、大模型……我花了几十万买了个'AI解决方案',结果发现就是套了个对话壳子。我连AI到底是个什么都还没搞明白,钱就花出去了。"   他苦笑着说:"我觉得我需要先搞懂AI是什么,再决定怎么...
18:53
8月3日,南下资金净买入港股110.31亿港元。其中:净买入盈富基金47.5亿、阿里巴巴41.69亿、腾讯24.32亿、美团5.8亿、南方恒生科技3.17亿、小米集团2.93亿;净卖出中芯国际10.64亿、华虹宏力4.2亿、建滔积层板3.1亿、智谱1.73亿、兆易创新1.73亿。据统计,南下资金已连续9日净卖出长飞光纤光缆,共计29.4896亿港元;连续6日...
18:53
作为“果链”当之无愧的代工霸主,立讯精密构筑了精密制造的平台。近期,立讯系在资本市场的又一重磅动作引发关注。据悉,立景创新科技股份有限公司(简称“立景创新”)已于2026年7月31日向港交所递交招股书,由中信证券和中金公司担任保荐人。作为立讯系在光学赛道的关键拼图,此次IPO不仅彰显了“果链”龙头向光学核心器件垂直整合的野心,更预示着立讯系的资本版图将再添猛...
18:53
史上最昂贵的IPO即将迎来“业绩检验”。美东时间8月4日盘后,SpaceX将发布上市后的首份财报。随着“史上最大IPO”的光环逐渐褪去,市场正聚焦于首份季报以及随后可能到来的千亿级解禁潮。摩根士丹利更是明确发出预警,称SpaceX正面临上市以来最危险的时刻。 **业绩“审判”倒计时** 市场普遍预计,SpaceX第二季度营收约为69亿美元,同比增长68%。其...
18:42
8月3日,据鼓狮财经报道,宏景科技(301396.SZ)发布公告称,公司董事会已批准股份回购方案。公司计划使用自有资金,通过集中竞价交易方式回购股份。此次回购资金总额将在3000万元至5000万元之间,每股价格不超过260元。回购的股份将用于未来实施员工持股计划或股权激励。
18:42
据鼓狮财经8月3日报道,胜蓝股份(300843.SZ)发布公告,宣布拟通过集中竞价交易方式回购公司股份。此次回购的资金总额不低于1亿元且不超过2亿元,回购价格上限为195.18元/股。回购所得股份将主要用于实施股权激励、员工持股计划或用于可转债转股。
18:42
鼓狮财经8月3日讯,豫光金铅发布公告称,公司已收到控股股东豫光集团转发的济源产城融合示范区国资局批复。该批复原则同意公司向特定对象发行股票的预案。具体而言,本次发行数量不超过3.63亿股,募集资金总额不超过18.39亿元,控股股东承诺以现金方式参与认购。目前,该事项尚需公司股东大会审议,并待上交所审核通过及证监会同意注册。
18:42
据鼓狮财经8月3日报道,当地时间8月3日,以色列议会外交和国防委员会投票通过了政府提交的延期申请,决定将军队紧急动员令延长两个月,有效期至今年9月30日。根据该决议,以色列国防军获准最多可征召24万名预备役军人。据悉,自2023年新一轮巴以冲突爆发以来,此类延长紧急动员期限的申请已多次获得批准。
18:10
究竟还有没有便宜又好用的模型?就在刚刚,阿里巴巴突袭发布了新一代基座大模型 Qwen3.8-Max。用四个字概括就是「能打」、「便宜」。总参数量达到2.4万亿,在编程、专业工作、长程任务、多模态智能体等场景上的表现直接跃升了一个档次。 在今天最新放榜的权威第三方榜单 Arena 中,Qwen3.8-Max 一路冲到全球大模型第一梯队,表现直逼 Anthrop...