最近这一个月,硅谷 AI 领域可谓动作频频,GPT-5.6、Fable 5、Grok-4.5 等顶尖模型相继发布,瞬间点燃了国内开发者与程序员的热情,关于这些前沿模型的讨论与测评层出不穷。虽然 Kimi-K3 等国产新锐模型也在同期问世,但从整体趋势来看,国产大模型在一线开发者群体中,依然面临着“叫好不叫座”的尴尬局面。

根据 OpenRouter 的数据,6月22日至28日,中国模型的周调用量高达20.39万亿 Token,连续九周领先美国模型(4.25万亿)。然而,这一亮眼的数据与国内“AI 六小龙”的营收表现形成了鲜明反差。公开财报显示,智谱2025年营收7.24亿元,亏损却超过30亿元;MiniMax营收约5.7亿元;月之暗面等其余四家尚未披露完整年营收。即便是头部企业,收入也多停留在数亿元量级。相比之下,Anthropic 的ARR已达约600至700亿美元,主要驱动力来自B2B API及AI编程场景。这不禁让人深思:为何号称“便宜”、“调用量大”的国产模型,在AI编程等高价值场景中,依然难以与国外顶尖模型正面抗衡?

最近,笔者与多位一线开发者深入探讨后,发现了一个反直觉的事实:国产大模型,在某种程度上其实非常“贵”。正是这种“贵”,掩盖了部分国产模型在性能上的突破。

首先,关于“低价”的印象,其实是一个长久的误区。单看Token单价,国产模型确实比GPT-5.6、Fable 5等有优势。例如 GLM-5.2 输入/输出单价为1.4/4.4 美元,DeepSeek-V4-Pro 为0.435/0.87 美元;而 GPT-5.6 Sol 为5/30 美元,Claude Fable 5 为10/50 美元。但在高强度编程场景下,国产模型的单价不仅没有优势,甚至比有套餐的 GPT、Claude 贵出好几倍。

科研工作者李光(化名)每天在 AI 编程场景下消耗几十亿 Token。他在交谈当天消耗了近40亿 Token,若使用 GLM-5.2,成本将高达约7800元人民币(按1美元兑7.2元估算)。而之所以能如此“敞开”使用,是因为他购买了 GPT 的 CodeX 套餐。CodeX 套餐将编程场景纳入订阅,Pro 版100美元/月起,额度是 Plus 版的5到20倍,用完后可购买 Credits。同样地,Claude Code 也有类似机制。

对于重度开发者小刘来说,使用 Codex 一周花费约300元人民币(在公司未报销的情况下),这让他觉得非常便宜。而同样的300元,在国产模型上根本买不到同等数量的 Token。虽然 Codex 并非真正无限量(最高档200美元/月约20亿额度),但通过“中转站”等渠道,部分开发者能以更低价格购买到更多 Token。相比之下,国产模型的套餐虽然存在,但限额严格,高峰期限流严重,使得高强度的开发者体验大打折扣。

国产大模型的定价现状,正如一句调侃所说:“你以为进的是自助餐,最后发现商家还是按斤计费。”以 Kimi Code 和 GLM-5.2 为例,Kimi 分为49、99、199、699元四档,按周刷新;GLM Coding Plan 的 Lite、Pro、Max 档位限制严格,高峰期甚至按3倍扣额。阿里云的 Qoder 也曾是国内优秀的 AI IDE,但因新定价调整导致至少二三十家客户放弃续费。一位运维朋友阿迷(化名)透露,Qoder 企业版199元的套餐,按重度开发者的用法,3天就耗尽了,甚至一天都不够。同样,GLM-5.2 的套餐常被开发者吐槽“约等于没有”,高峰期限流严重,甚至存在“背刺”用户的现象(如智谱曾因算力紧张将每日售罄量砍至20%)。

这种“吝啬”的背后,本质是算力不足的窘迫。数据显示,中国数据中心仅449个,总算力1053 EFLOPS,远低于美国的5427个和2400 EFLOPS。且中国算力中大量是国产芯片(如昇腾、寒武纪),与H100存在代差。为应对需求,2026年3月起,智谱、阿里云等集体涨价。OpenAI 和 Anthropic 通过高净值企业客户(如Cursor、GitHub)获得高收入,摊薄了成本。而国内云厂商利润微薄(阿里云EBITA Margin仅7.5%),且传统云可以超卖CPU,但大模型推理是实时的,无法超卖,用户若24小时高强度使用,成本瞬间击穿。

除了价格,性能也是开发者选择的关键。国产模型在性能上虽有进步,GLM-5.2 被公认为首个达到 Opus 级别的国产模型,Kimi-K3 在智力指数和编程榜上表现优异,但在复杂的异步任务上仍不及 GPT、Claude。开发者小张曾用国产模型做复杂的多级比对项目,只有 GPT 跑通了。Kimi 2.7 和豆包 2.1 Pro 虽属第二梯队,但总体弱于 Claude Sonnet 4.6。

目前,国产模型在“性能—价格—稳定性”的黄金三角中,仅勉强拿下了性能这一项。Kimi-K3 虽参数巨大、分数高,但 API 价格不低(2/20/100元/百万Token),且存在断连问题。总体而言,国内开发者并非不愿付费,而是国产模型因算力紧、成本高,开不起像 Codex 那样有性价比的套餐,只能提供看似自助餐实则限量的大众点评套餐。这种体验的不稳定和性价比模糊,导致用户留存困难。这本质上是在算力底座成本高企下的理性选择。国产模型在追赶 GPT、Claude 的过程中,不能只强调性能,还需等待算力基座大规模量产,在技术、价格、稳定性上形成合力。

最新快讯

2026年07月30日

10:45
最近这一个月,硅谷AI界可谓大招频出,GPT-5.6、fable5、Grok-4.5接连问世。一时间,国内开发者、程序员群体纷纷沸腾,各种关于GPT-5.6等前沿模型的讨论、测评此起彼伏。尽管这个月也有Kimi-K3这样的新锐国产模型问世,但总的来看,国产大模型当前在一线开发者群体中,始终处于一种“叫好不叫座”的状态。根据最新数据,在使用量...
10:45
北京时间7月29日,据《华尔街日报》报道,硅谷正在酝酿一股反Anthropic的风潮,其根源在于该公司推出的产品与现有软件提供商形成竞争,以及它对封闭式AI生态系统的倡导。 与合作伙伴竞争 创业公司创始人、软件公司高管及AI研究人员表示,在看到Anthropic向市场推出了一些与其他公司产品形成竞争的工具后,他们开始转向价格更低的AI模...
10:45
过去几天,一篇名为《王的猜想》的文章刷屏了。 它原本是《广西日报》为数学家王虹写的一篇人物特稿。文章火到纸质报纸一份难求,报社不得不宣布加印,就连价格都从 1 块钱炒到了二手平台上最高 60 块一份。 图片来自:广西日报微信公众号 7 月 23 日,35 岁的王虹获得菲尔兹奖。公众最熟悉的成果,是她与数学家 Joshua Za...
10:45
当代版 “ 焚书坑儒 ” 的判决出来了,但 “ 焚书坑儒 ” 成了里面最合法的一环。。。 从 2024 年 8 月,到这个月 20 号,拉扯了快两年的 Anthropic 盗版书训练集体诉讼案,终于结束了。法院最终批准,Anthropic 向原告支付15 亿美元的天价和解金。 这个数有多夸张呢,这么说吧,不看那些离谱的 ARR,根...
10:45
过去一年,OpenAI经历了一段Altman自己都承认“相当艰难”的时期。 在近期播客节目《Invest Like The Best》中,他少见地进行了系统性复盘,涵盖战略失误、竞争压力、安全隐患,以及他对AGI时间线和机器人未来的最新判断。 01 最艰难一年:“战线太宽,是我的错” "过去一年相当艰难,部分是我的错。"Altman...
10:44
7月29日盘后,Facebook母公司Meta Platforms交出了截至6月30日的2026年第二季度财报。具体来看,第二季度营收608亿美元,同比增长28%,创历史新高。但仅仅158亿的净利润,远远低于分析师预期的185-195亿;相比一季度267亿的净利润,更是几乎腰斩。自由现金流仅剩7.84亿美元,同比暴跌91%,创下了2022年三季度以来近四年最...
10:44
三星电子于7月30日发布了2026财年第二季度财报。公司二季度销售额171.50万亿韩元,同比增长130%;营业利润89.49万亿韩元,同比增长1814%,数据再次刷新历史纪录。与此同时,公司对2026年下半年展望积极,预计芯片供应短缺将在下半年持续。财报大超预期,叠加韩国政府出手稳市提振,三星电子今日拉涨超7%。Q2营业利润暴涨1814%数据显示,公司该季...
09:57
若要一句话概括当下漫剧圈爆火的“罪妻”模式,那便是:女主开局被发配边关,被迫选夫后,在艰苦环境中开启种田基建,凭借智慧与坚韧让荒地重获生机,并收获爱情与亲情。这一模板衍生出星际、兽世、废土等无数变体。而其源头,竟是两位“95后”夫妻自制出品的《发配边关,罪妻开荒养出战神》。该系列已更新至第九季,共有6部作品跻身“上半年AI剧/漫剧红果百强榜”TOP15。仅凭...
09:57
近期,关于 OpenAI 硬件生态版图的曝光速度显著加快。无论是彭博社关于音箱细节的报道,还是供应链分析师郭明錤关于手机规格和代工订单的详细调查,都让我们逐渐拼凑出了这头大象的实际轮廓:一台音箱、一部手机,后续可能还有眼镜、台灯,甚至耳机。 其中,音箱作为最早推出的硬件产品,预计将于 2027 年初上市,定价在 200 到 300 美元之间。OpenAI 交...
09:57
这几天,围绕 Claude Code 系统提示词的删减与增补,业界争论不休。先是 Claude Code 团队成员 Thariq Shihipar 发文称,他们砍掉了 80% 以上的提示词,内部评测结果并未下滑。但这番言论很快遭遇了反转。两天后,Qoder 工程师陈成抓取了实际请求数据,指出大幅精简发生在 Opus 4.8 版本,而非 Opus 5。4.7 ...
09:57
影视飓风似乎正在取代李一舟,成为新一代“AI教父”。近期,影视飓风推出了一门AI实战课,迅速卖爆。该课程共16课时、五个单元,内容涵盖AI生图、视频生成、提示词教程、TapNow功能介绍,以及首尾帧、全能参考等高阶玩法。每节课时长5至17分钟。原价99元,券后优惠价49元。上线当天,销量即突破10万单,日入近500万元。半个月后,该课程在抖音、B站、视频号等...
09:57
7月30日,字节跳动启动面向AI业务的组织架构调整,旨在强化豆包、飞书与火山引擎在企业生产力场景下的协同合作。 在产品研发层面,飞书与豆包的产品团队将合并,组建全新的“豆包产品团队”。该团队由赵祺(原豆包负责人)领导,飞书负责人谢欣将向其汇报。在市场与销售体系方面,飞书GTM团队将与火山引擎团队整合,成立新的“创造力服务平台”。该部门由谭待(原火山引擎负责人...