正如所有 AI 从业者常说的“AI 一天,人间一年”,这句话似乎精准地描绘了 Kimi K3 发布后的景象。对于刚刚发布的 Kimi K3 而言,或许没有什么形容比这句话更为贴切。月之暗面成立至今已有三年,但过去三年的所有积累,似乎都抵不上这三天引发的轰动。
自 ChatGPT 发布以来,中国 AI 行业曾多次震惊世界,既有真正的技术突破,也不乏媒体与厂商的自嗨。而 Kimi K3 的发布,似乎是唯一能与“DeepSeek 时刻”相媲美的存在。
就像去年 DeepSeek-R1 发布后美国芯片产业普跌一样,上周包括英伟达、博通及美光在内的费城半导体指数重挫 10%,创下 2025 年 4 月以来的最大单周跌幅,进入技术性熊市区间。媒体统计显示,72 小时内美股 AI 板块市值合计蒸发 4700 亿美元,约合 3 万亿人民币。
不止一家海外媒体及研究机构用诸如“DeepSeek 2.0”来形容 Kimi K3。《财富》杂志称这是“第二次 DeepSeek 冲击”,《华尔街日报》强调 Kimi 加剧了华尔街芯片股抛售,彭博社则表示“Kimi 颠覆了美国领先中国的传统认知”。
恐慌情绪不断蔓延,甚至令 OpenAI 及 Anthropic 都备受质疑,因为一款中国开源模型的性能似乎已逼近顶级闭源模型。二者本就处在上市前的关键节点,模型性能领先是他们获得高估值及高定价的关键。部分美国开发者已经开始质疑为何还要为 Claude 和 GPT 支付高昂的价格。
过去几日,Anthropic 宣布为所有 Max 及 Team Premium 用户开放 Claude Fable 5,但仅限额 50%,此前他们曾因算力问题计划完全从订阅方案中移除这一模型。OpenAI 则在上周多次重置 Codex 限额,甚至一度取消了 5 小时的用量限制。
很难说这些事件都是 Kimi K3 的冲击所致。在此之前,半导体产业已经连续承压数周,华尔街分析师们迫切需要为这轮下跌寻找一个足够醒目、也容易理解的借口——境外势力自然是万能法宝。更不用说 OpenAI 及 Anthropic 本就处在激烈竞争之中,已经演变到大打价格战的地步。
但这似乎并不影响美国科技行业对于 Kimi K3 的惊讶。即便 Kimi 承认自身总体性能仍落后于 Claude Fable 5 和 GPT-5.6 Sol,诸多海外评测机构仍在测评中对 K3 不吝赞美,排名往往位列前茅。Arena.ai 称 Kimi K3 以 1679 分的成绩获得前端代码竞技场榜首,超越 Claude Fable 5。该机构表示,上次中国模型如此接近领先,还是 2025 年的 DeepSeek-R1。
在高昂的市场热情下,连杨植麟都成为了美国科技圈热议的新偶像人物。大洋彼岸的人们疑惑为何他当年没有留在美国,而是选择了回国。杨植麟的博士生导师不得不专门发文解释,澄清杨植麟回国并非因为签证或移民问题,而是出于坚定的创业决心。
大模型行业依然遵循着优胜劣汰的法则,只要性能足够领先,价格就不是问题。即便 K3 模型的输入及输出价格较上代 K2.6 模型上涨超 3 倍,且显著高于 GLM-5.2 及 DeepSeek V4 Pro,已是目前市面上最贵的国产模型,但 Kimi 依然遭遇了算力紧缺问题。
7 月 19 日晚,Kimi 宣布由于算力紧缺,自即日起暂停 C 端新用户订阅。他们同时调整了会员权益,将原本覆盖 Kimi 网页版、App 及 Kimi Work 的通用会员与 Kimi Code 会员拆分销售。Kimi 总裁张予彤称,K3 发布次日公司 ARR 创下历史最大单日增幅。
算力紧缺在一定程度上或许也与 K3 模型自身的 Token 效率相关。在 Artificial Analysis 的评测中,K3 完成整套测试输出了 1.3 亿个 Token,接近同类模型平均水平的两倍。更长的输出通常意味着更高的推理成本,这可能进一步加重 Kimi 的算力压力。社交媒体上,也有不少开发者吐槽 Kimi K3 是 Token 消耗大户,有人称跑了 15 分钟就已经耗尽了 5 小时的限额。
Kimi K3 的出圈似乎再一次证明了 AI 时代模型竞争力的脆弱性。仅仅两周之前,中国大模型市场最被人看好的还是已经上市的智谱。上半年智谱发布的 GLM-5.2 模型被誉为国产开源模型的骄傲,几次大幅上调价格依然紧俏。上市半年来,智谱股价翻了 24 倍有余,总市值一度突破 1.3 万亿港元。
但从上周开始,智谱的神话似乎就已松动。上周五,智谱股价下跌 28.49%,本周一再跌 19.56%,两个交易日股价累计下跌超 4 成,市值跌破 5000 亿港元。
Kimi K3 的领先可能也维持不了多久。7 月 19 日,阿里巴巴发布 Qwen3.8 Max 预览版,参数规模达 2.4 万亿,宣称综合能力在全球范围内仅次于 Claude Fable 5。马斯克对外称,拥有 2 万亿参数量的 Grok 新模型即将完成初步训练,它可能在保持较高运行效率的同时超越 Kimi。
K3 发布当天,萨姆·奥尔特曼对外表示,他知道他们过去 12 个月并非最佳,这主要归咎于他,但他们即将迎来迄今为止最好的 12 个月。“团队正在做非常出色的工作,我相信你会对他们为你准备的惊喜感到非常满意。”
芯片行业多年来一直奉行摩尔定律,在成本大致不变的情况下芯片性能大约每 18 至 24 个月翻一倍。但正如 AI 行业人士常挂在嘴边的“AI 一天,人间一年”,AI 时代的模型性能提升可能以周甚至天来计算。去年谷歌的 Gemini 模型一度令萨姆·奥尔特曼在公司内拉响红色警报,但现在 Gemini 更流行的称谓是“北美豆包”。彭博社称 Gemini 3.5 Pro 的发布时间已经推迟数月,因为模型在编程及代码生成能力上未达预期。
两个交易日的重挫后,市场消息称智谱可能跳过 GLM-5.3,直接推出 GLM-5.5,预计最快将于 8 月发布,据称将具备万亿以上的参数规模。智谱的员工们已经开始在推特上放出小道消息,称现在可能是订阅 GLM Coding Plan 的最佳时机。
刚刚完成首轮融资的 DeepSeek 被曝即将推出 DeepSeek-V4 模型的正式版,外界称性能将逼近 GPT-5.6,且继续保持极高性价比的优势。
过去的时代总在反复证明时间的重要。无论是 PC 互联网还是移动互联网,一家公司只要起步足够早、跑得足够快,就有机会赶在窗口关闭前建立先发优势。而随着用户和市场规模不断扩大,领先非但不会被稀释,反而会持续放大,令后来者越来越难以追赶。
但在 AI 时代,优势并不总是站在时间这一边。所有的领先都建立在模型性能的迭代上,总有后来者不断推出更新的模型,缩短与前者的差距。如果说互联网时代最难追赶的是规模,那么 AI 最醒目的优势就是模型。只是这种优势的保质期,往往只有一个版本。
两个交易日内股价连跌 4 成的智谱,今日盘中涨幅一度超 35%。市场消息称,智谱已落地 1GW 级国产 AI 算力数据中心建设。
竞争仍在继续。
