Kimi K3发布后的48小时,全球AI圈被彻底点燃。人们迫切想验证这个综合性能仅次于Fable 5和GPT-5.6 Sol的开源模型到底如何。然而,巨大的流量瞬间击穿了Kimi的服务器。7月19日深夜,官方发布《关于算力紧缺与会员暂停开放的说明》。公告指出,K3的请求量远超预期,逼近算力极限。为保障老用户体验,即日起暂停C端新用户订阅,并将会员体系拆分为Kimi主权益和Kimi Code权益,以更精准分配算力。简单来说,K3太火了,服务器扛不住了,先别招新会员了。
与此同时,外媒爆料Kimi正寻求香港上市批准,最快六个月完成IPO。为推动上市,Kimi正在融资,估值可能超过300亿美元。其财务数据惊人:今年3月年化收入ARR突破1亿美元,5月突破2亿美元,6月接近3亿美元,三个月翻了三倍。收入结构也发生巨变,API业务占比已超70%,而以前主要靠C端订阅。外媒称K3发布后,ARR又实现数倍增长。
K3引发的震荡远不止于此。前美国AI事务负责人、现任总统科技顾问委员会联席主席大卫塞克斯发文称,这是中国模型首次在前端编程赛道拿下第一,照此以往美国将输掉AI竞赛。K3已成为硅谷新标的,马斯克表示xAI下周将发布超越Kimi的新模型。K3发布首日,英伟达市值蒸发约1111亿美元,费城半导体指数创15个月来最差单周表现,摩根大通称之为“DeepSeek 2.0”。加州大学伯克利分校教授、Databricks联合创始人伊翁斯托伊卡表示,开源模型与最先进模型的差距已从6-9个月缩短至2-3个月。
K3究竟从何而来?回溯两年前,2024年杨植麟分享了K0-Math模型,该模型具备验算和改错能力。当时杨植麟提出了“强化学习缩放定律”,与传统的“死记硬背”刷题库不同,RL Scaling让模型学会自我打分、改错并积累经验。K0-Math数学成绩超越了OpenAI当时的最强推理模型o1。今天的K3,正是两年前RL Scaling的大规模落地,引入了“视觉闭环”概念,将数学推理能力扩展到带视觉反馈的全场景。
技术报告展示了“视觉闭环”的效果。K3从零编写了一个3D开放世界游戏,利用Three.js、WebGPU在浏览器中运行,地形、光影、逻辑全由模型生成,甚至调用工具生成骑手模型。它还制作了发布预告片,从56段素材中剪辑、卡帧、对齐节拍,实现了帧级精准同步。K3参数量达2.8万亿,是全球最大开源模型。在KDA混合线性注意力机制和Attention Residuals技术下,其百万级长文本解码速度快6.3倍,训练效率提升25%。Artificial Analysis评测显示,K3综合得分57分,排名全球第三。成本仅0.94美元,比GPT-5.6 Sol便宜,是Claude Opus 4.8的一半。马斯克评价“Impressive”。
尽管在综合榜单上仅落后Fable 5 3分,但在具体任务上差距明显。在DeepSWE代码库基准测试中,GPT-5.6 Sol以73.0分领先,K3为67.5分。高难度视觉推理测试中,Fable 5以46.0分领先K3的41.0分。K3在部署层面存在缺陷:一是依赖完整的思考历史,会话切换或框架变更会导致输出质量下降;二是任务模糊时“过度主动”,可能引发工程错误。此外,幻觉率在上一代基础上反而上升,这是致命缺陷。Anthropic原本计划将Fable 5转为纯按量计费,但在K3发布后迅速改口,保留订阅方案并给予用户补偿,以应对竞争。
杨植麟为何离开美国?其导师、苹果前AI总监鲁斯兰发文庆祝,引发关于签证的猜测。鲁斯兰澄清称,苹果在北京有办公室,且杨植麟坚持回国创业。杨植麟的动机有三层:一是强烈的创业执念,博士二年级便创立循环智能,拒绝了谷歌、苹果、华为;二是想打破学术与工业界壁垒,将基础研究转化为产品;三是生态优势,核心团队(周昕宇等)都在中国,回国创业启动成本更低。
