智东西7月28日报道,月之暗面正式发布了Kimi K3模型权重与技术报告,并开源了支撑其训练的关键基础设施技术MoonEP、FlashKDA和AgentEnv。Hugging Face首席执行官Clem Delangue发文盛赞,称Kimi K3在30分钟内获得超过4000个点赞,登顶趋势榜,创造了迄今为止最快的发布增长速度。

此前7月17日发布的Kimi K3拥有2.8万亿参数,凭借出色的基准测试和实际体验,被不少网友誉为“中国的Fable 5时刻”。开源后,北美AI基础设施创企OsmanticAI创始人Ahmad将其称为“本地版Fable 5”,并强烈建议下载体验,称“这样他们永远也夺不走我的Fable 5了”。数字员工Devin的开发主体Cognition公司宣布,Kimi K3已接入其桌面客户端与命令行工具,并表示在FrontierCode 1.1评测基准上,Kimi K3是测试过的首款性能逼近前沿水准的开源模型。

Nebius、Baseten、Fireworks等海外AI基础设施厂商随即宣布Day 0适配Kimi K3。Nebius评价称,Kimi K3是首个达到前沿性能水平的开放权重模型,是开放模型发展历程的一大进步。华为昇腾CANN宣布对MXFP4量化实现Day 0原生支持,并提供在昇腾950PR/DT系列和Atlas A3系列集群的部署实践。趋境科技则宣布基于SGLang引擎完成了Kimi K3在华为昇腾910C超节点上的Day 0适配,并同步开源了相关成果。

网友在Kimi K3上线前的讨论十分热烈,甚至有网友戏称Hugging Face为其做了预热网页。截至上线半小时前,已有近3700名开发者在等待。上线10分钟前,Kimi K3的上线页面还曾短暂出现404错误。

模型权重地址:https://huggingface.co/moonshotai/Kimi-K3

**01 2.8万亿参数模型权重全面开放,三大关键Infra技术开源**

Kimi K3是一个拥有2.8万亿参数的混合专家模型,具备原生视觉理解能力,并支持100万token的上下文窗口。现在,任何人都可以下载并部署Kimi K3模型,无论是用于内部研发还是嵌入终端用户产品中,均可自由使用。

Kimi K3此次还同步开源了训练系统,即Infra基础设施层的三项技术:MoonEP、FlashKDA和AgentEnv。

三项开源技术中,MoonEP是为超大细粒度MoE设计的高性能通信库,确保专家并行通信在不均衡情况下仍保持极致效率。FlashKDA是Kimi Delta Attention的高性能算子,在英伟达H20上,其Prefill速度相比flash-linear-attention基线提升了1.72至2.22倍,可直接作为替换后端使用。AgentEnv是与KVCache.ai合作开发的沙箱系统,为大规模Agent训练提供高保真、强隔离的运行环境,支持快速快照、恢复和分叉,可应对大规模并行的Agent工作流。其中FlashKDA此前已开源,MoonEP和AgentEnv随本次发布正式开源。

在模型架构方面,KDA+AttnRes以3:1比例混合KDA与Gated MLA,通过块级注意力残差增强跨层信息流动,实现高效长上下文建模。Stable LatentMoE使每个token从896个路由专家中激活16个,通过SiTU-GLU与Quantile Balancing在极高稀疏度下保持训练稳定。MoonViT-V2视觉编码器从零开始使用next-token prediction训练,无需对比预训练,在达到基线效果的同时获得更稳定的优化过程。

在后训练方面,模型在通用推理、通用Agent和编程Agent三大领域进行大规模任务合成,配合百万token上下文的强化学习基建,并完成了近20个内部评测集的完整评估。

**02 多维评测,验证编程、Agent与视觉能力全面提升**

在官方公布的评测结果中,Kimi K3在编程、Agent任务和视觉理解等多个方向展现出较强能力。

在编程能力方面,Kimi K3在超长时序持续开发SWE Marathon、软件逆向Program Bench、终端运维Terminal Bench 2.1等测试中表现突出。其中SWE Marathon和Program Bench均取得第一,Terminal Bench 2.1达到88.3分,与GPT-5.6 Sol接近;在高难度软件工程任务FrontierSWE中,Kimi K3以81.2分位列第二,仅次于Claude Fable 5。

在Agent和知识工作场景中,Kimi K3同样展现出较强的任务执行能力。在网页深度调研BrowseComp、办公自动化Automation Bench、Excel财务建模SpreadsheetBench 2等测试中取得领先,其中BrowseComp达到91.2分,Automation Bench和SpreadsheetBench 2均排名第一。不过,在综合白领任务GDPval-AA v2、APEX-Agents等更贴近真实办公流程的评测中,Kimi K3仍弱于Claude Fable 5等顶级闭源模型。

在视觉能力方面,Kimi K3在图表理解CharXiv、文档分析OmniDocBench等任务中表现较强,其中OmniDocBench达到91.1分,超过参与对比的多款模型;但在部分视觉推理任务中,Kimi K3仍存在差距,例如零样本视觉工具任务Zerobench低于Claude Fable 5。

Kimi内部也测试了Kimi K3的工程能力。在GPU内核优化测试中,Kimi K3需自主完成代码分析、内核重写和性能验证,覆盖AttnRes、KDA、MLA等GPU计算任务。结果显示,在最高推理强度下,Kimi K3表现接近Claude Fable 5(含回退机制),并超过Claude Opus 4.8、GPT-5.6 Sol和GPT-5.5。

在知识工作方面,Kimi内部Internal Knowledge Work Bench测试显示,在统一开启最高深度思考模式后,Kimi K3在通用推理、深度文档分析和金融专项三类任务中的表现均超过GPT-5.5和Claude Opus 4.8。

**03 Kimi K3挑战复杂任务:生成游戏、设计芯片、分析科研数据**

Kimi K3发布后,智东西在Kimi K3 Max模式下实测了该模型的多模态与代码生成能力。在要求生成3D横版格斗游戏的测试中,提示词涉及“被霸天虎入侵的破败城市地图”、“低多边形风格”、“5种擎天柱阵营角色”、“5种霸天虎变种敌人”等复杂设定。Kimi K3仅用一次就完成了游戏创建,没有出现错误。

海外开发者@He1s_Sammy在游戏设计场景下对比测试Kimi K3、GPT-5.6 Sol、Fable 5三款模型,向三者输入完全相同的提示词,围绕方案质量、游玩体验、调用成本综合评估。测试结果显示,Kimi K3的游戏设计表现最优,能够抓住玩法核心,产出内容节奏自然;而Fable 5与GPT-5.6 Sol生成的游戏节奏普遍过快。

在价格方面,Kimi K3评分为9.5/10,调用成本为0.030美元(约合人民币0.2元);Fable 5评分为7.5/10,调用成本为0.38美元(约合人民币2.57元);GPT-5.6 Sol评分为7/10,调用成本为0.11美元(约合人民币0.74元)。

在官方展示的案例中,Kimi K3展现了更长程的任务执行能力。在芯片设计方面,K3基于开源EDA工具和Nangate 45nm工艺库,在48小时连续自主运行中独立完成了芯片的构建、优化与验证。在科研领域,K3一次分析了391个GWTC-5引力波事件,调用20多个并发子智能体,产出7张科学可视化图、2张表格,并综合了10多篇论文的文献内容。在GPU编程领域,它从零开发了类似Triton的编译器MiniTriton,将开发者编写的程序转换为GPU可执行的代码,部分场景性能甚至超过现有工具。

**结语:中国开源模型,正在进入全球开发者的工具箱**

对于Kimi K3,海外开发者的反应和半年前已经不太一样了。半年前,DeepSeek-V3开源时,海外社区的讨论更多是“又一个中国模型”。而到了Kimi K3,话题变成了“它比Claude Opus强”、“开发者正在把Fable换成K3”。

影响力变大,也意味着被盯上的风险在变大。就在Kimi K3开源引发热议的同时,美国参议员蒂姆·斯科特和比尔·哈格蒂已提案扩大商务部权限以限制外国对手接触AI技术。美国商务部去年曾考虑将月之暗面、DeepSeek、阿里Qwen团队等中国AI实验室列入实体清单。白宫还曾考虑通过行政令,要求使用中国模型的美国企业对安全事件承担责任。OpenAI、Anthropic等美国闭源AI企业曾提案禁用中国开源模型。

商务部回应称,这是“典型的人工智能霸权主义行径”,并指出近200家美国初创企业敦促政府不要切断对中国开源模型的访问,认为这将削弱美国企业竞争力。

当美国企业自己都在用中国的开源模型,制裁的合理性自然站不住脚。AI能力正在从少数公司的技术优势,变成全球开发者可以调用的基础工具——这个趋势不会因为一纸制裁令而改变。

最新快讯

2026年07月28日

11:49
鼓狮财经7月28日电,国内商品期货开盘多数下跌,原油跌近5%,燃料油跌超4%,液化气、纯苯、纯碱、焦煤、苯乙烯跌超2%,玻璃、沪银、菜粕跌超1%。涨幅方面,集运欧线、鸡蛋涨超1%。
11:49
鼓狮财经7月28日电,国内期货主力合约多数下跌,燃料油跌超6%,SC原油跌超5%,合成橡胶、液化石油气(LPG)、纯苯跌超3%,低硫燃料油(LU)、菜粕、沪银跌近3%。涨幅方面,鸡蛋涨超1%,红枣、沪铅小幅上涨。
11:49
7月27日港股收盘后,老铺黄金发布了一份堪称亮眼的上半年正面盈利预告——经调整净利润预计同比增长83%至85%。按照常理,如此强劲的增长理应提振股价。然而今日开盘,市场给出的答案却截然相反。7月28日,老铺黄金低开近13%,盘中跌幅一度扩大至超20%,截至发稿报316港元。对比2025年7月盘中创下的历史峰值1083.8港元,股价已跌至320港元附近,较高点...
11:49
鼓狮财经7月28日讯近期,韩国综合股价指数(Kospi)与纳斯达克100指数的相关性指数创下2021年以来新高。在AI硬件需求拉动下,美、韩两地科技股行情呈现前所未有的高度共振。 0.5的共振信号 全球量化资管机构Rayliant Global Advisors发布的最新数据显示,近期,Kospi指数与纳斯达克100指数的60个交易日滚动相关系数攀升至约0....
11:49
鼓狮财经7月28日讯据报道,韩国最高金融监管机构周二表示,如有必要,当局将考虑进一步限制散户投资单一股票杠杆型交易所交易基金(ETF)。 韩国金融服务委员会主席Lee Eog-weon在首尔与本土券商及资产管理公司举行会谈时表示,他将评估一项新政策的影响。该政策规定,从本周五起,投资个股杠杆ETF 所需的最低现金存款将提高至3000万韩元(约合20400美元...
11:46
鼓狮财经7月28日讯大空头史蒂夫•艾斯曼(Steve Eisman)最新警告说,如果任何一家超大规模科技巨头削减其人工智能(AI)资本支出,美国股市将“直线下跌”。 他在接受最新采访时指出,当前的市场已经变成了一个完全依赖于人工智能成败的单一交易环境。他进一步警告称,市场对人工智能的看法与一年前相比发生了巨大变化,当时投资者对每一项资本支出增加都热情欢呼。 ...
11:46
7月27日晚,月之暗面如约把Kimi K3的完整模型权重挂上了Hugging Face、GitHub和ModelScope。2.8 万亿参数,全球第一个摸到3万亿门槛的开放权重模型,任何人都可以免费下载、本地部署、二次开发。 十天前,马斯克刚在K3的评测报道下留了句“Impressive”,转头就在社交平台上宣布:xAI的2万亿参数新模型下...
11:46
7月27日,千问办公官网上线,Windows、macOS Beta版和鸿蒙电脑尝鲜版同步开放下载。网页端和钉钉内置版还要再等一段时间。 这是陈宇森6月11日接任钉钉CEO后,公开交付的第一款产品。前后46天。 官网信息显示,千问办公个人版分为免费、98元和198元三档,连续包月价格为78元和158元。企业标准版198元/月/席,旗舰版单...
11:46
7月24日,黄仁勋发布了自己的第一条X帖子。 他转发的是一封题为《开放权重与美国AI领导力》的公开信。联署名单最初只有英伟达、微软、Meta、IBM等25家公司和机构,随后迅速扩展至约50家,OpenAI、谷歌、AMD、思科、Cloudflare和GitHub等先后加入。在美国主要前沿模型公司中,Anthropic成为唯一仍未签署的企业。 ...
11:46
AI到底有没有开始抢饭碗? 斯坦福大学教授Neale Mahoney认为,从整体就业数据来看,答案可能是暂时还没有; 但对刚走出校门的应届生来说,他们可能已经提前体验到了。 2026年初,美国应届毕业生失业率达到5.6%,比三年前上升1.6个百分点。 在软件开发、客户服务等容易受到AI影响的职业中,年轻员工的就业人数明显下...
11:46
AI造出了一把自然界从未存在的基因剪刀。 而且,比几十亿年进化打磨出来的那把还好使。 7月16日,Nature刊出消息:科学家用AI造出了自然界里从来没有过的CRISPR酶,切基因比「天然版本」更利索。论文同日发表在Science。 带队的人,是2020年因为CRISPR拿下诺贝尔化学奖的Jennifer Doudna。 ...
11:32
Claude Design 竟然是一个被“卷”出来的副项目。它的背后,是两个工程师和一个设计师之间的故事。故事始于 2025 年 11 月 Opus 4.5 的发布。彼时,Anthropic 产品设计师 Nate Parrott 正负责 Claude Code 的 VS Code 项目,身边围绕着两名工程师。他们的共同目标是将只能敲命令的终端工具,转化为普通...