智东西7月28日报道,月之暗面正式发布了Kimi K3模型权重与技术报告,并开源了支撑其训练的关键基础设施技术MoonEP、FlashKDA和AgentEnv。Hugging Face首席执行官Clem Delangue发文盛赞,称Kimi K3在30分钟内获得超过4000个点赞,登顶趋势榜,创造了迄今为止最快的发布增长速度。

此前7月17日发布的Kimi K3拥有2.8万亿参数,凭借出色的基准测试和实际体验,被不少网友誉为“中国的Fable 5时刻”。开源后,北美AI基础设施创企OsmanticAI创始人Ahmad将其称为“本地版Fable 5”,并强烈建议下载体验,称“这样他们永远也夺不走我的Fable 5了”。数字员工Devin的开发主体Cognition公司宣布,Kimi K3已接入其桌面客户端与命令行工具,并表示在FrontierCode 1.1评测基准上,Kimi K3是测试过的首款性能逼近前沿水准的开源模型。

Nebius、Baseten、Fireworks等海外AI基础设施厂商随即宣布Day 0适配Kimi K3。Nebius评价称,Kimi K3是首个达到前沿性能水平的开放权重模型,是开放模型发展历程的一大进步。华为昇腾CANN宣布对MXFP4量化实现Day 0原生支持,并提供在昇腾950PR/DT系列和Atlas A3系列集群的部署实践。趋境科技则宣布基于SGLang引擎完成了Kimi K3在华为昇腾910C超节点上的Day 0适配,并同步开源了相关成果。

网友在Kimi K3上线前的讨论十分热烈,甚至有网友戏称Hugging Face为其做了预热网页。截至上线半小时前,已有近3700名开发者在等待。上线10分钟前,Kimi K3的上线页面还曾短暂出现404错误。

模型权重地址:https://huggingface.co/moonshotai/Kimi-K3

**01 2.8万亿参数模型权重全面开放,三大关键Infra技术开源**

Kimi K3是一个拥有2.8万亿参数的混合专家模型,具备原生视觉理解能力,并支持100万token的上下文窗口。现在,任何人都可以下载并部署Kimi K3模型,无论是用于内部研发还是嵌入终端用户产品中,均可自由使用。

Kimi K3此次还同步开源了训练系统,即Infra基础设施层的三项技术:MoonEP、FlashKDA和AgentEnv。

三项开源技术中,MoonEP是为超大细粒度MoE设计的高性能通信库,确保专家并行通信在不均衡情况下仍保持极致效率。FlashKDA是Kimi Delta Attention的高性能算子,在英伟达H20上,其Prefill速度相比flash-linear-attention基线提升了1.72至2.22倍,可直接作为替换后端使用。AgentEnv是与KVCache.ai合作开发的沙箱系统,为大规模Agent训练提供高保真、强隔离的运行环境,支持快速快照、恢复和分叉,可应对大规模并行的Agent工作流。其中FlashKDA此前已开源,MoonEP和AgentEnv随本次发布正式开源。

在模型架构方面,KDA+AttnRes以3:1比例混合KDA与Gated MLA,通过块级注意力残差增强跨层信息流动,实现高效长上下文建模。Stable LatentMoE使每个token从896个路由专家中激活16个,通过SiTU-GLU与Quantile Balancing在极高稀疏度下保持训练稳定。MoonViT-V2视觉编码器从零开始使用next-token prediction训练,无需对比预训练,在达到基线效果的同时获得更稳定的优化过程。

在后训练方面,模型在通用推理、通用Agent和编程Agent三大领域进行大规模任务合成,配合百万token上下文的强化学习基建,并完成了近20个内部评测集的完整评估。

**02 多维评测,验证编程、Agent与视觉能力全面提升**

在官方公布的评测结果中,Kimi K3在编程、Agent任务和视觉理解等多个方向展现出较强能力。

在编程能力方面,Kimi K3在超长时序持续开发SWE Marathon、软件逆向Program Bench、终端运维Terminal Bench 2.1等测试中表现突出。其中SWE Marathon和Program Bench均取得第一,Terminal Bench 2.1达到88.3分,与GPT-5.6 Sol接近;在高难度软件工程任务FrontierSWE中,Kimi K3以81.2分位列第二,仅次于Claude Fable 5。

在Agent和知识工作场景中,Kimi K3同样展现出较强的任务执行能力。在网页深度调研BrowseComp、办公自动化Automation Bench、Excel财务建模SpreadsheetBench 2等测试中取得领先,其中BrowseComp达到91.2分,Automation Bench和SpreadsheetBench 2均排名第一。不过,在综合白领任务GDPval-AA v2、APEX-Agents等更贴近真实办公流程的评测中,Kimi K3仍弱于Claude Fable 5等顶级闭源模型。

在视觉能力方面,Kimi K3在图表理解CharXiv、文档分析OmniDocBench等任务中表现较强,其中OmniDocBench达到91.1分,超过参与对比的多款模型;但在部分视觉推理任务中,Kimi K3仍存在差距,例如零样本视觉工具任务Zerobench低于Claude Fable 5。

Kimi内部也测试了Kimi K3的工程能力。在GPU内核优化测试中,Kimi K3需自主完成代码分析、内核重写和性能验证,覆盖AttnRes、KDA、MLA等GPU计算任务。结果显示,在最高推理强度下,Kimi K3表现接近Claude Fable 5(含回退机制),并超过Claude Opus 4.8、GPT-5.6 Sol和GPT-5.5。

在知识工作方面,Kimi内部Internal Knowledge Work Bench测试显示,在统一开启最高深度思考模式后,Kimi K3在通用推理、深度文档分析和金融专项三类任务中的表现均超过GPT-5.5和Claude Opus 4.8。

**03 Kimi K3挑战复杂任务:生成游戏、设计芯片、分析科研数据**

Kimi K3发布后,智东西在Kimi K3 Max模式下实测了该模型的多模态与代码生成能力。在要求生成3D横版格斗游戏的测试中,提示词涉及“被霸天虎入侵的破败城市地图”、“低多边形风格”、“5种擎天柱阵营角色”、“5种霸天虎变种敌人”等复杂设定。Kimi K3仅用一次就完成了游戏创建,没有出现错误。

海外开发者@He1s_Sammy在游戏设计场景下对比测试Kimi K3、GPT-5.6 Sol、Fable 5三款模型,向三者输入完全相同的提示词,围绕方案质量、游玩体验、调用成本综合评估。测试结果显示,Kimi K3的游戏设计表现最优,能够抓住玩法核心,产出内容节奏自然;而Fable 5与GPT-5.6 Sol生成的游戏节奏普遍过快。

在价格方面,Kimi K3评分为9.5/10,调用成本为0.030美元(约合人民币0.2元);Fable 5评分为7.5/10,调用成本为0.38美元(约合人民币2.57元);GPT-5.6 Sol评分为7/10,调用成本为0.11美元(约合人民币0.74元)。

在官方展示的案例中,Kimi K3展现了更长程的任务执行能力。在芯片设计方面,K3基于开源EDA工具和Nangate 45nm工艺库,在48小时连续自主运行中独立完成了芯片的构建、优化与验证。在科研领域,K3一次分析了391个GWTC-5引力波事件,调用20多个并发子智能体,产出7张科学可视化图、2张表格,并综合了10多篇论文的文献内容。在GPU编程领域,它从零开发了类似Triton的编译器MiniTriton,将开发者编写的程序转换为GPU可执行的代码,部分场景性能甚至超过现有工具。

**结语:中国开源模型,正在进入全球开发者的工具箱**

对于Kimi K3,海外开发者的反应和半年前已经不太一样了。半年前,DeepSeek-V3开源时,海外社区的讨论更多是“又一个中国模型”。而到了Kimi K3,话题变成了“它比Claude Opus强”、“开发者正在把Fable换成K3”。

影响力变大,也意味着被盯上的风险在变大。就在Kimi K3开源引发热议的同时,美国参议员蒂姆·斯科特和比尔·哈格蒂已提案扩大商务部权限以限制外国对手接触AI技术。美国商务部去年曾考虑将月之暗面、DeepSeek、阿里Qwen团队等中国AI实验室列入实体清单。白宫还曾考虑通过行政令,要求使用中国模型的美国企业对安全事件承担责任。OpenAI、Anthropic等美国闭源AI企业曾提案禁用中国开源模型。

商务部回应称,这是“典型的人工智能霸权主义行径”,并指出近200家美国初创企业敦促政府不要切断对中国开源模型的访问,认为这将削弱美国企业竞争力。

当美国企业自己都在用中国的开源模型,制裁的合理性自然站不住脚。AI能力正在从少数公司的技术优势,变成全球开发者可以调用的基础工具——这个趋势不会因为一纸制裁令而改变。

最新快讯

2026年07月28日

12:37
截至2026年7月27日收盘,自由现金流ETF南方(159232)换手8.06%,成交2.03亿元,跟踪标的指数中证全指自由现金流指数(932365.CSI) 涨0.90%。 7月27日,A股市场低开高走,上证指数上涨1.15%,深证成指上涨2.72%,创业板指上涨3.16%。盘面上,玻璃纤维、小微盘等方向表现活跃,油气、保险等板块相对偏弱。自由现金流ET...
12:37
鼓狮财经7月28日电,宇瞳光学在互动平台表示,目前康宁GlassBridge玻璃桥处于提供样品,进行工程验证和可靠性测试阶段,行业预测离大规模量产交付时间最快不低于一年,未对当前FAU方案市场造成影响。公司MT插芯产品尚处于送样阶段,验证周期较长。
12:37
鼓狮财经7月28日电,2026年亚太经合组织(APEC)林业部长级会议今天上午在深圳正式开幕。这是亚太经合组织时隔15年再次在中国举办生态领域专业会议。会议期间,来自APEC21个经济体及有关国际组织的高级别代表、专家学者,分享森林资源保护、可持续利用、生态产品价值实现、科技赋能等方面的政策机制、实践经验,共同探讨加强区域林业合作的新路径、新举措。此次会议的...
12:37
鼓狮财经7月28日电,今天上午国务院新闻办举行新闻发布会。发布会上,国家税务总局相关负责人介绍,今年以来,税务部门持续提升办税缴费便利度,百姓办理效率更高,办理离境退税的境外旅客数量大幅增长。据介绍,目前电子税务局已全面普及,日常申报、发票开具、社保费退费、个人社保费缴费记录查询等绝大多数高频税费业务,都实现了“网上办”“掌上办”。智能办税事项覆盖面已提升至...
12:37
鼓狮财经7月28日电,兴业银锡公告,7月26日15时30分许,全资子公司银漫矿业矿山井下三区750分层西主运19-1至25-1之间,生产施工过程中,发生一起事故,造成1人死亡,无人受伤。事故发生后,公司按照有关规定及时向当地应急管理部门报告,事故原因及故者死亡原因尚在调查确认中,公司将全力配合做好事故调查及后续工作。目前,银漫矿业采区已停产,银漫矿业选厂处于...
12:34
人工智能基础设施建设引发的融资热潮,正受到债券市场更严格的审视。伦敦证券交易所集团数据显示,甲骨文 、SpaceX、Alphabet、 亚马逊 、Meta、 博通和英伟达相关信用违约掉期(CDS)近期均升至各自纪录高位,显示投资者开始要求更高的风险补偿 。信用违约掉期又称CDS,相当于为企业债务购买保险。利差越高,通常意味着市场认为持有相关债券的风险越大。甲...
12:34
受芯片股抛售潮加剧影响,亚洲股市大幅下挫,区域基准指数正迈向技术性回调。MSCI亚太指数一度跌3.5%,较6月22日的高点累计跌幅已超过10%。韩国三星电子和SK海力士股价大跌,拖累韩国KOSPI指数盘中跌幅超过10%。由于市场担忧芯片股持仓过于拥挤,周二,全球半导体板块遭遇抛售,投资者对AI驱动的行情能否持续持怀疑态度。英伟达正推进总值超过7500亿美元的...
12:34
7月28日亚太股市迎来半导体重磅杀跌,行情极度惨烈。韩国综合指数KOSPI盘中暴跌近9.6%,触发交易所熔断机制,市场暂停交易20分钟,韩国两大存储龙头——SK海力士、三星电子,前者盘中暴跌超11%,后者大跌超9%。更惨的是2倍做多SK海力士、三星电子的相关ETF,早盘在港股上市的2倍做多SK海力士ETF一度跌超26%。本轮调整力度十分惊人,短短一两个月,S...
12:33
鼓狮财经7月28日讯随着人工智能持续推动内存需求,全球主要内存制造商的盈利状况正受到业界广泛关注。而本周,日韩三大内存制造商——SK海力士、三星电子和日本铠侠——即将陆续公布最新季度财报。 对于全球投资者来说,这些财报不仅将反映这三家公司自身的盈利能力,还将为全球AI基础设施投资的未来走向以及内存和存储供需格局提供重要参考。 更重要的是,全球存储股近期都遭遇...
12:33
AI与电池结合,能激发怎样的新机遇?原本需要两名工程师耗时三个月的项目,如今借助智能体技术,只需两三天即可完成。近期,一位1999年出生的清华博士创业者,正致力于这一领域。她就是周期智能的创始人卢宇芳,致力于为电池植入“AI大脑”,利用人工智能优化电池从研发、应用到衰减回收的全生命周期。 卢宇芳认为,真正的机遇并非再造一块电池,而是重构电池行业的服务模式:未...
11:49
据鼓狮财经7月28日报道,国内商品期货开盘呈现普跌态势。能源板块领跌,原油跌幅接近5%,燃料油下挫逾4%。化工及黑色系商品亦表现疲软,液化气、纯苯、纯碱、焦煤、苯乙烯跌幅均超2%,玻璃、沪银、菜粕跌逾1%。相比之下,集运欧线和鸡蛋逆势上涨,涨幅均超过1%。
11:49
鼓狮财经7月28日讯,国内期货主力合约今日多数收跌。其中,燃料油暴跌逾6%,SC原油跌幅超5%,合成橡胶、液化石油气(LPG)及纯苯均跌超3%。低硫燃料油(LU)、菜粕、沪银逼近3%。涨幅方面,鸡蛋上涨超1%,红枣与沪铅则小幅收涨。