7月27日晚,月之暗面如约将Kimi K3的完整模型权重上传至Hugging Face、GitHub和ModelScope。作为全球首个参数规模突破3万亿大关的开放权重模型,K3具备2.8万亿参数,用户可免费下载、本地部署并进行二次开发。

十天前,马斯克在K3的评测报道下留言“Impressive”,随即宣布xAI的2万亿参数新模型下周完成初训,声称可能超越Kimi。对此,Kimi官方仅回应一句:“欢迎马斯克加入2万亿俱乐部。”随后,月之暗面直接“拆了俱乐部的门”:你们还在比参数大小?不好意思,最大的那个,我白送。这显然不仅是情怀。

回顾月之暗面过去一个月的动向:6月中旬ARR(年度经常性收入)突破3亿美元,API收入占比超过七成;7月19日暂停C端新用户订阅;上一轮融资刚交割,新一轮投前估值已喊到315亿美元。心细的开发者发现,在Hugging Face上约1.56TB的模型文件旁,一份仅3.07KB的许可证,透露了更多商业信息。

根据Kimi K3的License,如果一家企业经营“模型即服务”业务,且企业及其关联方在任意连续12个月内的合计收入超过2000万美元,在将K3及其衍生模型用于商业目的前,必须与月之暗面另行签署协议。这份许可证将K3的话题从技术拉回了商业博弈。

一、 月之暗面不想给云厂商免费打工

开放模型一直存在一个尴尬:模型公司承担训练成本,云厂商却可能拿走后续收入。这也是百度李彦宏早些时候认为开源模型没有前景的原因。按照MIT许可证,云厂商可以下载模型、优化推理、包装成API,再利用已有客户、算力和销售渠道收费。模型公司获得下载量和声量,但客户关系、调用数据和账单却留在云平台。模型迭代越快,实验室越容易变成云厂商的上游研发部门。

K3的许可证中,“模型即服务”指的是允许第三方对输入、参数或训练数据进行实质性控制。把K3能力嵌进自家产品某个具体功能里,或者只是简单转发请求到别的平台,都不算在内。换句话说,月之暗面没打算拦研发者和大多数企业用户,它拦的是那些下载权重、封装成API,再用自己的品牌和定价对外销售推理服务的云厂商和推理平台。

海外已有分析人士将这道门槛与十年前的往事相提并论。MongoDB、Confluent当年也是先靠宽松许可证扩大规模采用。等到亚马逊等云厂商把它们的开源数据库直接包装成收费云服务,原开发商却拿不到分成,它们才被迫转向限制转售的SSPL、BSL许可证。先开放换规模,再规则拿回议价权。从超大规模云厂商,到Fireworks、Together这类专注模型托管的推理平台,理论上都被2000万美元的门槛纳入其中。K3面对的是与MongoDB、Confluent相似的商业挑战,但选择了更温和的法律路径:不直接禁止MaaS转售,而是要求达到收入门槛的经营者另行签约。

开放模型行业已经从“比谁先开源”“比谁开源得彻底”,走到了“比谁能从开放生态里拿回定价权”的阶段。同样是7月放出权重,智谱GLM-5.2和DeepSeek V4 Pro用的还是干净的MIT协议,不加任何转售门槛。当然,这也未必是因为它们更慷慨。至于月之暗面口中可以豁免这条门槛的“认证推理伙伴”,标准和名单目前谁都说不清楚,许可证原文也没有给出定义。

二、 从“卷参数”到“卷场景”

许可证只是K3的商业选择。回到模型本身,K3、DeepSeek、GLM和千问也已经走上了四条不同的路线。

K3走的是“大而全”。它拥有2.8万亿总参数、100万token上下文和原生视觉理解能力。官方演示中,K3从零编写了一套GPU编译器,还参与芯片设计、生成3D开放世界游戏。但输入每百万token 3美元,输出15美元,单任务平均成本约0.94美元,是四家中最贵的一个。

DeepSeek V4 Pro走的是相反路线。它的总参数达到1.6万亿,激活参数却压到约490亿。输入和输出价格分别为0.435美元和0.87美元,单任务成本约0.04美元。DeepSeek还引入了峰谷定价,错峰使用能节省一半。这与它一贯的打法一致:参数可以大,但激活规模和使用成本必须尽可能低。

智谱GLM-5.2选择了第三条路。它采用升级版DeepSeek Sparse Attention,把百万token上下文的推理开销压到通用硬件可以承受的范围。再配合约400亿的单token激活参数,首字延迟做到三家中最短。GLM-5.2的输入、输出价格分别为1.4美元和4.4美元,落在K3与DeepSeek之间,重点争夺编码和Agent场景里的响应速度。

阿里千问不追求单点极致,追的是覆盖面。上百种语言和更完整的多模态能力,使它更像一套面向企业客户的通用底座。不过Kimi也让阿里坐不住了,K3发布三天后,阿里预告Qwen3.8-Max,2.4万亿参数,明确说也要开放权重。过去一年,开源模型的规模天花板有9个月是Kimi顶上去的。现在,旗舰级开放权重正在变成中国大模型厂商的标配动作。

四条路线已经无法再用一个维度排座次。“卷参数”开始转向“卷场景”:长文本看K3,性价比看DeepSeek,响应速度看GLM,覆盖面看千问。差异化也不意味着谁能高枕无忧。DeepSeek、GLM和千问随时可能继续强化各自的长板,K3在价格上的劣势也不会自动消失。

三、 闭源模型的溢价被挤压

真正让这一轮开放模型显得扎眼的,是跑分与价格的综合对比。在第三方评测机构Artificial Analysis的智能指数榜单上,K3拿到约57分。排在它前面的是Claude Fable 5和GPT-5.6 Sol,分数分别约为60分和59分;Claude Opus 4.8则以约56分紧随其后。这是第一次有开放权重模型把成绩做到与顶级闭源模型相差两三分的位置。在Arena前端代码榜单上,K3上线24小时内冲到第一,超过Claude Fable 5,较上一代提升17个位次。

更关键的是,这些接近世界顶尖的成绩,对应的价格明显低于多数闭源旗舰。K3单任务平均成本约0.94美元,约为Claude Opus 4.8的一半。如果闭源模型的溢价建立在“只有我们能做到这个水平”之上,那么当一个开放权重模型把差距压缩到两三分,价格却只有其一半左右,这套溢价逻辑的解释空间就在迅速收窄。

微软CEO纳德拉管这叫“反向信息悖论”,买闭源模型其实付了两次钱,一次付账单,一次把喂给模型的业务know-how也送了出去。今年1月,纽约一家法院要求OpenAI交出2000万条脱敏用户对话,更是给所有企业提了个醒:数据在别人服务器上,就由不得你了。K3给的,正是那个“数据不出墙”的选项。

四、 权重只是开胃菜,真正的战场在推理层

开放权重这件事,在这个阵营里已经不算新闻。DeepSeek、GLM和千问的旗舰模型早已挂上Hugging Face,下载、商用和微调都不是问题。K3这次真正带来新鲜感的,反而是权重之外的部分。由于KDA改变了传统的前缀缓存机制,月之暗面把自己的缓存实现直接贡献给了vLLM项目。权重上线当天,vLLM和SGLang两大主流推理引擎同步提供部署方案。AMD团队完成了MI355X芯片的首日适配,云平台Modal上线了K3托管服务,Inferact则训练并开源了适配K3的DSpark投机解码器。

vLLM给出的最简部署配置,是8张英伟达B300或8张AMD MI355X。这两款都是尚未大规模铺货的顶级数据中心芯片,所需算力远非个人开发者能够触及。这意味着,月之暗面想要的不只是“模型更大”这个头条。它还想在推理框架和部署工具链中占据一个位置。权重谁都可以开放。但如果开发者使用的服务方案、缓存实现和投机解码器都围绕你的架构开发,更换模型的成本就不再只是“换一个文件”那么简单。

许可证中“通过认证推理伙伴使用可以豁免转售条款”的设计,又给了月之暗面一个开关:谁能进入这套生态,谁需要先坐下来谈判,可以由它筛选。放出权重是一次性动作,嵌入工具链才有可能真正留住开发者。这也是为什么,K3这次开放权重更适合被理解为一个开始,而不是终点。

但自定义规则同样有代价。大企业选择开放模型,看重的不只是能力和成本,还包括许可证是否简单、稳定。MIT和Apache 2.0之所以受欢迎,正是因为法务部门容易判断使用边界。K3增加了收入门槛、关联方口径、MaaS定义和认证伙伴等条件,企业部署前需要投入更多合规审查。如果GLM、DeepSeek或千问推出能力相近、许可证却更简单的替代品,平台完全可能绕开K3。开放模型原本就有较低的切换成本。一次发布带来的技术领先,很难长期支撑一套自定义规则。

据传,K3.1已经在路上,最快下个月就会发布,“开源—验证—迭代”这套打法,可能才刚刚开始被验证。

最新快讯

2026年07月28日

13:28
一个前沿模型,被要求随机生成一个奇数。结果,它输出了4。不是它不知道什么是奇数。真正原因是,那次任务的环境里,混进了一段看起来没清理干净的元数据,上面写着:评分器奖励偶数。模型在思维链里,把这事掂量了一遍:用户要奇数,打分的要偶数,然后它绕开用户,交出了4。这个案例的主角,是OpenAI一个还没出厂的模型,它当时只跑了能力向的强化学习,安全...
13:11
截至2026年7月27日收盘,中证2000ETF南方(159531)换手17.29%,成交2.19亿元,跟踪标的指数中证2000指数(932000.CSI) 涨3.52%。 市场自 7 月起已从 "预期博弈" 切换至 "业绩验证" 阶段,前期拥挤的大盘科技股剧烈回调,而中小盘的优势正在凸显:据 WIND 一致预期数据,中证 2000 指数未来两年净利润复合...
13:11
截至2026年7月27日收盘,新能源ETF南方(516160)换手6.44%,成交2.47亿元,跟踪标的指数中证新能源指数(399808.SZ) 涨2.69%。 国家发改委、国家能源局联合印发《可再生能源发展"十五五"规划》,明确提出到2030年可再生能源总装机规模达35亿千瓦,风电和太阳能总装机超28亿千瓦,发电量占比达30%。规划首次引入风电光伏置信出...
13:11
截至2026年7月27日收盘,红利低波50ETF南方(515450)换手0.84%,成交1.65亿元,跟踪标的指数标普中国A股大盘红利低波50指数(SPCLLHCP.SPI) 涨0.04%。 市场回暖,红利平稳。上周末特朗普再度释放地缘冲突缓和信号,此消息影响下资金风险偏好回暖,A股随海外股市同步上行。事实上,近期中东局势交织反复,美元及原油价格中枢再度抬...
13:11
南方基金刘文良认为,非科技板块,关注有色、非银和新能源方向机会。有色尤其是铜板块,外部约束未解、金融属性短期或有反复,但国内社库去化至年内低位,基本面扎实;新能源中的电池与储能企业,产业链地位与海外份额提升逻辑清晰。转债方面,重点关注新券上市初期定价分歧带来的交易机会;存量券看好正股具备业绩或事件催化、溢价率合理的平衡偏股品种,兼顾防御与弹性。
13:11
南方基金刘文良表示,权益市场磨底或已进入后期阶段,本轮主线板块自高点回撤已接近历次牛市单轮调整的经验极值,核心公司估值消化相对充分,政策呵护与增量资金预计形成共振。扰动项也在退坡,海外首份CSP大厂财报未证伪产业趋势,国内下周存储龙头挂牌落地,资金分流博弈预计收敛。预计科技仍是Q3行情的胜负手,预计资金有望在存储龙头带动下重新聚焦科技主线,近期产业积极信号也...
13:11
鼓狮财经7月28日电,俄罗斯莫斯科州州长沃罗比约夫今天(7月28日)通报称,过去一夜,数十架乌克兰无人机在该州多莫杰多沃市等4地上空被摧毁。契诃夫市一栋公寓楼被无人机击中,伤亡仍在核实。无人机坠落还造成几处房屋起火受损。莫斯科市长索比亚宁通报称,当地时间7月27日晚8点30分至今天清晨6点30分,超过390架乌克兰无人机飞向莫斯科地区,大部分在远端被压制,8...
13:10
鼓狮财经7月28日电,在今天(28日)举行的国家发展改革委专题新闻发布会上,国家发展改革委有关负责人表示,“十五五”时期,将推动中欧班列完善运输组织服务、拓展多元韧性通道,助力班列高质量发展。有关负责人表示,“十五五”时期,我国将持续优化中欧班列运输组织模式,提高通关便利化水平,增强全程时效稳定性。稳步扩大全程时刻表班列开行范围,强化多种运输方式高效衔接。高...
13:05
隔夜的美股市场一开盘,费城半导体指数便狂泄超过5%。龙头股英伟达同样大跌超过5%,一众先前火热的存储芯片股,跌幅更大。其中,SK海力士破发,闪迪大跌超过11%,美光虽然尾盘收回了,但开头也一度大跌超过7%。今天,这股跌势更像病毒一般传染到亚洲市场,韩股跌到熔断,日股、台股、A股、港股都出现类似的大跌。到底怎么一回事?原因很多,这里讲其中一个罪魁祸首--英伟达...
13:04
记者今天(7月28日)从雄安新区了解到,“人工智能大模型IPv6能力提升专项行动”由中央网信办联合北京、上海、浙江、深圳四地网信办,会同5家头部大模型企业在雄安新区共同启动,推动生成式大模型应用,全面支持IPv6,为智能时代筑牢网络根基。 当前,基于人工智能大模型的各类应用蓬勃发展,Token流量呈现爆发式增长趋势,对网络承载能力提出了新要求。IPv6凭借海...
13:04
过去两年,光是洛杉矶就蒸发了四万多个影视岗位。美国的报纸采编岗比2008年少了一半。这些消失的媒体人,有一批去了硅谷的大模型公司,用他们的写作经验教AI回答你的问题。每当你感到被大模型的回答击中内心的时候,写出来那句话的,就是之前的记者、编辑和纪录片导演。 本期《硅谷101》播客,我们来聊一聊这个鲜为人知的工种——Content En...
12:37
截至2026年7月27日收盘,自由现金流ETF南方(159232)换手8.06%,成交2.03亿元,跟踪标的指数中证全指自由现金流指数(932365.CSI) 涨0.90%。 7月27日,A股市场低开高走,上证指数上涨1.15%,深证成指上涨2.72%,创业板指上涨3.16%。盘面上,玻璃纤维、小微盘等方向表现活跃,油气、保险等板块相对偏弱。自由现金流ET...