一个月前,月之暗面同时接触微软、亚马逊和谷歌,希望让K3进入Azure、AWS和Google Cloud,并从相关服务产生的收入中分走一部分。最高30%的分成比例被摆上了谈判桌,但当时谁都不知道这笔账最后能不能谈成。如今,第一个答案浮出水面:Kimi真的把收费站修进了AWS。

美国时间9月18日,AWS正式宣布Kimi K3上线Amazon Bedrock。全球企业开发者可以直接在AWS里调用这款模型,按Token付费。而且月之暗面并不是唯一一个开始向海外云平台收钱的中国模型厂商,9月16日,智谱也在电话交流会上披露,与多家国内外头部云服务商签署了收入分成协议。中国模型,开始一起算海外这笔账了。

实际上,K3此前已经可以通过Microsoft Foundry调用,但微软走的是第三方路径:底层推理由Fireworks AI提供,Foundry主要负责模型接入、部署和企业治理。用户虽然是在微软的平台里调用K3,但推理服务背后还隔着Fireworks。AWS这次不一样,它自己就是K3的托管和推理服务提供方。K3现在是Amazon Bedrock里的正式托管模型,AWS自己负责承接调用和计费。

AWS给K3的标价为:全球标准档输入3美元/百万Token,输出15美元/百万Token,和月之暗面官方API价格完全一致;美国区域则分别为3.3美元和16.5美元。一个月前,这件事还只停留在谈判桌上。8月26日,路透社援引三名知情人士报道,月之暗面正在同时和微软、亚马逊、谷歌谈判,希望让K3进入Azure、AWS和Google Cloud,并从三大云上K3相关服务产生的收入中拿到最高30%。但“30%”当时只是月之暗面的谈判条件,谈判仍处于早期阶段。月之暗面和三大云厂商还没有解决具体怎么分钱、数据能开放到什么程度,以及如何审计K3实际消耗的Token。

现在,三大云里,AWS率先把K3摆上了货架。尽管双方协议未公开,具体分成比例乃至授权方式目前都无法确认,但有一件事是可以确定的:AWS和月之暗面至少已经谈成了一套单独的商业条款。K3在自己的许可证里写得很清楚:月之暗面允许普通开发者下载、部署和商业使用K3,但如果一家企业及其关联方经营MaaS业务,连续12个月总收入超过2000万美元,那么在把K3用于商业用途前,必须先和月之暗面另行达成协议。

AWS显然远超“连续12个月总收入超过2000万美元”这个门槛,且Bedrock做的正是典型的MaaS——AWS负责托管模型,企业通过API调用,再按照Token付费。顺便一提,K3目前也已经进入阿里云百炼。百炼目前同时提供两种K3服务:一种由月之暗面直供,另一种则由阿里云自己部署和提供推理。后者和AWS的逻辑类似,阿里云作为MaaS平台商业化提供K3,同样需要遵守K3许可证里的单独授权要求。也就是说,AWS并非唯一一个已经和月之暗面把这笔商业账谈下来的云厂商。接下来,就看微软和谷歌会不会也跟上了。

Bedrock并不缺开放权重模型。今年2月,AWS一次性把DeepSeek V3.2、MiniMax M2.1、GLM 4.7、GLM 4.7 Flash、Kimi K2.5和Qwen3 Coder Next六款模型接进Bedrock;AWS自己也说,从2025年以来,Bedrock已经加入数十款来自DeepSeek、MiniMax、Qwen、Mistral、NVIDIA等厂商的开放权重模型。AWS愿意单独和月之暗面谈K3,首先还是因为K3本身有足够强的使用价值。K3有100万Token上下文、原生视觉能力,AWS把它明确定位在长时间Coding、知识工作和Agent任务上。它还是Bedrock第一款支持显式Prompt Caching的开放权重模型,开发者可以主动控制哪些Prompt内容被缓存,长任务里反复使用相同代码库、工具说明或参考文档时,有助于降低输入成本和延迟。

而且——我们在前一篇文章里也提到——K3恰好很适合放在云上卖。企业想用K3,大致有三条路:自己部署、直接买Kimi官方API,或者通过云平台调用。自己部署,K3有2.8万亿总参数,官方建议最好使用64个或更多加速器组成的超节点;直接买官方API,国内企业要走认证、充值和配额体系,海外用户还要面对独立账户体系、网络稳定性和销售沟通。AWS抢的就是第三条路:把这些接入、采购和运维成本都包进企业本来就在用的云平台里。

许可证只能保留谈判权,不能制造谈判筹码。云厂商愿不愿意接受额外授权,只取决于一个非常简单的逻辑:这个模型有没有足够多的需求。只要不上K3会让用户和Token流向别的平台,AWS就有理由和月之暗面谈这笔生意。K3现在至少证明了开放权重和商业收费并不冲突。只要模型本身足够有吸引力,原厂依然可以保留收费权。

过去一年,中国模型已经越来越多地出现在海外开发者平台、企业云和API市场里。路透社9月16日的数据显示,截至9月14日,DeepSeek、智谱、腾讯和阿里在OpenRouter上的合计市场份额已经达到45%;MiniMax大约60%的销售额来自海外。中国模型靠低价、开放权重和越来越接近美国头部模型的能力,已经拿走了一块真实的海外需求。这种压力甚至已经传到了最头部的美国模型公司。9月19日,路透社在报道Anthropic考虑提前推出新模型时直接指出,除了OpenAI刚刚发布的GPT-6 Astra,低成本、部署灵活的开放权重模型,也正在成为Anthropic和OpenAI越来越重要的竞争对手。

换句话说,中国模型走到今天,已经不是“美国开发者愿不愿意试一试”的问题了。模型有人用,海外有收入,连Anthropic都开始把中国的开放模型当成必须面对的竞争对手。下一步自然就是:这些需求产生的钱,要能更多地回到训练模型的人手里。过去,海外云平台拿到中国开放模型,可以自己托管、卖API、收Token费。模型越火,平台的生意越好,但原厂未必能从这部分收入里持续分钱。Kimi正在改变这件事。它继续开放权重,却在许可证里给大型MaaS平台留了一道收费口。现在AWS接受了这道门槛,月之暗面也迈出了真正意义上的第一步。中国模型不只要去海外抢用户,也开始从海外云平台手里赚钱。

有意思的是,K3在AWS美国区域的价格还比全球标准档高10%。美国企业想在AWS自己的地盘上调用Kimi,甚至还得多付一点钱。而这件事已经开始在中国模型厂商中扩散。9月16日,智谱在面向分析师和投资人的电话会上披露,公司已经与多家国内外头部云服务商签署收入分成协议。GLM系列开放权重模型将以托管API形式进入海外云平台,双方按照约定比例分钱,相关收入从10月开始确认。这部分增量甚至已经被写进了增长预期:智谱把年末ARR指引从24亿美元上调到30亿美元,目前全业务口径ARR约18亿美元。阿里也已经被路透社曝出,准备在下一代Qwen3.8-Max上采用类似机制:模型继续开放权重,但大型商业用户围绕它赚钱,也要和阿里分一杯羹。

Kimi已经收到了钱,智谱已经签了协议,Qwen也在准备。下一版DeepSeek、MiniMax以及更多中国开放权重模型,如果也开始重新设计自己的商业许可,与大型云服务商谈收入分成,我一点都不会意外。毕竟,既然海外云厂商已经可以靠中国模型卖Token,中国模型公司没有理由继续把这笔钱全部留在别人的账上。

最新快讯

2026年09月23日

12:31
鼓狮财经9月23日电,青岛市近日正式印发《关于推动知识产权质押融资提质扩面的实施方案(2026—2028年)》,并同步配套发布《青岛市“青知贷”产品指引》与《知识产权质押融资内部估值体系实施指引》。此举旨在聚焦“降本、提质、扩面、增效”核心目标,全力营造全链条服务生态。 该方案构建了严谨的制度框架,涵盖总体要求、工作举措和保障机制三大板块。通过确立“1+2”...
12:31
鼓狮财经9月23日讯,新获批的摊余成本债基近期募集表现火爆,多只产品在短短数日内便提前结束募集。 贝莱德基金今日发布公告,将旗下“贝莱德稳利63个月封闭式债基”的募集截止日由原定的10月20日提前至9月22日,募集期大幅缩短至2天。 红土创新基金也发布通知,将募集截止时间提前至9月23日,募集期压缩至3天。其中,代销机构的募集截止时间已提前至9月22日,仅剩...
12:31
鼓狮财经9月23日讯,美东时间9月23日至24日,年度科技盛会Meta Connect 2026正式启幕。作为Meta集中展示次年重磅硬件产品、人工智能技术及元宇宙生态布局的核心舞台,Meta Connect与谷歌开发者大会、苹果秋季发布会等齐名。本次大会核心主题演讲定于首日登场,具体时间为太平洋时间9月23日16:00(美东时间19:00,北京时间9月24...
12:31
周三,港股与A股地产板块早盘集体发力,但随后冲高回落。A股方面,世联行录得6天5板,万科A斩获4天3板,我爱我家与华远控股亦实现3连板。港股内房股表现同样亮眼,截至发稿,融信中国暴涨近27%,万科企业涨幅超5%,碧桂园及旭辉控股集团涨逾3%。 多重利好提振地产行情,核心在于政策端的强力催化。近期官方多次对房地产市场定调。8月28日,住建部、自然资源部、央行、...
12:00
Jev迅速走红。AI圈每隔一段时间便会涌现出新的热点,这是继Token、龙虾、世界模型之后,最近半个月与RSI(递归自动改进)并列的时新名词。中文互联网很快将Jev概括成了“只会做选择的新模型”。Jev不聊天,也不写文章。开发者给它材料,再列出问题和候选答案,它只负责做判断:选哪个、打多少分,以及判断把握有多大。比如收到一封客服邮件,它可以判断应该分给退款组...
12:00
最近,一款不聊天、不写代码的AI模型刷屏了。这款名为Jev的模型,由前OpenAI研究员Diogo Almeida等人联合创立的TypeSafe AI于9月15日发布,并被冠以“System One Models”这一新品类。9月21日全面开放后,迅速吸引了大量开发者。Jev的核心能力在于“判断”,它能接管软件中大量的分类、评分和动作选择工作,而非像通用大模...
12:00
今夜,Anthropic毫无预热,直接发布了Claude Opus 5.5。作为Claude 5.5系列的首款模型,它在性能上追平了Fable 5.1,但成本却比上一代Opus 5降低了40%,输出速度更是提升了30%。这一次,Anthropic直接打破了“性能强=成本高”的刻板印象,让每个人都能以更低的成本获得Fable 5.1级别的能力。用三个字概括:更...
12:00
战况好激烈的一晚!就在刚刚,GPT-6 Sol和Luna也发布了!而就在几小时前,Opus 5.5前脚才刚发。这次,GPT-6全家桶同时端上来GPT-6 Sol与GPT-6 Luna。如果说Astra体现了AI智力的巅 峰,那Sol和Luna则是OpenAI亲手打造的、应用于千行百业的工业级放大器。它们完 美继承了Astra在专业推理、代码...
12:00
罗福莉素来对“天才少女”这一标签嗤之以鼻。去年,她曾公开吐槽围绕自己的文章充斥着事实错误,甚至直言如果自己不认识她,也会给那些买热搜的评论点赞。一年多后,她再次成为焦点。这次,小米没有选择沉默,而是将MiMo模型的训练进度公之于众,进行了一场为期数日的“直播”。 北京时间9月22日,随着MiMo-V2.6系列正式发布,这场持续数日的“直播”终于画上句号。在第...
12:00
继上半年全网接力“雪山救狐”后,近期AI二创“薛甄珠找凌玲”正席卷国内社交媒体。在原剧中,得知女婿陈俊生出轨后,薛甄珠气势汹汹杀到公司寻找凌玲。这段堪称“教科书式找人”的名场面在今年夏天翻红,被网友奉为“互联网四大名著”之一。而在AI创作者的手中,薛甄珠找人的画风开始逐渐跑偏。原本只在上海写字楼里寻找凌玲的她,如今随时切换片场:有时出现在春晚舞台,有时又闯进...
12:00
最近感觉真让人头大,前几天大家还在喊着要放慢模型发布速度,结果这新模型就像不要钱一样往外扔。昨天Grok 4.7和MiMo v2.6的对抗,看来是为了给今天这两位“大哥”做铺垫。今天凌晨,OpenAI的GPT-6 Sol和Luna,以及Anthropic的Claude Opus 5.5正式发布。不禁想问,大家口中的“放慢”到底体现在哪里?感觉像是吃了一嘴的“...
11:59
鼓狮财经9月23日电,国内期货主力合约多数下跌,SC原油跌4%,乙二醇(EG)跌近4%,短纤、碳酸锂、瓶片跌超3%,甲醇、沥青、PTA跌超2%。涨幅方面,20号胶、集运欧线、橡胶、沪镍涨超1%,铂、工业硅涨近1%。