上周全球市场直接把大家跌懵了,真假小作文趁机甚嚣尘上。除了韩国加息、地缘问题导致的流动性去杠杆因素外,另一个市场相对一致性的大跌归因——K3大模型的发布也被拿来反复讨论,以及与此一同被抬出来还有“中美竞争”的老生常谈。

K3所代表的中国大模型明显缩短了前沿大模型的追赶进程,并且还依赖本身的成本优势(模型架构、人才、电力等)、开源优势给终端用户增加了优质大模型的另一个选择。

海豚君认为,K3受制于短期算力供给,在性价比和输出速度上并不存在优势,因此实际短期对闭源模型龙头影响有限,但开源模型首次大幅缩小与顶尖闭源模型的技术差距,意义重大,也是纯大模型商业模式边际恶化的一次拐点。

对于独立AI Lab来说,很可能会因此拉长头部大模型厂商扭亏为盈的拐点等待期。

但这并不代表AI全行业的商业模式证伪。开源大模型的技术突破,短期给资金雄厚的追赶者们、中小企业本地部署需求增加大参数量模型的投入信心,中长期则因为开源模型降低门槛,加速AI大模型的大宗商品化进程,提高全行业的AI渗透,最终促使中游CSP等企业服务、下游C端应用层高速发展期的更快到来,共同做大AI的增量蛋糕。

一、当大模型竞争开始蔓延到头部

今年上半年,头部模型Lab密集发布各自的前沿大模型。就更新频次上,北美依旧是Anthropic和OpenAI保持模型创新的主要战斗力,xAI、Meta、Google紧随其后。中国大模型虽然并不领先,但生态则是百家争鸣。

企业端极其看重模型质量,因此一路领先的Anthropic在ARR表现上是一超多强。2月,Anthropic搬出口碑超预期的Opus 4.6,流水ARR重新加速。从25年四季度月均增速9% MoM,一下子飙至2026年1-2月的25% MoM。

随后的Opus 4.7、4.8虽不如当初的Opus 4.6带来的惊艳(体验升级的超预期幅度),但总归性能不断上升,以及同行中直到4月Open AI才搬出能与之有一战之力的GPT-5.5,因此Anthropic迎来了专属于自己的“春天”,从3月至6月,ARR月环比增速保持在30%以上。

但独立C端用户上,价格是第一考虑因素,因此中国大模型靠着性价比+开源优势,在OpenRouter渠道(个人和中小团队用户为主)的Token用量占比持续上升,6月起已经正式超过美国大模型,从而结构性的带动整体Token单价从2026年开始出现了一波下滑。

两个阵营原本相安无事,各自扫好门前雪。企业高端需求继续被Anthropic拿捏,Fable一会关一会开,部分需求悄悄转移到了OpenAI、智谱。个人普通需求中,除了一部分默默薅腾讯HY3.0的免费羊毛,其他需求则继续享受DeepSeek、小米、Minimax等高性价比方案。

但作为AI商业模式最易落地的场景,Coding市场蛋糕原本已被Anthropic独吞。很快我们看到北美的OpenAI、Google,以及中国的智谱、Kimi在研发目标上的战略调整,集中算力资源提升大模型的Coding能力。 

进入7月,战火才真正燃了起来:

(1)首先是北美内部互撕,OpenAI推出的GPT 5.6-Sol性能上快速看齐Fable 5。比较Artificial Analysis智能评分和Arena投票打分,两者差距都已经非常小。

而Sol的单价只有Fable 5的30%,Artificial Analysis评测的单任务成本指标里,Sol也只有Fable 5的38%。

(2)其次是东方卷王中国大模型的跃跃欲试,上周Kimi带着一款智能性同样可以归为一梯队的基模K3,打入了Anthropic和OpenAI的核心阵营。

K3的AA智能评分仅仅位列Fable、Sol之后,而靠着长周期任务的Agent优势,K3甚至在Arena榜单中被投成了榜一。

下图为各家AI Lab最前沿大模型的AA智能评分,虚线代表北美厂商,实线代表中国厂商。可以看到,综合实力看北美厂商依旧有优势,但二季度以来,智谱、Kimi先后进入TOP 5,与老大Anthropic的研发差距已经从6-12个月缩短到3个月。

二、K3短期竞争影响有限、但意义重大

作为继DeepSeek之后第二个令全球印象深刻的中国之光,Kimi K3是纸面实力还是真硬气?相对一梯队的同行又有哪些优劣势?

1. 除了中国特色,大模型迭代还是“越大越好”

Kimi K3是一款开源权重大模型,除了最底层的代码和训练数据库不公开外,其他部分会在7月27日全网开源。在第三方评测的核心指标榜单上,K3均排在前列,部分指标(来自Arena的前段代码领域)甚至被评到第一。

总的来说,K3的优势在前端开发和智能体上,UI审美高级、网页生成完成度较高,也更擅长处理长周期多工程任务。

而上述核心能力提升,主要源于总参数规模明显扩大、相比于其他同期的中国大模型,K3的总参数量达到了2.8万亿,将DeepSeek V4的1.6万亿刷新了最高记录。

不过这个参数量仍然不能和GPT 5.6、Fable 5差不多5-10万亿级别的量级相比,所以为了继续提高性能,无论是闭源还是开源,目前大模型的迭代思路仍然是遵循Scaling Law规律,因此未来最前沿的大模型,在参数量大幅提升的趋势是非常明确的。

2. 实际性价比不高

K3发布后,Anthropic宣布将Fable 5从7月20日起永久性纳入Max及Team订阅体系。但实话说,至少目前为止Kimi K3的性价比并不高,尤其是和GPT-5.6-Sol相比。

在单价低一半下,K3的Token使用效率偏低、推理速度偏慢,这使得从实际执行任务的角度,K3消耗成本相比GPT-5.6-Sol只便宜了10%(0.95/1.04=91%)。

在下图的“智能性&单任务成本”综合对比表中,也不属于“绿色”的综合优势领域。

从结果看,似乎Kimi并不具备性价比。但底层技术路线上,Kimi仍然在致力于提高训练效率。其中两个核心技术的创新,据Kimi自己说相比上一版本的大模型K2,带来了2.5x的缩放效率的提升。

中国AI Lab往往受困于高端芯片供应和资金短缺(独立模型厂商),导致训练大模型时并不能像欧美龙头一样随心所欲。比如大模型整体性能强悍的Anthropic,目前仍主要用Dense稠密模型架构,意味着每一次Token的处理,都需要每个参数参与计算。

而每此运行时只激活其中小部分参数的MoE稀疏架构,则成为中国开源大模型厂商退而求其次的最优选择(OpenAI自GPT-4起也开始采用)。

2024年初DeepSeek就是通过对MoE稀释架构做了显著的工程优化,将训练效率和成本进一步得到了很大改善,引起全球侧目,也是影响行业发展方向的里程碑时刻。

而Kimi的K3大模型则通过继续扩大模型稀疏度,从而降低了无效算力消耗,每次运行激活率不足2%(该架构一共设置896个专家,每次激活16个)。

K3的有效激活率再次刷新了此前DeepSeek V4 Pro创下的3%记录,而性能接近的GLM-5.2,激活率则有5%。同梯队的北美大模型,甚至大多处于10%的激活率。每次运行时专家激活率越低,越能减少训练过程中的冗余计算量,从而使得训练效果和运行效率得到显著优化。

除此之外,K3对训练效率的提升还得于另外两个自研核心技术——KDA(Kimi Delta Attention)注意力残差机制

后者“注意力残差机制”主要是解决大模型在深度场景的信息传递问题,减少因模型层数扩张、加深而带来信息传递损耗问题。

这两个技术都是用来解决传统Transformer(采用全注意力)在“长上下文”上的弊端:一个是在训练阶段的算力消耗较高,另一个则是在推理解码阶段对KV Cache占用空间过大。当下前沿大模型已经大多为100万Token,未来有希望继续向上突破。因此针对上下文的算力瓶颈,是全行业需要解决的核心问题。

而Kimi是将全注意力和线性注意力结合起来形成混合型,不需要保留每个历史Token完整KV值,仅在现有记忆状态无法解释新信息时才将误差补充写入,其他时期历史信息压缩在可持续更新的状态中。Kimi官方披露,通过KDA技术可以减少75%的KV Cache。

3. 高部署门槛

大参数量能快速提高模型性能,但随之而来的就是对硬件部署门槛要求也会提高。

尽管K3减少了75%的KV缓存,但K3本身模型参数上去了,总参数逼近3T级别。虽然每次推理只用到896个专家中的16个,也就是对应500亿参数,但所有专家权重都必须常驻显存中,因此整体模型权重的存储需求(原始权重1.4T,还要加上一些量化因子、路由表、共享层以及运行缓存等)超1.5TB。

这表明,仅加载模型就需要占用1.5T的HBM容量。但NV DGC B200单节点8颗GPU总显存约1.4T(180GB*8),只能勉强装下原始权重,但几乎没有空间给到实际运行。

这种情况下,就需要上GB300机柜。Kimi官方的建议是K3的最佳部署为包含至少64颗加速器的高带宽超级节点。按道理来说,除了72颗GPU的GB300 NVL72,包含64颗GPU的华为昇腾950 Superpod也可以满足K3的运行需求。

而等到模型权重开源后,哪怕是本地部署最小规模的K3推理集群,也要至少8颗NV A100,硬件成本超400万元RMB。

因此上周因为K3的一句KV Cache减少75%而加剧的存储恐慌,显然是“鬼故事”。市场混淆了单位需求和整体需求的区别,KDA技术只是降低了单Token存储和计算成本,但并不代表说所有推理过程的硬件需求整体压缩了。与此同时,开源模型本身也会进一步扩大全行业对硬件部署的需求规模。

就实测来看,由于参数量上去了,导致K3的算力紧缺已经相当明显:据调研199元/月的登月套餐Allegretto,K3只能用10小时+,海豚君亲测49元/月的初级套餐Andante,低频使用了三天也遭遇了算力告急(实际使用时会自动从K3模型切换到K2.6)。

不仅如此,Kimi官方也发了公告,暂停新增订阅,以保证存量用户的使用体验(额度和响应速度)。

三. 变天的不是行业,而是Anthropic

但仍有悲观声音喊出,Anthropic和OpenAI本身模型迭代带来的性能边际提升已经缩小,同时中国大模型技术追赶上来了,中式内卷下,又会进一步加剧大模型行业竞争。因此Anthropic的ARR(年化收入)很可能因此放缓,进而导致商业模式再次遇阻。

AI 龙头的商业化能否走通,确实会影响全行业的军备竞赛预期。AI的颠覆性,让科技巨头不敢离开战场;但AI ROI的变化趋势,决定着科技巨头是否会暂时放慢投入速度。

因此在当前产业链预期打满下,Capex哪怕只是降低增长斜率也会导致市场短期出现崩盘迹象。在周期顶部,低估值只是计算错觉。

市场关注度最高的Anthropic ARR,在近一年有明显的一超多强优势,核心原因就是它主打AI Coding这个易落地的应用场景。目前市场预期今年能够实现经营利润转正,这要比更倚重C端的OpenAI,先一步看到商业模式走通。

在上半年的3-6月,Anthropic的ARR经历了一次明显加速。目前7月数据还没出来,前两天小作文传出的Yipit测算值795亿(21天),被Yipit打假了。

海豚君暂时按照与预测值差不多的20%月均环比增速估算7月。8月之后考虑到竞争加剧,那么增速按趋势缓慢下滑下,预计到年底能够达到1180亿。对比年初公司制定的今年260亿收入和市场预期的年底1000亿ARR,目标达成的难度不是很大。

但今年超目标是早已priced in的市场预期,如若下半年的ARR环比增速真如上述谨慎预期下降至年底的5%,隐含年化增速70%,对Anthropic上市后的估值弹性必将不利。

不过海豚君认为,出于上述所讨论的算力瓶颈问题导致的“无性价比优势+输出速度劣势”,以及产品生态的布局(大模型、Claude code、专业领域Agent等),我们对Kimi K3对Anthropic的竞争影响短期没那么悲观,再加上川普正在考虑出台限制中国AI的相关政策,因此中国大模型的出海之路(尤其是企业端需求)可能没有想象中那么顺畅。

反过来说,就算Anthropic的“势头走弱”(比如OpenAI目前已经有正面竞争的实力,GPT-5.6-Sol在智能性上已经相差无几,但胜在便宜,以及后续若Google追赶上来),也不带代表全行业跟着完蛋。

如下图所示。北美作为全球AI投入最快、规模最大的市场,目前AI在各个领域的渗透率可以说是全球最高。目前20%的企业或多或少的已经采用AI,26年初一次显著跃升后,预计今年有望继续上升3ppt。

分行业上,得益于AI原生能力的替代性更加丝滑,Coding领域渗透率最高。其他领域,行业渗透率看着高,但这里面仍然是IT部门是目标人群。

公司内其他岗位的渗透,以及To C的端侧AI(包括具身智能),是AI未来增长方向。但这需要配合相应的产品形态、成熟渠道触达到更多的用户。这里往往涉及偏专业定制化的产品终端设计,因此需要时间和资金投入,其中降低算力门槛是加速AI在Coding之外领域渗透的核心关键。

四、大模型混战升级的思考

Kimi K3的出现,弱化了市场对Anthropic技术壁垒的信仰,但也给了资金雄厚的追赶者们,尤其是本身有生态、渠道优势的Big Tech们更大的投入信心。

但同时大模型行业的残酷竞争也被撕开最后的幻想。尤其是对于独立AI Lab来说,一年数十亿至上百亿的基础设施+训练成本,换来的是从以前12个月的领先优势,到如今只有3个月的溢价红利期,那么这笔账是很难算的明白的。

尤其是在成本大头——算力硬件价格全球统一下(实际因为大国卡脖子,中国采购高端芯片的成本溢价直接爆表),中国大模型的“性价比”优势部分来源于人才(中国AI工程师平均年薪与美国同行存在3-5倍差距)、电力(核心区中国便宜30-50%)的绝对差额,但更多的还是靠忍受亏损的“补贴”,实际也就是投资人买单,包括地方政府的补贴。

如下图:

(1)2026年A&O两家的毛利率目前都已经在60%上下,但智谱预计在2026年的毛利率还要继续削弱到30%以下。

(2)而如果考虑到负担更重的训练成本,经营亏损差距还将拉大,这一点光靠销售、管理等其他经营开支的低价优势,难以做有效对冲。

因此一定程度上可以说,盈利结构发生显著变化的拐点,源于下半年中国高端自主芯片的量产。

海豚君在年初覆盖智谱&MiniMax的深度报告中也曾提及,在缩放定律失效之前,竞争不会停歇,人人都认为自己有机会训练出下一个超越同行的前沿大模型。这种情况下,大模型公司会是持续的吞金兽,而公司商业模式本质上就变成了一场持续融资的资本竞赛。

下半年起,我们陆续会看到一梯队的AI Lab登上最大的融资舞台,Anthropic、OpenAI以及DeepSeek、Kimi将陆续筹划上市。当所有选手都拥有一样的融资通道时,最终的决战也会开始。

AI主权问题可能会将全球分割成数个战场,上游资源的地缘掣肘推高成本,人才流动下各方又拥有旗鼓相当的硬实力,上述因素都会使得这将成为一个持久战。

反过来混战期间,大模型的商业模式会更加难以看清,何时盈利、能否盈利也将在大模型厂商的每一次投入和融资时被投资人反复拷问,跑分刷榜来推动顺利融资的现象可能会出现得更加频繁。

而这个时候,拥有原有企业平台生态和渠道优势的CSP厂商,在开源大模型实力显著提升、大幅缩小与闭源模型差距的情况下,更有希望摆脱裸卖算力的低利润率模式。同时,通过结合原本产品服务,将硬件方下移的议价权收益,从滋润了大半年的模型厂端,拿回更多的话语权。

最新快讯

2026年07月22日

22:25
7月22日,鼓狮财经报道,恩捷股份(002812.SZ)发布公告,宣布拟采用集中竞价交易方式回购公司股份。本次回购金额不低于1亿元且不超过2亿元,回购价格上限为93元/股。 公告指出,回购的股份将用于实施股权激励计划或员工持股计划。回购期限自董事会审议通过之日起六个月内。
22:25
鼓狮财经7月22日讯,容百科技(688005.SH)披露了2024年半年度报告。数据显示,公司上半年实现营业收入87.21亿元,同比增长39.57%;归属于上市公司股东的净利润达到1.09亿元,成功实现扭亏为盈。 业绩回暖主要得益于海外客户订单放量、三元及钠电正极材料销量增长、磷酸锰铁锂产品满产满销,以及原材料价格上涨带来的成本传导。财务数据显示,第二季度单...
22:24
【热点】华电辽能澄清不涉及算电协同项目;立新能源表示无算力产业相关业务布局 【项目投资】金安国纪拟20亿元投建珠海国纪增资扩产项目;奥海科技控股子公司拟投建智新控制研发中心及生产基地 【业绩预告】南网数字预计上半年净利润同比增长1051.24%至1511.74%;奥浦迈预计上半年净利润同比增加约229% 【中标合同】平治信息预中标3亿元算力服务采购项目;许继...
22:17
《科创板日报》7月22日讯,继澜起科技与普冉股份之后,佰维存储成为本月第三家宣布回购方案的存储企业。7月22日盘后,佰维存储发布公告,由董事长孙成思提议以集中竞价交易方式回购公司股份。回购资金总额拟定为2亿元至2.5亿元,价格上限设定为不超过董事会决议前30个交易日均价的150%,或不超过558.44元/股。佰维存储强调,此次回购旨在维护公司价值和股东权益,...
21:52
7月22日,据鼓狮财经报道,东北制药(000597.SZ)发布公告称,公司已正式收到国家药品监督管理局核准签发的《化学原料药上市申请批准通知书》,获批生产玛巴洛沙韦原料药。该药品为抗流感病毒药物,主要适用于成人和儿童流感患者。此次获批将有助于丰富公司产品管线,增强市场竞争力,但具体投产销售时间及实际销售情况仍存在不确定性。
21:52
鼓狮财经7月22日讯,长江证券(000783.SZ)发布公告,董事长刘正斌提议使用公司自有资金,通过集中竞价交易方式回购股份。本次回购金额不低于1亿元,不超过2亿元。回购资金将主要用于实施员工持股计划、股权激励,或用于维护公司价值及股东权益。
21:51
7月21日至22日,国务院国资委举办中央企业负责人研讨班。会议强调,要高质量实施新一轮国资国企改革方案,推动改革工作向纵深发展。 在改革重点上,会议提出明确要求:在主业管理方面,需进一步优化企业功能分类;在重组整合方面,要确保新组建企业起步即加速。在深化公司治理方面,要加强党委(党组)前置研究的实质把关,差异化完善二、三级子企业董事会建设;同时要强化经理层成...
21:51
今日,多家A股公司密集披露2026年半年报及业绩预告,业绩表现亮眼。其中,益生股份净利暴增近49倍,联讯仪器、南网数字净利最高预增均超9倍,中微半导净利增逾九成,贝达药业、奥浦迈等公司亦有预增公告。 以下是详细情况: 益生股份:上半年净利同比增4897% 公司公告称,2026年上半年实现营业收入16.97亿元,同比增长28.44%;归属于上市公司股东的净利润...
21:15
鼓狮财经7月22日讯,好上好(001298.SZ)发布公告称,公司于7月22日收到深交所上市审核中心出具的审核中心意见告知函。深交所审核确认,公司符合发行条件、上市条件及信息披露要求。目前,公司后续将向证监会履行注册程序。值得注意的是,该事项尚需获得证监会的同意注册,最终结果仍存在不确定性。
21:15
据鼓狮财经7月22日报道,保加利亚议会当日通过表决,批准美军在2026年7月24日至10月1日期间,于贝兹梅尔空军基地驻扎。具体部署内容包括最多8架美国空军KC-135空中加油机及其机组人员、最多250名配备个人武器的士兵,以及相关机场设备。 7月21日,保加利亚外交部证实已收到伊朗驻保加利亚大使馆发出的外交照会,内容涉及美军可能在该基地部署加油机一事。对此...
21:15
据刚果(金)卫生部7月22日发布的消息,该国埃博拉疫情累计死亡病例已达999例。本轮疫情由本迪布焦型埃博拉病毒引发,截至目前,刚果(金)与乌干达两国累计报告的死亡病例已超过1000例。 根据刚果(金)卫生部截至7月20日的统计,该国共报告确诊病例2473例,死亡999例。同期,乌干达卫生部数据显示,该国累计确诊病例为20例,其中2例死亡。 目前,刚果(金)共...
21:15
过去两年,人们热议AI时代需要什么样的人才,却鲜有人深究:AI时代到底需要什么样的教育?这个问题无人敢轻易作答,但硅谷的科技与金融精英们,早已用真金白银投出了答案。这两年,硅谷悄然兴起一股反常趋势:一群最信奉科技的人,正砸下数十万美元,将孩子送入一种“非典型”的新式学校。它们有一个共同的名字——替代教育。 这些所谓的替代教育,学费高昂得令人咋舌。今年秋天,曼...