2026年上半年,具身智能赛道融资总额突破935亿元,发生融资事件322起,将行业推向风口浪尖。伴随融资热潮而来的,是另一个高频词汇——“全球第一”。据统计,目前行业内活跃的各类榜单已超过20个,几乎每周都有新的“第一”诞生。
星动纪元、智元、跨维、千寻智能、极佳视界、鹿明科技等企业纷纷在战报中宣称登顶国际榜单。RoboChallenge Table30的榜首位置半年内更迭四次,World Arena同期更是涌现出两个“第一”。
更耐人寻味的是,“第一”的生产速度甚至快于技术迭代。一款模型从发布到登顶榜单往往只需一周,榜单更新频率甚至超过了产品迭代周期。当“第一”数量激增,行业正经历一场关于排名通胀的集体困惑。
这种现象并不令人意外。资本追逐标的,标的争夺注意力,而“第一名”是最简单粗暴的锚点。但问题是,行业缺乏公认的技术评价体系,技术路线分散,具身智能究竟是什么样,尚在探索中。在混沌中,大量评测榜单粉墨登场。公众和资本不禁要问:这些“第一”含金量几何?谁在批量制造它们?当榜单狂欢盖过技术本身,具身智能这条前沿赛道正经历一场从泡沫到务实的成人礼。
具身智能刷榜利益链:谁需要第一,谁在制造第一?
时间回溯到一个月前,6月3日,千寻智能一篇推文将榜单乱象推至台前。文中称其自研基座模型Spirit v1.6在RoboArena榜单上综合得分全球第一,力压英伟达Cosmos3和Physical Intelligence的Pi0.5,宣称打破硅谷霸榜魔咒,而RoboArena更是其口中的“具身智能奥林匹克”和“世界级权威主榜单”。
同日,千寻宣布完成15亿元A+轮融资,三个月累计融资近50亿元。技术登顶与融资落地的时间点重合,看似是标准叙事。殊不知,几天后这场“胜利”被戳破。业内人士梳理RoboArena公开的310条评测记录发现,其中72%的分数仅来自两个注册账号:ECUST Robot Lab与Robotics Lab。前者对Spirit v1.6评测179次,胜率97%;后者评测45次,胜率86.7%。反观英伟达官方用同款模型测试21次,胜率仅为0%。更蹊跷的是,这两个高频账号均在5月底集中注册,此后Spirit v1.6的评测记录便爆发式增长,其中ECUST Robot Lab累计276次评测里,超过六成对象都是千寻智能的模型。
事件最终以RoboArena官方回溯调查、移除可疑数据、Spirit v1.6从主榜消失收场。但这扇窗口,照出了榜单的水分。
过去半年,榜单可谓“铁打的榜单,流水的第一”。几乎每隔几天就有一家企业宣布“登顶全球榜首”“力压国际巨头”。今年2月,原力灵机DM0宣称在RoboChallenge真机评测中获双项第一;3月,极佳视界GigaWorld-1在WorldArena Track1阶段性评测位列第一;5月,星动纪元Era0拿下RoboChallenge Table30综合第一;同月,智元GE-Sim 2.0登顶World Arena Track1;6月,跨维智能DSCFuncWorld登顶Track2。期间,World Arena上还出现星动纪元拿“具身任务能力全球第一”、北京人形Pelican-Unify成双冠王。
每个“第一”都有榜单背书,每个榜单都有赛道划分。当“第一”成为流水线标准件,我们需要追问:谁拼命要这个第一,又是谁在帮他们制造?
要理解这场狂欢,需看清利益链。对创业公司而言,榜单第一是商业工具。具身智能仍是故事驱动型赛道,技术路线未定、商业化未通,投资人缺硬指标,“第一”是最直观的估值锚点。一个头衔能拉动估值数亿元,是融资敲门砖。千寻和星动纪元均在登顶后同步宣布融资,榜单发布与融资官宣高度同步已成惯例:先造势,再抬估值,最后交割。
除了融资,榜单也是核心卖点。“全球第一”是成本最低、穿透力最强的营销话术。当每家公司都在讲模型能力、泛化能力却缺乏公认尺子时,榜单第一成了最易理解、最方便传播的信号。
需求旺盛催生供给。如今的榜单已非第三方中立评测,而是一门生意。市面上榜单分三类:VLA操作综合榜、世界模型榜、专项基准榜。问题在于,部分榜单本身就是商业产品,标准不透明、规则可干预、与商务深度绑定。智源研究院院长王仲远在智源大会上直言,现阶段“榜单并不完全可信,令人眼花缭乱”。
即便看似中立,也存在操作空间。RoboArena事件暴露了分布式评测漏洞:任何机构都可注册当考官。更多封闭榜单存在“针对榜单专项优化”。2026年自变量算法黑客松中,南京邮电大学队伍在A榜“按指令分类水果”任务中反复微调,成功率极高,但进入未知环境的B榜后效果大不如前。这是典型的“应试教育”,与具身智能追求的真实世界泛化能力背道而驰。
当需求与供给就位,刷榜成为心照不宣的集体狂欢。企业要第一融资,资本要第一讲故事,唯一被忽略的是技术与真实场景。
具身智能狂奔,行业需要一把价值标尺
如果说刷榜是表象,根源在于行业处于“蒙眼狂奔”状态,缺乏统一参照系。拆解利益链发现,能成立的前提是行业没公认标尺。
这种无标尺竞争并非独有。汽车有百公里加速、续航;手机有跑分、影像;大模型有MMLU等基准。但具身智能至今没有。技术路线分散(宇树重运动控制,千寻重模型,擎朗重场景),迭代极快(2024比自由度,2025比VLA,2026比世界模型)。
更深层的矛盾在于,终极考场是真实物理世界,难以完全标准化。实验室固定环境到真实工厂、家庭,变量指数级增加。仿真100%成功率,真机可能抓不稳杯子。固定场景完美,遇到偏移、光线变化就宕机。这让标准化评测参考价值大打折扣。
本质上,刷榜是行业从泡沫走向成熟的必经阶段。概念爆发期,资本涌入,技术未定,市场需要简单符号区分好坏。但深水区,泡沫退去,标尺建立。转折点在资本从听故事转向要业绩,从拼概念转向拼落地。
参数与融资盛宴背后,具身智能将进入去泡沫期
2026年上半年,融资935亿,事件322起,百亿估值独角兽至少22家(2025年仅3家)。参数路线分化:智元GE 2.0 20亿参数登顶,银河通用8040万,原力灵机4B。
但纸面参数亮眼,能落到真实场景的有多少?变化悄然发生。WAIC 2026是风向标。相比过去比“倒水”“手指灵活”,今年展台变微型工位。企业搬来酒店洗衣房、咖啡馆、便利店,人形机器人零遥操、纯自主运行,完成洗衣、叠衣、咖啡、拣选。所有场景来自真实合作品牌需求。“零遥操、纯自主”成隐形标准。
标准体系推进。WAIC期间《全球工业具身智能导则》编制启动,聚焦环境感知、决策、协同、安全,试图建立工业具身智能统一标准。
尽管标准未全,但共识清晰:具身智能能力不能靠榜单定义,要在真实场景验证。宇树冲刺A股,智元启动赴港上市,头部企业进入资本化兑现期。IPO硬要求倒逼行业褪去泡沫。
资本市场要的是出货量、营收、利润与商业模式,不是全球第一头衔。参考宇树、云深处,靠的是商业化基本盘。当头部企业带着真实业绩走向二级市场,估值体系重构。过去靠榜单抬估值的时代过去。
细数科技史,每条前沿赛道都经历概念炒作、泡沫膨胀、榜单泛滥,这是从实验室走向产业化的必经。具身智能承载下一代通用智能想象,出现阶段性泡沫与乱象不意外。
泡沫终退,虚名落地。具身智能终极考场永远是真实物理世界。机器人会不会走、模型跑分高不高,最终要回答:能不能在工厂替代人工,在家庭提供服务,创造价值。
眼下,具身智能正从概念走向产业成人礼。未来留在牌桌上的,不是榜单短暂第一,而是能在真实场景站稳脚跟、创造真实价值的企业。当刷榜喧嚣散去,真正的技术长跑才刚刚开始。
