**世界模型赛道:争议与资本共舞,智象未来等企业的突围之路**
关于世界模型是否通往AGI的必经之路,目前在AI圈内尚无定论。有人视其为“好生意”,有人坚信只有理解物理规律才能突破智能边界。然而,分歧未歇,资本却已汹涌。2026年上半年,全球风险投资流向世界模型初创企业的资金已突破30亿美元。智象未来、生数科技、千寻智能等领军企业接连完成大额融资,赛道热度不减。
**智象未来的崛起:从融资到技术**
2024年4月,《科创板日报》在合肥科交会上首次关注智象未来。当时,这家总部位于科大硅谷的公司刚完成超5亿元融资,并发布了新一代原生全模态世界模型HiDream-O1。短短三个月,智象未来又接连完成三轮融资,累计金额超过21亿元,估值迅速跨越独角兽门槛。近日,本报记者再度对话智象未来创始人梅涛,试图解析这家公司的快速崛起,以及一线从业者对世界模型赛道的真实判断。
**梅涛的世界观:从“建模”到“塑造”**
梅涛是世界模型路线的坚定拥护者。他认为,大语言模型难以独立迈向AGI,因为其无法指导机器与真实世界交互。真正的世界模型需要具备表达、建模、推理和反馈物理世界的能力。行业常称其为“model the world”,而梅涛更倾向于“mold the world”——即塑造世界。
梅涛指出,若AI仅复现世界,本质上是在压缩和拟合人类既有知识,这将成为能力边界。世界模型应具备表达、推演和构造世界的能力,不仅生成逼真图像,还要理解模态间的联系、空间关系及因果逻辑。这决定了智象未来的技术路线:原生全模态。其自研的UiT架构摒弃了传统VAE压缩与独立编码器,将图像、文本、视频体素及音频、动作等信号映射至共享Token空间,在同一系统中完成理解、生成与推理。“原生全模态是对人类感知方式的还原,”梅涛举例称,看到台风登陆新闻,人会联想到狂风、雷声及温度变化,这是多感官协同的结果。
**智象未来的产品与商业布局**
梅涛规划,智象未来将沿“以图入视、以视入世”路径,从图像生成延伸至视频生成,最终探索世界模型能力。在图像生成阶段,其开源模型在Artificial Analysis榜单中位列第一,闭源模型跻身全球前三。梅涛表示,公司不会在通用语言模型上与巨头硬刚,而是聚焦视频和原生多模态。
**世界模型的三大流派**
“世界模型”概念虽热,但企业路径迥异。记者将其粗略分为三类:
第一类:视频生成企业(智象未来、生数科技、爱诗科技)。解决画面质量、空间关系、一致性及成本问题。智象未来走原生全模态,生数科技提MoT架构,爱诗科技主打消费级产品。
第二类:具身智能基础模型(自变量、逆矩阵)。通过视频或仿真数据学习物理状态,为机器人感知决策服务。难点在于数据稀缺、仿真差距及长时序规划。
第三类:机器人技能与动作(逐际动力、跨维智能)。利用世界模型打通任务理解到真机执行的链路。世界模型在此扮演“技能层”角色,商业价值在于缩短链路,通过机器人整机或方案交付变现。
**资本涌入:四种力量交汇**
智象未来的融资速度是资本热情的缩影。其最新完成的15亿元C轮融资,由社保基金四川振兴科创基金、工银资本等联合领投。这是社保基金首次投资多模态大模型,工银资本也是首次入局。跟投方阵容庞大,涵盖厦门国贸、上影、华策等产业资本,以及合肥产投、湖北长江等地方国资。梅涛认为,国家级资本意味着长周期投入,影视资本带来高质量数据,地方国资则构建产业生态。
智象未来并非孤例。从资金分布看,资本对“离物理世界交互近”和“离内容生成近”的方向均保持投入。第一类视频生成企业(智象未来、爱诗科技、生数科技)融资合计超百亿,多已成独角兽。第二类具身智能企业(智元、星海图、银河通用)独角兽密度最高,估值普遍达百亿级。第三类技能执行类企业(逐际动力、跨维智能)仍处早期,尚未跑出独角兽。
“世界模型像2010年的移动互联网,”一位VC人士坦言,“虽不知谁能胜出,但不投必错。”目前,华为、小米、顺为、红杉、社保及多地国资已汇聚于此。百亿资金已入场,未来是技术突破、商业模式创新还是估值游戏,取决于企业能否将概念转化为可交付的产品。
