7月19日,2026世界人工智能大会(WAIC)期间,昆仑万维在上海西岸国际会展中心隆重举办了“世界模型与多模态范式跃迁”专场论坛。作为深耕AI科技领域的领军企业,昆仑万维在会上宣布核心模型重磅升级,发布了Matrix-Game 3.5世界模型、Mureka v9.5与O3音乐模型,全面覆盖世界模型与AIGC创作等前沿赛道。
**方汉:2026是“世界模型元年”,三大产业预判锚定未来方向**
在论坛主旨演讲环节,昆仑万维董事长兼CEO方汉正式宣布2026年为“世界模型元年”。他指出,过去两年AI行业的核心命题是“生成”——生成文字、图像、视频、音乐。而从2026年开始,AI的核心命题将转向“理解”与“交互”——让AI真正理解物理世界的运行规律,并能与真实环境进行闭环互动。世界模型正是实现这一跨越的关键技术底座。
方汉在演讲中系统阐述了三大产业预判:
第一,世界模型将走出屏幕,进入物理世界。他洞察到,具身智能正从实验室走向真实环境,这一趋势要求机器人在行动前先进行环境推演——预判动作后果、评估环境变化、及时调整应对策略。这种能力的突破,将使竞争焦点从单一任务转向陌生环境下的通用模型能力。
第二,游戏行业将率先被世界模型改变。Matrix-Game 3.5让虚拟世界随玩家行动实时生长、持续演化。未来三到五年,世界模型将成为游戏行业的基础设施,彻底刷新内容生产方式。
第三,AI音乐、AI视频等工具将从技术试验变成大众创作工具,促进AIGC的深层发展。Mureka作为中国最强、全球前两名的音乐生成模型,率先去除“AI味”,让普通人也能把模糊灵感转化为有情绪、有温度的作品。
**AI模型全球升级,掀起全模态内容生成革命**
本次论坛上,昆仑万维集中完成了核心模型的全球重磅升级。
**2.1 Matrix-Game 3.5:Patch级记忆注入,重新定义交互世界模型**
作为昆仑万维世界模型系列的最新迭代,Matrix-Game 3.5带来了革命性的技术升级。Skywork首席科学家成宇发布了该模型。Matrix-Game 3.5聚焦可交互世界模型技术,实现了Patch级别的记忆注入与系统级性能优化,5B模型在720p分辨率下可实现单卡20FPS实时生成,具备1分钟记忆能力。
成宇指出,世界模型是具身智能的“无限数据引擎”。Matrix-Game 3.5构建了支撑下一代世界模型的无限数据生产体系,突破传统瓶颈,打造了三条自动化数据生产管线,输出Video+Pose+Action+Language的高质量训练数据。
在技术架构上,Matrix-Game 3.5创新性地将历史帧切分为带有3D坐标的Patch Memory,推理时根据当前相机视锥检索可见Patch并重新投影,形成Mosaic后再作为Memory Token注入DiT,实现长期一致性的Patch级空间记忆。这一设计带来了四大核心优势:更准确的空间记忆检索与跨帧一致性、更稳定的相机运动生成、最大程度保留基座模型动态生成能力的In-context Learning、以及用户可自由编辑记忆块的可控记忆能力。
此外,Matrix-Game 3.5通过“减少模型吞吐+DiT模型优化+VAE剪枝”三重手段,达成单卡20FPS 720p实时推理的业界领先性能。Matrix-Game 3.5宣布核心架构开源,吸引全球开发者共建生态。
**2.2 Mureka v9.5与O3:最没有AI味的AI音乐模型,让音乐进入“版本化制作”时代**
Mureka v9.5与O3音乐大模型的发布,成为本次论坛最具情感冲击力的时刻之一。Mureka v9.5沿袭了MusiCoT路线,首次提出“最没有AI味的AI音乐模型”这一概念。它不再依赖声部堆砌和复杂编配制造“厉害”的第一印象,而是在真实的音乐框架中,以更为克制的方式处理编配、人声、情绪与Prompt意图。
O3建立在新版V9.5之上,通过test-time scaling扩展MusicoT的推理过程。它不是简单地“生成得更多”,而是让模型在生成过程中持续审视当前表达,回看偏差与自我修正,使音乐CoT能够逐步收敛。
在评测结果中,V9.5的指令精准度从6.92提升至7.62,O3则进一步强化了旋律发展、编曲结构与指令理解。Mureka还推出了Character功能,支持从一张图或一段视频生成专属歌手角色;Mureka Agent则能通过自然语言一次对话调用整曲生成、单轨生成、Remix等全部能力,让AI音乐从单一工具演变为完整的“版本化制作”平台。
**院士与行业领袖齐聚,共话世界模型未来**
本次论坛邀请了多位重量级嘉宾。中国科学院院士、南京大学副校长周志华受邀发表主旨演讲。他围绕世界模型的前沿方向展开分享,指出决策层世界模型长期面临“多步推演复合误差平方级放大”与“样本复杂度过高”两大瓶颈。他分享了团队的最新突破:通过分布匹配技术可将推演误差从平方级压至线性级,并创新性地逆向运用贝尔曼方程降低样本量,为现实任务构建决策世界模型提供了理论基础。此外,他还提出了“学件”概念,为世界模型生态开辟了新路径。
黎曼动力机器人创始人刘扬教授介绍了其推出的Riemann-1.0模型。该模型面向Physical AI,基于超过23.2万小时多源具身交互数据训练,在多个国际主流机器人Benchmark与真实机器人任务上均实现双SOTA。
Reactor Technologies CEO Alberto Taiuti则从产业落地角度指出,世界模型已从静态生成范式跃迁至有状态、实时交互的新范式。他展示了同名平台Reactor如何在保持极低延迟的同时,支持机器人、游戏等高频交互场景。
**全模态内容革命:AI重塑视频、游戏、音乐与全球文娱**
论坛压轴环节举行了“全模态内容革命”圆桌对话,由甲子光年创始人张一甲主持。昆仑万维董事长兼CEO方汉,中国电影家协会副主席黄晓明,演员王珞丹,爱奇艺高级副总裁杨海涛,青年导演崔睿共同参与。
嘉宾们一致认为,AI是文娱行业最好的工具与最大的革新者,人机协同将成为全球文娱行业的新发展范式。王珞丹分享了AI创作的“痛并快乐着”,黄晓明惊叹于AI生成的逼真细节,崔睿肯定了AI在提升制作效率方面的价值,杨海涛则提到AI短剧已开始分流真人剧流量。方汉承诺将持续降低创作门槛与Token成本,实现“人人如龙”的文化平权。
**从“生成内容”到“理解物理世界”:昆仑万维的下一个十年**
从2022年“All in AGI与AIGC”战略确立,到2026年“世界模型元年”的正式宣告,昆仑万维完成了从全模态内容生成到可交互世界模型的关键跃迁。昆仑万维正以世界模型为支点,撬动AGI时代的下一场多模态范式革命。世界模型元年,未来已来。
