9月21日,亮源新创正式发布了全身智能基础模型Light-O1。该模型通过学习互联网视频中的海量人类动作,并融合语言与视觉信息,成功将人类动作知识迁移至机器人,从而显著提升了机器人全身协调与任务执行的能力。这是亮源新创继规模化对齐与规模化部署之后,在Physical AI三段范式中的“规模化预训练”方向取得的重要进展。此外,Light-O1首次揭示了人类全身动作预训练的跨本体迁移扩展规律:预训练所用的人类动作数据规模越大,模型在适配不同机器人本体及视角后,动作预测的准确度就越高,这为利用大规模人类数据提升机器人通用能力提供了科学依据。

机器人预训练正从有限采集迈向海量人类行为。当前,机器人动作模型主要依赖遥操作或UMI等专用方式采集训练数据。然而,这种采集方式成本高昂、耗时漫长,且覆盖不同任务往往需要定制采集流程、组织培训人员,同时还要受制于设备成本与操作便捷性的限制。随着任务场景的增多,人员管理与采集组织的复杂性也随之上升。这些约束导致数据规模与行为多样性难以同步扩展,已成为制约机器人基础模型规模化发展的关键瓶颈。

针对这一瓶颈,亮源新创的Light-O1模型将数据来源拓展至互联网视频中已有的海量人类行为。这些视频记录了人类在不同环境中移动、操作物体、使用工具以及社交互动的全过程,在规模和多样性上有效补充了专项采集数据的不足,使预训练数据的扩展不再完全依赖人工组织的专项采集。

在技术路径上,Light-O1构建了涵盖数据构建、自回归预训练与机器人适配的完整体系。其核心在于从丰富的人类行为中提炼可复用的动作知识,并将其迁移至身体结构、观察视角及控制方式各异的机器人身上。具体实施步骤包括:首先将视频中的行为整理为统一的多模态动作数据,再通过大规模预训练形成关于“在何种情境下、如何行动”的先验知识,最后利用目标机器人的数据进行适配,从而将人类的行为经验转化为机器人的实际行动能力。

沿着这一路径,亮源新创进一步验证了人类全身动作预训练的跨本体迁移扩展规律。研究团队使用不同规模的基于视频构建的人类动作数据进行预训练,随后分别适配至第一视角人类采集数据、公开的人形机器人数据以及亮源自有机器人的全身移动操作数据,评估了预训练规模对动作预测能力的影响。结果显示,随着预训练数据规模的扩大,模型在目标领域适配后的动作预测更加精准:动作预测损失呈幂律下降趋势,离线开环评估中的全身姿态误差也随之降低。这充分证明,人类动作预训练带来的收益能够跨越本体差异,迁移至机器人的动作预测中。这一规律为未来进一步扩大人类动作数据规模、提升机器人通用动作能力奠定了基础。

基于规模化人类动作预训练与后续适配,Light-O1成功将指令理解、环境感知和全身行动连接起来,从真实场景中的全身协同操作以及面向用户意图的理解与行动两个层面,展现了通用全身智能的能力。在真实环境中,机器人能够协调全身持续完成任务。搭载该模型的自研小型人形机器人LightBot,能够自主完成递送毛巾、整理鞋柜归置拖鞋、捡拾垃圾等任务,将行动决策、移动导航和全身操作无缝衔接为连续的执行过程。面对执行失败、外界干扰以及物品类型和位置的变化,机器人能根据环境反馈与执行情况动态调整行动,必要时自主重试,体现了强大的抗干扰能力和对不同物品与空间的泛化能力。

在理解自然语言指令方面,Light-O1能够结合指令描述的情境,深入理解用户需求与隐含意图,推理出完成目标所需的身体姿态、动作顺序及约束条件,进而生成相应的全身动作。亮源新创同步在官网开源了通用动作生成模型Light-O1-Preview,用户只需表达目标,模型即可推导身体应如何行动,并展示相应的推理过程,让用户直观体验从“理解需求”到“生成行动”的完整链条。

围绕“规模化预训练—规模化对齐—规模化部署”的三段范式,亮源新创已相继取得成果,此次发布的Light-O1则进一步确立了规模化预训练方向的核心技术路径。至此,亮源新创在三段范式上的核心技术成果已全部落位,形成了从基础模型预训练、能力对齐到真实世界部署的完整技术链路。更重要的是,这套技术体系的价值在于建立了一条可持续扩展的Physical AI能力增长路径:基础能力通过规模化预训练不断积累,进入物理世界的能力通过规模化对齐持续增强,真实部署又进一步将模型带入更多任务、环境和机器人本体。三者相互衔接,使Physical AI不再依赖单点能力突破,而是具备从数据、训练到真实世界应用持续迭代的系统性技术路径。

最新快讯

2026年09月22日

10:48
物理隔离,有可能阻止失控AI吗?OpenAI核心研究员Noam Brown给出的答案是——不能!即使拔掉网线,将服务器锁进物理隔绝的暗室,足够聪明的AI,也有可能逃脱。9月17日,在长达一小时的深度播客对话中,Noam Brown亲口说出了这个惊人的事实。这个话题火速引发热议,激起一场硅谷量化基金、安全学者及AI核心圈的剧烈震荡。他所披露的...
10:48
ChatGPT联合创始人Almeida隐身两年后推出Jev,这个AI模型不聊天、不写代码,只做判断——从预定义选项中选择、打分或给出是非概率。Jev在自动化工作流任务上比现有大语言模型快193.6倍、成本低444.6倍,输入每百万Token仅0.042美元,输出免费。上线即刷屏开发者圈,现已向所有用户开放。9月21日,TypeSafe官方在...
10:48
一辆变“聪明”的两轮电动车,从外观上人们很难察觉出变化。因为变化集中在那块小小的电子屏里。除了常规的时速、电量之外,它会显示导航、红绿灯读秒、P点停车提醒等信息。除此之外,人们还能通过它实现碰一碰开锁、一键还车等功能。这些“小”改变带来的“大”爽感,经常骑车的人都能懂。它省掉了那些来回掏手机的流程,让用户得到更轻盈方便的骑行体验。类似的故事...
10:48
不久前,北京一场线下活动散场,人流拥挤的出口,几张印刷粗糙的传单被塞到路人手中。没有华丽的宣传画册,只是普通铜版纸,上面印着二维码,大字写着“AI红娘帮你找到灵魂伴侣”。拿到传单那一刻,两个矛盾的疑问冒了出来:AI婚恋为什么还要靠这种十几年前地推发传单的模式揽客?另一边,又不得不感慨,万物皆可AI的时代,真连找对象这种事也要交给算法了。一边...
10:48
一个月前,月之暗面同时找上微软、亚马逊和谷歌,希望让K3进入Azure、AWS和Google Cloud,并从相关服务产生的收入里分走一部分。最高30%的数字被摆上了谈判桌,但当时谁都不知道,这笔账最后能不能谈成。现在,第 一个答案出来了:Kimi真的把收费站修进AWS了。美国时间9月18日,AWS正式宣布Kimi K3上线Amazon B...
10:48
数学界正面临一场前所未有的冲击,AI已经逼近了人类认知的防线。OpenAI近日发布重磅博文,宣布其新模型在短短24天内攻克了百余道世界级数学难题,横跨数学主要领域。其中最引人注目的,是成功攻克了困扰数学界多年的“纳维-斯托克斯”千禧年难题。这种惊人的进化速度令OpenAI内部数学家都感到意外。为此,OpenAI邀请了包括菲尔兹奖得主在内的9位全球顶尖数学家成...
10:41
9月22日,鼓狮财经报道,美国针对数据中心的反对声浪正逐渐侵蚀华尔街对该行业的信心。不少投资者开始对数据中心的增长预期及其建设风险持保留态度,迫使行业高管及顾问不得不重新审视并调整IPO计划。 软银旗下的SB Energy公司原定于本月进行IPO,其计划在俄亥俄州建设全球规模最大的数据中心。然而,据知情人士透露,鉴于投资者对其高达500亿美元乃至更高的估值存...
10:41
周二早盘,美股的AI热潮迅速传导至港股市场。昨日收盘,纳斯达克指数大涨2.26%,报27122.09点,时隔近四个月再次创下收盘历史新高。市场焦点集中在芯片板块,费城半导体指数大涨4.29%,ARM、英特尔和高通分别录得17.16%、12.14%和9.29%的涨幅。AMD表现尤为亮眼,股价上涨9.95%至615.52美元,市值首次突破1万亿美元,成为美股第四...
10:15
GPT-6 Sol 终于要来了!英伟达的代码合并记录中已经赫然出现了这一字样。业内甚至出现了成熟的“AI打工矩阵”协作案例:由旗舰模型 GPT-6 Astra 负责编写代码,直接交给 GPT-6 Sol 进行审查。X 平台上关于 OpenAI 和 Anthropic 的爆料层出不穷。有消息人士透露,就在本周二,甚至有人卡点在凌晨三点,OpenAI 将正式全面...
10:10
据鼓狮财经9月22日报道,韩国央行货币政策委员会成员Chang Yongsung周二发表声明称,央行将依据通胀水平、经济状况及金融稳定情况,审慎研判并决定进一步加息的时机与步伐。为此,央行将加强对金融及外汇市场的监测,密切关注国内外宏观因素,并与政府保持密切协作,一旦市场出现波动,将迅速采取稳定措施。 尽管当前面临诸多内外不确定性,得益于金融机构的稳健运营及...
10:09
鼓狮财经9月22日讯,当地时间周一,OpenAI发布了一系列关于前沿人工智能安全保障的提案,核心聚焦于“对齐研究”与“递归自我改进”(RSI)技术。OpenAI在博客中强调,要实现安全转型,必须开展协调研究,以匹配技术能力的提升,确保构建的系统始终与人类价值观保持一致,并处于人类掌控之中。 为此,OpenAI呼吁建立国际合作机制,制定前沿标准,并借鉴包括美国...