7月20日,宇树科技正式发布全新具身智能大模型UnifoLM-OminiA-0.3。该模型专为家庭康养场景深度优化,以单一架构实现多任务协同处理,支持全模态交互理解,全程自主运行,抗干扰性强。

一、单模型统筹全场景:从搬运到康养,一套系统打通

区别于传统分段式机器人算法,UnifoLM-OminiA-0.3打通了感知、决策、执行闭环,无需多模型切换调度,大幅降低硬件算力消耗。

官方演示视频显示,搭载该模型的宇树G1人形机器人先后走进客厅、卧室、厨房和康养空间,完成了一系列长序列任务:

基础物品搬运: 机器人可自主识别地面散落的抱枕,规划路径平稳放置至沙发。途中被问到抱枕是什么颜色,它会停下来说“要看一眼”,然后回答“白色”。

视觉感知与交互: 能精准分辨抱枕颜色,快速清点出红、蓝、黄三色共三盒药品并主动向用户汇报信息。

精细操作: 可从床头柜第三层精准抽出顶层蓝色药盒;自主分拣黑色脏衣物投入收纳篓;平稳夹持餐具送入洗碗机,还能回答洗碗机中有一个透明玻璃杯。

康养设备联动: 可语音操控病床升降,当用户发出“停”的口令时,机械结构即刻制动。

二、关键突破:口语化指令理解与抗干扰能力

该模型的亮点在于其对口语化、带有位置和指代关系指令的理解能力。机器人能听懂“把第三层的蓝色药盒拿出来”“把这件也放进去”等自然语言指令。

同时,面对外部推拉等干扰,机器人会重新调整身体和手臂姿态,继续执行尚未完成的操作。在病床控制场景中,当用户说“可以了,停”,机器人能立即终止动作,体现了连续人机交互和动态任务适应能力。

三、从UnifoLM系列到量产落地:宇树的“模型+硬件”闭环

UnifoLM-OminiA-0.3是宇树UnifoLM系列能力边界的又一次外扩。2025年9月,宇树开源了世界模型—动作架构UnifoLM-WMA-0;2026年1月发布UnifoLM-VLA-0,官方称其能够使用单一策略完成12类复杂操作任务。

硬件端同样在加速放量。数据显示,2025年宇树人形机器人出货量超5500台,全球第一。截至2026年5月,G1人形机器人累计下线约11000台,创下全球人形机器人单一型号量产新纪录。宇树计划募集42.02亿元,其中20.22亿元拟用于智能机器人模型研发。

当人形机器人从“分段式控制”走向“端到端自主执行”,国产厂商正在用“模型+量产”的组合拳,定义具身智能的下一个竞争维度。