作者 | 肖汝健
编辑 | 周伟鹏
9月7日晚,宇树又放出了一段机器人格斗视频。
这次没有遥控器,操控宇树G1的,是官方新发布的世界-动作大模型UnifoLM-X2-1.0。
按照官方说法,这套模型可以让它实时预测、规划并执行动作,是“全球首次世界模型实时驱动”的全自主人形机器人格斗。

8月19日上市首日,宇树股价最高冲到1100元,市值一度超过4400亿元。
而截至今天收盘,股价已经回落至523.68元,总市值2118亿元,较最高点回落超过一半。

宇树机器人,开始自己出招了
这次最大的变化,不是G1又学会了什么新招。
整段演示中,它的进攻招式只有两板斧:左右勾拳和扫腿。
去年参加机器人格斗赛时,这些招式已经出现过,只不过当时仍需要操作员控制,招式也主要来自提前训练好的动作库。
现在,什么时候出拳、往哪里移动,开始由机器人自己判断。
这种变化在对打过程中很明显,视频里,G1受到重击后虽然会明显晃动,但很快又能稳住重心,继续跟着对手移动。

支持它的,就是宇树新发布的模型UnifoLM-X2-1.0;不过,这颗“大脑”可能是外置的。
据外媒Humanoids Daily消息,演示视频曝光的运行日志中,出现了服务器接收观测信息、重新规划动作的相关记录。
结合宇树初代世界模型的部署方式,G1很可能仍需要借助场外服务器完成部分推理,再把动作传回机器人执行。
这就有点像我们平时用手机导航,手机负责获取当前位置,服务器根据实时路况计算路线,再把“下一步怎么走”发回来。


拳台之外,宇树也在练干活
这次自主格斗当然是一个明显的进步,而且足够炫酷。
不过现在,机器人“大脑”的竞争已经越来越多地走进真实任务。
收拾房间、叠衣服、搬零件,大家开始直接用“能不能干活”来检验模型。
宇树也没把训练场只留在拳台上。今年8月,王兴兴接受采访时表示,公司内部的AI模型和训练,基本都是围绕机器人进入家庭和工厂干活展开。
例如,今年2月,宇树就把世界模型部署到自己的机器人工厂,让机器人参与机器人零部件的装配。

至于为什么大家更常看到机器人打拳击,王兴兴解释说,不同动作的展示效果不一样,观众更喜欢格斗和表演,所以公司会优先展示“大家更喜欢看的”。
目前,有关宇树具体怎么训练机器人大脑,公开信息还比较少。
相比之下,海外的Figure AI把训练思路讲得更细。
它们将自家的视觉-语言-动作模型Helix 02分成不同层级:上层负责理解环境、判断任务,中间层把判断转成全身动作,底层则专门处理平衡、接触和身体协调。
简单来说,就是先想清楚要干什么,再解决身体具体怎么动。
为了训练底层控制,Helix 02使用了超过1000小时的人类动作数据,并在超过20万个并行仿真环境中训练。
最近,Figure又推出Index,让普通人上传做饭、清洁、洗衣等第一视角视频。
截至目前,Figure称已经收集超过1600万条视频,累计向贡献者支付1500万美元,这些训练也被放进了真实任务。
发布Helix 02时,Figure让机器人在完整厨房里连续自主运行约4分钟,一口气完成61个动作。从取出餐具、收纳,到重新装载洗碗机,全程没有人工接管和重置。

此前,Figure 02还曾在宝马工厂累计运行超过1250小时,搬运超过9万个零部件,并参与超过3万辆汽车的生产。

王兴兴,还在赶路
近几天,有网友在首都机场摆渡车上偶遇王兴兴。
照片里,他一个人背着包,靠在车厢一侧低头看手机,神情有些严肃。

过去一个月,他也频繁出现在公开活动中。8月19日宇树上市,第二天,他就赶到世界机器人大会,继续谈机器人。
从大学时自己做出第一台双足机器人,到四足机器人、人形机器人,再到今天给机器人补上“大脑”,这条路他已经走16年。
上市前接受采访时,他说,过去几年自己花时间最多的,就是机器人AI和基础模型。相比几年前,现在模型结构、数据采集和训练路线都已经清晰了很多。
他形容自己已经看到了“黎明的光”,这次的X2-1.0,也是宇树交出的一份新答卷。
接下来值得期待的是,这套“大脑”什么时候能把拳台上的自主判断,带进更多真实的工厂和家庭场景。
•END•
Question. Write.Narrate. Believe. Become a story.易简传媒的愿景是提问和传播商业故事,让读者更开阔,更聪明。有 2500 万微信粉丝关注我们的账号,欢迎大家关注: