9月7号晚上,宇树科技扔出一段视频,两台人形机器人在台上真打了起来,挥拳、格挡、倒地、起身,节奏还挺像回事。评论区一半嗨了,喊"机器人要起义了",另一半起哄"快出家用版"。我第一遍刷到也上头,但退出来想想,这段视频真正值钱的不是那个挥拳的瞬间,是它背后那三个字:世界模型。
**打的不是架,是"预判"**
先把技术讲人话。宇树管这套东西叫 UnifoLM-X2-1.0,自己做的"世界-动作大模型"。官方原话:全程无预设脚本、无人遥控,机器人靠模型自己对物理世界的实时推演来定攻防。翻译一下:它不是在按写好的动作打,而是在每一瞬间先猜对手下一拳往哪来、自己要怎么躲怎么还,猜完立刻把决定变成全身关节的动作,整个过程实时闭环。
这个"猜"字,就是世界模型和传统控制的分水岭。以前的机器人打架靠遥控器、靠动作库、靠条件判断,人给规则,它才动。现在它得先在心里对真实世界做"未来帧预测",再按预测下命令。跟它过招,你面对的是一个会估你下一步的家伙,而不是一条播放预设脚本的机器。光是"主动预判"这四个字,就已经和过去所有机器人表演划开了一个身位。
**造硬件的,为什么突然死磕"大脑"**
宇树的看家本领本来是关节电机和四足机器人,是妥妥的硬件公司。可具身智能卷到今天,光硬件能打已经不够了:能做出好关节的厂家一大把,真正稀缺的是"大脑",是让机器人体会物理世界、还能实时规划的那层东西。宇树这次把世界模型的"未来帧预测"和全身运动控制塞进同一个实时回路,再配上自研关节电机和强化学习训练栈,摆明了要软硬件一起迭代,把闭环攥在自己手里。
这条路上不是没人抢跑。有人押注用现实世界海量数据喂大模型,有人死磕端侧小模型加动作库,各有各的道理。宇树选的是把世界模型直接"长"进身体里,赌的是通用性:一个能在擂台上预判来拳的大脑,换到车间、换到野外,理论上改改约束就能复用。它也不是第一天押这个方向,早先就开源过一版世界模型引擎,等于把底牌摊开给人看,靠的是一整套软硬件闭环在背后撑。
官方自己也讲得实在:格斗不是目的,是一次极限压力测试,为的是验证世界模型驱动的人形机器人批量落地的可行性。说白了,今天能无脚本地跟真人搏击,明天才有底气谈进车间做动态避障、做巡检、做救援。
**视频有多燃,离产品就有多远**
该泼的冷水还得泼。打架视频能反复拍到最漂亮的一条,产线却要求机器人天天在线、全年不撂挑子。一次格斗演示背后是成堆的服务器在实时算,机器人身上那点电量和板载算力,离支撑"全天候思考"还差得远。世界模型在"擂台"上转得动,不等于在嘈杂车间里转得稳:算力成本、实时性、复杂环境的鲁棒性,每一关都是用真金白银在烧。拿一次演示去推整条赛道的商业化,话说早了。
不过我还是愿意给这段视频一个高分。不是因为它打得好看,而是它终于指向一件已经快被喊烂、却一直没人真正啃下来的事:让机器人先懂物理世界,懂了立刻行动。具身智能喊了这么些年"元年",这回总算有人把最硬的那块骨头,啃出声响了。
宇树机器人互殴刷屏,重点根本不是打架
9月7号晚上,宇树科技扔出一段视频,两台人形机器人在台上真打了起来,挥拳、格挡、倒地、起身,节奏还挺像回事。评论区一半嗨
阅读:0
点赞:0