经济学人,中国将难以从人形机器人身上赚到钱China will struggle to make money from humanoid robots
中国领先竞争对手,并在培训数千台机器人,但距离盈利还很遥远
中国的人形机器人正在甩开竞争对手——而且是字面意义上的“跑在前面”。8月17日,其中一台名为“超人”(Superman)的人形机器人跑出了每秒12.66米的速度,超过了此前由尤塞恩·博尔特保持的纪录,随后一头撞上了墙。这一壮举进一步推高了人们对宇树科技(Unitree)的关注。这家制造“超人”的公司两天后在上海上市,股价随即暴涨460%。
未来几天,随着人形机器人运动会在北京举行,预计还会有更多令人印象深刻的表演。但“超人”这次以撞墙收场,也说明这项技术距离成熟仍有很长的路要走。预计今年中国企业将销售5万台人形机器人,超过去年的3倍。它们基本已经掌握了机器人的硬件技术,但软件却是另一回事。
要打造能够让机器人流畅执行大量实用任务的基础模型,如今必须收集海量数据。目前驱动这一代人形机器人的模型拥有几十亿个“参数”;如果要复制人体的运作方式,它们所需的参数量将达到数千亿。
这将使它们的规模与驱动聊天机器人的大型语言模型相当。不同之处在于,聊天机器人可以利用互联网上海量的数字文本进行训练。而要收集足够的数据,教会机器人识别一个玻璃杯、拿起它并往里面倒咖啡,要困难得多。机器人必须理解从玻璃杯的空间位置,到玻璃的脆弱程度,再到杯中液体的黏稠度等一切信息。这些信息必须从现实世界的实际经历中获取,或者通过对这些经历进行高度细致的模拟来获得。
目前,人形机器人获得的训练数据五花八门,其中往往来自质量不高的模拟环境。现实世界采集的数据有用得多,如今也因此备受追捧。其中最有价值的一类是“真实机器”数据,即由机器人自身的行动产生的数据——机器人可能是在远程操控下完成动作,也可能是在自主执行任务。另一个重要来源则是记录人类完成任务的过程。这类数据被称为“第一视角”(egocentric)数据,通常通过让人佩戴头显和触觉传感手套,记录其身体动作来收集。
得益于湖北人形机器人创新中心等培训基地,中国正迅速成为争夺真实机器数据的领跑者。在中国中部城市武汉的这座大型设施内,每天有多达100台机器人花费数小时观察并模仿人类。在中心数十个工作站中的一个,一名年轻男子站在柜台后,手上戴着数字传感手套,反复转动手腕,做出仿佛正在往咖啡中倒热水的动作。他身旁站着一台机器人,模仿他的动作,同时真的从水壶中将水倒入一个装有咖啡粉的漏斗。机器人的手腕和手指移动方式与人类极为相似,甚至令人有些毛骨悚然。临时搭建的咖啡店旁几步远,是一个看起来像药房的场景,另一组人和机器人正在那里给货架补货。再往前是便利店,然后是工厂生产线,以及其他各种工作场景。(截至目前,外国记者还不被允许参观这些中心。)
咨询公司Interact Analysis的数据显示,武汉的这一中心是中国专门用于挖掘人类动作奥秘的53座设施之一。其中大多数是在过去两年建成的,另有34座正在建设或规划之中。上海正在建设的一座中心将拥有容纳1000台人形机器人的空间。浙江省一个沿海小城市已经拥有6座培训中心。
培训中心需要大量空间和人员运营,还需要一大批最先进的人形机器人,而每台机器人的价格可能高达10万元人民币(约合1.5万美元)。汇丰银行的Corey Chan估算,这种训练方式每小时成本为500至700元。在咖啡工作站,一台机器人连续8小时执行倒咖啡动作,最终只能产生3小时的有效数据。其余数据都被浪费了,主要原因是机器人犯下的错误是工程师不希望它们学会的。据一项估算,要开发一台能够执行各种日常任务的机器人,需要1亿个训练小时。
幸运的是,对于宇树科技这样的中国企业而言,政府承担了这些中心的大部分费用。大约五分之四的培训中心都有政府背景。许多中心是私营企业与地方政府合作建立的,地方政府负责购买人形机器人,然后再将产生的数据卖回给企业。不同估算有所差异,但2026年上半年,中国制造的人形机器人中可能有多达70%被送往这些培训中心,总数约为1.3万台。地方官员通过建设培训中心,可以为当地生产的机器人撑起需求。
与此同时,中国机器人制造商也在设法从庞大的制造业劳动力队伍——以及数量众多的失业年轻人——身上收集第一视角数据。一批专门生产相关可穿戴设备的小型供应商已经应运而生。有些企业希望年轻人在家中佩戴这些设备,把它当作一份兼职工作。今年早些时候,电商公司京东表示,已经启动一个项目,向10万名员工和另外50万人付费,让他们记录自己的身体动作。在沿海省份江苏的一处设施内,据报道该设施获得了政府资金,京东付钱让人们在仿真的杂货店和其他环境中缓慢执行各种任务。未来两年,该公司计划收集1000万个小时的数据,用来记录现实世界中的人类行为场景。
人类生成的第一视角数据远不如真实机器数据有用,这是因为在现实世界中,人类肢体与机器人肢体的运动方式存在差异。即便是其中有用的数据,也必须经过标注:需要人工逐一标记每个动作,让机器人知道这个动作对应哪条肢体或哪种行为。不过,一位机器人公司工程师表示,中国曾经通过雇用大批人员给图片打标签,在图像识别技术上取得先发优势;这一次也可能如法炮制。
如何训练你的机器人
中国的人形机器人产业与其他在中国蓬勃发展的制造业大不相同。未来几年,中国很可能生产并销售数十万台昂贵却基本没什么用的机器,希望借此换来未来更便宜、更实用的机器人。美国竞争对手则一直依赖成本更低的训练方式。据称,美国最大的人形机器人生产商特斯拉正在自己的仓库里训练机器人,从而无需建造独立的培训设施。多家公司也在利用人类动作视频来训练人形机器人。而如今美国已经很少有工厂工人可以直接配备设备来收集第一视角数据,因此据报道,一些企业正在向贫穷国家的工人支付报酬,让他们在工作时佩戴头显和触觉手套,因为这些国家的工资低于中国。
不过,就像在计算机视觉领域一样,中国似乎几乎注定会继续保持数据收集方面的领先地位。但代价是什么?考虑到目前这项技术的发展水平,以及进一步改进所需的时间,本十年内人形机器人的商业市场很可能都不会真正形成。摩根士丹利估计,到2030年,中国每年生产的人形机器人可能达到约45万台。其中许多机器人仍将“智力低下”——继续不断地一头撞向墙壁。海外新鲜事





