今年WRC最大展台,预告具身智能未来
henry 发自 凹非寺
量子位 | 公众号 QbitAI
相信去年来过WRC现场的朋友,多半会跟我一样:
刚一踏进场馆,就开启了逛展隐藏支线——
寻找遥控器
。
那时候,几乎是每一个成功操作的机器人,背后都有一个拿着遥控器的小哥。
就算绕着展台兜了一圈,没找到人,很快也会发现,机器人来来回回演示的,多半还是提前编好的一套“公式动作”。
说到底,机器人虽然在动,但真正干活的,很多时候还是人。
但今年的WRC,体感上已经明显不一样了。
生产力觉醒,究竟是怎么个觉醒法
走进展台,我们看到星海图这次WRC的主题,叫 生产力觉醒 。十几组demo背后的具身大脑
在前面的展示里,机器人之所以能做到百万SKU的物品与刚性柔性物体泛化,并把一整套长程任务自己串起来,背后用到的就是星海图最新的VLA模型 G0.5 。 在公开榜单测试中,G0.5已经在LIBERO、BEHAVIOR-1K、RoboTwin 2.0、DROID Zero-shot等8个权威Benchmark中登顶,覆盖长程任务、精细操作、零样本泛化等不同能力,整体位居第一梯队。 在具体的架构方面,G0.5走的是一条统一自回归路线,用G0.5背后研究者的话说就是,你可以把它理解成一个大语言模型: 它把视觉理解、具身推理和动作生成,都放进了同一个Transformer Decoder里。数据、本体、模型闭环
星海图创始人、CEO高继扬曾不止一次解释过这套飞轮:做过自动驾驶你发现:要做物理世界智能,就得有物理世界数据;要有数据,就得有一个收集数据的载体,整机。以前做自动驾驶最大的问题就是软件供应商拿数据的链路不通畅,飞轮跑不起来,这就是致命的问题。说白了, 不掌握本体,就很难掌握数据闭环;数据闭环跑不起来,大脑也就很难持续迭代。 所以在数据上,星海图一直押注 真实数据。 早在去年9月,他们就开源了GOD真实场景数据集,下载量全球第一。与此同时,还通过投资简智、元流等玩家继续扩充数据来源,并计划2026年将真实数据规模做到 100万小时。 而这些数据背后,是星海图自己的本体体系。 包括最新的双足机器人Kengo、轮式机器人Nexo在内,星海图已经先后推出R1、R1 Lite、R1 Pro等一系列机器人。