在前一日参加公司正式登陆科创板的敲钟仪式后,宇树科技创始人、董事长王兴兴立即赶往北京,他在8月20日的世界机器人大会上进行“展品到产品:人形机器人产业的下一个十年”的主题演讲。
这次演讲是王兴兴在公司上市后的首次公开亮相。他在现场介绍了公司的标杆性人形机器人产品G1、载人机甲以及前几天刚公开的新机“超人”等。
![]()
其中,宇树科技具身“大脑”的布局、场景应用内容等占据演讲不少时长。这也是宇树科技如今要面向市场回答的问题。经历首日暴涨后,8月20日宇树科技股价盘中跌超15%。
王兴兴称,这些年公司其实一直在推动机器人真正走进生活,比如在部分汽车工厂进行落地应用、在自家工厂部署机器人进行简单测试等,另外AI团队也在推进机器人在家庭干活。但他提到,由于目前整体效率、泛用性能力还是不够高,宇树并没有进行大规模推广。
据了解,今年年初,宇树自研的工业级具身大模型UnifoLM-X1-0已在自有工厂中完成试点部署测试;5月份,WVLA2.0模型发布,该款模型是融合世界模型与视觉语言动作的具身大模型;7月份,具身大模型发布UnifoLM-OminiA-0.3,该款模型靠单模型就能统筹家居康养场景下的多类任务。
“在2020年年初,我们就开始做基于视频生成的世界模型方向,当时做的效果不是特别理想,中间搁置了一段时间。”王兴兴表示,在去年公司再次聚焦这一方向。他透露,“我们对AI模型的投入一直是非常大的,应该是公司目前资金和人力投入最大的一个方向。”
演讲中,王兴兴也回应了通用机器人何时才能真正走进生活、走进家庭。
他认为,目前全球具身智能最大的瓶颈还是泛化能力不足。“进行数据采集训练后,AI模型在一个固定场景上的成功率基本上可以做到接近百分之百的成功率。但是如果操作的物品或者在环境稍微换一下,成功率下降还是非常严重。”
王兴兴提到,迈向具身智能的ChatGPT时刻,要在80%的陌生场景中,通过语音或文字指令,机器人能够顺利完成大约80%的任务。理想情况下,可能需要2-3年实现,或者更长5-10年的时间。
目前,完成这一目标最核心的挑战是AI大模型的输入输出和真实机器人的对齐。
他解释称,对于机器人来说,输入输出是有偏差、有损失的,这一情况也导致了模型泛化能力和任务成功率相对不高。
王兴兴介绍,最近公司正在推动让物理AI机器人的模型自进化,即使用顶级AI大模型进行驱动,其可以自己生成自己的机器人控制代码,并在仿真环境里进行,也可以控制实物机器人进行部署测试。同时,团队也会参与进去。这套体系一旦运行起来,将提高整机的开发效率。
“随着基础模型的能力提升、多元数据规模的提高,可以真正使用AI把机器人进化效率大幅度提升。”王兴兴认为,这将是开启一个物理AI机器人自进化的新纪元。