融资近2亿美元、估值达到150亿元的消息还在发酵,逐迹动力就发布了人形大脑系统COSA 0.5,带着一段长程移动操作任务登场。融资新闻里的数字当然够大,但看完视频,我反而觉得,这段Demo更能解释150亿元估值到底值在哪里。
视频里,Oli连续完成挂衣服、收纳玩具、搬箱、摞箱、弯腰捡东西、清理垃圾和递送物品。全程一镜到底,中间不剪辑、不复位、无遥操、不切策略,场景里的东西还会被临时重新摆放。
单独看某个动作,其实不算多新鲜。现在会抓东西的机器人不少,真正难的是把这些事连起来做。
机器人走起来以后,相机视角一直在变;弯腰、转身、搬箱子时,身体重心也一直在变。它得一边判断接下来干什么,一边让手脚配合,还得随时根据现场情况调整。很多Demo更像站在固定位置答一道题,逐际这次更接近让机器人在房间答选择题、主观题、客观题,什么都做。
这次COSA 0.5也第一次把人形大脑系统三层架构完整讲清楚了。S2负责环境理解、记忆、推理和任务调度,决定接下来要做什么;S1是一组可以复用的技能,VLA是其中一项;S0负责全身平衡和动作精度。三层运行在不同的频率上,任务意图向下传递,机器人状态向上反馈,所以它才能边走边做,让上层想法真正落到全身动作上。
逐际对“机器人大脑”的理解也挺有意思:模型只是一项能力,能把认知、记忆、技能、调度和身体控制组织起来的系统,才算真正的大脑。
这里最容易被忽略的,反而是最底层的运控。COSA的WBT模型约千万参数,却要以1000 Hz的频率在机器人本机控制全身。机器人弯腰会不会摔,搬东西会不会晃,边走边伸手还能不能保持准确,都得看这一层。
放到全球范围里,能完成长程移动操作任务的,当前只有Figure和逐迹动力。
Figure更强调端到端模型和真机数据,逐际从一开始就在搭完整系统。Flexion近期公开的三层结构,在架构范式上也和COSA的S2、S1、S0开始趋同。逐际今年1月发布COSA时,已经把“大小脑融合”的方向讲了出来,这次0.5算是把那套想法真正跑给大家看。
所以这轮融资,我更愿意把它看成结果。资本买单的,大概不只是一个机器人会做多少动作,而是它有没有机会把这些动作组成真正能工作的产品。
以前说Figure的对手在深圳,看完COSA 0.5,这句话开始有画面了。




