看灵初智能的新闻,年底要冲百万小时动作数据,四月还开源了首批千小时人类手数据。这事基本等于把大模型"数据越多越好"的Scaling路,原样搬到了具身智能。
早几年聊机器人,焦点都在模型架构、控制算法。现在风向变了,比谁数据多、采集快。和ImageNet时代的转向一个道理,当年也是先有海量标注数据,性能才真正往上走。
但动作数据比文本、图像都贵得多。文字能爬,图片能众包标,人类手的动作得真人现场示范,再把时空轨迹一条条标出来,得建专门采集中心。成本曲线起来后,规模化是真金白银堆出来的。后来者想追,差的不是想法,是这条烧钱的数据 pipeline。
所以具身赛道的护城河,未必是哪个惊艳 demo,而是谁能把人类动作稳定、便宜、合规地变成数据。这块谁先跑通,谁就握着下一阶段的门票。