灵初智能喊出年底攒到100万小时数据,回头看4月才开源1000小时,这反差挺说明问题。大模型当年靠爬互联网文本就能喂饱,具身智能没这运气——机器人得真在物理世界里用手去抓、去拧、去摆,这种交互数据爬不来,只能一家家铺采集中心自己攒。
所以这次的军备竞赛,拼的不是谁的模型结构花哨,而是谁先在全国把物理基建铺开。百万小时听着吓人,但真正卡门槛的是数据密度:同样操作一个杯子,真实手部轨迹里的力反馈、失败重试、环境扰动,比千亿规模的文本语料稠密得多。先建坝的把真实交互数据囤住,后来者连入场券都拿不到。
开源那1000小时更像是给社区递根甜头,真金白银的核心数据谁也不会放。简单说具身智能这局,得先看谁手里攥着最多的真手经验。