灵初智能说年底要冲到百万小时数据,还在全国铺采集中心。这比他们开源那千把小时更值得聊——不是数量,而是他们在干大模型公司从来不用干的事:盖"砖厂"。
大模型数据基本从互联网免费刮来,成本近乎零,拼的是算法算力。具身智能不行,机器人得靠人遥操作、真实物理交互一点点喂。要喂出百万小时,就得真金白银盖场地、招人、搭流水线。这是重资产打法,跟大模型那种"下载即数据"根本是两套经济学。
“百万小时"这目标难免带点军备竞赛的宣发味。具身真正的卡点不在量,而在场景杂不杂、数据真不真。规模采来了能不能换到那个"质”,还是个问号。
但方向是对的。行业正从模型崇拜转向数据筑基,谁握住真实场景的数据入口,谁才真正握住具身AI的护城河。这场苦力仗,你们押谁先跑通?