灵初智能前阵说年底要攒到100万小时数据,而4月份才刚开源1000小时。三个月量级翻了快一千倍,这胃口说明具身智能对数据的渴求跟大模型根本不在一个维度上。
我更在意的是"小时"这个单位本身。早年搞AI,数据都按"张""条"数,ImageNet多少万张、语料多少亿token。现在直接拿时间轴说话,底层其实是数据形态变了——从一张图配个标签,变成连续的交互时序。一段抓、放、反馈的视频流你没法拆成"条"去数,只能按时长量。采集、存储、清洗那套门槛完全不一样,带宽和标注成本是指数往上走的。
再看它全国铺数据采集中心,信号挺清楚:下半场拼的不再只是算力和模型结构,谁先把真实世界的交互数据规模化采下来,谁就捏住具身智能的入口。接下来比的是带时间轴的活数据,不是躺在那儿的静态样本。