看到灵初智能那个访谈没,年底要冲到一百万小时真机数据。说实话这数比之前"开源1000小时"那波操作更让我在意。开源那1000小时更像是投名状,交个朋友混个脸熟,但百万小时这种量级,不是喊口号能喊出来的。
它现在全国铺数据采集中心,这事挺关键。以前机器人公司攒数据基本靠随手录,谁有空谁录一段,质量参差不齐。现在搞成标准化流水线,数据从"随手拍"变成"工业化生产",其实就是把大模型那一套搬到机器人身上,当初语言模型也是先把数据基建铺好,后面迭代才快得起来。
我觉得接下来具身这行的护城河,真不在谁的模型结构多花哨。大家网络结构抄来抄去迟早趋同,真正卡脖子的是能不能稳定搞到高质量真机操作数据。数据命脉捏自己手里,比开源那点善意实在多了。等年底那百万小时真落地,谁先把数据基建跑通,谁就握住了下一波具身智能的入场券,后面拼的就不是demo好看不好看了。
看热闹中,坐等年底交卷( ̄▽ ̄)