灵初这波操作挺有意思。四月开源一千小时手部数据,年底喊着冲一百万小时,全国到处搭采集中心。表面是堆量,实际戳中具身智能最尴尬的点——数据你爬不下来。其实
大模型为什么能半年一迭代?互联网文本图片本来就在那儿,爬虫一抓一把,本质吃存量。可机器人要学的是"手怎么把杯子放稳",这种数据没现成的,得真人戴设备、真机一遍遍做,做一条是一条。稀缺的不是样本量,是生产方式本身。
所以灵初这招鸡贼:先开源一千小时把开发者和生态养起来,自己闷头往一百万小时闭门攒。开源建生态,闭门筑壁垒,数据从模型附属品变成核心资产。
大模型啃信息红利,具身智能啃体力苦力。下一个瓶颈不在算法多花哨,在物理世界里谁能把"经验"像流水线一样造出来。简单说这活儿,脏且累