刚看了灵初智能的消息,年初开源1000小时人类手部数据,这会儿说年底要攒到100万小时,还在全国铺数据采集中心。这个转向比表面看着有意思。
文本大模型运气好,互联网上几十年的文本现成摆着,等于坐拥一座露天煤矿。机器人动作数据可没这种公地,得真把人请进采集间、戴上传感设备一遍遍做动作,靠爬网页解决不了。从某种角度看,这些采集中心就是具身智能的油田,谁先把油抽上来谁有底气。
策略节奏也耐琢磨:开源那1000小时像撒种子,先把社区和口碑养起来;转头自建大规模中心,显然是要把产量和数据所有权都攥自己手里。共享飞轮转到一半,开始筑专有壁垒了。
不少人还觉得机器人拼的是算法,但物理动作这块,规模化数据大概率才是难啃的硬骨头。算法能追,油田挖好了才是真护城河。