刷到灵初智能的消息,说年底要冲到百万小时的数据积累,四月已经开源了首批1000小时人类手部数据,觉得这个方向挺值得聊的。
之前聊大模型,默认数据是从网上"捞"的,文本图片又多又便宜。但具身智能不是这套逻辑——机器人要学的不是怎么聊,是怎么用手指捏起一颗鸡蛋、怎么不把杯子碰倒地倒水。这种数据爬不出来,得靠真人在真实场景里一遍遍做。
1000小时看着不少,对上百万的目标其实才刚起步。不过开源这步挺聪明,像不少开源模型那样先让社区用起来、把生态搭起来…,比一个人闷头攒数据更走得通。
说到底手是人类最精密的工具,复刻这份灵巧,可能比堆参数难多了。