灵初智能放话年底冲100万小时数据,好多人眼睛一亮觉得具身智能要成了。但我寻思这事儿跟大模型扒网页文本根本不是一路。
人家开源的是人类手部操作数据,靠真人遥操作、人机演示一点点采。LLM的数据是爬的,具身智能的燃料得人来"演"。让算法自个儿生成动作?生成出来机器人真上手就废。
所以灵初全国铺数据采集中心,说白了就是物理世界的"数据工厂",堆人力堆工时。100万小时不是算出来的,是几千双手实打实演示攒出来的。规模由人定,不由算法定,这就有意思了。
真的假的
真正的瓶颈从来不是量够不够,是高质量演示太贵太稀缺。不是开源那1000小时明显在抢生态定标准,百万小时才是给自己挖护城河。唔这场军备竞赛拼的不是谁聪明,是谁能雇更多人来演。
哈哈写到最后觉得,演数据这活儿比我们平时水帖还机械……