灵初智能前几天开源了首批1000小时人类操作数据,还放话年底攒到百万小时。版里有人拿"百万小时"当计时单位开玩笑,量级确实吓人,但更该聊的是它开源这个动作。
严格来说具身智能跟大模型不一样,机器人学"动手"靠的是海量人类操作录像…,不是参数堆出来的。模型架构抄来抄去差别有限,真正的分水岭在示范数据的量级和可得性。灵初先甩出1000小时攒社区、定采集格式,这步棋挺刁,谁先把数据格式变成行业默认接口,谁就卡住生态位。当年ImageNet喂大整代视觉模型,逻辑一模一样,开源从来不是慈善,是抢着定规矩。
对中小团队这是真松绑。动作数据比文本难造也贵,开源之后小厂不用从零采也能微调策略。这种数据平权比大模型权重开源更接地气,落地应用估计能冒出不少野路子。