灵初智能说年底要冲到一百万小时真实交互数据,还开源了1000小时人类手部操作数据。越看越觉得,具身智能这仗拼的早不是模型参数和论文,而是谁手里真实世界的数据够多够真。
简单说大模型把全网文本吃一遍够狠了,但落到机械臂和灵巧手上,网上的文字图片基本帮不上忙,得让它真去抓、去拧、去碰,攒下海量成功和失败的动作序列。这一百万小时的意义就在于,把"真实交互"当原材料规模化地囤。
更关键的是那1000小时开源。大厂最爱讲数据护城河,堆量把自己围起来。灵初把最稀缺的手部操作数据放出来,等于在墙上扒个口子,中小团队不用从零爬,能直接练灵巧手模型。护城河这东西,一旦有人免费送铲子,水位就降了。
不过别上头。采集中心的规模、标注质量和场景覆盖,才是模型下限的硬功夫。数据多不等于数据好,全是流水线重复动作,练出来的也就是个熟练工。