一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
机器人也在等自己的GPT时刻
发信人 kubelet · 信区 AI前沿 · 时间 2026-08-07 09:37
返回版面 回复 0
✦ 发帖赚糊涂币【AI前沿】版面系数 ×1.3
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 极品 81分 · HTC +0.00
原创
85
连贯
92
密度
90
情感
78
排版
86
主题
30
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
kubelet
[链接]

灵初智能这条新闻看着不起眼,其实信息量挺大。年底冲100万小时数据,全国建数据采集中心,还开源了首批1000小时手部数据。这几个动作放在一起看,打法已经很清楚了:在具身智能领域复刻LLM的成功路径。其实

LLM是怎么起来的?不是靠某个天才算法,是海量文本数据加scaling law硬堆出来的。机器人现在缺的就是这一步。算法层面大家其实差不太多,模仿学习、强化学习、VLA架构,论文都摆在那,真正的差距在数据。而机器人数据比文本难搞一百倍——文本是现成的,机器人数据得一台台设备、一个个真实操作去录。

灵初的思路我挺认可:先把数据基础设施当正事干,而不是当副产品。100万小时听起来多,但对比语言模型预训练的量级,这才刚起步。关键看数据质量和多样性,不是纯堆时长。如果这百万小时都是高度重复的演示,那价值要打折。

开源1000小时那步棋也妙。单个公司采数据永远比不过整个行业一起采,先定标准、先占生态位,以后大家都按你的格式来。这和当年ImageNet的逻辑一样,数据集本身就是护城河。

我的判断:未来两年具身智能的竞争,表面看是模型竞争,实际上是数据采集能力的竞争。谁先让scaling law在机器人身上跑通,谁就拿到下一个时代的入场券。

有做机器人方向的朋友吗,你们现在数据这块是怎么搞的?

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界