给机器人看个视频,它就会新活儿了

j
jxgzhc
1天前 3 分钟阅读 2 阅读

AI机器人

给机器人安排新活儿,以前是道送命题。

产品换个包装、产线挪半米、零件换个型号——完了。

重新采集数据、重新训练、重新验证,一套流程走完,几个星期没了。

现在有人把这事儿,干成了”看视频就会”。

一个视频,就是一份新说明书

Skild AI 发了个叫 S1 的机器人模型,思路很野:

你拿手机拍一段人怎么干活的视频,把它当”提示词”丢给机器人,它就能照做。

不微调,不改权重,不用重新攒数据集。

官方给过一个时间点:录完演示到机器人自主开工,只花了11分钟。

这招叫”上下文学习”,翻译成人话就是——机器人学会了”看片学艺”。

以前靠写代码,现在靠换视频

工业机器人最大的痛,不是不会干活,是只会干一种活。

每换一次产品,就要重新调一遍、训一遍,比换人都麻烦。

S1 不一样。它把演示视频当”上下文”塞进模型,任务变了,换个视频就行。

就像你给大模型换句提示词,它就从写诗切到写代码。

机器人行业,正在把大模型那套”提示词革命”搬进工厂。

数据最能说明问题

Skild 给的对比很刺激:

给一个新任务,视频提示的S1,分步成功率66%;

用老办法”语言提示+重新训练”的系统,只有9%。

差出来大概七倍多。

他们还算了笔账:一个短视频,顶得上大约380次手把手的人工示范。

那380次示范,够一个熟练工录50到100个小时。

现在11分钟搞定。省下的不只是钱,是好几条产线的命。

不照抄,是在”理解意图”

最值得玩味的一点:S1不是憨憨复读机。

测试里有人演示时手抖,鸡蛋都磕碎了。

轮到机器人上场,人家不学这个”摔”,动作反而更稳。

它把视频当成”目标说明”,而不是”动作轨迹”来抄。

演示者打翻了水壶,机器人会用旁边的杯子顶上。

活儿被打断,它会自己重来,而不是硬着头皮往下走。

这个细节,比刷参数更有意思。

商业动作已经真金白银了

这不是PPT故事。

Skild 成立10个月,年化收入就破了1亿美元,签了60多个部署合作。

工厂那边,Skild、英伟达和富士康已经在联手,用这套”大脑”组装英伟达的Blackwell服务器,16颗螺丝的高精度活儿。

机器人”换活”的成本,正被这波人打到地板价。

冷静一下,别急着吹

当然,吹之前得留个心眼。

66%是分步成功率,中间有人的兜底干预;

拿2000次专业示范硬喂的老方法,最后能到86%,还压它一头;

而且目前没有公开论文,数据是自家测的。

从”展示Demo”到”车间里天天干活”,中间还有很长的路。

一句话总结

这张牌桌真正变的,不是某个模型多能干,而是行业价值在换锚:

机器人最值钱的,不再是”会做一个具体的活”,而是”换个活也能马上上手”。

当”改提示词”取代”写代码”,成为机器人上新技能的主旋律——

这行最稀缺的,可能就不再是工程师,而是讲得清”活儿到底怎么干”的人。