给机器人看个视频,它就会新活儿了

给机器人安排新活儿,以前是道送命题。
产品换个包装、产线挪半米、零件换个型号——完了。
重新采集数据、重新训练、重新验证,一套流程走完,几个星期没了。
现在有人把这事儿,干成了”看视频就会”。
一个视频,就是一份新说明书
Skild AI 发了个叫 S1 的机器人模型,思路很野:
你拿手机拍一段人怎么干活的视频,把它当”提示词”丢给机器人,它就能照做。
不微调,不改权重,不用重新攒数据集。
官方给过一个时间点:录完演示到机器人自主开工,只花了11分钟。
这招叫”上下文学习”,翻译成人话就是——机器人学会了”看片学艺”。
以前靠写代码,现在靠换视频
工业机器人最大的痛,不是不会干活,是只会干一种活。
每换一次产品,就要重新调一遍、训一遍,比换人都麻烦。
S1 不一样。它把演示视频当”上下文”塞进模型,任务变了,换个视频就行。
就像你给大模型换句提示词,它就从写诗切到写代码。
机器人行业,正在把大模型那套”提示词革命”搬进工厂。
数据最能说明问题
Skild 给的对比很刺激:
给一个新任务,视频提示的S1,分步成功率66%;
用老办法”语言提示+重新训练”的系统,只有9%。
差出来大概七倍多。
他们还算了笔账:一个短视频,顶得上大约380次手把手的人工示范。
那380次示范,够一个熟练工录50到100个小时。
现在11分钟搞定。省下的不只是钱,是好几条产线的命。
不照抄,是在”理解意图”
最值得玩味的一点:S1不是憨憨复读机。
测试里有人演示时手抖,鸡蛋都磕碎了。
轮到机器人上场,人家不学这个”摔”,动作反而更稳。
它把视频当成”目标说明”,而不是”动作轨迹”来抄。
演示者打翻了水壶,机器人会用旁边的杯子顶上。
活儿被打断,它会自己重来,而不是硬着头皮往下走。
这个细节,比刷参数更有意思。
商业动作已经真金白银了
这不是PPT故事。
Skild 成立10个月,年化收入就破了1亿美元,签了60多个部署合作。
工厂那边,Skild、英伟达和富士康已经在联手,用这套”大脑”组装英伟达的Blackwell服务器,16颗螺丝的高精度活儿。
机器人”换活”的成本,正被这波人打到地板价。
冷静一下,别急着吹
当然,吹之前得留个心眼。
66%是分步成功率,中间有人的兜底干预;
拿2000次专业示范硬喂的老方法,最后能到86%,还压它一头;
而且目前没有公开论文,数据是自家测的。
从”展示Demo”到”车间里天天干活”,中间还有很长的路。
一句话总结
这张牌桌真正变的,不是某个模型多能干,而是行业价值在换锚:
机器人最值钱的,不再是”会做一个具体的活”,而是”换个活也能马上上手”。
当”改提示词”取代”写代码”,成为机器人上新技能的主旋律——
这行最稀缺的,可能就不再是工程师,而是讲得清”活儿到底怎么干”的人。