AI机器人 一次性学习

教机器人拧瓶盖,以前要多久?

工程师先远程操控机器人,反复演示几千次;然后训练、调试、再验证。折腾下来,两三个月是常事。

现在,只需要给它看10秒钟视频。

这不是段子。8月19日,机器人公司Generalist AI发布了新一代基础模型GEN-1.5:只要给机器人看一段3到12秒的演示,它当场就能学会这个动作,不用重新训练,一行代码都不用改。

10个测试任务——拧瓶盖、拉开笔袋拉链、从钱包里取钱、把积木扫进碗里——看一眼就做,平均成功率59%。

别嫌这个数字低。再给它5分钟、约50段演示,成功率直接飙到83%。

更离谱的是后面几个“意外收获”:

人用手演示一遍,它看着也会;在虚拟世界录的演示,直接丢给真机,它也能照做;把两段演示拼在一起,它能自动连成一套连贯动作;让它用刷子扫积木,刷子没了,它抄起一根香蕉就上了。

团队自己都说:这些能力,我们根本没专门设计。

没有加什么“小样本学习”模块,没有搞元学习回路,没有额外训练目标。它就是在8个月、几十万小时真实操作数据的预训练里,自己“长”出来的。

这个剧本,语言模型界见过一次。

2020年,GPT-3出现,大家发现大模型不用针对每个任务重新训练,给几个例子它就能举一反三。整个行业因此拐了个弯。

GEN-1.5,被看作这个“拐弯”的物理版:以前教机器人是“两个月+一个工程师”,现在是“10秒视频+任何人”。

这才是真正的冲击:当教机器人干活变得跟教人一样简单,门槛塌了。工厂、仓库、餐厅、家里,谁都能当机器人的师傅。而“会编程才玩得转机器人”这句话,正在过时。

当然,别急着嗨。

59%的成功率,进不了任何一家工厂。这10个任务也都是拧拧开开的小活儿。结果还是厂商自己报的,没经过第三方复测。

但方向已经很清楚了:机器人学技能的曲线,正在从“爬坡”变成“陡峭上升”。

总有一天,你教会它一次,它就把这活干一辈子。

那天可能没我们想的那么远。

机器人演示