Skild AI 发布 S1:看一遍视频就会做,机器人不用再微调了

AI资讯3分钟前发布 kade
2.8K 0

Skild AI 推出了机器人基础模型 S1,卖点是从单个视频演示里学会新任务,不需要微调,也不需要后训练。

官方给的例子有点具体:做手冲咖啡、给植物换盆、煎松饼、组装一套零件,最长可以执行 10 分钟的未见过任务。做法是把视频演示当成 prompt 输进去,模型把它翻译成自己环境里的机器人动作。

“视频当 prompt”这个说法值得停一下。语言模型的 few-shot 是给几个文本例子,模型照着办;S1 想做的是同一件事,只不过例子换成了一段人做动作的视频。中间要跨越的是视角、身体结构和物理约束三重差异——人的手和机械爪,怎么把动作对上,这一直是具身智能里最难啃的部分。

10 分钟的任务长度也是个信号。机器人演示视频里那些漂亮的抓取、叠衣服,通常是几十秒的短程任务,误差还来不及累积。10 分钟意味着几十上百步动作,中间任何一步偏了都得自己纠回来。

需要泼的冷水是:这类发布通常是精心挑过的成功案例,成功率、环境变化下的鲁棒性、失败时怎么办,这些数据没给。真正能不能用,得看第三方复现。

© 版权声明

相关文章

Skild AI 发布 S1:看一遍视频就会做,机器人不用再微调了 暂无评论

none
暂无评论...