本文介绍了硅谷具身智能初创公司Skild AI发布的最新机器人基础模型S1,其核心突破在于实现了无需后训练的上下文学习能力。S1只需观看一段人类示范视频,即可直接完成长达10分钟以上的复杂操作任务,如煎饼制作、咖啡冲泡、植物换盆和设备组装等。实验数据显示,在未见过的任务上,S1的成功率达到66%,远超基于语言提示的VLA模型的9%;而传统后训练路线需约380次演示才能追平其单次学习效果。Skild AI将这一进展类比为大模型从BERT时代迈向GPT时代的范式转换,强调预训练的真正价值在于让机器人获得从上下文中直接学习的能力,而非仅减少后训练数据需求。这一成果引发业界对通用机器人发展进程的乐观预期,有观点认为通用机器人可能两年内出现,标志着具身智能正迈向类似GPT的关键时刻。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅