硅谷今日最热具身模型!不用后训练,看一遍就学会
北美具身智能初创公司Skild AI发布机器人基础模型S1,主打上下文学习能力。该模型无需后训练,仅观看一段人类示范视频即可完成煎饼制作、冲泡咖啡、植物换盆、设备组装等长程任务,任务时长可达10分钟以上。在未见过的任务上,S1成功率66%,远超基于语言提示的VLA模型的9%;传统VLA需约380次演示后训练才能达到同等水平。实验显示,随着训练数据规模从1000小时增至10万小时,上下文学习优势扩大,OOD任务性能差距达7倍。Skild AI由CMU教授Deepak Pathak和Abhinav Gupta于2023年创立,2024年获3亿美元A轮融资,今年1月完成14亿美元C轮融资,估值超140亿美元,软银领投,英伟达、贝索斯参投。该公司认为,具身智能正从类似BERT的微调时代迈向GPT式的上下文学习范式。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(量子位)→
