RoboICL 走了另一条路线:冻结 GPT-6 Astra,不训练任务专用 VLA,只在推理时向模型提供少量示范,并持续保留机器人刚刚执行过什么、环境发生了什么。RoboICL 的核心思路很直接:把示范和机器人自己的执行历史都组织为模型能够读取的具身上下文,让冻结的 GPT-6 Astra 在每次决策时参考这些经验,直接输出下一段双臂动作。RoboICL 展示的不是一个新的机器人预训练模型,而是一种让现有通用模型在部署时继续学习的方法。
RoboICL 走了另一条路线:冻结 GPT-6 Astra,不训练任务专用 VLA,只在推理时向模型提供少量示范,并持续保留机器人刚刚执行过什么、环境发生了什么。RoboICL 的核心思路很直接:把示范和机器人自己的执行历史都组织为模型能够读取的具身上下文,让冻结的 GPT-6 Astra 在每次决策时参考这些经验,直接输出下一段双臂动作。RoboICL 展示的不是一个新的机器人预训练模型,而是一种让现有通用模型在部署时继续学习的方法。