Playful Agentic Robot Learning:RATs 先玩再干活
RATs 让机器人在收到指令前先自己玩:agent 团队自提目标、写代码当策略、把成功经验存成可复用技能库,LIBERO-PRO 成功率从 23.2% 升到 43.8%。
机构
独立 AI 研究实验室,与 UC Berkeley 合作研究具身与智能体机器人学习。
RATs 让机器人在收到指令前先自己玩:agent 团队自提目标、写代码当策略、把成功经验存成可复用技能库,LIBERO-PRO 成功率从 23.2% 升到 43.8%。