HuggingFace Daily Papers·· 8 天前AI 评分33
Agent Priors-guided Policy Learning(APPL):用结构先验连接技能泛化与技能组合
Agent Priors-guided Policy Learning
AI 导读
机器人策略学习方法 APPL 把每个策略的结构先验当作技能组合的接口,在 MetaWorld 与长程 ManiSkill 任务上提升了分布外技能泛化。构建智能体把完整演示切分为可复用技能,为每个技能提出多个结构先验并逐先验训练、验证策略;运行时智能体据此选择并组合策略,实现此前未见过的技能组合。消融接口信息会显著降低性能。
来源:HuggingFace Daily Papers · huggingface.co