Agent Priors-guided Policy Learning
QUESTION — Comment utiliser les a prioris structurels des politiques pour améliorer la généralisation et la composition des compétences hors distribution dans l'apprentissage par robot ?
L'article présente Agent Priors-guided Policy Learning (APPL) pour combler le fossé d'information entre la composition des compétences et l'exécution de compétences individuelles dans l'apprentissage par robot. APPL exploite les a prioris structurels établis pendant l'entraînement pour guider la généralisation des politiques et sert d'interface linguistique pour la composition. Des expériences sur les tâches MetaWorld et ManiSkill montrent qu'APPL améliore la généralisation des compétences hors distribution et permet des compositions de compétences inédites.
APPL améliore la généralisation des compétences hors distribution et permet des compositions de compétences inédites à travers les tâches MetaWorld et ManiSkill.
liushiliushi · 28 sept. 2026
lire l'original ↗