Learning Foresight without Explicit Trajectories for 3D Diffusion Policies
Les auteurs introduisent Movement Trend Guidance, une méthode permettant aux politiques de diffusion 3D de capturer une anticipation des interactions sans planification de trajectoire explicite. À partir d'un court historique d'observation, la politique apprend une représentation latente compacte de l'évolution des interactions supervisée par des états de préhenseur futurs. Ce latent fournit un conditionnement global pour la génération d'actions aux côtés d'une branche FiLM. Ajoutant seulement 3.52% de paramètres à DP3, la méthode améliore les performances sur RoboTwin2.0, LIBERO-40 et sur des tâches robotiques réelles.
La méthode ajoute seulement 3.52% de paramètres en plus à DP3.
Elle atteint 62.8% contre 56.1% dans l'entraînement mixte de 50 tâches sur RoboTwin2.0.
Elle obtient 71.93% contre 37.08% sur LIBERO-40 et 72.0% contre 49.0% sur cinq tâches de robots réels.