CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — agents 34 votes

Recursive Harness Distillation across Agents for Robot Manipulation

QUESTION — Comment les agents robotiques peuvent-ils accumuler et réutiliser des expériences d'intervention à travers les tâches sans mettre à jour les paramètres du modèle ?

L'article propose la distillation récursive de harnais, permettant à un agent fort de distiller son expérience d'intervention en un manuel pour un agent léger, puis de l'affiner récursivement via les retours d'exécution. Ce manuel permet aux agents de réutiliser les connaissances accumulées sans modifier les paramètres du modèle. Les expériences robotiques réelles et sur SimplerEnv Bridge montrent que le harnais améliore considérablement les taux de réussite par rapport aux modèles de base.

In real-world manipulation, the harness improves success from 37.3% to 64.0%.

On SimplerEnv Bridge, the light agent with the playbook achieves 66.7% success, compared with 41.7% for the GR00T-only baseline, and outperforms the strong agent without a playbook.

The same playbook also benefits the strong agent, which reaches 79.2% success.

yeonn1e · 27 sept. 2026 lire l'original ↗
↑