RoboFoundry: System-as-Policy Evolution for Self-Learning Embodied Agents
Les auteurs proposent RoboFoundry, un cadre d'agents incarnés qui formule l'auto-amélioration comme un système évolutif en tant que politique. Le cadre diagnose les lacunes et convertit les traces d'exécution en mises à jour système validées à travers un système de contexte et un système de compétences hiérarchique. Sur EmbodiedBench, RoboFoundry améliore GPT-5.5 de 27,8 % et amène Qwen3.7-Plus à quasi-parité à 70,3 % contre 72,7 %. De plus, il surpasse les références sur RoboMemArena d'au moins 39,0 % et dépasse Cap-Agent0 de 243,8 % à 679,7 % sur LIBERO-PRO.
Sur EmbodiedBench, RoboFoundry atteint des performances de pointe, améliorant notamment GPT-5.5 de 27,8 %.
Il amène également Qwen3.7-Plus presque à parité avec GPT-5.5 (70,3 % contre 72,7 %), montrant des gains cohérents.
Pour la mémoire à long horizon, RoboFoundry surpasse toutes les références sur RoboMemArena d'au moins 39,0 %.