Consonance dimanche 20 septembre 2026 frenvi
01 · agents

RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments

QuestionComment les agents numériques peuvent-ils s'améliorer de manière récursive et autonome dans de nouveaux environnements sans mettre à jour les paramètres du modèle ?

Les auteurs présentent RSIAgent, un framework multi-agent sans entraînement conçu pour l'auto-amélioration récursive par construction de mémoire autonome. RSIAgent coordonne des agents de curriculum, d'acteur et de vérificateur pour explorer continuellement des environnements inconnus, valider les résultats et retenir des connaissances spécifiques. Il utilise une stratégie d'exploration large puis profonde pour découvrir diverses structures et cas limites. La mémoire résultante est gelée et directement réutilisée pour les tâches en aval sans modifier les paramètres du modèle. Les expériences sur OSWorld-v2 et Agent's Last Exam montrent que RSIAgent permet à des modèles open-source comme Kimi-K3 et GLM-5.3 de surpasser des modèles propriétaires de pointe, y compris GPT-6.

RSIAgent est un framework multi-agent sans entraînement permettant l'auto-amélioration récursive par construction de mémoire autonome.
Il utilise une stratégie d'exploration large puis profonde combinant exploration parallèle et auto-exploration ciblée.
Les expériences sur OSWorld-v2 et Agent's Last Exam montrent que Kimi-K3 et GLM-5.3 surpassent des modèles propriétaires de pointe, y compris GPT-6.
↑ Haut de page