RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments
Les auteurs présentent RSIAgent, un framework multi-agent sans entraînement conçu pour l'auto-amélioration récursive par construction de mémoire autonome. RSIAgent coordonne des agents de curriculum, d'acteur et de vérificateur pour explorer continuellement des environnements inconnus, valider les résultats et retenir des connaissances spécifiques. Il utilise une stratégie d'exploration large puis profonde pour découvrir diverses structures et cas limites. La mémoire résultante est gelée et directement réutilisée pour les tâches en aval sans modifier les paramètres du modèle. Les expériences sur OSWorld-v2 et Agent's Last Exam montrent que RSIAgent permet à des modèles open-source comme Kimi-K3 et GLM-5.3 de surpasser des modèles propriétaires de pointe, y compris GPT-6.