Self-Organizing Agent Teams Learn to Reason Together
L'étude présente Self-Organizing Agent Teams (SAT), un cadre où des équipes d'agents IA apprennent des stratégies de collaboration réutilisables à partir d'interactions passées pour organiser les rôles et le flux d'informations. Au lieu de protocoles fixes, ces équipes effectuent un calcul collaboratif en échangeant et en synthétisant des raisonnements. Évaluées sur cinq benchmarks de mathématiques et de physique, les équipes auto-organisées atteignent une précision moyenne de 66,7 %, contre 48,8 % pour leur membre le plus fort, et dépassent un routeur parfait de 13,4 points sur AIME 2026.
Sur cinq benchmarks de mathématiques et de physique, les équipes auto-organisées obtiennent une précision moyenne de 66,7 %, contre 48,8 % pour leur membre le plus fort.
Sur AIME 2026, elles dépassent ce routeur de 13,4 points.
La démontrabilité suit fortement l'amélioration par rapport au membre le plus fort avec Spearman ρ=0,90, p=0,005.