CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — agents 18 votes

MILO: Automated Harness Discovery via Orchestrated Multi-Agent Evolution

QUESTION — Comment co-évoluer automatiquement les harnais d'agents et les stratégies de découverte pour maximiser les performances des agents à long terme ?

Ils présentent MILO (Meta-evolutionary Island Orchestration), un cadre qui co-évolue les harnais d'agents et la stratégie utilisée pour les découvrir. MILO combine une mémoire de lignée hiérarchique sur des arbres basés sur des îles en utilisant des mutations rejetées comme preuves négatives, des agents mutateurs par île qui réécrivent des harnais complets à l'aide de l'historique global et de retours parentaux, et un orchestrateur adaptant la recherche par greffe de lignée et spéciation. Sur Terminal-Bench 2.1, PaperBench et DeepSWE, les harnais découverts par MILO surpassent huit harnais de pointe et six méthodes de recherche. Avec Opus 4.8, MILO améliore la résolution par rapport à son harnais initial de +12,0 %, +28,3 % et +10,3 %, respectivement. Sur Terminal-Bench 2.1, il atteint 86,1 pm 2,0 % tout en utilisant 26 % de jetons en moins que son harnais initial.

Avec Opus 4.8, MILO améliore la résolution par rapport à son harnais initial de +12,0 %, +28,3 % et +10,3 %, respectivement.

Sur Terminal-Bench 2.1, il atteint 86,1 pm 2,0 %, dépassant la meilleure entrée du classement officiel de 83,8 pm 2,3 %.

Utilise 26 % de jetons en moins que son harnais initial sur Terminal-Bench 2.1.

nikosusc · 29 sept. 2026 lire l'original ↗
↑