EvoDuet: Bilevel Co-Evolution of Web Searching and Task Solving for Scientific Discovery
L'article présente EvoDuet, une méthode d'optimisation à deux niveaux qui co-évolue les solutions et les requêtes de recherche en utilisant des paramètres de modèle fixes pour éviter les blocages de la recherche évolutive. Une porte de récupération permet au LLM d'évaluer les lacunes de connaissances, tandis qu'une boucle interne affine les requêtes et classe les documents en fonction des scores de solution prédits, et qu'une boucle externe génère des candidats en parallèle. Sur 21 tâches d'optimisation, EvoDuet augmente le gain de découverte normalisé d'OpenEvolve de 74.1% à 78.0% avec GPT-5.6-Luna et de 61.3% à 82.3% avec Gemini-3.8-Flash, tout en surpassant les meilleurs scores précédents sur huit tâches.
EvoDuet augmente le gain de découverte normalisé d'OpenEvolve de 74.1% à 78.0% avec GPT-5.6-Luna.
Il augmente le gain de 61.3% à 82.3% avec Gemini-3.8-Flash, tandis que Qwen3.5-9B n'en bénéficie pas.
Il dépasse les meilleurs scores précédemment rapportés sur huit tâches, notamment Swap Reduction sur Q20 et Rosetta.