CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — evaluation 7 votes

When AI Reviews Train AI Reviewers: Scientific-Judgment Collapse and Mitigation

QUESTION — Comment se manifeste l'effondrement du jugement scientifique lorsque les réexamineurs par les pairs en IA sont entraînés de manière récursive sur des revues synthétiques ?

Cet article étudie la boucle de rétroaction récursive dans l'évaluation par les pairs scientifique par l'IA, où les modèles successeurs sont entraînés sur des critiques générées par des modèles précédents. À partir de Llama 3.1 8B, les auteurs affinent un évaluateur sur des avis ICLR officiels et entraînent des modèles successeurs sur des mélanges variés d'avis officiels et synthétiques. L'étude montre que l'introduction d'avis synthétiques comprime les distributions de notes et réduit la diversité sémantique, un phénomène nommé scientific-judgment collapse. Pour atténuer ce mode de défaillance, les auteurs introduisent TrustReviewer, un système open source intervenant lors de l'entraînement et du test.

taesiri · 17 sept. 2026 lire l'original ↗
↑