When AI Reviews Train AI Reviewers: Scientific-Judgment Collapse and Mitigation
QUESTION — Comment se manifeste l'effondrement du jugement scientifique lorsque les réexamineurs par les pairs en IA sont entraînés de manière récursive sur des revues synthétiques ?
Cet article étudie la boucle de rétroaction récursive dans l'évaluation par les pairs scientifique par l'IA, où les modèles successeurs sont entraînés sur des critiques générées par des modèles précédents. À partir de Llama 3.1 8B, les auteurs affinent un évaluateur sur des avis ICLR officiels et entraînent des modèles successeurs sur des mélanges variés d'avis officiels et synthétiques. L'étude montre que l'introduction d'avis synthétiques comprime les distributions de notes et réduit la diversité sémantique, un phénomène nommé scientific-judgment collapse. Pour atténuer ce mode de défaillance, les auteurs introduisent TrustReviewer, un système open source intervenant lors de l'entraînement et du test.
taesiri · 17 sept. 2026
lire l'original ↗