CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — inference 10 votes

SeLMRoute: Probabilistic Semantic Evidence for Large Language Model Routing

QUESTION — Comment pouvons-nous améliorer les décisions de routage de LLM en exploitant des preuves sémantiques indépendantes plutôt que de reposer uniquement sur des plongements de requêtes ?

L'article propose SeLMRoute, un cadre de routage de LLM qui sépare l'extraction de preuves sémantiques indépendantes de l'apprentissage des performances des modèles. Un modèle de décision évalue d'abord des questions interprétables sur les exigences de raisonnement d'une requête sous forme de distributions de probabilités. Un routeur supervisé léger utilise ensuite cet état sémantique probabiliste pour estimer les performances des candidats. Sur LLMRouterBench, SeLMRoute atteint une précision moyenne de 72,08 % pm 0,45, contre 69,23 % pour le candidat fixe le plus fort.

Sur le LLMRouterBench (15 jeux de données, 20 modèles candidats, 11 481 requêtes), SeLMRoute atteint une précision moyenne de 72,08 % pm 0,45.

L'évaluation groupée à cinq reprises atteint 72,64 %, contre 69,23 % pour le candidat fixe le plus fort.

Dans un cadre performance-coût distinct de 13 modèles, SeLMRoute améliore les performances dans les cinq divisions groupées, avec un PerfGain moyen de 2,66 %.

nikopavl · 28 sept. 2026 lire l'original ↗
↑