CONSONANCE.for your information
lundi 5 octobre 2026frenvi

En discussion

01 — evaluation 10 VOIX

Les laboratoires publient de nouveaux modèles et benchmarks pour agents

Labs release new models and scientific agent benchmark leaderboards

La communauté de l'IA a lancé le classement Terminal-Bench-Science 0.1 pour les agents de recherche scientifique, parallèlement à des rapports sur de nouveaux entraînements de modèles à grande échelle chez DeepSeek. Des modèles économiques comme Gemini 3.8 Flash ont également été déployés.

10 comptes indépendants 70 messages 1 articles 3 labos 34 495 interactions
qwen3deepseek v4deepseekglmkv cachedeepseek v4 flashmixture of expertsqwen3.8
@AlexFinn ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@ClementDelangue ses sujets sur X ↗
@EMostaque ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OpenRouter ses sujets sur X ↗
@PrismML ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
↑