Les laboratoires publient de nouveaux modèles et benchmarks pour agents
Labs release new models and scientific agent benchmark leaderboards
La communauté de l'IA a lancé le classement Terminal-Bench-Science 0.1 pour les agents de recherche scientifique, parallèlement à des rapports sur de nouveaux entraînements de modèles à grande échelle chez DeepSeek. Des modèles économiques comme Gemini 3.8 Flash ont également été déployés.
10 comptes indépendants
70 messages
1 articles
3 labos
34 495 interactions
qwen3deepseek v4deepseekglmkv cachedeepseek v4 flashmixture of expertsqwen3.8
@AlexFinn
@ArtificialAnlys
@ClementDelangue
@EMostaque
@Hesamation
@OpenRouter
@PrismML
@alex_prompter
https://z.ai/ z.ai