CONSONANCE.for your information
lundi 5 octobre 2026frenvi

En discussion

01 — evaluation 15 VOIX

De nouveaux modèles atteignent les sommets des benchmarks d'évaluation de l'IA

New models achieve top rankings across AI evaluation benchmarks

Plusieurs nouveaux modèles d'intelligence artificielle ont atteint des positions de premier plan sur les benchmarks techniques et les indices de cybersécurité. Google a lancé Gemini 4 Argon égalant GPT-6 Astra à moindre coût, tandis que Grok 4.7 s'est imposé en tête de l'AA Cyber Index et que Claude Opus 5.5 a progressé sur Drone-Bench.

15 comptes indépendants 139 messages 2 articles 7 labos 224 487 interactions
anthropicgooglegroknvidiaastradeepseekclaude opusclaude sonnet
@AlexFinn ses sujets sur X ↗
@AndrewCurran_ ses sujets sur X ↗
@AravSrinivas ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@ClaudeDevs ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@PromptLLM ses sujets sur X ↗
↑