De nouveaux modèles atteignent les sommets des benchmarks d'évaluation de l'IA
New models achieve top rankings across AI evaluation benchmarks
Plusieurs nouveaux modèles d'intelligence artificielle ont atteint des positions de premier plan sur les benchmarks techniques et les indices de cybersécurité. Google a lancé Gemini 4 Argon égalant GPT-6 Astra à moindre coût, tandis que Grok 4.7 s'est imposé en tête de l'AA Cyber Index et que Claude Opus 5.5 a progressé sur Drone-Bench.
15 comptes indépendants
139 messages
2 articles
7 labos
224 487 interactions
anthropicgooglegroknvidiaastradeepseekclaude opusclaude sonnet
@AlexFinn
@AndrewCurran_
@AravSrinivas
@ArtificialAnlys
@ClaudeDevs
@Hesamation
@OpenAI
@PromptLLM
Sonnet 5.5 anthropic.com