Grok 4.7 xHigh atteint 58% sur le benchmark AA-Briefcase d'Artificial Analysis
Grok 4.7 xHigh scores 58% on Artificial Analysis AA-Briefcase benchmark
Grok 4.7 xHigh a atteint 58 % sur le benchmark AA-Briefcase d'Artificial Analysis, se classant juste un point derrière Claude Fable 5.1 Max à 59 %. Par ailleurs, le modèle furtif Pixel Canary a été lancé sur Cline, à égalité avec GPT-6 Astra et surpassant Kimi K3 sur le benchmark Next.js Agent Evals.
7 comptes indépendants
36 messages
3 labos
207 318 interactions
kimi k3glmllamallama.cpp