Grok 4.6 : xAI ne vise pas la première place, il vise le prix
Sorti le 12 août, le nouveau modèle de xAI se place dans le peloton de tête des modèles frontière. Sa vraie proposition est ailleurs : cinq fois moins cher en entrée et plus de huit fois moins cher en sortie que Claude Fable 5.

Photo : Growtika / Unsplash
xAI a publié Grok 4.6 le 12 août 2026. Le modèle est disponible dans Cursor, Grok Build, l'API, ainsi que via OpenRouter, Vercel et Cloudflare.
La communication de l'entreprise met en avant les tâches longues — « les agents qui tournent longtemps » — et le travail visuel ou interactif. C'est cohérent avec les chiffres publiés, et c'est aussi là que se joue la concurrence en ce moment.
Les chiffres annoncés par xAI
AA Intelligence Index : 61, à égalité avec GPT-5.6 Sol.
GDPval-AA v2 : 1753.
CursorBench v3.2 : 69,9 %.
DeepSWE v1.1 : 65,9 %, contre 54 pour Grok 4.5.
FrontierCode v1.1 : 61,3 %.
Le saut sur DeepSWE est le plus parlant : près de douze points en une itération sur une épreuve de résolution de tickets logiciels. xAI attribue ces gains à un entraînement supplémentaire plus long, à des données de raisonnement générées par le modèle puis triées, à un optimiseur revu, à des trajectoires d'apprentissage supervisé régénérées, et à un apprentissage par renforcement agentique étendu à plusieurs domaines.
L'entreprise décrit aussi un comportement plus qu'un score : le modèle se teste et se vérifie davantage lui-même sur les tâches longues. C'est le genre d'amélioration qui ne se lit pas dans un classement mais qui change tout sur une session de deux heures.
Le vrai argument : le prix
Grok 4.6 est facturé :
2 dollars par million de tokens en entrée ;
6 dollars par million de tokens en sortie ;
0,50 dollar par million de tokens en entrée mise en cache ;
le double pour la variante plus rapide.
Mis en regard de la concurrence sur le même segment, l'écart n'a rien d'anecdotique. Claude Fable 5 est à 10 et 50 dollars, GPT-5.6 Sol à 5 et 30 dollars. Pour un score d'intelligence agrégé du même ordre, la sortie de Grok 4.6 coûte plus de huit fois moins cher que celle de Fable 5.
Ce que xAI ne met pas en avant
Deux chiffres relevés par l'agrégateur BenchLM méritent d'être mentionnés, en gardant à l'esprit qu'il s'agit d'une mesure tierce et non de données constructeur.
Le débit est mesuré à 66 tokens par seconde, contre une médiane de 94 sur les modèles suivis. Et la latence avant le premier token atteint 32 secondes — un chiffre qui paraît énorme hors contexte, mais qui correspond au temps de réflexion d'un modèle de raisonnement avant qu'il ne commence à répondre. Ce n'est pas un défaut en soi ; c'est un mauvais choix pour un usage conversationnel, et sans importance pour un agent qui tourne en arrière-plan.
La fenêtre de contexte est de 500 000 tokens selon la même source. Elle n'apparaît pas sur la page d'annonce de xAI.
Où ça le place
Sur l'instantané de l'index Artificial Analysis relevé le 14 août, Grok 4.6 arrive troisième, derrière Claude Opus 5 et Claude Fable 5. xAI, de son côté, annonce 61 points et une égalité avec GPT-5.6 Sol, que le même instantané place cinquième à 58,9.
Cette divergence n'est pas un détail, et elle mérite qu'on s'y arrête — c'est l'objet de notre comparatif des modèles frontière. Retenez surtout ceci : dans le peloton de tête, les écarts d'intelligence se comptent en points et changent d'un relevé à l'autre. Les écarts de prix, eux, se comptent en multiples et ne bougent pas.
Sources
xAI, « Introducing Grok 4.6 », 12 août 2026. Mesures de débit, latence et contexte : BenchLM, relevé du 14 août 2026. Tarifs de la concurrence : Artificial Analysis.
À lire ensuite
OpenAI suspend les nouveaux abonnements ChatGPT Pro, débordée par la demande pour GPT-6 Astra
OpenAI a suspendu les nouvelles souscriptions à ChatGPT Pro, invoquant une demande sans précédent pour GPT-6 Astra. Les abonnés déjà inscrits ne sont pas concernés. La mesure fait écho, sans lui être formellement liée, à des propos de Sam Altman sur un ralentissement possible du rythme de l'IA.
Kelvyn3 min de lecture
DeepSeek V4.1 Flash mise sur des « N-grammes » pour alléger la mémoire de son modèle
DeepSeek dévoile V4.1 Flash, une mise à jour qui introduit des « N-grammes », un nouveau type de paramètres censé réduire fortement la consommation mémoire. Les chiffres d'efficience sont documentés, mais aucun benchmark de qualité ne vient encore les mettre en perspective.
Kelvyn2 min de lecture
Universal Music lance une plateforme IA de remix musical avec ElevenLabs
Universal Music Group annonce un accord pluriannuel avec ElevenLabs pour une plateforme IA de remix et mashup musicaux. La participation des artistes est optionnelle et aucune date de lancement public n'a été fixée.
Kelvyn3 min de lecture