Aller au contenu
KLYNLABS

Grok 4.6 : xAI ne vise pas la première place, il vise le prix

Sorti le 12 août, le nouveau modèle de xAI se place dans le peloton de tête des modèles frontière. Sa vraie proposition est ailleurs : cinq fois moins cher en entrée et plus de huit fois moins cher en sortie que Claude Fable 5.

Kelvyn3 min de lecture

xAI a publié Grok 4.6 le 12 août 2026. Le modèle est disponible dans Cursor, Grok Build, l'API, ainsi que via OpenRouter, Vercel et Cloudflare.

La communication de l'entreprise met en avant les tâches longues — « les agents qui tournent longtemps » — et le travail visuel ou interactif. C'est cohérent avec les chiffres publiés, et c'est aussi là que se joue la concurrence en ce moment.

Les chiffres annoncés par xAI

  • AA Intelligence Index : 61, à égalité avec GPT-5.6 Sol.

  • GDPval-AA v2 : 1753.

  • CursorBench v3.2 : 69,9 %.

  • DeepSWE v1.1 : 65,9 %, contre 54 pour Grok 4.5.

  • FrontierCode v1.1 : 61,3 %.

Le saut sur DeepSWE est le plus parlant : près de douze points en une itération sur une épreuve de résolution de tickets logiciels. xAI attribue ces gains à un entraînement supplémentaire plus long, à des données de raisonnement générées par le modèle puis triées, à un optimiseur revu, à des trajectoires d'apprentissage supervisé régénérées, et à un apprentissage par renforcement agentique étendu à plusieurs domaines.

L'entreprise décrit aussi un comportement plus qu'un score : le modèle se teste et se vérifie davantage lui-même sur les tâches longues. C'est le genre d'amélioration qui ne se lit pas dans un classement mais qui change tout sur une session de deux heures.

Le vrai argument : le prix

Grok 4.6 est facturé :

  • 2 dollars par million de tokens en entrée ;

  • 6 dollars par million de tokens en sortie ;

  • 0,50 dollar par million de tokens en entrée mise en cache ;

  • le double pour la variante plus rapide.

Mis en regard de la concurrence sur le même segment, l'écart n'a rien d'anecdotique. Claude Fable 5 est à 10 et 50 dollars, GPT-5.6 Sol à 5 et 30 dollars. Pour un score d'intelligence agrégé du même ordre, la sortie de Grok 4.6 coûte plus de huit fois moins cher que celle de Fable 5.

Ce que xAI ne met pas en avant

Deux chiffres relevés par l'agrégateur BenchLM méritent d'être mentionnés, en gardant à l'esprit qu'il s'agit d'une mesure tierce et non de données constructeur.

Le débit est mesuré à 66 tokens par seconde, contre une médiane de 94 sur les modèles suivis. Et la latence avant le premier token atteint 32 secondes — un chiffre qui paraît énorme hors contexte, mais qui correspond au temps de réflexion d'un modèle de raisonnement avant qu'il ne commence à répondre. Ce n'est pas un défaut en soi ; c'est un mauvais choix pour un usage conversationnel, et sans importance pour un agent qui tourne en arrière-plan.

La fenêtre de contexte est de 500 000 tokens selon la même source. Elle n'apparaît pas sur la page d'annonce de xAI.

Où ça le place

Sur l'instantané de l'index Artificial Analysis relevé le 14 août, Grok 4.6 arrive troisième, derrière Claude Opus 5 et Claude Fable 5. xAI, de son côté, annonce 61 points et une égalité avec GPT-5.6 Sol, que le même instantané place cinquième à 58,9.

Cette divergence n'est pas un détail, et elle mérite qu'on s'y arrête — c'est l'objet de notre comparatif des modèles frontière. Retenez surtout ceci : dans le peloton de tête, les écarts d'intelligence se comptent en points et changent d'un relevé à l'autre. Les écarts de prix, eux, se comptent en multiples et ne bougent pas.

Sources

xAI, « Introducing Grok 4.6 », 12 août 2026. Mesures de débit, latence et contexte : BenchLM, relevé du 14 août 2026. Tarifs de la concurrence : Artificial Analysis.

À lire ensuite