![]()
Flash
2 dollars le million de tokens en entrée, 6 dollars en sortie. xAI a mis Grok 4.7 en ligne le 21 septembre 2026 dans Cursor, Grok Build et son API, avec une promesse recopiée telle quelle sur sa page d’annonce : « deux fois plus rapide, à la moitié du prix des modèles comparables ».
Au 22 septembre 2026, un aller-retour d’un million de tokens coûte 8 dollars sur Grok 4.7 contre 60 dollars sur GPT-6 Astra, soit 7,5 fois moins. L’unité additionne le tarif d’entrée et le tarif de sortie pour un million de tokens de chaque côté. Une équipe qui brûle 1 000 dollars d’API par mois chez OpenAI en dépenserait environ 133 à volume identique chez xAI.
À retenir
- xAI annonce 46,3 % sur le test de code CursorBench 4.0, contre 40,4 % pour Grok 4.6, et 64,0 % sur EEBench contre 53,0 %.
- Sur ce même tableau, l’éditeur place pourtant Fable 5.1 devant sur CursorBench (51,8 %) et GPT-5.6 Sol devant sur DeepSWE v1.1 (72,7 %).
- La fenêtre de contexte monte à 500 000 tokens, mais la facturation change de palier bien avant.
- Une variante rapide est proposée au double du tarif, pour le double de la vitesse.
Le prix affiché n’est pas le prix payé.
La documentation de l’API ajoute un palier que la page d’annonce passe sous silence : au-delà de 200 000 tokens de contexte, l’entrée passe à 4 dollars et la sortie à 12. Les tarifs publiés par OpenAI appliquent la même mécanique à Astra, avec 20 dollars en entrée et 75 en sortie dès la bascule en contexte long.
La grille d’Astra, détaillée le 5 septembre 2026, plaçait déjà l’aller-retour court à 60 dollars, et le coût par exécution grimpait de 14,6 % malgré 42,7 % de jetons consommés en moins. Mises sur la même unité, les six configurations se lisent d’un coup d’œil.
| Configuration | Entrée ($ / million) | Sortie ($ / million) | Aller-retour |
|---|---|---|---|
| Grok 4.7, contexte sous 200 000 tokens | 2 | 6 | 8 $ |
| Grok 4.7, contexte de 200 000 tokens et plus | 4 | 12 | 16 $ |
| Grok 4.7, variante rapide (double tarif annoncé) | 4 | 12 | 16 $ |
| GPT-6 Astra, contexte court | 10 | 50 | 60 $ |
| GPT-6 Astra, contexte long | 20 | 75 | 95 $ |
| GPT-6 Astra, mode rapide, contexte court | 20 | 100 | 120 $ |
Pourquoi ça compte : un modèle de code se paie à l’usage, et un agent qui relit son propre travail consomme des millions de tokens par tâche. xAI écrit justement que Grok 4.7 « vérifie mieux son propre travail et gère mieux les contextes longs ». Plus l’agent se relit, plus le compteur tourne. À ce régime, le tarif pèse autant que le score.
OpenAI ne propose pas son mode rapide aux clients qui exigent la résidence des données dans l’Union européenne. Pour une équipe parisienne, ça fait une case en moins à cocher et une colonne en moins à comparer.
Votre réaction :
Article créé en collaboration avec l’IA.
Les plus lus
- 1
Taratata 600 : la date d’enregistrement et celle de diffusion - 2
Mondiaux de cyclisme : le maillot arc-en-ciel rapporte 8 000 euros, moins qu’une étape du Tour - 3
Prix du roman Fnac 2026 : « C’était ça ou mourir » lauréat - 4
Résultats des évaluations nationales 2026, dès le 21 septembre - 5
Résultat du Super Loto du 18 septembre : 13 millions gagnés
Nos dossiers
- France395
- Science278
- Culture196
- Consommation173
- Santé publique168
- Patrimoine167
- IA166
- Sport159
Recevez notre sélection dans votre boîte mail
Le meilleur d’Actu Alt Plus : décryptages, chiffres et panoramas. Désinscription en 1 clic, zéro spam.

