(Essayez l'IA de Yiaho, c'est gratuit !)
L’essentiel
- Grok 4.5 est sorti le 8 juillet 2026 : xAI (SpaceXAI) a ouvert son modèle « niveau Opus » au public, dans Grok Build, Cursor et sa console API.
- Benchmarks partagés le jour J. Chiffres officiels de xAI : Grok 4.5 bat Opus 4.8 sur 2 tests sur 4. Mesure indépendante d’Artificial Analysis : 4ᵉ place (score 54), derrière Fable 5, GPT-5.5 et Opus 4.8.
- Le vrai argument, c’est l’efficacité : très rapide (~80 tokens/s), 2 à 4× plus économe en tokens, et bien moins cher (2 $/6 $ par million de tokens).
- Premiers retours partagés entre l’enthousiasme (vitesse, prix) et les critiques (contexte réduit à 500k, taux d’hallucination élevé, pas encore en Europe, méfiance envers xAI).
Hier, nous avons publié ce que l’on savait de Grok 4.5 avant sa sortie : promesses, rumeurs et zones d’ombre. Ça, c’était l’annonce. Cet article-ci, c’est l’après : le modèle est désormais public, les premiers benchmarks tombent et les premiers utilisateurs le testent en conditions réelles. Voici une synthèse datée au 9 juillet 2026 des chiffres, des retours (positifs comme critiques) et de ce qu’il faut en penser.
Sortie confirmée
Grok 4.5 est disponible publiquement depuis le 8 juillet 2026. Il est le modèle par défaut de Grok Build, accessible dans l’éditeur de code Cursor (tous plans) et via la console SpaceXAI. Il n’est pas encore proposé dans l’Union européenne : xAI vise une disponibilité « mi-juillet ».
Ce qui a changé depuis l’annonce
La sortie publique a transformé plusieurs « promesses » en faits vérifiables, et confirmé quelques limites. Le point rapide :
- Confirmé : modèle bâti sur la nouvelle fondation « V9 » à 1 500 milliards de paramètres, entraîné aux côtés de Cursor (que SpaceX rachète). Prix officiels : 2 $ par million de tokens en entrée, 6 $ en sortie. Vitesse d’environ 80 tokens par seconde.
- Nuance importante : la fenêtre de contexte est de 500 000 tokens — soit deux fois moins que le million promis sur Grok 4.3. Elon Musk a réagi aux critiques en annonçant un passage à 1M « probablement d’ici la semaine prochaine ».
- Toujours flou : aucun benchmark totalement indépendant (LMArena, SWE-bench officiel, Humanity’s Last Exam) n’avait encore de score homologué au moment de la sortie, faute d’API publique pour les faire tourner. Seule Artificial Analysis a publié une évaluation tierce.
Le « vérificateur d’infos » (confirmé / promesse / rumeur) reste disponible dans notre article d’annonce. Ici, on se concentre sur les chiffres réels et les retours.
Les benchmarks : officiels xAI contre mesures indépendantes
C’est le nerf de la guerre — et le point où il faut être précis, car tous les chiffres ne se valent pas. On distingue nettement ce que xAI déclare de ce qu’un tiers a mesuré.
Ce que xAI met en avant (chiffres auto-déclarés)
Sur sa page de lancement, xAI a publié quatre benchmarks. Résultat : Grok 4.5 bat Opus 4.8 sur deux d’entre eux et perd sur les deux autres. À prendre pour ce que c’est — des chiffres maison, non vérifiés par un tiers.

| Benchmark (officiel xAI) | Grok 4.5 | Opus 4.8 | GPT-5.5 | Fable 5 |
|---|---|---|---|---|
| DeepSWE 1.0 | 62,0 % | 55,75 % | 64,31 % | 66,1 % |
| DeepSWE 1.1 | 53 % | 59 % | 67 % | 70 % |
| Terminal-Bench 2.1 | 83,3 % | 78,9 % | 83,4 % | 84,3 % |
| SWE-Bench Pro | 64,7 % | 69,2 % | — | 80,4 % |
Le chiffre qui impressionne n’est pas un score, c’est un ratio : sur SWE-Bench Pro, xAI affirme que Grok 4.5 résout les tâches avec 15 954 tokens de sortie en moyenne, contre 67 020 pour Opus 4.8 — un écart de 4,2×. Autrement dit : à qualité proche, il « parle » beaucoup moins pour arriver au résultat, ce qui réduit d’autant la facture.
Ce qu’un tiers indépendant a mesuré (Artificial Analysis)
Seul laboratoire tiers à avoir publié une évaluation le jour du lancement, Artificial Analysis situe Grok 4.5 4ᵉ de son « Intelligence Index » avec un score de 54, derrière Fable 5, GPT-5.5 et Opus 4.8 — mais avec un bond de 16 points par rapport à Grok 4.3. Sur son indice de codage agentique, Grok 4.5 (dans Grok Build) obtient 76, à parité avec GPT-5.5, pour un coût très inférieur.
Le point qui fâche : les hallucinations
Selon Artificial Analysis, le taux d’hallucination de Grok 4.5 grimpe à 54 % sur son test de connaissances (AA-Omniscience), contre 25 % pour Grok 4.3. Sa précision factuelle progresse (52 % contre 35 %), mais le modèle se trompe avec assurance bien plus souvent. À retenir avant de l’utiliser pour de la recherche factuelle : vérifiez ses réponses.
Comparez vous-même
Cliquez sur un benchmark pour voir comment Grok 4.5 se place face à Opus 4.8, GPT-5.5 et Fable 5. Les trois premiers onglets sont des chiffres officiels xAI ; le dernier (coût par tâche) vient d’Artificial Analysis, indépendant.
Comparateur de benchmarks
Grok 4.5 vs Opus 4.8, GPT-5.5 et Fable 5. Barre plus longue = meilleur.
Lecture : les 3 premiers onglets sont des chiffres auto-déclarés par xAI (non vérifiés par un tiers). L’onglet « Coût / tâche » vient d’Artificial Analysis (indépendant) — moins cher = mieux. Données au 9 juillet 2026.
Premiers retours des utilisateurs : entre enthousiasme et prudence
En moins de 48 heures, les réactions ont afflué sur X et les forums de développeurs. Le clivage est net : on salue la vitesse et le prix, on tique sur le contexte réduit, les hallucinations et la confiance envers xAI. Voici un échantillon équilibré de propos réels (verbatim, en anglais).

Côté enthousiaste
Sans surprise, l’annonce vient d’en haut. Elon Musk a lancé le modèle en insistant sur le triptyque capacité / vitesse / coût :
@elonmusk
Based on strong positive feedback from customers in our beta test program, @SpaceXAI will make Grok 4.5 available to the public tomorrow. It is an Opus-class model, but faster, more token-efficient and lower cost.
Du côté des outils, l’éditeur d’IA Cline a mis en avant le même angle — vitesse, efficacité, prix :
@cline
xAI has just released Grok 4.5, beating Opus 4.8 on Terminal-Bench. Notably, Grok 4.5 is served at fast speeds w/ 2x greater token efficiency than other top models, while being priced ~5x cheaper than GPT. Meaning it delivers the highest intelligence per unit of time and cost.
Sur le forum de Cursor, plusieurs développeurs confirment l’impression de rapidité et de coût imbattable :
Positif
It’s so fast even in non-fast and incredibly cheap
Et quelques démonstrations spectaculaires ont circulé. Le développeur Evan Bacon aurait construit en direct une application de suivi de fusées avec données en temps réel et globe 3D — « Ok Grok 4.5 is wild… I might need a new benchmark after this », rapporte VentureBeat.
Côté critique et nuancé
La communauté a aussi vite pointé les limites. La première : la fenêtre de contexte, ressentie comme un recul — et encore plus rabotée dans Cursor.
Musk a répondu publiquement à cette critique récurrente en promettant une montée en puissance rapide :
@elonmusk
Grok 4.5 context window will upgrade to 1M probably by next week
Deuxième grief, plus terre à terre : l’accès. Dans Cursor, Grok 4.5 est réservé aux abonnés haut de gamme.
Critique
First Cursor model hidden behind Max Only and not available to Legacy users
Sur Hacker News, le ton est plus mesuré : un modèle « correct » et bon marché, sans révolution — et, pour certains, un problème de confiance qui n’a rien à voir avec la technique.
Nuancé
Pretty decent, comparable with some older opus models, and fairly cheap per token
Critique
I just don’t think that I can ever trust an xAI model
Enfin, les analystes indépendants d’Artificial Analysis résument bien l’ambivalence : Grok 4.5 n’est pas le plus intelligent, mais il est nettement le plus efficient économiquement.
@ArtificialAnlys
SpaceXAI’s Grok 4.5 scores 54 to place fourth on the Artificial Analysis Intelligence Index following only Fable 5, GPT-5.5, and Opus 4.8. It scores on par with GPT-5.5 in Codex on the Artificial Analysis Coding Agent Index in the Grok Build harness, at much lower cost.
Transparence sur nos sources
Les citations ci-dessus sont réelles et attribuées (X, forum Cursor, Hacker News), avec lien vers le message d’origine. Nous n’avons pas trouvé, à cette date, de discussion Reddit vérifiable et citable sur Grok 4.5 (indexation encore incomplète moins de 48 h après la sortie) : nous nous en tenons donc aux forums de développeurs plutôt que de risquer une citation non vérifiée. Aucun propos n’a été inventé ni reformulé.
Prix, accès et limites : le récapitulatif
Au-delà des scores, ce sont ces chiffres concrets qui décideront de l’adoption au quotidien.
- Où l’utiliser : Grok Build (modèle par défaut, avec un accès gratuit pour tester), l’éditeur Cursor (réservé au plan Max), et la console API SpaceXAI. De nombreuses passerelles (OpenRouter, Vercel, Cloudflare, Databricks…) le prennent en charge.
- Coût : parmi les plus bas de sa catégorie. Cache à 0,50 $ par million de tokens (75 % de réduction sur les entrées répétées).
- Limites du jour : pas de disponibilité UE avant « mi-juillet » ; contexte à 500k ; taux d’hallucination élevé sur les questions factuelles ; benchmarks maison non homologués.
Grok 4.5 face à la concurrence
Le même 9 juillet, OpenAI ouvrait aussi sa famille GPT-5.6 (Sol, Terra, Luna) : la semaine est chargée. Voici comment situer Grok 4.5 face aux modèles de tête.
| Critère | Grok 4.5 | Opus 4.8 | GPT-5.5 | Fable 5 |
|---|---|---|---|---|
| Intelligence (AA Index) | 54 (4ᵉ) | Top 3 | Top 3 | 1ᵉʳ |
| Coût par tâche codage (AA) | 2,49 $ | — | 5,07 $ | 11,80 $ |
| Vitesse | Très rapide | Moyenne | Rapide | Moyenne |
| Contexte | 500k | Élevé | Élevé | Élevé |
| Disponible en Europe | Pas encore | Oui | Oui | Oui |
— Elon Musk, sur X, juillet 2026
Traduction : xAI assume de ne pas viser la première place des classements, mais le meilleur rapport intelligence / vitesse / prix. Pour un usage codage et agentique à gros volume, l’argument est sérieux. Pour de la recherche factuelle exigeante, la prudence reste de mise. Besoin d’un panorama plus large ? Voyez notre guide complet de l’IA et notre point sur Claude Fable 5 ou l’alternative chinoise GLM-5.2.
Alors, faut-il l’adopter ?
- Oui, si vous codez ou automatisez à gros volume, que le coût et la vitesse priment, et que vous travaillez déjà dans Cursor ou via API.
- À tempérer, si vous avez besoin d’un très grand contexte, d’une fiabilité factuelle maximale, ou d’un accès depuis l’Europe dès maintenant.
- Attendez un peu, si vous voulez des benchmarks indépendants complets (LMArena, SWE-bench officiel) : ils manquaient encore au 9 juillet.
FAQ — Grok 4.5
Quand Grok 4.5 est-il sorti ?
Publiquement le 8 juillet 2026, après une phase de bêta chez SpaceX et Tesla. Il est le modèle par défaut de Grok Build.
Grok 4.5 est-il meilleur que Claude Opus 4.8 ou GPT-5.5 ?
Cela dépend du critère. Sur l’« Intelligence Index » indépendant d’Artificial Analysis, il est 4ᵉ, derrière Fable 5, GPT-5.5 et Opus 4.8. Mais il est nettement plus rapide et moins cher, et bat Opus 4.8 sur certains tests de codage (chiffres xAI). Son avantage est l’efficacité, pas la puissance brute.
Grok 4.5 est-il disponible en France ?
Pas encore. Au 9 juillet 2026, il n’est proposé ni dans l’UE via les produits SpaceXAI ni via l’API dans l’UE ; une disponibilité « mi-juillet » est annoncée. En attendant, vous pouvez tester une IA gratuite et sans inscription directement sur Yiaho.
Combien coûte Grok 4.5 ?
2 $ par million de tokens en entrée, 6 $ en sortie, avec un cache à 0,50 $/million. C’est parmi les tarifs les plus bas de sa catégorie. Grok Build propose aussi un accès gratuit pour l’essayer.
Quelle est sa fenêtre de contexte ?
500 000 tokens à la sortie (deux fois moins que le million de Grok 4.3). Elon Musk a annoncé un passage à 1M « probablement d’ici la semaine prochaine ». Dans Cursor, la limite observée par des utilisateurs était même de 256k.
Peut-on se fier à ses benchmarks ?
Les quatre benchmarks mis en avant sont auto-déclarés par xAI et non vérifiés par un tiers. Seul Artificial Analysis avait publié une évaluation indépendante au lancement. À prendre avec du recul, surtout le taux d’hallucination (54 %) mesuré côté indépendant.
Pas d’accès à Grok 4.5 en Europe ? Testez une IA gratuite tout de suite
Yiaho vous donne accès à une IA en ligne, en français, sans inscription et en illimité — de quoi coder, rédiger et poser vos questions dès maintenant.
Sources : page officielle « Introducing Grok 4.5 » (x.ai) ; Artificial Analysis (Intelligence Index, coût par tâche, AA-Omniscience) ; posts X de @elonmusk, @cline et @ArtificialAnlys ; forum Cursor et Hacker News ; TechCrunch, Axios et VentureBeat. Chiffres datés au 9 juillet 2026. Les benchmarks xAI sont auto-déclarés ; seule l’évaluation d’Artificial Analysis est indépendante à cette date.


