Le 8 juillet 2026, xAI a publié Grok 4.5, son premier modèle conçu spécifiquement pour le codage et les tâches agentiques. Il ne s'agit pas d'une mise à niveau des capacités générales. C'est un pivot délibéré vers les développeurs, avec un entraînement réalisé à partir de vraies données de sessions Cursor et des benchmarks conçus pour mesurer ce qu'une IA peut réellement accomplir dans une base de code réelle sur une longue session. Il a été supplanté le 12 août 2026 par Grok 4.6, une mise à niveau post-entraînement reposant sur la même architecture.
Le résultat est un modèle qui obtient 56 à l'Artificial Analysis Intelligence Index, devançant tous les modèles Gemini, à une fraction du coût de fonctionnement des modèles les plus récents. Artificial Analysis a dépensé $0,36 pour faire passer Grok 4.5 à travers l'index, contre $1,23 pour GPT-5.6 Sol et $2,34 pour Claude Opus 5 au raisonnement maximal.
Elon Musk l'a formulé directement : « C'est un modèle de la classe Opus, mais plus rapide, plus économe en tokens et moins coûteux. » Dans un message de suivi, il a été plus précis : « Grok 4.5 est à peu près comparable à Opus 4.7, mais bien plus rapide. »
Musk a également signalé que les vitesses actuelles ne sont pas le plafond. xAI n'a pas encore déployé sa pile d'inférence interne en C/C++ qui s'interface directement avec le matériel GB300, et lorsqu'il le fera, il s'attend à un doublement ou davantage de la vitesse. Il a annoncé une prochaine amélioration significative pour le mois suivant ; au 10 août 2026, rien n'a encore été publié, et grok-4.5-latest reste l'alias actuel dans la liste de modèles de xAI.
L'essentiel à retenir
- Grok 4.5 a été lancé le 8 juillet 2026 et obtient 56 à l'Artificial Analysis Intelligence Index v4.1.1, devançant tous les modèles Gemini. Il s'est classé 4e au lancement et occupe désormais la 15e place sur 185 entrées.
- Fondé sur le modèle de base V9 à 1,5 trillion de paramètres et entraîné sur de vraies données de sessions Cursor pour le codage et les tâches agentiques.
- Tarifé à $2 / $6 par million de tokens, avec les entrées en cache à $0,30, contre $5 / $25 pour Claude Opus 5 actuel. Sur Artificial Analysis, c'est le modèle le moins cher du top 15 à faire passer par l'Intelligence Index.
- Très économe en tokens, utilisant environ 14 000 tokens de sortie par tâche de l'Intelligence Index contre 67 020 pour Opus 4.8 selon la comparaison du jour de lancement de xAI.
- Musk le qualifie de « classe Opus, mais plus rapide », avec une pile d'inférence personnalisée censée doubler les actuels ~80 tokens/s.
Ce qu'est vraiment Grok 4.5
Grok 4.5 est le premier modèle de xAI entraîné de zéro pour le codage et les tâches agentiques plutôt que pour l'intelligence générale. Fondé sur le modèle de base V9 à 1,5 trillion de paramètres, il a été entraîné en partenariat avec Cursor pour gérer des travaux de longue durée sur plusieurs dépôts et fonctionner avec une intervention humaine minimale sur des centaines d'appels d'outils. Ce partenariat a ensuite donné naissance au produit agent de SpaceXAI, qui applique la même approche dans une application de bureau.
Les spécifications principales sont simples.
| Spécification | Détail |
|---|---|
| Nom du modèle API | grok-4.5 |
| Architecture | Modèle de base V9, 1,5 trillion de paramètres (3x plus grand que le V8 de Grok 4.3) |
| Fenêtre de contexte | 500 000 tokens |
| Vitesse | environ 80 tokens par seconde |
| Modalités d'entrée | texte et images (vision) |
| Raisonnement | configurable à faible, moyen, élevé ou très élevé (par défaut : élevé) |
| API supportées | Responses API et Chat Completions |
| Capacités intégrées | appel de fonctions, recherche web, recherche X, exécution de code |
Le nom V9 marque un changement de génération complet par rapport à la série V8 qui propulsait Grok 4.3, triplant l'échelle tout en orientant entièrement l'entraînement vers le codage et les tâches agentiques. La fenêtre de contexte est passée du million de tokens de Grok 4.3 à 500 000, ce qui représente un vrai compromis pour ceux qui avaient besoin du million complet.
Le lien avec Cursor
La mention « entraîné avec Cursor » dans l'annonce n'est pas qu'un simple partenariat marketing. Mi-juin 2026, SpaceX a acquis Cursor pour environ 60 milliards de dollars, intégrant l'un des éditeurs de codage IA les plus utilisés directement dans l'écosystème xAI. C'est cette acquisition qui explique pourquoi l'entraînement de Grok 4.5 a incorporé de vraies données de sessions Cursor, offrant à xAI un accès direct aux workflows réels, aux schémas de contexte et aux structures de tâches longues qu'utilisent les développeurs en production.
Contrairement à un entraînement sur des dépôts de code publics, les données de sessions réelles capturent la façon dont les développeurs itèrent sur un problème, changent de contexte entre les fichiers et prennent des décisions en plusieurs étapes dans des projets concrets. Grok 4.5 est le premier modèle à refléter cette réalité.
xAI a également introduit une nouvelle méthodologie d'entraînement avec ce modèle, l'apprentissage asynchrone, qui permet aux sessions d'entraînement agentiques de plusieurs heures de se dérouler en parallèle avec l'entraînement continu du modèle plutôt que séquentiellement. L'effet pratique est que les boucles de rétroaction entre le comportement du modèle et ses mises à jour d'entraînement sont bien plus serrées, ce qui permet au modèle de gérer le type de sessions autonomes prolongées sur lesquelles la plupart des agents calent habituellement.
Résultats des benchmarks
Benchmarks publiés par xAI au lancement
| Benchmark | Fable 5 | GPT-5.5 | Grok 4.5 | Opus 4.8 | GLM-5.2 |
|---|---|---|---|---|---|
| DeepSWE 1.0 | 66,1 % | 64,3 % | 62,0 % | 55,8 % | n/a |
| DeepSWE 1.1 | 70,0 % | 67,0 % | 53,0 % | 59,0 % | 44,0 % |
| Terminal-Bench 2.1 | 84,3 % | 83,4 % | 83,3 % | 78,9 % | n/a |
| SWE-Bench Pro | 80,4 % | n/a | 64,7 % | 69,2 % | 62,1 % |
Ce sont les chiffres publiés par xAI le 8 juillet 2026, mesurés face aux modèles en vigueur ce jour-là. En lecture directe : Grok 4.5 surpasse Opus 4.8 sur deux des quatre benchmarks (DeepSWE 1.0 et Terminal-Bench 2.1) et lui est inférieur sur les deux autres (DeepSWE 1.1 et SWE-Bench Pro). Claude Fable 5 arrive en tête sur les quatre, et sur Terminal-Bench 2.1 l'écart entre Grok 4.5 (83,3 %) et GPT-5.5 (83,4 %) est d'un dixième de point. Opus 4.8 et GPT-5.5 ont depuis été supplantés par Claude Opus 5 et GPT-5.6 Sol, pour lesquels xAI n'a publié aucun chiffre comparatif, aussi la section sur le classement actuel est-elle la référence pertinente pour tout choix d'achat.
Benchmarks indépendants d'Artificial Analysis
Sur l'Artificial Analysis Intelligence Index, désormais à la version v4.1.1, Grok 4.5 en raisonnement élevé obtient 56. Grok 4.3 obtient 37 en raisonnement moyen sur le même tableau, ce qui fait de ce résultat le plus grand bond de génération en génération que xAI ait jamais affiché sur cet index ; Grok 4.5 surpasse encore tous les modèles Gemini listés, le meilleur d'entre eux, Gemini 3.6 Flash, plafonnant à 52. Le score lui-même est passé de 54 à 56 en août parce qu'Artificial Analysis a réévalué l'ensemble du tableau à la hausse dans sa v4.1.1, non parce que le modèle a changé.
Sa position a évolué, cependant, et cela mérite d'être dit clairement. Grok 4.5 était classé quatrième sur 168 entrées au lancement le 8 juillet. Au tableau actuel, il est 15e sur 185, avec Claude Opus 5, Claude Fable 5, GPT-5.6 Sol, Kimi K3, Qwen3.8 Max, Muse Spark 1.2 et GPT-5.6 Terra le devançant tous. Claude Opus 4.8, contre lequel Grok 4.5 a été évalué au lancement, n'est plus répertorié dans le tableau. Le score n'a pas baissé, c'est le domaine qui a avancé.
Une affirmation faite au lancement ne tient plus. Grok 4.5 ne surpasse plus tous les modèles open source, car Kimi K3 a publié ses poids ouverts le 27 juillet 2026 et obtient 60 sur le même index.
Sur GDPval-AA v2, le benchmark mesurant le travail de connaissance agentique soutenu, Grok 4.5 obtient un Elo de 1 543, devant GLM-5.2 à 1 513 et derrière Claude Opus 4.8 à 1 600. Il était classé quatrième au lancement, mais Claude Opus 5 a depuis affiché 1 861 sur le même benchmark, cette position ayant donc aussi évolué. Sur la sous-tâche de raisonnement financier la plus difficile, tau3-Banking, Grok 4.5 atteint 33 %, le meilleur score parmi tous les modèles évalués, devançant GPT-5.5 (xhigh) à 31 %.
Sur l'Artificial Analysis Coding Agent Index (DeepSWE, Terminal-Bench v2 et SWE-Atlas QnA combinés), Grok 4.5 dans le harnais Grok Build obtient 76, se classant troisième. Il est au même niveau que GPT-5.5 (xhigh) dans Codex et se situe juste sous Fable 5 (max) dans Claude Code.
xAI publie également les résultats du Harvey Legal Agent Benchmark, où Grok 4.5 se classe premier. Combiné au meilleur score tau3-Banking, cela indique que le droit et le travail de connaissance financière constituent des points forts spécifiques au-delà de ce que les benchmarks de codage seuls permettent de mesurer.

Efficacité en tokens
Le prix par token est le chiffre mis en avant, mais l'efficacité en tokens est la donnée la plus significative. Sur SWE-Bench Pro, Grok 4.5 a utilisé environ 15 954 tokens de sortie par tâche contre 67 020 pour Opus 4.8, soit un écart de 4,2x. Sur l'Artificial Analysis Intelligence Index, il utilise environ 14 000 tokens de sortie par tâche, plus de 60 % de moins qu'Opus 4.8. Sur le Coding Agent Index, il mobilise en moyenne 1,9 million de tokens au total par tâche, contre 7,2 millions pour Fable 5 dans Claude Code et 6,2 millions pour GPT-5.5 dans Codex.
Un modèle qui utilise 4x moins de tokens n'est pas seulement moins cher par tâche. Il est plus rapide et génère moins de bruit dans les pipelines agentiques, ce qui compte pour les travaux autonomes en plusieurs étapes.
Tarifs et coût par tâche
Grok 4.5 est tarifé à $2,00 par million de tokens en entrée et $6,00 par million de tokens en sortie. Les hits de cache bénéficient d'une remise de 85 %, ramenant les tokens en entrée mis en cache à $0,30 par million. Un point important : les tarifs doublent pour les entrées de plus de 200 000 tokens. Pour une ventilation complète des abonnements Grok et des tarifs API, y compris les offres grand public, ce guide couvre toutes les options.
Face à la frontière actuelle, c'est bien moins de la moitié de ce que Claude Opus 5 facture à $5 / $25. Mais le coût par tâche est la donnée la plus parlante, car il tient compte du nombre de tokens réellement consommés par chaque modèle. Le tableau ci-dessous reprend les chiffres de xAI et d'Artificial Analysis tels que publiés au lancement en juillet 2026.
| Modèle | Entrée (par 1M) | Sortie (par 1M) | Coût par tâche Intelligence Index | Coût par tâche Coding Agent |
|---|---|---|---|---|
| Grok 4.5 | $2,00 | $6,00 | $0,31 | $2,49 |
| GPT-5.5 (Codex) | $5,00 | $30,00 | higher | $5,07 |
| Fable 5 (Claude Code) | $10,00 | $50,00 | higher | $11,80 |
| Opus 4.8 | $5,00 | $25,00 | higher | n/a |
Les chiffres par tâche sont ceux qui comptent vraiment à l'échelle de la production. Grok 4.5 a atteint des performances d'agent de codage quasi équivalentes à environ la moitié du coût de GPT-5.5 et moins du quart du coût de Fable 5 par tâche accomplie. Cet avantage s'est maintenu à mesure que le domaine a progressé. Sur l'Intelligence Index actuel, Artificial Analysis chiffre le coût d'utilisation de Grok 4.5 à $0,36 contre $1,23 pour GPT-5.6 Sol et $2,34 pour Claude Opus 5, tous deux au raisonnement maximal.
Disponibilité de Grok 4.5
Grok 4.5 est devenu disponible sur un large ensemble de plateformes dès le jour du lancement. Il est accessible dans l'API xAI sous le nom de modèle grok-4.5, dans Grok Build (le harnais d'agent de codage de xAI) et dans Cursor sur tous les plans. L'accès tiers couvre OpenRouter, Vercel, Cloudflare, Snowflake et Databricks Mosaic. Il est également disponible dans Fello AI sur Mac, iPhone et iPad.
Le lancement du plugin Office est notable. xAI positionne Grok 4.5 non seulement comme un modèle de codage, mais aussi comme un modèle de travail de connaissance capable de construire des modèles Excel complexes intégrant de la recherche web et de générer du contenu PowerPoint sophistiqué. Cela élargit le champ d'application bien au-delà du développement logiciel.
L'accès en Europe est désormais ouvert. Grok 4.5 a été lancé dans 47 pays mais était bloqué dans les 27 États membres de l'UE, un délai attribué aux travaux de conformité au titre de la loi européenne sur l'IA, qui traite les modèles entraînés au-delà de 1025 FLOPs comme présentant un risque systémique. xAI a ouvert l'accès à l'UE plus tard en juillet 2026, et sa documentation développeur ne porte plus la restriction régionale qu'elle affichait au lancement.
Le modèle prend en charge les formats Responses API et Chat Completions, ce qui lui permet de s'intégrer dans des bases de code déjà construites sur des API compatibles OpenAI sans modification.
Ce qu'a dit Elon Musk
Musk a fait plusieurs déclarations autour du jour du lancement qui indiquent la place de ce modèle et son évolution future.
Sur le positionnement des capacités : « C'est un modèle de la classe Opus, mais plus rapide, plus économe en tokens et moins coûteux », avec une précision ultérieure indiquant qu'il est « à peu près comparable à Opus 4.7, mais bien plus rapide ». Ce dernier détail compte. Musk se compare à Opus 4.7, pas à 4.8, ce que les données indépendantes confirment largement.
Sur le plafond de vitesse : « Grok 4.5 n'utilise pas encore notre logiciel d'inférence C/C++ développé en interne, qui s'interface exactement avec le matériel GB300. Doubler ou plus la vitesse actuelle est probablement atteignable. » Le débit actuel d'environ 80 tokens par seconde n'est pas le chiffre définitif. La pile d'inférence personnalisée est en développement et apportera une vitesse supplémentaire sans modifier les poids du modèle.
Sur la suite : « La sortie du mois prochain sera une nouvelle amélioration significative, alors que nous bouclons la boucle sur la résolution de problèmes d'ingénierie réels chez Tesla, SpaceX, Neuralink et Boring Company. » Cette boucle de rétroaction issue des travaux d'ingénierie réels des entreprises sœurs de xAI constitue une source de données d'entraînement qu'aucun autre laboratoire ne possède à la même échelle.
Sur les futures capacités multimodales : Grok acquerra la capacité d'appeler Grok Imagine comme outil en mode agentique, invoquant la génération d'images et de vidéos dans le cadre d'un workflow autonome plus long plutôt que comme fonctionnalité séparée. Musk a signalé que cela serait particulièrement utile pour les développeurs de jeux.
Premières réactions des utilisateurs
Les retours des développeurs ayant eu accès à Cursor en avant-première ont été positifs. Danny Limanseta l'a décrit comme « Opus 4.8 à 2x la vitesse à un prix bien inférieur » après l'avoir utilisé pour réfléchir, planifier et mettre en œuvre une fonctionnalité de jeu complexe sur toute une session sans avoir besoin de le corriger manuellement à chaque étape.
Artificial Analysis a résumé le changement concurrentiel sans détour le jour du lancement, écrivant que Grok 4.5 « hisse SpaceXAI à la frontière de l'intelligence, derrière seulement OpenAI et Anthropic, et surpassant tous les modèles open source et notamment les modèles Gemini de Google. » La partie open source de cette affirmation a depuis été dépassée, comme indiqué plus haut.
Comment Grok 4.5 se compare à la concurrence
Face à la frontière actuelle, Grok 4.5 ne prend que rarement la première place en termes de capacités brutes, mais il s'impose régulièrement sur le coût et l'efficacité en tokens. Voici comment il se positionne modèle par modèle, en utilisant le tableau Artificial Analysis v4.1.1 pour tout ce qui est actuel et les chiffres de lancement de xAI lorsqu'il s'agit des seuls chiffres publiés.
Face à Grok 4.3
56 contre 37 pour Grok 4.3 représente le plus grand bond générationnel de la lignée Grok. La fenêtre de contexte a été divisée par deux, de 1M à 500 000 tokens, et les modalités d'entrée se sont réduites au texte et aux images, qui sont les deux véritables compromis. Si vous utilisiez Grok 4.3 pour le codage, Grok 4.5 constitue une amélioration significative sur toutes les autres dimensions.
Face à Claude Opus 5
Claude Opus 5 est le modèle phare actuel d'Anthropic et domine l'Intelligence Index avec 63, soit sept points de plus que Grok 4.5. Il dispose également d'une fenêtre de contexte de 1M de tokens contre 500 000 pour Grok 4.5. La comparaison des coûts va dans l'autre sens, et de façon marquée. Opus 5 est affiché à $5 / $25 par million de tokens contre $2 / $6, et Artificial Analysis a dépensé $2,34 pour faire passer Opus 5 par l'index contre $0,36 pour Grok 4.5. Pour les tâches de codage les plus complexes à réponse ouverte, Opus 5 a l'avantage ; pour les pipelines agentiques où le coût par tâche se multiplie sur des centaines d'appels d'outils, Grok 4.5 offre la meilleure économie.
Face à Claude Fable 5
Fable 5 arrive en tête sur les quatre benchmarks de xAI et sur l'Intelligence Index. L'écart de coût est le plus important de toutes les comparaisons : $2,49 contre $11,80 par tâche Coding Agent, soit près de 5x. Pour les charges de travail exigeant absolument les meilleures performances de codage, Fable 5 reste en tête. Pour des performances proches de la frontière à une fraction du coût, Grok 4.5 l'emporte.
Face à GPT-5.6 Sol
Sol est le modèle phare actuel d'OpenAI et la comparaison la plus proche sur le tableau. Il obtient 61 au raisonnement maximal et 57 au raisonnement élevé, plaçant les 56 de Grok 4.5 à un seul point de Sol au réglage élevé. Le coût les distingue : Artificial Analysis a fait passer Sol au maximum par l'index pour $1,23 contre $0,36 pour Grok 4.5. Si vous choisissez sur la base des capacités brutes, Sol gagne ; si vous choisissez sur la base du rapport capacités/coût à grande échelle, Grok 4.5 s'impose.
Face au binôme du jour de lancement, Opus 4.8 et GPT-5.5
Les deux modèles contre lesquels Grok 4.5 a été évalué en juillet ont depuis été relégués au statut legacy, mais les chiffres méritent d'être conservés car ce sont les seules données de comparaison directe publiées par xAI. Face à Opus 4.8, Grok 4.5 a remporté DeepSWE 1.0 et Terminal-Bench 2.1 et perdu DeepSWE 1.1 et SWE-Bench Pro. Face à GPT-5.5, l'écart sur Terminal-Bench 2.1 était d'un dixième de point (83,3 % vs 83,4 %), le Coding Agent Index était à égalité, et Grok 4.5 menait tau3-Banking de 2 points à environ la moitié du coût par tâche ($2,49 vs $5,07).
Face à GLM-5.2
Grok 4.5 se situe juste devant GLM-5.2 sur GDPval-AA v2 (Elo 1 543 vs 1 513). Grok 4.5 mène sur l'Intelligence Index global et sur tau3-Banking.

Pourquoi cette sortie est importante
Trois éléments ressortent du lancement de Grok 4.5 et méritent d'être suivis au-delà des chiffres de benchmarks.
xAI a atteint la frontière de l'intelligence. Grok 4.3 ne concurrençait pas Anthropic et OpenAI au sommet du classement des capacités, avec 37 à l'Intelligence Index. Grok 4.5, lui, y est avec 56. Cela fait évoluer la structure concurrentielle du marché, d'une course à deux vers un face-à-face à trois.
L'argument de l'efficacité des coûts est réel, pas seulement une remise tarifaire. Grok 4.5 est moins cher par token, mais il est aussi considérablement plus économe en tokens par tâche. Un modèle qui produit le même résultat en 14 000 tokens quand un concurrent en utilise 67 000 n'est pas seulement moins cher à utiliser, il est plus rapide et génère moins de bruit dans les workflows agentiques. Ces deux aspects comptent à l'échelle de la production.
Le plafond de vitesse n'a pas encore été atteint. 80 tokens par seconde est le chiffre actuel. Lorsque xAI déploiera sa pile d'inférence C/C++ personnalisée adaptée au matériel GB300, Musk s'attend à un doublement ou plus. Un modèle déjà compétitif sur le coût et la qualité devient sensiblement plus rapide sans aucune mise à jour du modèle.
Grok 4.5 est disponible dans Fello AI, où vous pouvez l'utiliser aux côtés de Claude, ChatGPT, Gemini, DeepSeek et Perplexity dans une application native pour Mac, iPhone et iPad, en comparant la même tâche sur tous les modèles de pointe avec un seul abonnement au lieu de gérer des comptes séparés. Pour comprendre ce qui succède à Grok 4.5, l'article sur Grok 5 couvre ce que xAI a annoncé concernant la prochaine version majeure.
FAQ
Quand Grok 4.5 a-t-il été publié ?
xAI a publié Grok 4.5 le 8 juillet 2026. C'est le premier modèle de xAI conçu spécifiquement pour le codage et les tâches agentiques, entraîné sur de vraies données de sessions Cursor.
Quel est le tarif de Grok 4.5 ?
Le tarif API est de $2,00 par million de tokens en entrée et $6,00 par million de tokens en sortie. Les hits de cache bénéficient d'une remise de 85 %, ramenant les entrées en cache à $0,30 par million. Les tarifs doublent pour les entrées de plus de 200 000 tokens.
Grok 4.5 est-il meilleur que Claude Opus 5 ?
Pas en termes de capacités brutes. Claude Opus 5 obtient 63 à l'Artificial Analysis Intelligence Index contre 56 pour Grok 4.5, et dispose d'une fenêtre de contexte de 1M tokens contre 500 000. Grok 4.5 s'impose nettement sur le coût, à $2 / $6 par million de tokens contre $5 / $25, et sur l'efficacité en tokens par tâche accomplie.
Quelle est la fenêtre de contexte de Grok 4.5 ?
Grok 4.5 dispose d'une fenêtre de contexte de 500 000 tokens, en baisse par rapport au million de tokens de Grok 4.3. C'est le seul compromis clair dans ce qui est par ailleurs une amélioration sur tous les autres points.
Puis-je utiliser Grok 4.5 dans Fello AI ?
Oui. Grok 4.5 est disponible dans Fello AI, ce qui vous permet de l'utiliser aux côtés de Claude, ChatGPT, Gemini, DeepSeek et Perplexity dans une application native pour Mac, iPhone et iPad, et de comparer la même tâche sur tous les modèles de pointe avec un seul abonnement.