Google gère désormais deux lignes temporelles Gemini qui n'avancent plus au même rythme. La ligne Flash a filé jusqu'à Gemini 3.8 Flash, lancé le 2 septembre 2026, tandis que la ligne Pro reste figée sur Gemini 3.1 Pro depuis février. Si vous avez cherché un « Gemini 3.5 Pro » ou un « 3.6 Pro », c'est la première chose à clarifier dans toute comparaison de modèles Gemini honnête, car aucun des deux n'existe encore. Puis, le 30 septembre 2026, Google a annoncé Gemini 4 Argon, son premier nouveau modèle phare depuis 3.1 Pro, même si seul un petit groupe de spécialistes de la cyberdéfense agréés peut l'utiliser pour l'instant.
Ce guide retrace toute la gamme, de Gemini 2.5 à 3.8 Flash et au nouveau Gemini 4 Argon, version par version, avec un tableau de benchmarks et de prix pour chacune, ainsi que la façon dont les modèles apparaissent dans l'app Gemini et une recommandation claire pour chaque cas d'usage. Vous verrez exactement pourquoi Google a scindé la famille en deux, ce qui a vraiment changé à chaque version, et quel modèle est le bon choix par défaut pour le code, le chat du quotidien, les documents longs et les budgets serrés.
Les points clés à retenir
- Gemini 3.8 Flash est le modèle le plus récent que vous pouvez utiliser, disponible depuis le 2 septembre 2026, à un tarif d'introduction de $0.75 / $3.75 par million de tokens. C'est le troisième lancement Flash de Google en 43 jours, et 3.7 Flash et 3.6 Flash sont au même tarif.
- Il n'existe pas de Gemini 3.5 Pro ni de 3.6 Pro. Le modèle phare Pro actuel reste Gemini 3.1 Pro, de février 2026.
- Ce tarif avantageux expire. Les trois modèles 3.8, 3.7 et 3.6 Flash repassent à $1.50 / $7.50 le 1er janvier 2027, donc budgétez avec le chiffre le plus élevé après le nouvel an.
- Gemini 3.5 Flash-Lite est le modèle actuel le moins cher, à $0.30 / $2.50 par million de tokens.
- Dans l'app, le plan Gratuit ne fait tourner que Gemini Flash-Lite à partir du 9 octobre 2026, 3.6 Flash passant à AI Plus et au-delà. Ni 3.7 ni 3.8 Flash n'est gratuit : 3.7 n'atteint les particuliers que via Spark, et l'accès à 3.8 est pour l'instant signalé pour les abonnés AI Pro et Ultra. Deep Think reste réservé à AI Ultra, tandis que Gemini Spark atteint AI Pro aux États-Unis et dans plus de 160 pays supplémentaires.
- Gemini 4 Argon, premier modèle Gemini 4 de Google et nouveau modèle phare, a été annoncé le 30 septembre 2026 à un tarif d'introduction de $2 / $10 par million de tokens, mais pour l'instant seuls les spécialistes de la cyberdéfense du programme Fairwind peuvent l'utiliser.
La gamme Gemini en un coup d'œil (2026)
Google organise Gemini en trois niveaux. Pro est le niveau phare du raisonnement, Flash est le cheval de bataille rapide du quotidien, et Flash-Lite est l'option économique. Ce qui est déroutant, c'est que ces niveaux ne partagent plus le même numéro de version, si bien que le Flash le plus récent (3.8) a quatre versions complètes d'avance sur le Pro le plus récent (3.1). Gemini 4 Argon, annoncé le 30 septembre, rompt de nouveau le schéma : il porte un nom de code plutôt qu'un nom de niveau.
Voici la famille actuelle, de la plus ancienne à la plus récente, avec les modèles les plus importants en gras.
| Modèle | Sortie | Niveau | Statut | Idéal pour |
|---|---|---|---|---|
| Gemini 2.5 Pro | mars 2025 | Pro | Historique | Raisonnement de repli moins coûteux |
| Gemini 2.5 Flash | avril 2025 | Flash | Historique | Anciennes tâches du quotidien |
| Gemini 2.5 Flash-Lite | juin 2025 | Flash-Lite | Historique | Volume élevé, coût réduit |
| Gemini 3 Pro | novembre 2025 | Pro | Aperçu | Premier modèle phare « 3.0 » |
| Gemini 3 Flash | décembre 2025 | Flash | Aperçu | Bon rapport qualité-prix |
| Gemini 3.1 Pro | février 2026 | Pro | Le Pro le plus récent que vous pouvez utiliser | Raisonnement le plus difficile, documents longs |
| Gemini 3.1 Flash-Lite | mars 2026 | Flash-Lite | Remplacé | Travail agentique à petit budget |
| Gemini 3.5 Flash | mai 2026 | Flash | Remplacé | Cheval de bataille précédent |
| Gemini 3.5 Flash-Lite | juillet 2026 | Flash-Lite | Actuel | Option qualité la moins chère |
| Gemini 3.6 Flash | juillet 2026 | Flash | Remplacé | Toujours la valeur par défaut de l'app gratuite |
| Gemini 3.7 Flash | août 2026 | Flash | Remplacé | Cheval de bataille précédent |
| Gemini 3.8 Flash | septembre 2026 | Flash | Cheval de bataille actuel | La plupart des gens, la plupart des tâches |
| Gemini 4 Argon | septembre 2026 | Modèle phare (sans nom de niveau) | Annoncé, réservé aux partenaires Fairwind | Code long, travail de connaissance et tâches de cyberdéfense |
Deux modèles spécialisés restent en dehors du tableau principal. Gemini 3 Deep Think est un aperçu de raisonnement étendu datant de décembre 2025, et Gemini 3.5 Flash Cyber, sorti le 21 juillet, est une version de 3.5 Flash affinée pour trouver et corriger des vulnérabilités de sécurité au sein du système CodeMender de Google.
Pourquoi il n'existe pas de Gemini 3.5 Pro (ni de 3.6 Pro)
La plus grande source de confusion dans toute comparaison de modèles Gemini tient aux versions Pro manquantes. Quand Google a sorti 3.5 Flash, puis 3.6 Flash, puis 3.7 Flash, puis 3.8 Flash, beaucoup ont supposé qu'un Pro équivalent arrivait aussi. Ce n'a pas été le cas.
Selon TechCrunch, Google a sorti trois nouveaux modèles le 21 juillet et, délibérément, aucun 3.5 Pro. Les informations de Bloomberg citées dans cet article indiquent que Google a connu des retards internes et a eu du mal à atteindre ses propres objectifs de performance pour 3.5 Pro, qui reste donc en test chez des partenaires plutôt qu'en lancement général. Le responsable produit Logan Kilpatrick a déclaré que l'entreprise le teste encore et espère qu'il « arrivera bientôt ».
Cela laisse Gemini 3.1 Pro, de février 2026, comme le modèle Pro le plus récent que vous pouvez réellement utiliser. Pendant ce temps, la ligne Flash a continué de sortir de nouvelles versions, ce qui explique le décalage apparent des numéros de version. La conclusion est simple : quand vous voulez le meilleur raisonnement Gemini aujourd'hui, vous utilisez 3.1 Pro, pas un 3.5 ou 3.6 Pro qui n'a pas été lancé. En septembre, Koray Kavukcuoglu, de Google DeepMind, a déclaré que Google « avait fait un petit pas en arrière » pour se concentrer sur ses modèles Flash, et le modèle phare suivant annoncé par Google, le 30 septembre, fut Gemini 4 Argon plutôt qu'un 3.5 Pro.
Gemini 2.5 : le socle historique à trois niveaux
La famille 2.5 est la génération historique, sortie tout au long de 2025, et c'est elle qui a fixé le schéma à trois niveaux que Google utilise encore. Gemini 2.5 Pro est arrivé le 25 mars, 2.5 Flash le 17 avril, et 2.5 Flash-Lite le 17 juin, chacun avec une fenêtre de contexte de 1M de tokens. Ces modèles fonctionnent encore et restent une solution de repli moins chère, mais ils sont en retard sur la famille 3.x en raisonnement, en code et sur les tâches agentiques.
Performances et prix des niveaux 2.5
Au lancement, 2.5 Pro dominait le classement LMArena et obtenait 63,8 % sur SWE-Bench Verified. 2.5 Flash était nettement moins cher, et 2.5 Flash-Lite descendait encore plus bas, à $0.10 / $0.40, toujours le tarif Gemini le plus bas que l'API ait jamais proposé. Notre guide des benchmarks IA explique ce que chacun de ces tests mesure réellement.
| Modèle | Sortie | Prix (entrée / sortie par 1M) | Point fort |
|---|---|---|---|
| Gemini 2.5 Pro | 25 mars 2025 | $1.25 / $10.00 | N° 1 sur LMArena au lancement ; SWE-Bench 63,8 % |
| Gemini 2.5 Flash | 17 avril 2025 | $0.30 / $2.50 | Cheval de bataille rapide du quotidien |
| Gemini 2.5 Flash-Lite | 17 juin 2025 | $0.10 / $0.40 | Le tarif Gemini le plus bas jamais proposé |
Quand choisir un modèle 2.5
N'utilisez 2.5 que si vous êtes sur une infrastructure plus ancienne ou si vous avez besoin du coût le plus bas possible et que la qualité de pointe ne vous importe pas. Pour tout nouveau projet, les niveaux 3.x représentent une amélioration nette, à prix similaire ou inférieur.
Gemini 3.0 : la remise à zéro de la génération
Le modèle Gemini 3 a ouvert la génération actuelle. Gemini 3 Pro a été lancé le 18 novembre 2025 comme modèle phare en aperçu, suivi de Gemini 3 Deep Think le 4 décembre pour un raisonnement multi-étapes plus poussé, puis de Gemini 3 Flash le 17 décembre. C'est ce saut qui a redéfini la position de Google dans les benchmarks face à ChatGPT et Claude.
Benchmarks et tarifs de Gemini 3.0
Gemini 3 Pro est sorti avec une fenêtre de contexte de 1M de tokens et 64K en sortie, affichant 91,9 % sur GPQA Diamond, un Elo de 1501 sur LMArena, et 76,2 % sur SWE-Bench Verified. Gemini 3 Flash a ensuite dépassé son propre frère Pro en code, atteignant 78 % sur SWE-Bench Verified pour seulement $0.50 / $3.00 par million de tokens. Deep Think, un mode de raisonnement étendu pour les abonnés AI Ultra, a porté ARC-AGI-2 à 45,1 % avec exécution de code.
| Modèle | Sortie | Prix (entrée / sortie par 1M) | Benchmark clé |
|---|---|---|---|
| Gemini 3 Pro | 18 novembre 2025 | s.o. (aperçu) | GPQA 91,9 %, SWE 76,2 %, Elo 1501 |
| Gemini 3 Deep Think | 4 décembre 2025 | AI Ultra uniquement | ARC-AGI-2 45,1 % |
| Gemini 3 Flash | 17 décembre 2025 | $0.50 / $3.00 | SWE-Bench 78 % |
Comment la génération 3.0 se tient aujourd'hui
Les modèles 3.0 ont introduit l'architecture et le travail sur le contexte long sur lesquels les versions suivantes se sont appuyées. La plupart ont depuis été remplacés par 3.1 et les versions Flash plus récentes, donc considérez 3.0 comme la base plutôt que comme un modèle à choisir aujourd'hui.
Gemini 3.1 Pro : le modèle phare que vous pouvez utiliser
Gemini 3.1 Pro, sorti le 19 février 2026, est le modèle à privilégier quand vous avez besoin du maximum de capacité. Il utilise une architecture de mélange d'experts épars, gère une fenêtre de contexte de 1M de tokens, et génère jusqu'à 64K tokens en une seule réponse. Il obtient 94,3 % sur GPQA Diamond et 80,6 % sur SWE-Bench Verified, deux chiffres propres à Google. La mesure indépendante est moins flatteuse : sur l'Artificial Analysis Intelligence Index v4.3.2, relevé le 25 septembre 2026, il se situe à 29,7, derrière les modèles phares actuels d'OpenAI et d'Anthropic et, plus gênant encore pour Google, onze points derrière son propre Gemini 3.8 Flash, à 40,9. Le Gemini 4 Argon de Google se situe désormais bien au-dessus des deux, à 52,6, mais pour l'instant seuls les partenaires du programme Fairwind peuvent l'utiliser.
Caractéristiques et tarifs de Gemini 3.1 Pro
| Caractéristique | Gemini 3.1 Pro |
|---|---|
| Sortie | 19 février 2026 |
| Contexte / sortie max | 1M / 64K tokens |
| Prix (texte) | $2.00 / $12.00 par 1M, un seul niveau |
| Prix (sortie image) | $120.00 par 1M, environ $0.134 par image 1K/2K |
| GPQA Diamond | 94,3 % (Google) |
| SWE-Bench Verified | 80,6 % (Google) |
| AA Intelligence Index v4.3.2 | 29,7 (relevé le 25 sept. 2026) |
Quand utiliser 3.1 Pro
C'est le bon choix pour le raisonnement complexe, l'analyse de documents longs, la recherche, et les tâches de code agentique les plus difficiles. Comme Google n'a pas mis à jour le niveau Pro depuis février, 3.1 Pro devrait rester le Gemini le plus puissant que vous puissiez réellement utiliser jusqu'à ce que Gemini 4 Argon s'ouvre au-delà des partenaires Fairwind de Google.
Gemini 3.5 Flash et Flash-Lite : les chevaux de bataille du milieu de 2026
Gemini 3.5 Flash est sorti lors de Google I/O le 19 mai 2026, à $1.50 / $9.00 par million de tokens avec une fenêtre de contexte de 1M de tokens, et il a notamment battu 3.1 Pro sur plusieurs benchmarks de code et agentiques malgré son statut de modèle Flash. Il a servi de cheval de bataille au quotidien jusqu'à ce que 3.6 le remplace en juillet.
Gemini 3.5 Flash-Lite : le champion économique
Gemini 3.5 Flash-Lite, sorti le 21 juillet à $0.30 / $2.50 par million de tokens, est l'actuel champion économique. Google affirme qu'il surpasse nettement l'ancien Gemini 3 Flash, plus grand, sur certaines évaluations, dont SWE-Bench Pro et OSWorld-Verified, ce qui en fait un choix solide en matière de rapport qualité-prix pour le travail à fort volume.
| Modèle | Sortie | Prix (entrée / sortie par 1M) | Contexte | Remarque |
|---|---|---|---|---|
| Gemini 3.5 Flash | 19 mai 2026 | $1.50 / $9.00 | 1M | A battu 3.1 Pro sur des évaluations de code |
| Gemini 3.5 Flash-Lite | 21 juillet 2026 | $0.30 / $2.50 | 1M | Modèle actuel le moins cher |
Pourquoi le duo Flash compte
Ce duo est tout l'intérêt. Flash couvre le travail quotidien de qualité tandis que Flash-Lite gère les tâches à fort volume et sensibles au coût, et les deux disposent d'une fenêtre complète d'un million de tokens. Quand 3.6 Flash est arrivé en juillet, il s'est placé au-dessus de 3.5 Flash ; 3.7 Flash a pris la tête de la ligne Flash trois semaines plus tard, et 3.8 Flash l'a prise trois semaines après encore, tandis que Flash-Lite est resté le plancher économique tout du long.
Gemini 3.8 Flash : le cheval de bataille actuel
Gemini 3.8 Flash est devenu disponible pour tous le 2 septembre 2026, trois semaines après 3.7 Flash et comme troisième lancement Flash de Google en 43 jours. Chaque ligne de la fiche technique reste inchangée par rapport à son prédécesseur : la même fenêtre de contexte de 1M de tokens, la même limite de sortie de 64K, la même date de connaissances de mars 2026, la même liste de modalités et le même prix de lancement. Toute la nouveauté tient à ce que le modèle fait dans cette même enveloppe, et Google l'a ajusté pour des agents à long horizon plutôt que pour le code pur, axe de 3.7.
Prix et gains de benchmark de Gemini 3.8 Flash
Le prix n'a pas bougé. 3.8 Flash affiche le même tarif d'introduction de $0.75 / $3.75 par million de tokens que 3.7 et 3.6 Flash, avec la même note de bas de page : le 1er janvier 2027, les trois passent à $1.50 / $7.50. Il devance 3.7 Flash sur chaque ligne publiée par Google, avec les plus gros gains sur BioMysteryBench Human Difficult (de 43,5 % à 56,5 %), Terminal-bench 4.0 (de 11,2 % à 19,1 %) et DeepSWE v1.1 (de 65,3 % à 73,7 %). Il n'a pas tout raflé : dans sa propre comparaison de lancement, datée de septembre 2026, Google a vu Claude Opus 5 remporter les tests agentiques les plus difficiles, avec 51,8 % contre 19,1 % sur Terminal-bench 4.0 et 75,4 % contre 59,0 % sur OSWorld-2.0. Anthropic a depuis remplacé Opus 5 par Opus 5.5 et classé Opus 5 dans sa liste de modèles historiques, donc lisez cette comparaison comme celle publiée par Google au lancement, et non comme l'état actuel de la technique. Notre analyse de Gemini 3.8 Flash propose le tableau complet à 14 lignes et le chiffre de benchmark largement republié qui s'est révélé erroné.
| Caractéristique | Gemini 3.8 Flash |
|---|---|
| Sortie | 2 septembre 2026 |
| Prix | $0.75 / $3.75 par 1M (introductif, double le 1er janvier 2027) |
| Contexte | 1M tokens en entrée, 64K en sortie |
| AA Intelligence Index v4.3.2 | 40,9 en réglage de raisonnement élevé, contre 39,1 pour 3.7 Flash (relevé le 25 sept. 2026) |
| DeepSWE v1.1 | De 65,3 % à 73,7 % |
| Terminal-bench 4.0 | De 11,2 % à 19,1 % |
| BioMysteryBench (difficile) | De 43,5 % à 56,5 % |
Gemini 3.7 Flash : le cheval de bataille précédent
Gemini 3.7 Flash est arrivé le 13 août 2026, seulement 23 jours après 3.6 Flash, dans AI Studio, l'API Gemini, Android Studio et la Gemini Enterprise Agent Platform, avec la même fenêtre de contexte de 1M de tokens et la même limite de sortie de 64K que son prédécesseur. Contrairement à la version 3.6, celle-ci représentait un vrai saut de capacité et non une simple passe d'efficacité : les scores en code et en tâches agentiques ont beaucoup progressé en trois semaines. Il a occupé la tête de la ligne Flash pendant exactement trois semaines, avant que 3.8 Flash ne le remplace au même prix.
Prix et gains de benchmark de Gemini 3.7 Flash
Le prix a été divisé par deux, à $0.75 / $3.75 par million de tokens, et Google a placé 3.6 Flash au même tarif, celui sur lequel 3.8 Flash a aussi fini par atterrir, si bien que les trois coûtent aujourd'hui la même chose. Lisez la note avant de budgétiser : ces tarifs sont introductifs et expirent le 31 décembre 2026, pour remonter à $1.50 / $7.50 en janvier. Côté benchmarks, DeepSWE v1.1 est passé de 49,0 % à 65,3 % et AutomationBench a presque doublé, de 17,0 % à 30,4 %. Pour le tableau complet, y compris les régions exclues par Google, consultez notre analyse de Gemini 3.7 Flash.
| Caractéristique | Gemini 3.7 Flash |
|---|---|
| Sortie | 13 août 2026 |
| Prix | $0.75 / $3.75 par 1M (introductif, double le 1er janvier 2027) |
| Contexte | 1M tokens en entrée, 64K en sortie |
| AA Intelligence Index v4.3.2 | 39,1, contre 34,0 pour 3.6 Flash (relevé le 25 sept. 2026) |
| FrontierCode 1.1 Main | De 34,4 % à 43,6 % |
| DeepSWE v1.1 | De 49,0 % à 65,3 % |
| AutomationBench | De 17,0 % à 30,4 % |
Gemini 3.6 Flash : le cheval de bataille précédent
Gemini 3.6 Flash est sorti le 21 juillet 2026 et reste le modèle par défaut de l'app Gemini gratuite seulement jusqu'au 9 octobre 2026, date à laquelle les comptes gratuits basculent vers Flash-Lite, avec une fenêtre de contexte de 1M de tokens. C'est une amélioration d'efficacité plutôt qu'un nouveau niveau de pointe. Il utilise environ 17 % de tokens de sortie en moins que 3.5 Flash sur l'Artificial Analysis Index, avec des réductions allant jusqu'à 65 % sur certaines tâches d'ingénierie à long horizon.
Prix et gains de benchmark de Gemini 3.6 Flash
Le changement de prix au lancement a souvent été mal rapporté. La baisse ne portait que sur la sortie : la sortie est passée de $9.00 à $7.50 par million de tokens, tandis que l'entrée restait fixe à $1.50. Google a depuis réduit le modèle une nouvelle fois, à $0.75 / $3.75, pour l'aligner sur Gemini 3.7 Flash. Côté benchmarks, DeepSWE est passé de 37 % à 49 %, MLE-Bench de 49,7 % à 63,9 %, et OSWorld-Verified de 78,4 % à 83,0 %, selon l'annonce de Google. Pour une analyse plus détaillée de cette version, consultez notre analyse complète de Gemini 3.6 Flash.
| Caractéristique | Gemini 3.6 Flash |
|---|---|
| Sortie | 21 juillet 2026 |
| Prix | $0.75 / $3.75 par 1M (réduit pour s'aligner sur 3.7 Flash ; lancé à $1.50 / $7.50) |
| Contexte | 1M tokens |
| AA Intelligence Index | 34,0 sur v4.3.2, relevé le 25 sept. 2026 (il affichait 52 sur la v4.1.1, désormais retirée) |
| DeepSWE | De 37 % à 49 % |
| MLE-Bench | De 49,7 % à 63,9 % |
| OSWorld-Verified | De 78,4 % à 83,0 % |
Comparatif des tarifs de l'API Gemini (2026)
C'est au niveau des prix que la séparation des niveaux devient concrète. Flash et Flash-Lite sont conçus pour le volume, tandis que Pro coûte plus cher et reste réservé aux tâches qui le justifient. Le tableau ci-dessous présente les tarifs actuels de l'API par million de tokens.
| Modèle | Entrée (par 1M) | Sortie (par 1M) | Contexte |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.7 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.6 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.5 Flash | $1.50 | $9.00 | 1M |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 1M |
| Gemini 3.1 Pro | $2.00 | $12.00 | 1M |
Pour la plupart des charges de travail, Gemini 3.8 Flash offre désormais les meilleurs résultats de la ligne Flash, et comme 3.6 et 3.7 Flash sont au même tarif, rien ne justifie financièrement de rester sur un modèle plus ancien. Les trois tarifs Flash sont introductifs et doublent le 1er janvier 2027. Si vous traitez d'énormes volumes de requêtes plus simples, 3.5 Flash-Lite réduit encore les coûts tout en conservant une qualité étonnamment solide.
Le niveau Pro était auparavant facturé selon la taille du prompt, avec un second tarif au-delà de 200K tokens. Ce n'est plus le cas. La grille tarifaire actuelle de l'API de Google affiche un seul tarif texte pour Gemini 3.1 Pro, $2.00 / $12.00, dans ses tableaux Standard, Batch, Flex et Priority, sans distinction de contexte long ; le niveau à $4.00 / $18.00 que ce guide montrait auparavant a disparu. Ce que Pro continue de tarifer séparément, c'est la sortie image, à $120 par million de tokens, ce qui équivaut à environ $0.134 par image 1K ou 2K et $0.24 par image 4K. Batch et Flex réduisent de moitié le tarif texte, à $1.00 / $6.00.
Comment Gemini apparaît dans l'app (Gratuit, Plus, Pro, Ultra)
La plupart des gens ne touchent jamais à l'API. Dans l'app Gemini, les modèles apparaissent sous forme de forfaits grand public plutôt que de numéros de version, et la version que vous obtenez dépend de ce que vous payez. À partir du 9 octobre 2026, le forfait Gratuit ne fait tourner que Gemini Flash-Lite, AI Plus ajoute Flash, et seuls AI Pro et Ultra donnent accès au modèle de raisonnement Pro, si bien que les niveaux payants achètent désormais des modèles en plus de limites d'usage plus élevées et des fonctions plus poussées. Notez qu'aucune des deux versions Flash les plus récentes n'apparaît comme niveau de forfait : 3.7 Flash n'atteint les utilisateurs de l'app qu'au sein de Spark, qui nécessite AI Pro ou Ultra, et le déploiement de 3.8 Flash a été signalé pour les abonnés AI Pro et Ultra, même si les notes de version des apps Gemini ne mentionnent encore rien à son sujet.
| Forfait | Prix / mois | Accès aux modèles et fonctions |
|---|---|---|
| Gratuit | $0 | Uniquement Gemini Flash-Lite à partir du 9 oct. (3.6 Flash et accès variable à 3.1 Pro avant) |
| Google AI Plus | $4.99 | Flash-Lite et Flash, Pro retiré en octobre ; limites 2x plus élevées que Gratuit, génération vidéo, Daily Brief |
| Google AI Pro | $19.99 | Limites 4x plus élevées, accès renforcé au raisonnement de Gemini 3.1 Pro, Deep Research, fonctions agentiques, Gemini Spark dans plus de 160 pays |
| Google AI Ultra | De $99.99 à $199.99 | Accès maximal à 3.1 Pro, Deep Think, Gemini Spark, Veo 3.1, jusqu'à 20x les limites du forfait Pro |
La conclusion pratique est simple. Si vous voulez seulement un assistant rapide pour des questions du quotidien, le forfait Gratuit suffit toujours, mais à partir du 9 octobre il tourne sur Flash-Lite, donc AI Plus à $4.99 est le moyen le plus économique de garder Flash. Passez à AI Pro pour un raisonnement plus poussé, Deep Research et l'agent Gemini Spark, qui a atteint Pro aux États-Unis le 23 juillet 2026 et plus de 160 pays supplémentaires le 30 juillet. Seuls les forfaits AI Ultra ajoutent Deep Think. Spark n'est proposé nulle part dans l'EEE, au Royaume-Uni, en Suisse ni au Nigeria.
Comparatif des benchmarks Gemini
Les benchmarks racontent la même histoire de lignées séparées, et ils la racontent désormais beaucoup plus fort qu'avant. Sur l'Artificial Analysis Intelligence Index v4.3.2, un composite de dix évaluations, la ligne Flash ne dépasse pas seulement de peu l'ancien Pro, elle le surpasse nettement. Gemini 3.8 Flash obtient 40,9 en réglage de raisonnement élevé et Gemini 3.7 Flash, 39,1, contre 29,7 pour le modèle phare Gemini 3.1 Pro. Gemini 3.6 Flash se situe à 34,0, Gemini 3.5 Flash à 32,6, et le Gemini 3.5 Flash-Lite économique à 22,2. Chacun de ces modèles Flash devance le modèle Pro, sauf Flash-Lite.
Une mise en garde sur tous les chiffres Artificial Analysis que vous verrez cités pour Gemini, y compris ceux que ce guide a utilisés jusqu'en septembre 2026. AA a réétalonné son index quatre fois en sept semaines, en passant par v4.1.1, v4.2, v4.3 et v4.3.2, et chaque réétalonnage a déplacé tous les scores à la fois sans qu'aucun modèle ne change. Gemini 3.8 Flash affichait 59 sur v4.1.1 et affiche 40,9 sur v4.3.2 ; rien n'a empiré dans le modèle. Les chiffres de cette page ont tous été relevés de nouveau sur les pages de modèle d'AA le 25 septembre 2026 et sont tous en v4.3.2, ils sont donc comparables entre eux, mais avec rien de ce qui a été publié avant septembre. Notez aussi que l'infobulle du classement d'AA indique encore v4.3, tandis que les pages de chaque modèle indiquent v4.3.2 ; ce sont les pages de modèle qu'il faut croire. Considérez tout chiffre d'index sans mention de version comme inutilisable.
| Modèle | AA Intelligence Index (v4.3.2, 25 sept. 2026) | Vitesse de sortie (tokens/s) |
|---|---|---|
| Gemini 3.8 Flash | 40,9 (élevé) | 304,6 |
| Gemini 3.7 Flash | 39,1 (élevé) | 279,4 |
| Gemini 3.6 Flash | 34,0 (élevé) | 210,0 |
| Gemini 3.5 Flash | 32,6 (élevé) | 189 |
| Gemini 3.1 Pro | 29,7 | 113 |
| Gemini 3.5 Flash-Lite | 22,2 | 463 |
Deux détails valent la peine d'être relevés. Le premier, c'est que la ligne Flash n'est plus plate : sur v4.1, 3.5 et 3.6 Flash obtenaient tous les deux 50, et sur v4.3.2 ils se séparent à 32,6 et 34,0, avec 3.7 et 3.8 qui s'éloignent encore plus. Le second, c'est que Gemini 3.1 Pro est le troisième modèle le plus lent et le quatrième au score dans le tableau de sa propre famille, une position inhabituelle pour un modèle phare. Les propres gains de Gemini 3.6 se voient surtout en efficacité et en code agentique, avec des bonds à deux chiffres sur DeepSWE et MLE-Bench tout en utilisant environ 17 % de tokens de sortie en moins que 3.5 Flash. En vitesse brute, Flash-Lite est dans une autre catégorie, à 463 tokens par seconde, contre 189 pour 3.5 Flash et 113 pour 3.1 Pro.
Progression des benchmarks dans toute la famille Gemini
Suivre quelques évaluations clés d'une version à l'autre montre clairement les deux trajectoires. La ligne Pro progresse régulièrement sur les tests de raisonnement et de code les plus difficiles, tandis que la ligne Flash rattrape discrètement le modèle phare sur l'indice composite. Les cellules vides signifient que Google ou Artificial Analysis n'a pas publié ce chiffre pour le modèle.
| Benchmark | 2.5 Pro | 3 Pro | 3.1 Pro | 3.5 Flash | 3.6 Flash | 3.8 Flash |
|---|---|---|---|---|---|---|
| GPQA Diamond | s.o. | 91,9 % | 94,3 % | s.o. | s.o. | s.o. |
| SWE-Bench Verified | 63,8 % | 76,2 % | 80,6 % | s.o. | s.o. | s.o. |
| AA Index v4.3.2 | s.o. | s.o. | 29,7 | 32,6 | 34,0 | 40,9 |
| DeepSWE | s.o. | s.o. | s.o. | 37 % | 49 % | 73,7 % (v1.1) |
En lisant les colonnes Pro de haut en bas, la tendance est une progression nette sur les propres évaluations de Google, GPQA Diamond passant de 91,9 % à 94,3 % et SWE-Bench Verified de 63,8 % à 76,2 %, puis à 80,6 %. En lisant la ligne AA à l'horizontale, l'histoire s'inverse : Flash n'a pas comblé l'écart, il l'a dépassé, passant de 32,6 à 40,9 tandis que le modèle phare reste à 29,7. La lecture honnête est que les deux mesures divergent parce qu'elles mesurent des choses différentes. Les chiffres de Google sont des scores d'évaluation unique en raisonnement et en code, où 3.1 Pro mène réellement ; le composite d'AA intègre dix évaluations, dont du travail sur des documents à contexte long et des tâches agentiques, et sur cette base un modèle Pro vieux de sept mois perd face à un Flash vieux de trois semaines. Si votre travail ressemble à GPQA, choisissez Pro. S'il ressemble à tout le reste, choisissez Flash.
Quel modèle Gemini devriez-vous utiliser ?
Pour la plupart des gens, Gemini 3.8 Flash est le bon choix par défaut. Il est rapide, économique à $0.75 / $3.75 par million de tokens jusqu'en janvier, et gère bien le code et les tâches quotidiennes. Passez à Gemini 3.1 Pro pour le raisonnement le plus difficile et le travail sur documents longs, et descendez à Gemini 3.5 Flash-Lite quand le coût prime sur tout. Le tableau ci-dessous associe des tâches courantes au modèle qui convient.
| Votre tâche | Meilleur modèle | Pourquoi |
|---|---|---|
| Chat et écriture du quotidien | Gemini 3.8 Flash | Rapide, économique, bonne qualité générale |
| Code général | Gemini 3.8 Flash | Plus gros gains en code agentique (DeepSWE v1.1 73,7 %) |
| Raisonnement le plus difficile et recherche | Gemini 3.1 Pro | Meilleurs scores, GPQA 94,3 % et SWE 80,6 % |
| Analyse de documents longs | Gemini 3.1 Pro | Contexte de 1M avec le raisonnement le plus poussé |
| Travail à fort volume et petit budget | Gemini 3.5 Flash-Lite | $0.30 / $2.50 et le plus rapide, à 463 tok/s |
| Travail sur les vulnérabilités de sécurité | Gemini 3.8 Flash Cyber | Le spécialiste sécurité actuel de Google, sorti le 2 septembre 2026 dans le cadre du programme Fairwind ; il remplace 3.5 Flash Cyber |
Si votre travail principal est la programmation, 3.8 Flash est le choix le plus rentable et 3.1 Pro reste le plafond pour les problèmes les plus difficiles. Une mise en garde pour les non-développeurs : ni 3.7 ni 3.8 Flash n'est gratuit dans l'app Gemini, et à partir du 9 octobre 2026 le niveau gratuit ne répond qu'avec Flash-Lite. Pour un panorama plus large sur l'association entre tâches et modèles, toutes marques confondues, notre guide sur quand utiliser quel modèle d'IA couvre l'ensemble du sujet.
Comment Gemini se compare à ChatGPT et Claude
La stratégie de Google diffère de celle de ses rivaux. Plutôt que de viser un seul modèle phare au benchmark maximal, elle optimise pour la polyvalence pratique, la multimodalité et une intégration profonde avec Search, Workspace et Android. C'est pourquoi le niveau Flash reçoit tant d'attention : c'est le modèle que la plupart des gens utilisent réellement chaque jour. Pour le volet Claude en détail, voir la comparaison ultime des modèles Claude.
| Modèle phare | AA Index (v4.3.2, 25 sept. 2026) | Contexte / sortie | Prix (entrée / sortie par 1M) | Sortie |
|---|---|---|---|---|
| Gemini 3.1 Pro | 29,7 | 1M / 64K | $2.00 / $12.00 | févr. 2026 |
| GPT-6 Astra | 52,7 (max) | 1,05M / 128K | $10.00 / $50.00 | sept. 2026 |
| Claude Opus 5.5 | 57,6 (max) | 1M / 128K | $4.00 / $20.00 | sept. 2026 |
| Gemini 4 Argon (réservé aux partenaires Fairwind) | 52,6 (élevé) | 1M / 1M | $2.00 / $10.00 intro., puis $4.00 / $20.00 | sept. 2026 |
| Gemini 3.8 Flash, pour référence | 40,9 (élevé) | 1M / 64K | $0.75 / $3.75 | sept. 2026 |
C'est le tableau qui a le plus bougé depuis l'été, et pas en faveur de Google. Les deux rivaux ont remplacé leurs modèles phares en septembre 2026, et la réponse de Google n'est arrivée que le 30 septembre, en diffusion limitée. Sur v4.3.2, il accuse un retard de 23 et 28 points sur GPT-6 Astra, à 52,7, et sur Claude Opus 5.5, à 57,6, là où l'ancienne lecture v4.1 situait l'écart entre 13 et 15. Ce qui tient toujours, c'est l'argument du prix, et il est plus fort qu'avant : Gemini 3.1 Pro coûte un cinquième du prix d'entrée d'Astra et un quart de son prix de sortie, et la moitié du prix d'entrée d'Opus 5.5. Le nouveau modèle phare de Google, Gemini 4 Argon, referme la majeure partie de l'écart de score à 52,6, à un cheveu d'Astra, mais pour l'instant seuls les spécialistes de la cyberdéfense du programme Fairwind peuvent l'utiliser. Parmi les Gemini que vous pouvez appeler aujourd'hui, la vraie réponse de Google aux deux n'est pas son niveau Pro du tout. C'est Gemini 3.8 Flash, qui obtient 40,9, plus que Pro, à $0.75 / $3.75, et c'est cette ligne qu'une comparaison coût/qualité devrait réellement utiliser.
Les trois modèles phares gèrent désormais environ un million de tokens de contexte, donc le vrai compromis porte sur la profondeur de raisonnement et le prix plutôt que sur la taille de la fenêtre. Une différence pratique : OpenAI et Anthropic permettent des réponses uniques bien plus longues, avec 128K tokens de sortie contre 64K pour Gemini, ce qui compte pour la génération de code volumineux ou de longs rapports. Gemini 4 Argon inverse cela avec jusqu'à 1M de tokens de sortie, une fois que vous pouvez y accéder.
Sur les propres évaluations de Google, 3.1 Pro rivalise avec les meilleurs modèles GPT-6 et Claude 5 sans dominer le peloton ; sur le composite indépendant, il ne rivalise plus du tout avec eux, et c'est Flash qui joue au-dessus de sa catégorie de prix. Pour le panorama complet entre fournisseurs, voir notre comparatif des meilleurs modèles d'IA et l'analyse approfondie de Gemini 3.5.
Ce qui arrive ensuite pour Gemini (3.5 Pro et Gemini 4)
Le premier, c'est Gemini 3.5 Pro, toujours bloqué en test chez des partenaires après que Google a manqué ses propres objectifs internes. En juillet, l'équipe produit s'est contentée de dire qu'elle espérait que le modèle « arriverait bientôt », et en septembre Koray Kavukcuoglu, de Google DeepMind, a déclaré que Google « avait fait un petit pas en arrière » pour se concentrer sur Flash. Google n'a pas dit si 3.5 Pro sera un jour lancé.
Le second est partiellement arrivé. Google a confirmé en juillet avoir lancé son « entraînement préalable le plus ambitieux à ce jour » pour Gemini 4, et le 30 septembre 2026, il a annoncé Gemini 4 Argon, le premier modèle Gemini 4. Il est d'abord déployé auprès des spécialistes de la cyberdéfense du programme Fairwind de Google, puis auprès des clients payants de l'API et des abonnés Google AI Ultra, sans date pour l'un ou l'autre, donc la carte ci-dessus reste celle avec laquelle la plupart des gens devront composer encore un moment.
Utilisez tous les meilleurs modèles de la classe Gemini sans choisir de version
Le labyrinthe de versions que cet article vient de cartographier est le vrai coût de choisir un niveau Gemini. Google AI Pro coûte $19.99 par mois et continue de vous répondre avec la version que l'app décide de vous donner, et côté API, vous devez suivre quel tarif Flash est introductif et quel seuil Pro double votre facture.
Fello AI est une app native pour Mac, iPhone et iPad qui vous donne accès à Gemini sous un seul abonnement, avec en plus ChatGPT, Claude, Grok, DeepSeek, Perplexity, Kimi, GLM et Qwen. Elle démarre à $9.99 par mois, soit la moitié de Google AI Pro, avec un niveau gratuit pour l'essayer d'abord et une note de 4,7 étoiles sur plus de 27 000 avis. Les derniers modèles Gemini disponibles publiquement sont simplement là dès que vous ouvrez l'app, et vous pouvez poser la même question à un modèle rival dans la même conversation au lieu de vous engager sur une version et une grille tarifaire.
Conclusion
La comparaison de modèles Gemini honnête pour 2026 est une histoire à deux trajectoires. Flash a filé jusqu'à 3.8, trois versions en 43 jours et moins chère que jamais, tandis que Pro reste à 3.1, avec 3.5 Pro toujours non lancé. Pour presque tout le monde, commencez par Gemini 3.8 Flash, passez à 3.1 Pro pour le travail le plus difficile, et descendez à 3.5 Flash-Lite quand le budget prime. Avec Gemini 4 Argon annoncé le 30 septembre mais réservé aux partenaires Fairwind, attendez-vous à ce que la carte évolue encore une fois qu'il s'ouvrira aux clients payants de l'API et aux abonnés Google AI Ultra.
FAQ
Existe-t-il un Gemini 3.5 Pro ?
Non. En date de septembre 2026, Gemini 3.5 Pro n'a pas été lancé et n'a aucune entrée dans le journal des modifications de l'API. Google le teste encore avec des partenaires après des retards internes, donc le modèle Pro phare actuel reste Gemini 3.1 Pro, de février 2026. La ligne Flash, pendant ce temps, a progressé jusqu'à 3.8 Flash. Le modèle phare suivant de Google s'est révélé être Gemini 4 Argon, annoncé le 30 septembre 2026.
Quel modèle Gemini devrais-je utiliser ?
Pour la plupart des gens, Gemini 3.8 Flash est le meilleur choix par défaut, car il est rapide, économique à $0.75 / $3.75 par million de tokens, et c'est la version Flash la plus performante en code et en travail agentique. Choisissez Gemini 3.1 Pro pour le raisonnement le plus difficile et les documents longs, et Gemini 3.5 Flash-Lite quand vous avez besoin du coût le plus bas.
Quelle est la différence entre Gemini 3.5 Flash et 3.6 Flash ?
Gemini 3.6 Flash a remplacé 3.5 Flash comme cheval de bataille. Il utilise environ 17 % de tokens de sortie en moins, a réduit le prix de sortie de $9 à $7.50 par million au lancement tandis que l'entrée restait à $1.50, et a affiché de gros gains en code, comme DeepSWE passant de 37 % à 49 %. C'était une amélioration d'efficacité, pas un nouveau niveau de pointe, et il fonctionne désormais à $0.75 / $3.75 aux côtés de Gemini 3.7 Flash et Gemini 3.8 Flash.
Quelle est la différence entre Gemini 3.7 Flash et 3.8 Flash ?
Rien sur la fiche technique et rien sur le prix. Gemini 3.8 Flash, sorti le 2 septembre 2026, a la même fenêtre de contexte de 1M de tokens, la même limite de sortie de 64K, la même date de connaissances de mars 2026 et le même tarif d'introduction de $0.75 / $3.75 que 3.7 Flash. La différence se mesure sur la qualité : il devance 3.7 Flash sur chaque ligne de benchmark publiée par Google, avec DeepSWE v1.1 passant de 65,3 % à 73,7 % et Terminal-bench 4.0 de 11,2 % à 19,1 %. Comme le prix est identique, rien ne justifie de démarrer un nouveau projet sur 3.7 Flash.
Quels modèles Gemini les forfaits de l'app incluent-ils ?
À partir du 9 octobre 2026, le forfait Gratuit ne fait tourner que Gemini Flash-Lite, AI Plus ajoute Flash, et AI Pro et Ultra ajoutent 3.1 Pro et Deep Think. Google AI Pro, à $19.99, relève les limites et donne un accès renforcé au modèle de raisonnement Pro ainsi qu'à Deep Research, et les forfaits AI Ultra, de $99.99 à $199.99, ajoutent Deep Think. Gemini Spark est disponible sur AI Pro aux États-Unis et dans plus de 160 pays supplémentaires, mais il n'est pas proposé dans l'EEE, au Royaume-Uni, en Suisse ni au Nigeria.
Quel est le modèle Gemini le moins cher ?
Gemini 3.5 Flash-Lite, sorti le 21 juillet 2026, est le modèle actuel le moins cher, à $0.30 en entrée et $2.50 en sortie par million de tokens. Google affirme qu'il surpasse l'ancien Gemini 3 Flash sur certains benchmarks de code et agentiques, ce qui en fait une excellente valeur pour le travail à fort volume.
Gemini 4 est-il déjà sorti ?
Oui, mais sous une forme limitée. Google a annoncé Gemini 4 Argon, le premier modèle Gemini 4, le 30 septembre 2026, mais pour l'instant, seuls les spécialistes de la cyberdéfense de son programme Fairwind peuvent l'utiliser. Les clients payants de l'API et les abonnés Google AI Ultra viennent ensuite, sans date fixée, et Gemini 3.5 Pro n'a toujours pas été lancé.