Google gère désormais deux lignes temporelles Gemini qui n'avancent plus au même rythme. La ligne Flash a filé jusqu'à Gemini 3.8 Flash, lancé le 2 septembre 2026, tandis que la ligne Pro reste figée sur Gemini 3.1 Pro depuis février. Si vous avez cherché un « Gemini 3.5 Pro » ou un « 3.6 Pro », c'est la première chose à clarifier dans toute comparaison de modèles Gemini honnête, car aucun des deux n'existe encore. Puis, le 30 septembre 2026, Google a annoncé Gemini 4 Argon, son premier nouveau modèle phare depuis 3.1 Pro, même si seul un petit groupe de spécialistes de la cyberdéfense agréés peut l'utiliser pour l'instant.

Ce guide retrace toute la gamme, de Gemini 2.5 à 3.8 Flash et au nouveau Gemini 4 Argon, version par version, avec un tableau de benchmarks et de prix pour chacune, ainsi que la façon dont les modèles apparaissent dans l'app Gemini et une recommandation claire pour chaque cas d'usage. Vous verrez exactement pourquoi Google a scindé la famille en deux, ce qui a vraiment changé à chaque version, et quel modèle est le bon choix par défaut pour le code, le chat du quotidien, les documents longs et les budgets serrés.

Les points clés à retenir

  • Gemini 3.8 Flash est le modèle le plus récent que vous pouvez utiliser, disponible depuis le 2 septembre 2026, à un tarif d'introduction de $0.75 / $3.75 par million de tokens. C'est le troisième lancement Flash de Google en 43 jours, et 3.7 Flash et 3.6 Flash sont au même tarif.
  • Il n'existe pas de Gemini 3.5 Pro ni de 3.6 Pro. Le modèle phare Pro actuel reste Gemini 3.1 Pro, de février 2026.
  • Ce tarif avantageux expire. Les trois modèles 3.8, 3.7 et 3.6 Flash repassent à $1.50 / $7.50 le 1er janvier 2027, donc budgétez avec le chiffre le plus élevé après le nouvel an.
  • Gemini 3.5 Flash-Lite est le modèle actuel le moins cher, à $0.30 / $2.50 par million de tokens.
  • Dans l'app, le plan Gratuit ne fait tourner que Gemini Flash-Lite à partir du 9 octobre 2026, 3.6 Flash passant à AI Plus et au-delà. Ni 3.7 ni 3.8 Flash n'est gratuit : 3.7 n'atteint les particuliers que via Spark, et l'accès à 3.8 est pour l'instant signalé pour les abonnés AI Pro et Ultra. Deep Think reste réservé à AI Ultra, tandis que Gemini Spark atteint AI Pro aux États-Unis et dans plus de 160 pays supplémentaires.
  • Gemini 4 Argon, premier modèle Gemini 4 de Google et nouveau modèle phare, a été annoncé le 30 septembre 2026 à un tarif d'introduction de $2 / $10 par million de tokens, mais pour l'instant seuls les spécialistes de la cyberdéfense du programme Fairwind peuvent l'utiliser.

La gamme Gemini en un coup d'œil (2026)

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-6, Claude 5.5, Gemini 3.8, Grok 4.7 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

Google organise Gemini en trois niveaux. Pro est le niveau phare du raisonnement, Flash est le cheval de bataille rapide du quotidien, et Flash-Lite est l'option économique. Ce qui est déroutant, c'est que ces niveaux ne partagent plus le même numéro de version, si bien que le Flash le plus récent (3.8) a quatre versions complètes d'avance sur le Pro le plus récent (3.1). Gemini 4 Argon, annoncé le 30 septembre, rompt de nouveau le schéma : il porte un nom de code plutôt qu'un nom de niveau.

Voici la famille actuelle, de la plus ancienne à la plus récente, avec les modèles les plus importants en gras.

ModèleSortieNiveauStatutIdéal pour
Gemini 2.5 Promars 2025ProHistoriqueRaisonnement de repli moins coûteux
Gemini 2.5 Flashavril 2025FlashHistoriqueAnciennes tâches du quotidien
Gemini 2.5 Flash-Litejuin 2025Flash-LiteHistoriqueVolume élevé, coût réduit
Gemini 3 Pronovembre 2025ProAperçuPremier modèle phare « 3.0 »
Gemini 3 Flashdécembre 2025FlashAperçuBon rapport qualité-prix
Gemini 3.1 Profévrier 2026ProLe Pro le plus récent que vous pouvez utiliserRaisonnement le plus difficile, documents longs
Gemini 3.1 Flash-Litemars 2026Flash-LiteRemplacéTravail agentique à petit budget
Gemini 3.5 Flashmai 2026FlashRemplacéCheval de bataille précédent
Gemini 3.5 Flash-Litejuillet 2026Flash-LiteActuelOption qualité la moins chère
Gemini 3.6 Flashjuillet 2026FlashRemplacéToujours la valeur par défaut de l'app gratuite
Gemini 3.7 Flashaoût 2026FlashRemplacéCheval de bataille précédent
Gemini 3.8 Flashseptembre 2026FlashCheval de bataille actuelLa plupart des gens, la plupart des tâches
Gemini 4 Argonseptembre 2026Modèle phare (sans nom de niveau)Annoncé, réservé aux partenaires FairwindCode long, travail de connaissance et tâches de cyberdéfense

Deux modèles spécialisés restent en dehors du tableau principal. Gemini 3 Deep Think est un aperçu de raisonnement étendu datant de décembre 2025, et Gemini 3.5 Flash Cyber, sorti le 21 juillet, est une version de 3.5 Flash affinée pour trouver et corriger des vulnérabilités de sécurité au sein du système CodeMender de Google.

Pourquoi il n'existe pas de Gemini 3.5 Pro (ni de 3.6 Pro)

La plus grande source de confusion dans toute comparaison de modèles Gemini tient aux versions Pro manquantes. Quand Google a sorti 3.5 Flash, puis 3.6 Flash, puis 3.7 Flash, puis 3.8 Flash, beaucoup ont supposé qu'un Pro équivalent arrivait aussi. Ce n'a pas été le cas.

Selon TechCrunch, Google a sorti trois nouveaux modèles le 21 juillet et, délibérément, aucun 3.5 Pro. Les informations de Bloomberg citées dans cet article indiquent que Google a connu des retards internes et a eu du mal à atteindre ses propres objectifs de performance pour 3.5 Pro, qui reste donc en test chez des partenaires plutôt qu'en lancement général. Le responsable produit Logan Kilpatrick a déclaré que l'entreprise le teste encore et espère qu'il « arrivera bientôt ».

Cela laisse Gemini 3.1 Pro, de février 2026, comme le modèle Pro le plus récent que vous pouvez réellement utiliser. Pendant ce temps, la ligne Flash a continué de sortir de nouvelles versions, ce qui explique le décalage apparent des numéros de version. La conclusion est simple : quand vous voulez le meilleur raisonnement Gemini aujourd'hui, vous utilisez 3.1 Pro, pas un 3.5 ou 3.6 Pro qui n'a pas été lancé. En septembre, Koray Kavukcuoglu, de Google DeepMind, a déclaré que Google « avait fait un petit pas en arrière » pour se concentrer sur ses modèles Flash, et le modèle phare suivant annoncé par Google, le 30 septembre, fut Gemini 4 Argon plutôt qu'un 3.5 Pro.

Gemini 2.5 : le socle historique à trois niveaux

La famille 2.5 est la génération historique, sortie tout au long de 2025, et c'est elle qui a fixé le schéma à trois niveaux que Google utilise encore. Gemini 2.5 Pro est arrivé le 25 mars, 2.5 Flash le 17 avril, et 2.5 Flash-Lite le 17 juin, chacun avec une fenêtre de contexte de 1M de tokens. Ces modèles fonctionnent encore et restent une solution de repli moins chère, mais ils sont en retard sur la famille 3.x en raisonnement, en code et sur les tâches agentiques.

Performances et prix des niveaux 2.5

Au lancement, 2.5 Pro dominait le classement LMArena et obtenait 63,8 % sur SWE-Bench Verified. 2.5 Flash était nettement moins cher, et 2.5 Flash-Lite descendait encore plus bas, à $0.10 / $0.40, toujours le tarif Gemini le plus bas que l'API ait jamais proposé. Notre guide des benchmarks IA explique ce que chacun de ces tests mesure réellement.

ModèleSortiePrix (entrée / sortie par 1M)Point fort
Gemini 2.5 Pro25 mars 2025$1.25 / $10.00N° 1 sur LMArena au lancement ; SWE-Bench 63,8 %
Gemini 2.5 Flash17 avril 2025$0.30 / $2.50Cheval de bataille rapide du quotidien
Gemini 2.5 Flash-Lite17 juin 2025$0.10 / $0.40Le tarif Gemini le plus bas jamais proposé

Quand choisir un modèle 2.5

N'utilisez 2.5 que si vous êtes sur une infrastructure plus ancienne ou si vous avez besoin du coût le plus bas possible et que la qualité de pointe ne vous importe pas. Pour tout nouveau projet, les niveaux 3.x représentent une amélioration nette, à prix similaire ou inférieur.

Gemini 3.0 : la remise à zéro de la génération

Le modèle Gemini 3 a ouvert la génération actuelle. Gemini 3 Pro a été lancé le 18 novembre 2025 comme modèle phare en aperçu, suivi de Gemini 3 Deep Think le 4 décembre pour un raisonnement multi-étapes plus poussé, puis de Gemini 3 Flash le 17 décembre. C'est ce saut qui a redéfini la position de Google dans les benchmarks face à ChatGPT et Claude.

Benchmarks et tarifs de Gemini 3.0

Gemini 3 Pro est sorti avec une fenêtre de contexte de 1M de tokens et 64K en sortie, affichant 91,9 % sur GPQA Diamond, un Elo de 1501 sur LMArena, et 76,2 % sur SWE-Bench Verified. Gemini 3 Flash a ensuite dépassé son propre frère Pro en code, atteignant 78 % sur SWE-Bench Verified pour seulement $0.50 / $3.00 par million de tokens. Deep Think, un mode de raisonnement étendu pour les abonnés AI Ultra, a porté ARC-AGI-2 à 45,1 % avec exécution de code.

ModèleSortiePrix (entrée / sortie par 1M)Benchmark clé
Gemini 3 Pro18 novembre 2025s.o. (aperçu)GPQA 91,9 %, SWE 76,2 %, Elo 1501
Gemini 3 Deep Think4 décembre 2025AI Ultra uniquementARC-AGI-2 45,1 %
Gemini 3 Flash17 décembre 2025$0.50 / $3.00SWE-Bench 78 %

Comment la génération 3.0 se tient aujourd'hui

Les modèles 3.0 ont introduit l'architecture et le travail sur le contexte long sur lesquels les versions suivantes se sont appuyées. La plupart ont depuis été remplacés par 3.1 et les versions Flash plus récentes, donc considérez 3.0 comme la base plutôt que comme un modèle à choisir aujourd'hui.

Gemini 3.1 Pro : le modèle phare que vous pouvez utiliser

Gemini 3.1 Pro, sorti le 19 février 2026, est le modèle à privilégier quand vous avez besoin du maximum de capacité. Il utilise une architecture de mélange d'experts épars, gère une fenêtre de contexte de 1M de tokens, et génère jusqu'à 64K tokens en une seule réponse. Il obtient 94,3 % sur GPQA Diamond et 80,6 % sur SWE-Bench Verified, deux chiffres propres à Google. La mesure indépendante est moins flatteuse : sur l'Artificial Analysis Intelligence Index v4.3.2, relevé le 25 septembre 2026, il se situe à 29,7, derrière les modèles phares actuels d'OpenAI et d'Anthropic et, plus gênant encore pour Google, onze points derrière son propre Gemini 3.8 Flash, à 40,9. Le Gemini 4 Argon de Google se situe désormais bien au-dessus des deux, à 52,6, mais pour l'instant seuls les partenaires du programme Fairwind peuvent l'utiliser.

Caractéristiques et tarifs de Gemini 3.1 Pro

CaractéristiqueGemini 3.1 Pro
Sortie19 février 2026
Contexte / sortie max1M / 64K tokens
Prix (texte)$2.00 / $12.00 par 1M, un seul niveau
Prix (sortie image)$120.00 par 1M, environ $0.134 par image 1K/2K
GPQA Diamond94,3 % (Google)
SWE-Bench Verified80,6 % (Google)
AA Intelligence Index v4.3.229,7 (relevé le 25 sept. 2026)

Quand utiliser 3.1 Pro

C'est le bon choix pour le raisonnement complexe, l'analyse de documents longs, la recherche, et les tâches de code agentique les plus difficiles. Comme Google n'a pas mis à jour le niveau Pro depuis février, 3.1 Pro devrait rester le Gemini le plus puissant que vous puissiez réellement utiliser jusqu'à ce que Gemini 4 Argon s'ouvre au-delà des partenaires Fairwind de Google.

Gemini 3.5 Flash et Flash-Lite : les chevaux de bataille du milieu de 2026

Gemini 3.5 Flash est sorti lors de Google I/O le 19 mai 2026, à $1.50 / $9.00 par million de tokens avec une fenêtre de contexte de 1M de tokens, et il a notamment battu 3.1 Pro sur plusieurs benchmarks de code et agentiques malgré son statut de modèle Flash. Il a servi de cheval de bataille au quotidien jusqu'à ce que 3.6 le remplace en juillet.

Gemini 3.5 Flash-Lite : le champion économique

Gemini 3.5 Flash-Lite, sorti le 21 juillet à $0.30 / $2.50 par million de tokens, est l'actuel champion économique. Google affirme qu'il surpasse nettement l'ancien Gemini 3 Flash, plus grand, sur certaines évaluations, dont SWE-Bench Pro et OSWorld-Verified, ce qui en fait un choix solide en matière de rapport qualité-prix pour le travail à fort volume.

ModèleSortiePrix (entrée / sortie par 1M)ContexteRemarque
Gemini 3.5 Flash19 mai 2026$1.50 / $9.001MA battu 3.1 Pro sur des évaluations de code
Gemini 3.5 Flash-Lite21 juillet 2026$0.30 / $2.501MModèle actuel le moins cher

Pourquoi le duo Flash compte

Ce duo est tout l'intérêt. Flash couvre le travail quotidien de qualité tandis que Flash-Lite gère les tâches à fort volume et sensibles au coût, et les deux disposent d'une fenêtre complète d'un million de tokens. Quand 3.6 Flash est arrivé en juillet, il s'est placé au-dessus de 3.5 Flash ; 3.7 Flash a pris la tête de la ligne Flash trois semaines plus tard, et 3.8 Flash l'a prise trois semaines après encore, tandis que Flash-Lite est resté le plancher économique tout du long.

Gemini 3.8 Flash : le cheval de bataille actuel

Gemini 3.8 Flash est devenu disponible pour tous le 2 septembre 2026, trois semaines après 3.7 Flash et comme troisième lancement Flash de Google en 43 jours. Chaque ligne de la fiche technique reste inchangée par rapport à son prédécesseur : la même fenêtre de contexte de 1M de tokens, la même limite de sortie de 64K, la même date de connaissances de mars 2026, la même liste de modalités et le même prix de lancement. Toute la nouveauté tient à ce que le modèle fait dans cette même enveloppe, et Google l'a ajusté pour des agents à long horizon plutôt que pour le code pur, axe de 3.7.

Prix et gains de benchmark de Gemini 3.8 Flash

Le prix n'a pas bougé. 3.8 Flash affiche le même tarif d'introduction de $0.75 / $3.75 par million de tokens que 3.7 et 3.6 Flash, avec la même note de bas de page : le 1er janvier 2027, les trois passent à $1.50 / $7.50. Il devance 3.7 Flash sur chaque ligne publiée par Google, avec les plus gros gains sur BioMysteryBench Human Difficult (de 43,5 % à 56,5 %), Terminal-bench 4.0 (de 11,2 % à 19,1 %) et DeepSWE v1.1 (de 65,3 % à 73,7 %). Il n'a pas tout raflé : dans sa propre comparaison de lancement, datée de septembre 2026, Google a vu Claude Opus 5 remporter les tests agentiques les plus difficiles, avec 51,8 % contre 19,1 % sur Terminal-bench 4.0 et 75,4 % contre 59,0 % sur OSWorld-2.0. Anthropic a depuis remplacé Opus 5 par Opus 5.5 et classé Opus 5 dans sa liste de modèles historiques, donc lisez cette comparaison comme celle publiée par Google au lancement, et non comme l'état actuel de la technique. Notre analyse de Gemini 3.8 Flash propose le tableau complet à 14 lignes et le chiffre de benchmark largement republié qui s'est révélé erroné.

CaractéristiqueGemini 3.8 Flash
Sortie2 septembre 2026
Prix$0.75 / $3.75 par 1M (introductif, double le 1er janvier 2027)
Contexte1M tokens en entrée, 64K en sortie
AA Intelligence Index v4.3.240,9 en réglage de raisonnement élevé, contre 39,1 pour 3.7 Flash (relevé le 25 sept. 2026)
DeepSWE v1.1De 65,3 % à 73,7 %
Terminal-bench 4.0De 11,2 % à 19,1 %
BioMysteryBench (difficile)De 43,5 % à 56,5 %

Gemini 3.7 Flash : le cheval de bataille précédent

Gemini 3.7 Flash est arrivé le 13 août 2026, seulement 23 jours après 3.6 Flash, dans AI Studio, l'API Gemini, Android Studio et la Gemini Enterprise Agent Platform, avec la même fenêtre de contexte de 1M de tokens et la même limite de sortie de 64K que son prédécesseur. Contrairement à la version 3.6, celle-ci représentait un vrai saut de capacité et non une simple passe d'efficacité : les scores en code et en tâches agentiques ont beaucoup progressé en trois semaines. Il a occupé la tête de la ligne Flash pendant exactement trois semaines, avant que 3.8 Flash ne le remplace au même prix.

Prix et gains de benchmark de Gemini 3.7 Flash

Le prix a été divisé par deux, à $0.75 / $3.75 par million de tokens, et Google a placé 3.6 Flash au même tarif, celui sur lequel 3.8 Flash a aussi fini par atterrir, si bien que les trois coûtent aujourd'hui la même chose. Lisez la note avant de budgétiser : ces tarifs sont introductifs et expirent le 31 décembre 2026, pour remonter à $1.50 / $7.50 en janvier. Côté benchmarks, DeepSWE v1.1 est passé de 49,0 % à 65,3 % et AutomationBench a presque doublé, de 17,0 % à 30,4 %. Pour le tableau complet, y compris les régions exclues par Google, consultez notre analyse de Gemini 3.7 Flash.

CaractéristiqueGemini 3.7 Flash
Sortie13 août 2026
Prix$0.75 / $3.75 par 1M (introductif, double le 1er janvier 2027)
Contexte1M tokens en entrée, 64K en sortie
AA Intelligence Index v4.3.239,1, contre 34,0 pour 3.6 Flash (relevé le 25 sept. 2026)
FrontierCode 1.1 MainDe 34,4 % à 43,6 %
DeepSWE v1.1De 49,0 % à 65,3 %
AutomationBenchDe 17,0 % à 30,4 %

Gemini 3.6 Flash : le cheval de bataille précédent

Gemini 3.6 Flash est sorti le 21 juillet 2026 et reste le modèle par défaut de l'app Gemini gratuite seulement jusqu'au 9 octobre 2026, date à laquelle les comptes gratuits basculent vers Flash-Lite, avec une fenêtre de contexte de 1M de tokens. C'est une amélioration d'efficacité plutôt qu'un nouveau niveau de pointe. Il utilise environ 17 % de tokens de sortie en moins que 3.5 Flash sur l'Artificial Analysis Index, avec des réductions allant jusqu'à 65 % sur certaines tâches d'ingénierie à long horizon.

Prix et gains de benchmark de Gemini 3.6 Flash

Le changement de prix au lancement a souvent été mal rapporté. La baisse ne portait que sur la sortie : la sortie est passée de $9.00 à $7.50 par million de tokens, tandis que l'entrée restait fixe à $1.50. Google a depuis réduit le modèle une nouvelle fois, à $0.75 / $3.75, pour l'aligner sur Gemini 3.7 Flash. Côté benchmarks, DeepSWE est passé de 37 % à 49 %, MLE-Bench de 49,7 % à 63,9 %, et OSWorld-Verified de 78,4 % à 83,0 %, selon l'annonce de Google. Pour une analyse plus détaillée de cette version, consultez notre analyse complète de Gemini 3.6 Flash.

CaractéristiqueGemini 3.6 Flash
Sortie21 juillet 2026
Prix$0.75 / $3.75 par 1M (réduit pour s'aligner sur 3.7 Flash ; lancé à $1.50 / $7.50)
Contexte1M tokens
AA Intelligence Index34,0 sur v4.3.2, relevé le 25 sept. 2026 (il affichait 52 sur la v4.1.1, désormais retirée)
DeepSWEDe 37 % à 49 %
MLE-BenchDe 49,7 % à 63,9 %
OSWorld-VerifiedDe 78,4 % à 83,0 %

Comparatif des tarifs de l'API Gemini (2026)

C'est au niveau des prix que la séparation des niveaux devient concrète. Flash et Flash-Lite sont conçus pour le volume, tandis que Pro coûte plus cher et reste réservé aux tâches qui le justifient. Le tableau ci-dessous présente les tarifs actuels de l'API par million de tokens.

ModèleEntrée (par 1M)Sortie (par 1M)Contexte
Gemini 3.8 Flash$0.75$3.751M
Gemini 3.7 Flash$0.75$3.751M
Gemini 3.6 Flash$0.75$3.751M
Gemini 3.5 Flash$1.50$9.001M
Gemini 3.5 Flash-Lite$0.30$2.501M
Gemini 3.1 Pro$2.00$12.001M

Pour la plupart des charges de travail, Gemini 3.8 Flash offre désormais les meilleurs résultats de la ligne Flash, et comme 3.6 et 3.7 Flash sont au même tarif, rien ne justifie financièrement de rester sur un modèle plus ancien. Les trois tarifs Flash sont introductifs et doublent le 1er janvier 2027. Si vous traitez d'énormes volumes de requêtes plus simples, 3.5 Flash-Lite réduit encore les coûts tout en conservant une qualité étonnamment solide.

Le niveau Pro était auparavant facturé selon la taille du prompt, avec un second tarif au-delà de 200K tokens. Ce n'est plus le cas. La grille tarifaire actuelle de l'API de Google affiche un seul tarif texte pour Gemini 3.1 Pro, $2.00 / $12.00, dans ses tableaux Standard, Batch, Flex et Priority, sans distinction de contexte long ; le niveau à $4.00 / $18.00 que ce guide montrait auparavant a disparu. Ce que Pro continue de tarifer séparément, c'est la sortie image, à $120 par million de tokens, ce qui équivaut à environ $0.134 par image 1K ou 2K et $0.24 par image 4K. Batch et Flex réduisent de moitié le tarif texte, à $1.00 / $6.00.

Comment Gemini apparaît dans l'app (Gratuit, Plus, Pro, Ultra)

La plupart des gens ne touchent jamais à l'API. Dans l'app Gemini, les modèles apparaissent sous forme de forfaits grand public plutôt que de numéros de version, et la version que vous obtenez dépend de ce que vous payez. À partir du 9 octobre 2026, le forfait Gratuit ne fait tourner que Gemini Flash-Lite, AI Plus ajoute Flash, et seuls AI Pro et Ultra donnent accès au modèle de raisonnement Pro, si bien que les niveaux payants achètent désormais des modèles en plus de limites d'usage plus élevées et des fonctions plus poussées. Notez qu'aucune des deux versions Flash les plus récentes n'apparaît comme niveau de forfait : 3.7 Flash n'atteint les utilisateurs de l'app qu'au sein de Spark, qui nécessite AI Pro ou Ultra, et le déploiement de 3.8 Flash a été signalé pour les abonnés AI Pro et Ultra, même si les notes de version des apps Gemini ne mentionnent encore rien à son sujet.

ForfaitPrix / moisAccès aux modèles et fonctions
Gratuit$0Uniquement Gemini Flash-Lite à partir du 9 oct. (3.6 Flash et accès variable à 3.1 Pro avant)
Google AI Plus$4.99Flash-Lite et Flash, Pro retiré en octobre ; limites 2x plus élevées que Gratuit, génération vidéo, Daily Brief
Google AI Pro$19.99Limites 4x plus élevées, accès renforcé au raisonnement de Gemini 3.1 Pro, Deep Research, fonctions agentiques, Gemini Spark dans plus de 160 pays
Google AI UltraDe $99.99 à $199.99Accès maximal à 3.1 Pro, Deep Think, Gemini Spark, Veo 3.1, jusqu'à 20x les limites du forfait Pro

La conclusion pratique est simple. Si vous voulez seulement un assistant rapide pour des questions du quotidien, le forfait Gratuit suffit toujours, mais à partir du 9 octobre il tourne sur Flash-Lite, donc AI Plus à $4.99 est le moyen le plus économique de garder Flash. Passez à AI Pro pour un raisonnement plus poussé, Deep Research et l'agent Gemini Spark, qui a atteint Pro aux États-Unis le 23 juillet 2026 et plus de 160 pays supplémentaires le 30 juillet. Seuls les forfaits AI Ultra ajoutent Deep Think. Spark n'est proposé nulle part dans l'EEE, au Royaume-Uni, en Suisse ni au Nigeria.

Comparatif des benchmarks Gemini

Les benchmarks racontent la même histoire de lignées séparées, et ils la racontent désormais beaucoup plus fort qu'avant. Sur l'Artificial Analysis Intelligence Index v4.3.2, un composite de dix évaluations, la ligne Flash ne dépasse pas seulement de peu l'ancien Pro, elle le surpasse nettement. Gemini 3.8 Flash obtient 40,9 en réglage de raisonnement élevé et Gemini 3.7 Flash, 39,1, contre 29,7 pour le modèle phare Gemini 3.1 Pro. Gemini 3.6 Flash se situe à 34,0, Gemini 3.5 Flash à 32,6, et le Gemini 3.5 Flash-Lite économique à 22,2. Chacun de ces modèles Flash devance le modèle Pro, sauf Flash-Lite.

Une mise en garde sur tous les chiffres Artificial Analysis que vous verrez cités pour Gemini, y compris ceux que ce guide a utilisés jusqu'en septembre 2026. AA a réétalonné son index quatre fois en sept semaines, en passant par v4.1.1, v4.2, v4.3 et v4.3.2, et chaque réétalonnage a déplacé tous les scores à la fois sans qu'aucun modèle ne change. Gemini 3.8 Flash affichait 59 sur v4.1.1 et affiche 40,9 sur v4.3.2 ; rien n'a empiré dans le modèle. Les chiffres de cette page ont tous été relevés de nouveau sur les pages de modèle d'AA le 25 septembre 2026 et sont tous en v4.3.2, ils sont donc comparables entre eux, mais avec rien de ce qui a été publié avant septembre. Notez aussi que l'infobulle du classement d'AA indique encore v4.3, tandis que les pages de chaque modèle indiquent v4.3.2 ; ce sont les pages de modèle qu'il faut croire. Considérez tout chiffre d'index sans mention de version comme inutilisable.

ModèleAA Intelligence Index (v4.3.2, 25 sept. 2026)Vitesse de sortie (tokens/s)
Gemini 3.8 Flash40,9 (élevé)304,6
Gemini 3.7 Flash39,1 (élevé)279,4
Gemini 3.6 Flash34,0 (élevé)210,0
Gemini 3.5 Flash32,6 (élevé)189
Gemini 3.1 Pro29,7113
Gemini 3.5 Flash-Lite22,2463

Deux détails valent la peine d'être relevés. Le premier, c'est que la ligne Flash n'est plus plate : sur v4.1, 3.5 et 3.6 Flash obtenaient tous les deux 50, et sur v4.3.2 ils se séparent à 32,6 et 34,0, avec 3.7 et 3.8 qui s'éloignent encore plus. Le second, c'est que Gemini 3.1 Pro est le troisième modèle le plus lent et le quatrième au score dans le tableau de sa propre famille, une position inhabituelle pour un modèle phare. Les propres gains de Gemini 3.6 se voient surtout en efficacité et en code agentique, avec des bonds à deux chiffres sur DeepSWE et MLE-Bench tout en utilisant environ 17 % de tokens de sortie en moins que 3.5 Flash. En vitesse brute, Flash-Lite est dans une autre catégorie, à 463 tokens par seconde, contre 189 pour 3.5 Flash et 113 pour 3.1 Pro.

Progression des benchmarks dans toute la famille Gemini

Suivre quelques évaluations clés d'une version à l'autre montre clairement les deux trajectoires. La ligne Pro progresse régulièrement sur les tests de raisonnement et de code les plus difficiles, tandis que la ligne Flash rattrape discrètement le modèle phare sur l'indice composite. Les cellules vides signifient que Google ou Artificial Analysis n'a pas publié ce chiffre pour le modèle.

Benchmark2.5 Pro3 Pro3.1 Pro3.5 Flash3.6 Flash3.8 Flash
GPQA Diamonds.o.91,9 %94,3 %s.o.s.o.s.o.
SWE-Bench Verified63,8 %76,2 %80,6 %s.o.s.o.s.o.
AA Index v4.3.2s.o.s.o.29,732,634,040,9
DeepSWEs.o.s.o.s.o.37 %49 %73,7 % (v1.1)

En lisant les colonnes Pro de haut en bas, la tendance est une progression nette sur les propres évaluations de Google, GPQA Diamond passant de 91,9 % à 94,3 % et SWE-Bench Verified de 63,8 % à 76,2 %, puis à 80,6 %. En lisant la ligne AA à l'horizontale, l'histoire s'inverse : Flash n'a pas comblé l'écart, il l'a dépassé, passant de 32,6 à 40,9 tandis que le modèle phare reste à 29,7. La lecture honnête est que les deux mesures divergent parce qu'elles mesurent des choses différentes. Les chiffres de Google sont des scores d'évaluation unique en raisonnement et en code, où 3.1 Pro mène réellement ; le composite d'AA intègre dix évaluations, dont du travail sur des documents à contexte long et des tâches agentiques, et sur cette base un modèle Pro vieux de sept mois perd face à un Flash vieux de trois semaines. Si votre travail ressemble à GPQA, choisissez Pro. S'il ressemble à tout le reste, choisissez Flash.

Quel modèle Gemini devriez-vous utiliser ?

Pour la plupart des gens, Gemini 3.8 Flash est le bon choix par défaut. Il est rapide, économique à $0.75 / $3.75 par million de tokens jusqu'en janvier, et gère bien le code et les tâches quotidiennes. Passez à Gemini 3.1 Pro pour le raisonnement le plus difficile et le travail sur documents longs, et descendez à Gemini 3.5 Flash-Lite quand le coût prime sur tout. Le tableau ci-dessous associe des tâches courantes au modèle qui convient.

Votre tâcheMeilleur modèlePourquoi
Chat et écriture du quotidienGemini 3.8 FlashRapide, économique, bonne qualité générale
Code généralGemini 3.8 FlashPlus gros gains en code agentique (DeepSWE v1.1 73,7 %)
Raisonnement le plus difficile et rechercheGemini 3.1 ProMeilleurs scores, GPQA 94,3 % et SWE 80,6 %
Analyse de documents longsGemini 3.1 ProContexte de 1M avec le raisonnement le plus poussé
Travail à fort volume et petit budgetGemini 3.5 Flash-Lite$0.30 / $2.50 et le plus rapide, à 463 tok/s
Travail sur les vulnérabilités de sécuritéGemini 3.8 Flash CyberLe spécialiste sécurité actuel de Google, sorti le 2 septembre 2026 dans le cadre du programme Fairwind ; il remplace 3.5 Flash Cyber

Si votre travail principal est la programmation, 3.8 Flash est le choix le plus rentable et 3.1 Pro reste le plafond pour les problèmes les plus difficiles. Une mise en garde pour les non-développeurs : ni 3.7 ni 3.8 Flash n'est gratuit dans l'app Gemini, et à partir du 9 octobre 2026 le niveau gratuit ne répond qu'avec Flash-Lite. Pour un panorama plus large sur l'association entre tâches et modèles, toutes marques confondues, notre guide sur quand utiliser quel modèle d'IA couvre l'ensemble du sujet.

Comment Gemini se compare à ChatGPT et Claude

La stratégie de Google diffère de celle de ses rivaux. Plutôt que de viser un seul modèle phare au benchmark maximal, elle optimise pour la polyvalence pratique, la multimodalité et une intégration profonde avec Search, Workspace et Android. C'est pourquoi le niveau Flash reçoit tant d'attention : c'est le modèle que la plupart des gens utilisent réellement chaque jour. Pour le volet Claude en détail, voir la comparaison ultime des modèles Claude.

Modèle phareAA Index (v4.3.2, 25 sept. 2026)Contexte / sortiePrix (entrée / sortie par 1M)Sortie
Gemini 3.1 Pro29,71M / 64K$2.00 / $12.00févr. 2026
GPT-6 Astra52,7 (max)1,05M / 128K$10.00 / $50.00sept. 2026
Claude Opus 5.557,6 (max)1M / 128K$4.00 / $20.00sept. 2026
Gemini 4 Argon (réservé aux partenaires Fairwind)52,6 (élevé)1M / 1M$2.00 / $10.00 intro., puis $4.00 / $20.00sept. 2026
Gemini 3.8 Flash, pour référence40,9 (élevé)1M / 64K$0.75 / $3.75sept. 2026

C'est le tableau qui a le plus bougé depuis l'été, et pas en faveur de Google. Les deux rivaux ont remplacé leurs modèles phares en septembre 2026, et la réponse de Google n'est arrivée que le 30 septembre, en diffusion limitée. Sur v4.3.2, il accuse un retard de 23 et 28 points sur GPT-6 Astra, à 52,7, et sur Claude Opus 5.5, à 57,6, là où l'ancienne lecture v4.1 situait l'écart entre 13 et 15. Ce qui tient toujours, c'est l'argument du prix, et il est plus fort qu'avant : Gemini 3.1 Pro coûte un cinquième du prix d'entrée d'Astra et un quart de son prix de sortie, et la moitié du prix d'entrée d'Opus 5.5. Le nouveau modèle phare de Google, Gemini 4 Argon, referme la majeure partie de l'écart de score à 52,6, à un cheveu d'Astra, mais pour l'instant seuls les spécialistes de la cyberdéfense du programme Fairwind peuvent l'utiliser. Parmi les Gemini que vous pouvez appeler aujourd'hui, la vraie réponse de Google aux deux n'est pas son niveau Pro du tout. C'est Gemini 3.8 Flash, qui obtient 40,9, plus que Pro, à $0.75 / $3.75, et c'est cette ligne qu'une comparaison coût/qualité devrait réellement utiliser.

Les trois modèles phares gèrent désormais environ un million de tokens de contexte, donc le vrai compromis porte sur la profondeur de raisonnement et le prix plutôt que sur la taille de la fenêtre. Une différence pratique : OpenAI et Anthropic permettent des réponses uniques bien plus longues, avec 128K tokens de sortie contre 64K pour Gemini, ce qui compte pour la génération de code volumineux ou de longs rapports. Gemini 4 Argon inverse cela avec jusqu'à 1M de tokens de sortie, une fois que vous pouvez y accéder.

Sur les propres évaluations de Google, 3.1 Pro rivalise avec les meilleurs modèles GPT-6 et Claude 5 sans dominer le peloton ; sur le composite indépendant, il ne rivalise plus du tout avec eux, et c'est Flash qui joue au-dessus de sa catégorie de prix. Pour le panorama complet entre fournisseurs, voir notre comparatif des meilleurs modèles d'IA et l'analyse approfondie de Gemini 3.5.

Ce qui arrive ensuite pour Gemini (3.5 Pro et Gemini 4)

Le premier, c'est Gemini 3.5 Pro, toujours bloqué en test chez des partenaires après que Google a manqué ses propres objectifs internes. En juillet, l'équipe produit s'est contentée de dire qu'elle espérait que le modèle « arriverait bientôt », et en septembre Koray Kavukcuoglu, de Google DeepMind, a déclaré que Google « avait fait un petit pas en arrière » pour se concentrer sur Flash. Google n'a pas dit si 3.5 Pro sera un jour lancé.

Le second est partiellement arrivé. Google a confirmé en juillet avoir lancé son « entraînement préalable le plus ambitieux à ce jour » pour Gemini 4, et le 30 septembre 2026, il a annoncé Gemini 4 Argon, le premier modèle Gemini 4. Il est d'abord déployé auprès des spécialistes de la cyberdéfense du programme Fairwind de Google, puis auprès des clients payants de l'API et des abonnés Google AI Ultra, sans date pour l'un ou l'autre, donc la carte ci-dessus reste celle avec laquelle la plupart des gens devront composer encore un moment.

Utilisez tous les meilleurs modèles de la classe Gemini sans choisir de version

Le labyrinthe de versions que cet article vient de cartographier est le vrai coût de choisir un niveau Gemini. Google AI Pro coûte $19.99 par mois et continue de vous répondre avec la version que l'app décide de vous donner, et côté API, vous devez suivre quel tarif Flash est introductif et quel seuil Pro double votre facture.

Fello AI est une app native pour Mac, iPhone et iPad qui vous donne accès à Gemini sous un seul abonnement, avec en plus ChatGPT, Claude, Grok, DeepSeek, Perplexity, Kimi, GLM et Qwen. Elle démarre à $9.99 par mois, soit la moitié de Google AI Pro, avec un niveau gratuit pour l'essayer d'abord et une note de 4,7 étoiles sur plus de 27 000 avis. Les derniers modèles Gemini disponibles publiquement sont simplement là dès que vous ouvrez l'app, et vous pouvez poser la même question à un modèle rival dans la même conversation au lieu de vous engager sur une version et une grille tarifaire.

Conclusion

La comparaison de modèles Gemini honnête pour 2026 est une histoire à deux trajectoires. Flash a filé jusqu'à 3.8, trois versions en 43 jours et moins chère que jamais, tandis que Pro reste à 3.1, avec 3.5 Pro toujours non lancé. Pour presque tout le monde, commencez par Gemini 3.8 Flash, passez à 3.1 Pro pour le travail le plus difficile, et descendez à 3.5 Flash-Lite quand le budget prime. Avec Gemini 4 Argon annoncé le 30 septembre mais réservé aux partenaires Fairwind, attendez-vous à ce que la carte évolue encore une fois qu'il s'ouvrira aux clients payants de l'API et aux abonnés Google AI Ultra.

FAQ

Existe-t-il un Gemini 3.5 Pro ?

Non. En date de septembre 2026, Gemini 3.5 Pro n'a pas été lancé et n'a aucune entrée dans le journal des modifications de l'API. Google le teste encore avec des partenaires après des retards internes, donc le modèle Pro phare actuel reste Gemini 3.1 Pro, de février 2026. La ligne Flash, pendant ce temps, a progressé jusqu'à 3.8 Flash. Le modèle phare suivant de Google s'est révélé être Gemini 4 Argon, annoncé le 30 septembre 2026.

Quel modèle Gemini devrais-je utiliser ?

Pour la plupart des gens, Gemini 3.8 Flash est le meilleur choix par défaut, car il est rapide, économique à $0.75 / $3.75 par million de tokens, et c'est la version Flash la plus performante en code et en travail agentique. Choisissez Gemini 3.1 Pro pour le raisonnement le plus difficile et les documents longs, et Gemini 3.5 Flash-Lite quand vous avez besoin du coût le plus bas.

Quelle est la différence entre Gemini 3.5 Flash et 3.6 Flash ?

Gemini 3.6 Flash a remplacé 3.5 Flash comme cheval de bataille. Il utilise environ 17 % de tokens de sortie en moins, a réduit le prix de sortie de $9 à $7.50 par million au lancement tandis que l'entrée restait à $1.50, et a affiché de gros gains en code, comme DeepSWE passant de 37 % à 49 %. C'était une amélioration d'efficacité, pas un nouveau niveau de pointe, et il fonctionne désormais à $0.75 / $3.75 aux côtés de Gemini 3.7 Flash et Gemini 3.8 Flash.

Quelle est la différence entre Gemini 3.7 Flash et 3.8 Flash ?

Rien sur la fiche technique et rien sur le prix. Gemini 3.8 Flash, sorti le 2 septembre 2026, a la même fenêtre de contexte de 1M de tokens, la même limite de sortie de 64K, la même date de connaissances de mars 2026 et le même tarif d'introduction de $0.75 / $3.75 que 3.7 Flash. La différence se mesure sur la qualité : il devance 3.7 Flash sur chaque ligne de benchmark publiée par Google, avec DeepSWE v1.1 passant de 65,3 % à 73,7 % et Terminal-bench 4.0 de 11,2 % à 19,1 %. Comme le prix est identique, rien ne justifie de démarrer un nouveau projet sur 3.7 Flash.

Quels modèles Gemini les forfaits de l'app incluent-ils ?

À partir du 9 octobre 2026, le forfait Gratuit ne fait tourner que Gemini Flash-Lite, AI Plus ajoute Flash, et AI Pro et Ultra ajoutent 3.1 Pro et Deep Think. Google AI Pro, à $19.99, relève les limites et donne un accès renforcé au modèle de raisonnement Pro ainsi qu'à Deep Research, et les forfaits AI Ultra, de $99.99 à $199.99, ajoutent Deep Think. Gemini Spark est disponible sur AI Pro aux États-Unis et dans plus de 160 pays supplémentaires, mais il n'est pas proposé dans l'EEE, au Royaume-Uni, en Suisse ni au Nigeria.

Quel est le modèle Gemini le moins cher ?

Gemini 3.5 Flash-Lite, sorti le 21 juillet 2026, est le modèle actuel le moins cher, à $0.30 en entrée et $2.50 en sortie par million de tokens. Google affirme qu'il surpasse l'ancien Gemini 3 Flash sur certains benchmarks de code et agentiques, ce qui en fait une excellente valeur pour le travail à fort volume.

Gemini 4 est-il déjà sorti ?

Oui, mais sous une forme limitée. Google a annoncé Gemini 4 Argon, le premier modèle Gemini 4, le 30 septembre 2026, mais pour l'instant, seuls les spécialistes de la cyberdéfense de son programme Fairwind peuvent l'utiliser. Les clients payants de l'API et les abonnés Google AI Ultra viennent ensuite, sans date fixée, et Gemini 3.5 Pro n'a toujours pas été lancé.