Google a scindé Gemini 3.5 en deux lancements, et un seul est réellement arrivé. Gemini 3.5 Flash est devenu disponible le 19 mai 2026 lors de Google I/O 2026 et a fait une première pour Google, avec son offre « Flash », bon marché et rapide, qui a battu l'ancien modèle phare en codage. L'autre moitié, Gemini 3.5 Pro, est le modèle que tout le monde attend, et sa date de sortie a désormais glissé de plusieurs mois. La position officielle de Google, publiée le 21 juillet 2026, est que Pro est « actuellement testé auprès de partenaires », sans date associée.

Cet article couvre les deux volets. Vous découvrez ce que Gemini 3.5 Flash propose aujourd'hui, tous les benchmarks face à Gemini 3.1 Pro, et les tarifs. Vous découvrez aussi tout ce que Google a réellement confirmé au sujet de Gemini 3.5 Pro, et comment distinguer ces faits des rumeurs, car la plupart des caractéristiques qui circulent pour Pro ne viennent jamais de Google. Google a également confirmé qu'un modèle Gemini sur mesure allait équiper le Siri reconstruit d'Apple, ce qui accentue encore l'enjeu. Un point à connaître d'emblée : l'offre Flash a déjà changé de génération, et notre avis sur Gemini 3.6 Flash couvre le remplaçant du 21 juillet 2026.

Les points clés

  • Gemini 3.5 Flash a été lancé le 19 mai 2026 à Google I/O 2026, premier modèle de la famille Gemini 3.5.
  • Il bat le plus gros Gemini 3.1 Pro sur les benchmarks de codage et d'agentique tout en tournant 4x plus vite en tokens de sortie par seconde.
  • Le tarif API est de $1.50 par million de tokens en entrée et $9.00 par million de tokens en sortie, soit environ 25 % moins cher que Gemini 3.1 Pro. Son remplaçant, Gemini 3.6 Flash, maintient l'entrée à $1.50 et réduit la sortie à $7.50.
  • Il dispose d'une fenêtre de contexte de 1M tokens. Il était le modèle de l'offre gratuite dans l'app Gemini depuis mai 2026, mais la page des forfaits de Google indique désormais « Access to 3.6 Flash » pour l'offre gratuite.
  • Gemini 3.5 Pro n'est toujours pas sorti. Google a déclaré le 21 juillet 2026 qu'il est « actuellement testé auprès de partenaires ». Bloomberg a rapporté qu'il a des mois de retard. La fenêtre de contexte de 2M tokens et le mode Deep Think qui circulent en ligne ne sont pas confirmés par Google.

Qu'est-ce que Gemini 3.5 Flash ?

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

Gemini 3.5 Flash est le nouveau modèle vitesse-et-coût de Google, et c'est le lancement phare de Google I/O 2026. Dans son annonce officielle, Google qualifie la famille d'« intelligence de pointe qui agit », et ce positionnement est délibéré. Les modèles Flash étaient autrefois l'option économique vers laquelle on se tournait quand on n'avait pas besoin du modèle le plus intelligent. Gemini 3.5 Flash inverse la donne en offrant des performances qui, selon Google, « rivalisent avec les grands modèles phares sur plusieurs dimensions » tout en gardant la vitesse et le prix propres à la gamme Flash. Alibaba a lancé son propre modèle de raisonnement de pointe le lendemain ; voir notre avis sur Qwen3.7-Max pour le face-à-face avec Flash sur les tarifs et les benchmarks.

Le modèle est optimisé pour le codage et les tâches agentiques, ce travail à long horizon où une IA planifie, appelle des outils et itère au lieu de répondre à une seule question. Il domine aussi en compréhension multimodale, avec un score de 84,2 % sur CharXiv Reasoning. L'ID du modèle dans l'API est gemini-3.5-flash, la fenêtre de contexte est de 1 048 576 tokens en entrée avec 64K tokens en sortie, et la date de connaissances est janvier 2026. Pour comprendre comment Google en est arrivé là, notre analyse du passage de Gemini 2.5 à Gemini 3 retrace l'historique des versions. À noter, la génération a depuis changé : l'ID gemini-3.5-flash reste stable et toujours utilisable, mais gemini-3.6-flash est désormais le modèle Flash actuel dans le catalogue de Google.

Gemini 3.5 Flash contre Gemini 3.1 Pro : les benchmarks

Voici la partie qui compte vraiment. Un modèle Flash n'est pas censé battre le modèle Pro de la génération précédente, et c'est exactement ce que fait Gemini 3.5 Flash sur les benchmarks qui comptent le plus pour Google. Le tableau ci-dessous le compare à Gemini 3.1 Pro, le modèle qu'il remplace de fait pour la plupart des utilisateurs. Pour voir comment chaque version de 2.5 à 3.6 se positionne, consultez notre comparatif complet des modèles Gemini.

BenchmarkGemini 3.5 FlashGemini 3.1 ProVainqueurCe qui est mesuré
Terminal-Bench 2.176,2 %70,3 %3.5 FlashCodage réel dans un terminal
GDPval-AA1 656 Elo1 314 Elo3.5 FlashTâches agentiques réelles
MCP Atlas83,6 %78,2 %3.5 FlashUtilisation d'outils à grande échelle
CharXiv Reasoning84,2 %N/A3.5 FlashCompréhension multimodale
Humanity's Last Exam40,2 %44,4 %3.1 ProRaisonnement expert le plus difficile
ARC-AGI-272,1 %77,1 %3.1 ProRaisonnement abstrait
Vitesse de sortie~4x plus rapideréférence3.5 FlashTokens de sortie par seconde

Sur GDPval-AA, le bond est spectaculaire. Gemini 3.1 Pro obtient 1 314 Elo ; Gemini 3.5 Flash obtient 1 656 Elo, soit un écart de 342 points sur des tâches agentiques réelles. Google affirme que Gemini 3.5 Flash est 4 fois plus rapide que les autres modèles de pointe en tokens de sortie par seconde. Pour des agents qui bouclent des dizaines d'étapes, cet écart de vitesse se cumule vite.

Là où Gemini 3.1 Pro l'emporte encore

Gemini 3.5 Flash ne rafle pas tout, et Google le reconnaît honnêtement. Sur les tests de raisonnement pur les plus difficiles, l'ancien Gemini 3.1 Pro garde l'avantage. Il devance sur Humanity's Last Exam (44,4 % contre 40,2 %) et ARC-AGI-2 (77,1 % contre 72,1 %), et il tient mieux la route sur la récupération à très long contexte, avec un score de 84,9 % sur MRCR v2 à 128k tokens contre 77,3 % pour Flash, selon des données indépendantes de benchmarks et de tarifs.

Le constat pratique est simple. Pour le codage, l'utilisation d'outils et les workflows agentiques, Gemini 3.5 Flash est aujourd'hui le choix le meilleur et le moins cher. Pour les problèmes de raisonnement les plus poussés ou le travail sur des documents à très grand contexte, Gemini 3.1 Pro reste rentable jusqu'à l'arrivée de Gemini 3.5 Pro. Notre avis complet sur Gemini 3.1 Pro couvre les domaines où ce modèle brille encore. Google a depuis lancé deux modèles Flash supplémentaires au lieu du modèle Pro, Gemini 3.7 Flash en août 2026 et Gemini 3.8 Flash le 2 septembre, creusant encore l'écart entre les deux gammes.

Tarifs de Gemini 3.5 Flash

Pour la plupart des gens, l'app Gemini ne coûte rien, et cela n'a pas changé. Ce qui a changé, c'est le modèle que vous obtenez. Gemini 3.5 Flash était le modèle de l'offre gratuite depuis mai 2026, et la page des forfaits de Google indique désormais « Access to 3.6 Flash » pour l'offre gratuite, si bien qu'un utilisateur gratuit accède aujourd'hui à la génération plus récente. Les tarifs ci-dessous comptent si vous êtes développeur et appelez gemini-3.5-flash directement via l'API. Pour la réponse courte, voir si Gemini est gratuit.

Tarifs des tokens API

Type de tokenGemini 3.5 FlashGemini 3.1 Pro
Entrée (par million)$1.50$2.00
Sortie (par million)$9.00$12.00
Entrée mise en cache (par million)$0.15N/A

Cela rend Gemini 3.5 Flash environ 25 % moins cher en entrée comme en sortie que Gemini 3.1 Pro aux tarifs officiels de l'API de Google, qui s'élèvent à $2.00 en entrée / $12.00 en sortie jusqu'à 200k tokens et $4.00 en entrée / $18.00 en sortie au-delà, tout en obtenant de meilleurs scores sur les benchmarks de codage et d'agentique. C'est environ 3x le prix de l'ancien Gemini 3 Flash ($0.50 en entrée / $3.00 en sortie), mais bien plus capable, ce qui le place dans un nouveau point d'équilibre. Le successeur l'a depuis sous-enchéri des deux côtés. Gemini 3.6 Flash a été lancé à $1.50 en entrée / $7.50 en sortie, puis Google l'a ramené à $0.75 / $3.75 le 13 août 2026 pour s'aligner sur Gemini 3.7 Flash, ce qui le place à la moitié du prix d'entrée de 3.5 Flash et bien en dessous de la moitié pour la sortie. Les deux tarifs Flash sont introductifs et doublent le 1er janvier 2027. Pour une vue d'ensemble, voir notre analyse complète des tarifs Gemini et notre comparatif des tarifs IA face aux principaux modèles.

Comment utiliser Gemini 3.5 dès maintenant

Gemini 3.5 Flash est déjà disponible partout où Google déploie Gemini. Pas besoin d'attendre ni de s'inscrire sur une liste. Il existe quatre façons de l'utiliser dès aujourd'hui.

  1. App Gemini : ouvrez l'app Gemini sur le web, Android ou iOS (l'app Gemini pour iOS figure désormais parmi les meilleures apps IA pour iPhone). Google n'a pas republié de modèle par défaut pour l'app depuis Gemini 3 Flash, mais l'offre gratuite atteint désormais 3.6 Flash.
  2. Mode IA dans Search : Gemini 3.5 Flash a été déployé dans le mode IA de Google Search dans le monde entier en mai 2026, gratuitement pour tous. Google n'a publié aucun changement de modèle pour le mode IA depuis.
  3. API Gemini : les développeurs peuvent appeler gemini-3.5-flash via Google AI Studio, l'API Gemini et Android Studio.
  4. Entreprise : il est disponible via Google Antigravity, la Gemini Enterprise Agent Platform, et Gemini Enterprise.

Si vous utilisez surtout Gemini sur Mac, notre avis sur l'app Gemini pour Mac détaille l'expérience sur ordinateur. Vous préférez un seul abonnement qui vous donne accès à plusieurs modèles plutôt que de jongler entre les apps ? L'app Fello AI pour Mac réunit Gemini, ChatGPT, Claude, Grok et DeepSeek derrière un seul forfait à $9.99/mois, pour changer de modèle selon la tâche sans payer chacun séparément.

Gemini Spark et le reste de Google I/O 2026

Gemini 3.5 Flash fait tourner bien plus que le chat. Google s'en est servi pour lancer Gemini Spark, un agent IA personnel actif 24h/24 et 7j/7 qui travaille en arrière-plan pour gérer les tâches récurrentes de votre vie numérique. Spark a d'abord été déployé auprès de testeurs de confiance, suivi d'une bêta pour les abonnés Google AI Ultra aux États-Unis, selon Engadget. Il a depuis dépassé ce stade : Spark a rejoint Google AI Pro à $19.99/mois le 23 juillet 2026 et plus de 160 pays supplémentaires le 30 juillet, même s'il reste indisponible dans l'EEE, au Royaume-Uni, en Suisse et au Nigeria. Le fait que Spark tourne sur Gemini 3.5 Flash plutôt que sur la version Pro plus lourde est ce qui lui permet de rester en ligne 24h/24 à un tarif de niveau agent.

Le keynote a aussi apporté une refonte Neural Expressive de l'app Gemini, un Daily Brief personnalisé, un résumé matinal pour les abonnés AI Plus, Pro et Ultra, ainsi que des mises à jour de Gemini Omni. Google AI Ultra démarre à $99.99/mois pour 5x les limites de Google AI Pro, avec un palier supérieur à $199.99/mois pour 20x. Côté sécurité, Google indique que Gemini 3.5 embarque des garde-fous cyber et CBRN renforcés, moins de refus incorrects sur des requêtes sûres, et de nouveaux outils d'interprétabilité qui inspectent le raisonnement interne du modèle avant qu'une réponse ne soit renvoyée. Google a aussi dévoilé des lunettes intelligentes Android XR intégrant Gemini 3.5 Flash, plaçant Google directement face à Apple dans la course de 2027.

Quand sort Gemini 3.5 Pro ?

Gemini 3.5 Pro n'est toujours pas sorti, et Google n'a plus jamais donné de nouvelle date. Sundar Pichai l'a annoncé à l'I/O le 19 mai 2026 en disant qu'il arriverait le mois suivant. Juin est passé. Le 21 juillet 2026, dans l'annonce de Gemini 3.6 Flash, la seule déclaration publique de Google a été que « Gemini 3.5 Pro est actuellement testé auprès de partenaires et nous prévoyons de le rendre largement disponible dès qu'il sera prêt ». Le modèle n'apparaît dans le catalogue de modèles de l'API Gemini ni dans la liste des modèles Vertex AI, sous aucune forme, version preview comprise.

Les informations derrière ce retard sont plus minces que ce que laisse penser Internet. Bloomberg a rapporté le 16 juillet 2026 que Gemini 3.5 Pro a des mois de retard parce que Google a cherché à améliorer ses capacités, notamment en codage. Google a mis à jour les données utilisées pour entraîner le modèle fin juin, et les résultats n'ont pas été à la hauteur des attentes. En s'entretenant avec 10 employés actuels et anciens, Bloomberg a décrit la frustration d'ingénieurs, de chercheurs et de responsables chez Google, inquiets de voir l'entreprise perdre son avance pendant qu'Anthropic et OpenAI lancent des modèles qui surpassent Gemini. C'est là tout le récit vérifié.

Méfiez-vous des caractéristiques lues ailleurs. La fenêtre de contexte de 2 millions de tokens et le mode de raisonnement intégré Deep Think sont les deux fonctionnalités attribuées à Gemini 3.5 Pro dans presque tous les récapitulatifs, et Google n'a confirmé ni l'une ni l'autre pour ce modèle. Deep Think existe bel et bien et est déjà proposé dans Gemini pour les abonnés Google AI Ultra, mais il s'agit là d'une fonctionnalité produit que vous pouvez acheter dès aujourd'hui, pas d'une caractéristique publiée de 3.5 Pro. Le tarif non plus n'est pas officiel, donc traitez tout chiffre qui circule comme un simple espace réservé tant que Google n'a pas publié ses tarifs.

CaractéristiqueGemini 3.5 FlashGemini 3.5 Pro
StatutDisponible depuis le 19 mai 2026Non sorti ; « testé auprès de partenaires »
Fenêtre de contexte1M tokens2M annoncé par rumeur, non confirmé
Mode Deep ThinkNonAnnoncé par rumeur, non confirmé
Idéal pourVitesse, codage, agents, discussion quotidienneRaisonnement le plus poussé, travail à très grand contexte
Tarif API (par million)$1.50 en entrée / $9.00 en sortieNon publié

Pourquoi Gemini 3.5 Pro est en retard

Vous trouverez en ligne un récit détaillé selon lequel Google aurait abandonné puis reconstruit le modèle de base après qu'il a échoué sur l'appel d'outils récursif et des mises en page SVG complexes. Rien de tout cela n'apparaît dans une source primaire. Cela remonte à des chaînes de commentaires IA et à des agrégateurs SEO, et cela a été répété assez souvent pour ressembler à du reportage. Ce que Bloomberg a réellement décrit est plus étroit et plus terne : une mise à jour des données d'entraînement fin juin, ciblant le codage, qui n'a pas apporté les gains attendus par Google, sur un modèle déjà en retard de plusieurs mois.

Le contexte documenté, ce sont les personnes. TechCrunch a rapporté le 24 juin 2026 que Google DeepMind avait perdu quatre chercheurs seniors en une quinzaine de jours. Noam Shazeer, co-responsable de Gemini et coauteur de l'article ayant introduit le Transformer, est parti chez OpenAI. Quelques jours plus tard, John Jumper, le directeur de DeepMind qui a partagé le prix Nobel de chimie 2024 pour AlphaFold, a rejoint Anthropic, et les contributeurs de Gemini Jonas Adler et Alexander Pritzel l'y ont suivi. Personne n'a directement relié ces départs au retard de Pro, mais ils concordent avec la frustration décrite par les sources de Bloomberg.

En attendant que Pro soit disponible pour tout le monde, Gemini 3.6 Flash couvre presque tous les cas d'usage et gemini-3.1-pro-preview reste le meilleur choix pour les tâches de raisonnement les plus poussées, sachant que Google le propose encore en version preview plutôt qu'en modèle stable. Nous mettrons cet article à jour dès que Gemini 3.5 Pro deviendra disponible pour tous.

Gemini est sur le point d'équiper le nouveau Siri d'Apple

La portée de Gemini dépasse désormais largement les propres apps de Google. Dans le cadre d'un accord pluriannuel dont la valeur serait d'environ 1 milliard de dollars par an, un modèle Gemini sur mesure, qui tournerait avec environ 1 200 milliards de paramètres dans les propres data centers d'Apple, équipe le Siri reconstruit d'Apple, la plus grosse refonte que l'assistant ait jamais connue. Apple a dévoilé le nouveau Siri AI à la WWDC 2026 sous la forme d'une app autonome façon chatbot pour iPhone, iPad et Mac, capable de puiser du contexte dans vos messages, e-mails et photos et d'exécuter des actions à plusieurs étapes à travers les apps.

La bêta publique d'iOS 27 est sortie mi-juillet 2026, si bien que tout le monde peut désormais tester le Siri AI propulsé par Gemini avant une sortie générale à l'automne, en même temps que le prochain iPhone. Cela signifie que la même famille de modèles passée en revue ici équipe déjà l'assistant pour les premiers testeurs, et bientôt des centaines de millions d'appareils Apple supplémentaires. Pour la vue d'ensemble de ce qui change, voir notre analyse de si Siri est désormais une vraie IA.

Comment Gemini 3.5 Pro et Flash se positionnent face à ChatGPT et Claude

Face au reste du marché, le tableau est concurrentiel plutôt que dominant, et les chiffres ne sont pas tendres. Sur l'Artificial Analysis Intelligence Index v4.1, Claude Fable 5 est en tête avec 60, devant GPT-5.6 Sol à 59, Kimi K3 à 57 et Claude Opus 4.8 à 56. Le meilleur score de Google sur ce classement est Gemini 3.6 Flash avec 50, et Gemini 3.1 Pro Preview est encore plus bas, à 46. Que l'offre Flash de Google dépasse sa propre offre Pro est la mesure la plus claire de l'importance de 3.5 Pro, et de pourquoi ce retard fait mal. L'avantage de Gemini aujourd'hui, c'est la vitesse et le prix pour une qualité proche des modèles phares. Gemini 3.5 Flash ne revendique pas la couronne globale, mais il change l'équation de valeur en offrant ce niveau de performance au coût et à la vitesse de Flash, et Gemini 3.5 Pro est conçu pour défier le haut du panier sur les tâches de raisonnement les plus difficiles.

Pour un face-à-face sur l'usage quotidien, voir comment Gemini se compare à ChatGPT, ou notre comparatif à trois ChatGPT contre Claude contre Gemini pour les utilisateurs Mac. Le constat honnête, c'est qu'aucun modèle ne gagne sur tous les tableaux, et c'est exactement pourquoi choisir le bon modèle selon la tâche l'emporte sur la fidélité à un seul modèle.

Faut-il utiliser Gemini 3.5 ?

Pour les utilisateurs de l'app, la question se résout d'elle-même : l'offre gratuite atteint Gemini 3.6 Flash et vous obtenez la fenêtre de contexte de 1M tokens sans frais. Pour les développeurs, la recommandation honnête est de laisser de côté gemini-3.5-flash et d'appeler gemini-3.6-flash à la place, puisqu'il facture désormais $0.75 / $3.75 contre $1.50 / $9.00 pour 3.5 Flash, et produit environ 17 % de tokens de sortie en moins en plus de cela. gemini-3.8-flash, lancé le 2 septembre 2026, applique le même tarif et obtient des scores encore meilleurs, donc autant commencer par lui, sauf raison particulière de rester sur un modèle plus ancien. gemini-3.7-flash facture le même tarif et reste un solide plan de secours. Réservez gemini-3.1-pro-preview aux moments où vous avez besoin du raisonnement le plus poussé. Et ne bâtissez pas de plan autour de l'arrivée de Gemini 3.5 Pro à une date donnée, car Google n'en a fixé aucune. Si vous voulez que le modèle sur lequel vous vous arrêtez reste dans le Dock plutôt que dans un onglet de navigateur, notre guide du client de bureau Gemini pour macOS couvre les options natives.

FAQ

Quand Gemini 3.5 est-il sorti ?

Gemini 3.5 Flash a été lancé le 19 mai 2026 à Google I/O 2026. C'était le premier modèle de la famille Gemini 3.5 et il est devenu le modèle de l'offre gratuite dans l'app Gemini. Gemini 3.5 Pro, annoncé le même jour, n'est toujours pas sorti.

Gemini 3.5 est-il gratuit ?

Gemini 3.5 Flash était le modèle de l'offre gratuite dans l'app Gemini depuis mai 2026. La page des forfaits de Google indique désormais « Access to 3.6 Flash » pour l'offre gratuite, si bien que les utilisateurs gratuits accèdent au modèle plus récent. Les développeurs qui appellent gemini-3.5-flash paient $1.50 par million de tokens en entrée et $9.00 par million de tokens en sortie.

Gemini 3.5 Flash est-il meilleur que Gemini 3.1 Pro ?

Sur les benchmarks de codage et d'agentique, oui. Il bat Gemini 3.1 Pro sur Terminal-Bench 2.1, MCP Atlas et GDPval-AA tout en tournant environ 4x plus vite. Gemini 3.1 Pro garde l'avantage sur les tests de raisonnement pur les plus difficiles.

Quand sort Gemini 3.5 Pro ?

Google n'a donné aucune date. Pichai l'a annoncé à l'I/O le 19 mai 2026 pour le mois suivant, et le 21 juillet 2026 Google a seulement déclaré qu'il était « actuellement testé auprès de partenaires ». Bloomberg a rapporté le 16 juillet que le modèle avait des mois de retard après qu'une mise à jour des données d'entraînement fin juin n'a pas tenu ses promesses en codage. La fenêtre de contexte de 2M tokens et le mode Deep Think qui circulent en ligne ne sont pas confirmés.

Gemini 3.5 Pro a-t-il manqué un lancement le 17 juillet ?

Non. Google n'a jamais fixé de date au 17 juillet. Cette affirmation, tout comme les récits d'une preview Vertex AI et d'un modèle de base abandonné, provient de chaînes de commentaires IA et de blogs agrégateurs, et non de Google ou de Bloomberg. La seule position officielle de Google est que Gemini 3.5 Pro est en cours de test auprès de partenaires.

Qu'est-ce que Gemini Spark ?

Gemini Spark est un agent IA personnel actif 24h/24 et 7j/7, propulsé par Gemini 3.5 Flash. Il gère les tâches récurrentes en arrière-plan et a d'abord été déployé auprès de testeurs de confiance, avec une bêta pour les abonnés Google AI Ultra aux États-Unis. Depuis le 23 juillet 2026, il est inclus avec Google AI Pro à $19.99/mois, et il a atteint plus de 160 pays supplémentaires le 30 juillet.