Google a lancé Gemini 3.1 Pro le 19 février 2026, et ses scores de benchmark sont difficiles à ignorer. Le modèle a obtenu 77,1 % sur ARC-AGI-2, un test conçu spécifiquement pour empêcher l'IA de s'appuyer sur des réponses mémorisées : il impose un raisonnement authentique sur des problèmes que le modèle n'a jamais rencontrés auparavant. C'est plus du double des 31,1 % obtenus par Gemini 3 Pro lors de son lancement il y a seulement trois mois. Google a depuis lancé Gemini 3.5, dont le modèle Flash devance désormais Gemini 3.1 Pro sur les benchmarks de programmation et agentiques.

Cet article couvre tout ce qu'il faut savoir sur Gemini 3.1 Pro, y compris ce qui a changé par rapport à la version précédente, comment il se comporte face à Claude Opus 4.6 et GPT-5.2, ce qu'il coûte, et où vous pouvez y accéder dès maintenant. Si vous hésitez encore à l'intégrer à votre workflow IA, les données ci-dessous rendent la comparaison claire.

Les points clés à retenir

  • Google a lancé Gemini 3.1 Pro le 19 février 2026, actuellement disponible en préversion
  • Score ARC-AGI-2 : 77,1 %, une amélioration de 2,5x par rapport aux 31,1 % de Gemini 3 Pro
  • Les tarifs démarrent à $2 par million de tokens en entrée, plus de six fois moins cher que Claude Opus 4.6
  • Prend en charge une fenêtre de contexte de 1 million de tokens avec jusqu'à 75 % d'économies grâce à la mise en cache du contexte
  • Disponible dès maintenant dans l'appli Gemini, Google AI Studio, Vertex AI et GitHub Copilot

Qu'est-ce que Gemini 3.1 Pro ?

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

Gemini 3.1 Pro est le nouveau modèle IA phare de Google, le plus performant de la famille Gemini 3. L'incrément .1 est une nouveauté chez Google ; les générations précédentes passaient directement du modèle de base à une mise à jour .5, ce qui signale un vrai saut de capacité plutôt qu'un simple correctif.

Google le destine aux tâches complexes, pas à la conversation du quotidien. Il traite le texte, les images, l'audio, la vidéo et des dépôts de code entiers en une seule session, avec une fenêtre de contexte en entrée de 1 million de tokens et jusqu'à 64 000 tokens de sortie par appel. Trois niveaux de réflexion configurables (faible, moyen et élevé) vous permettent d'arbitrer entre profondeur de raisonnement, vitesse et coût selon les besoins de la tâche.

Qu'est-ce qui a changé par rapport à Gemini 3 Pro ?

L'amélioration du raisonnement est le fait marquant. Gemini 3.1 Pro a obtenu 77,1 % sur ARC-AGI-2, contre 31,1 % pour Gemini 3 Pro. ARC-AGI-2 est conçu pour tester si un modèle peut résoudre des schémas logiques qu'il n'a vraiment jamais rencontrés : il évite délibérément tout ce qu'un modèle pourrait avoir mémorisé depuis ses données d'entraînement. Un gain de 2,5x sur ce benchmark en une seule mise à jour est significatif.

Les performances en programmation progressent aussi. Le modèle a obtenu 80,6 % sur SWE-Bench Verified et 68,5 % sur Terminal-Bench 2.0, se classant premier sur les deux au lancement parmi les modèles publiquement classés. Google le décrit comme un « modèle de programmation agentique » conçu pour les workflows d'édition puis de test qui nécessitent moins d'appels d'outils par tâche accomplie.

Trois niveaux de réflexion : faible, moyen, élevé

Gemini 3.1 Pro introduit des niveaux de réflexion sélectionnables, une fonctionnalité pensée pour optimiser les coûts à grande échelle. Vous choisissez le budget de raisonnement que le modèle applique selon ce que vous faites. Un résumé rapide de document n'exige pas la même profondeur de traitement que la conception d'un pipeline de données ou le débogage d'une base de code complexe. Google n'a pas encore publié de détail des performances par niveau, mais le système est conçu pour éviter de payer un raisonnement lourd quand vous n'en avez pas besoin.

Benchmarks de Gemini 3.1 Pro : comparaison avec Claude et GPT

Gemini 3.1 Pro est en tête sur la plupart des grands benchmarks, même si le tableau se nuance selon le type de tâche. Selon le suivi de benchmarks de Digital Applied, le modèle occupe actuellement la première place sur 12 des 18 indicateurs suivis.

Benchmark Gemini 3.1 Pro Claude Opus 4.6 Claude Sonnet 4.6 GPT-5.2
ARC-AGI-2 77,1 % 68,8 % 60,4 % 52,9 %
GPQA Diamond 94,3 % 91,3 % 74,1 % 93,2 %
SWE-Bench Verified 80,6 % 80,8 % 79,6 % 80,0 %
Terminal-Bench 2.0 68,5 % 65,4 % 59,1 % 60,0 %
GDPval-AA Elo 1 317 1 606 1 633 1 462
Fenêtre de contexte 1M tokens 1M tokens (bêta) 1M tokens (bêta) 400K tokens
Prix en entrée (pour 1M tokens) $2 $5 $3 $1.75
Prix en sortie (pour 1M tokens) $12 $25 $15 $14

*Le score ARC-AGI-2 de Claude Opus 4.6 est une estimation ; selon Google, Gemini 3.1 Pro le devance de plus de 8 points de pourcentage. Les données de benchmark de GPT-5.2 n'étaient pas confirmées publiquement au moment de la rédaction.

Gemini 3.1 Pro devance Claude Opus 4.6 de plus de 8 points de pourcentage sur ARC-AGI-2 et de 3 points sur GPQA Diamond, pour un coût des tokens en entrée plus de six fois inférieur.

Le seul domaine où Claude Opus 4.6 conserve une nette avance est GDPval-AA, un benchmark qui mesure la performance sur des tâches bureautiques complexes de niveau expert. Claude Opus 4.6 obtient 1 633 Elo contre 1 317 pour Gemini 3.1 Pro. Si votre travail implique de la synthèse de recherche à fort enjeu, une analyse juridique en plusieurs étapes ou de la rédaction longue et complexe, cet écart est réel et mérite d'être pris en compte.

Tarifs de Gemini 3.1 Pro

Les tarifs de Gemini 3.1 Pro sont identiques à ceux de Gemini 3 Pro. Pour les prompts de moins de 200 000 tokens, vous payez $2 par million de tokens en entrée et $12 par million de tokens en sortie. Pour des sessions plus longues, entre 200 000 et 1 000 000 de tokens, cela passe à $4 par million en entrée et $18 par million en sortie.

La mise en cache du contexte réduit ces coûts jusqu'à 75 % pour le contenu répété au fil de longues sessions, un atout pour quiconque exécute régulièrement le modèle sur de gros documents ou des bases de code.

Palier Entrée (pour 1M tokens) Sortie (pour 1M tokens)
Moins de 200K tokens $2 $12
De 200K à 1M tokens $4 $18
Avec mise en cache du contexte jusqu'à 75 % de réduction jusqu'à 75 % de réduction

Claude Opus 4.6 coûte $15 par million de tokens en entrée et $75 par million de tokens en sortie, soit plus de six fois le coût en entrée et plus de six fois le coût en sortie pour la même charge de travail. Pour la plupart des usages, Gemini 3.1 Pro est le choix nettement plus rentable, à moins que vos tâches ne relèvent de la catégorie experte où Claude garde l'avantage.

Où accéder à Gemini 3.1 Pro

Gemini 3.1 Pro est sorti en préversion le 19 février 2026. Il est disponible dès aujourd'hui sur toutes les plateformes suivantes.

  • L'appli Gemini, disponible pour les abonnés Google AI Pro et Ultra
  • NotebookLM, pour les abonnés Google AI Pro et Ultra
  • Google AI Studio, accès développeur gratuit via l'identifiant de modèle gemini-3.1-pro-preview
  • Vertex AI, pour le déploiement en entreprise
  • GitHub Copilot, disponible pour les utilisateurs des forfaits Pro, Pro+, Business et Enterprise
  • Gemini CLI et Android Studio, pour les outils de développement

Une deuxième variante, gemini-3.1-pro-preview-customtools, est disponible pour les workflows agentiques où la précision des appels de fonction compte. Les tests du premier jour de Simon Willison ont aussi relevé une latence importante au lancement ; une requête a pris plus de 100 secondes, et Google devrait résoudre ce problème à mesure que la préversion monte en charge.

La disponibilité générale est attendue prochainement. Pour une vue d'ensemble de la place de Gemini 3.1 Pro dans le paysage actuel de l'IA, consultez notre classement actuel des modèles d'IA.

Génération musicale : Lyria 3 arrive dans l'appli Gemini

Parallèlement au lancement de 3.1 Pro, Google a ajouté la génération musicale à l'appli Gemini via Lyria 3, son modèle musical le plus performant à ce jour. Vous décrivez un morceau en texte simple ou importez une image, et Gemini génère une chanson de 30 secondes avec paroles écrites par l'IA et pochette incluses. Le déploiement a débuté le 18 février 2026 sur ordinateur, le support mobile suivant peu après.

Lyria 3 est un modèle nettement meilleur que son prédécesseur. Il gère des structures de morceaux plus complexes, vous donne davantage de contrôle sur le style musical et les voix, et génère les paroles directement dans le résultat au lieu d'exiger une étape séparée. Chaque morceau est filigrané grâce à la technologie SynthID de Google, afin que la musique générée par IA reste identifiable même après montage ou réencodage.

La fonctionnalité prend en charge huit langues au lancement : anglais, allemand, espagnol, français, hindi, japonais, coréen et portugais, avec d'autres prévues. Elle est accessible à tous les utilisateurs de Gemini âgés de 18 ans et plus. La limite actuelle est de 30 secondes par morceau, adaptée aux clips pour réseaux sociaux, aux démos et au contenu court. Google n'a pas confirmé quand des morceaux plus longs seront pris en charge.

Il s'agit d'une fonctionnalité de l'appli Gemini reposant sur Lyria 3, et non d'une capacité du modèle 3.1 Pro lui-même. Aucun forfait Gemini payant n'est nécessaire pour y accéder, même si la disponibilité peut varier selon les régions durant le déploiement initial.

Gemini 3.1 Pro vaut-il le coût ?

Pour les développeurs et les utilisateurs technophiles, l'argument est solide. Gemini 3.1 Pro domine la plupart des benchmarks à un tarif qui rend Claude Opus 4.6 difficile à justifier pour les mêmes tâches. L'intégration à GitHub Copilot signifie que vous pouvez y accéder directement dans votre éditeur existant, sans changer vos habitudes de travail.

Pour les utilisateurs non techniques, la réponse dépend de ce que vous faites réellement. Sur les tâches bureautiques expertes de GDPval-AA, Claude Opus 4.6 garde l'avance avec un score Elo de 1 633 contre 1 317. Pour la rédaction analytique pointue, la synthèse de recherche et les tâches de raisonnement à fort contexte, cet écart peut compter.

Les cas les plus évidents pour choisir Gemini 3.1 Pro sont la programmation, les problèmes de raisonnement inédits, un usage API à fort volume où le coût compte, et tout workflow qui profite d'une fenêtre de contexte d'1 million de tokens. Pour savoir où se situe Claude en ce moment, consultez notre analyse de la sortie de Claude Sonnet 4.6.

Conclusion

Gemini 3.1 Pro représente un vrai progrès par rapport à Gemini 3 Pro. Son score ARC-AGI-2 et ses benchmarks de programmation le placent en tête du classement actuel pour la plupart des tâches, et à $2 par million de tokens en entrée, c'est le modèle phare le plus rentable disponible aujourd'hui. Le seul bémol concerne les tâches de niveau expert, où Claude Opus 4.6 garde une nette avance.

Si vous ne l'avez pas encore essayé, Google AI Studio vous donne un accès gratuit dès aujourd'hui via l'identifiant de modèle gemini-3.1-pro-preview. Si vous avez un forfait GitHub Copilot, il est déjà disponible dans votre éditeur.

FAQ

Gemini 3.1 Pro est-il meilleur que Claude Opus 4.6 ?

Sur la plupart des benchmarks, oui. Gemini 3.1 Pro devance Claude Opus 4.6 sur ARC-AGI-2 et GPQA Diamond, pour un coût en entrée plus de six fois inférieur. Claude Opus 4.6 garde l'avance sur GDPval-AA, un benchmark pour les tâches bureautiques de niveau expert. Le meilleur choix dépend de votre cas d'usage précis.

Combien coûte Gemini 3.1 Pro ?

$2 par million de tokens en entrée et $12 par million de tokens en sortie pour les prompts de moins de 200 000 tokens. La mise en cache du contexte peut réduire les coûts jusqu'à 75 % pour le contenu répété au sein de longues sessions.

Comment accéder à Gemini 3.1 Pro ?

Il est disponible dans l'appli Gemini, Google AI Studio (gratuit, via gemini-3.1-pro-preview), Vertex AI, NotebookLM, Gemini CLI et GitHub Copilot (forfaits Pro, Pro+, Business et Enterprise). Pour connaître le prix de chaque palier NotebookLM, consultez notre guide tarifs de NotebookLM. Les étudiants peuvent aussi vérifier si Google AI Pro est encore gratuit pour les étudiants dans leur pays : Google a relancé l'offre étudiante de 12 mois le 19 août 2026, avec une année gratuite d'AI Pro aux États-Unis et une année gratuite d'AI Plus dans plus de 140 autres marchés.

Quelle est la différence entre Gemini 3 Pro et Gemini 3.1 Pro ?

La principale amélioration concerne le raisonnement. Gemini 3.1 Pro a obtenu 77,1 % sur ARC-AGI-2 contre 31,1 % pour Gemini 3 Pro, soit un bond de 2,5x. Les performances en programmation ont aussi progressé, le modèle étant en tête sur SWE-Bench Verified et Terminal-Bench 2.0 au lancement.