A Google gere agora duas linhas temporais do Gemini que já não avançam ao mesmo ritmo. A linha Flash avançou até ao Gemini 3.8 Flash, lançado a 2 de setembro de 2026, enquanto a linha Pro está congelada no Gemini 3.1 Pro desde fevereiro. Se tem andado à procura de um «Gemini 3.5 Pro» ou de um «3.6 Pro», isso é a primeira coisa a esclarecer em qualquer comparação de modelos Gemini honesta, porque nenhum dos dois existe ainda. Depois, a 30 de setembro de 2026, a Google anunciou o Gemini 4 Argon, o seu primeiro modelo de topo novo desde o 3.1 Pro, embora até agora só um pequeno grupo de especialistas em ciberdefesa aprovados o possa usar.

Este guia mapeia toda a gama, desde o Gemini 2.5 até ao 3.8 Flash e ao novo Gemini 4 Argon, versão a versão, com uma tabela de benchmarks e preços para cada uma, além de como os modelos aparecem dentro da app Gemini e uma recomendação clara para cada caso de uso. Verá exatamente porque é que a Google dividiu a família em duas, o que realmente mudou em cada lançamento e qual é o modelo certo por defeito para programação, conversas do dia a dia, documentos longos e orçamentos reduzidos.

As principais conclusões

  • Gemini 3.8 Flash é o modelo mais recente que pode usar, disponível desde 2 de setembro de 2026, a um preço inicial de $0.75 / $3.75 por 1M de tokens. É o terceiro lançamento Flash da Google em 43 dias, e o 3.7 Flash e o 3.6 Flash estão à mesma tarifa.
  • Não existe Gemini 3.5 Pro nem 3.6 Pro. O atual modelo de topo Pro continua a ser o Gemini 3.1 Pro, de fevereiro de 2026.
  • Esse preço reduzido tem prazo. Os três, 3.8, 3.7 e 3.6 Flash, voltam a $1.50 / $7.50 a 1 de janeiro de 2027, por isso deve orçamentar com o valor mais alto a partir do novo ano.
  • O Gemini 3.5 Flash-Lite é o modelo atual mais económico, a $0.30 / $2.50 por 1M de tokens.
  • Na app, o plano Gratuito só executa o Gemini Flash-Lite a partir de 9 de outubro de 2026, com o 3.6 Flash a passar para o AI Plus e níveis superiores. Nem o 3.7 nem o 3.8 Flash são gratuitos: o 3.7 chega aos consumidores apenas através do Spark, e o acesso ao 3.8 foi reportado, até agora, para assinantes do AI Pro e Ultra. O Deep Think mantém-se exclusivo do AI Ultra, enquanto o Gemini Spark chega ao AI Pro nos EUA e em mais de 160 países.
  • O Gemini 4 Argon, o primeiro modelo Gemini 4 da Google e o novo modelo de topo, foi anunciado a 30 de setembro de 2026 a um preço inicial de $2 / $10 por 1M de tokens, mas até agora só os especialistas em ciberdefesa do Fairwind Program o podem usar.

A gama Gemini em resumo (2026)

Do editor

Todos os modelos de IA numa só aplicação

Fello AI reúne GPT-6, Claude 5.5, Gemini 3.8, Grok 4.7 e mais numa só aplicação nativa para Mac e iPhone.

Descarregue já!

A Google organiza o Gemini em três níveis. O Pro é o nível de raciocínio de topo, o Flash é o cavalo de batalha rápido do dia a dia, e o Flash-Lite é a opção económica. A parte confusa é que estes níveis já não partilham um número de versão, por isso o Flash mais recente (3.8) está quatro lançamentos completos à frente do Pro mais recente (3.1). O Gemini 4 Argon, anunciado a 30 de setembro, quebra o padrão outra vez: tem um nome de código em vez de um nome de nível.

Eis a família atual, da mais antiga à mais recente, com os modelos mais importantes em negrito.

ModeloLançamentoNívelEstadoMelhor para
Gemini 2.5 Promar. 2025ProLegadoRaciocínio de reserva mais económico
Gemini 2.5 Flashabr. 2025FlashLegadoTarefas do dia a dia mais antigas
Gemini 2.5 Flash-Litejun. 2025Flash-LiteLegadoGrande volume, baixo custo
Gemini 3 Pronov. 2025ProPré-visualizaçãoPrimeiro modelo de topo «3.0»
Gemini 3 Flashdez. 2025FlashPré-visualizaçãoValor equilibrado
Gemini 3.1 Profev. 2026ProO Pro mais recente que pode usarRaciocínio mais exigente, documentos longos
Gemini 3.1 Flash-Litemar. 2026Flash-LiteSubstituídoTrabalho agêntico económico
Gemini 3.5 Flashmai. 2026FlashSubstituídoCavalo de batalha anterior
Gemini 3.5 Flash-Litejul. 2026Flash-LiteAtualOpção de qualidade mais económica
Gemini 3.6 Flashjul. 2026FlashSubstituídoContinua a ser a opção predefinida da app gratuita
Gemini 3.7 Flashago. 2026FlashSubstituídoCavalo de batalha anterior
Gemini 3.8 Flashset. 2026FlashCavalo de batalha atualA maioria das pessoas, a maioria das tarefas
Gemini 4 Argonset. 2026Modelo de topo (sem nome de nível)Anunciado, apenas parceiros FairwindProgramação longa, trabalho de conhecimento e tarefas de ciberdefesa

Dois modelos especializados ficam fora da grelha principal. O Gemini 3 Deep Think é uma pré-visualização de raciocínio alargado de dezembro de 2025, e o Gemini 3.5 Flash Cyber, lançado a 21 de julho, é uma versão do 3.5 Flash afinada para encontrar e corrigir vulnerabilidades de segurança dentro do sistema CodeMender da Google.

Porque não há Gemini 3.5 Pro (nem 3.6 Pro)

A maior fonte de confusão em qualquer comparação de modelos Gemini é a ausência de lançamentos Pro. Quando a Google lançou o 3.5 Flash, depois o 3.6 Flash, depois o 3.7 Flash, depois o 3.8 Flash, muita gente assumiu que um Pro equivalente também tinha chegado. Não chegou.

Segundo o TechCrunch, a Google lançou três novos modelos a 21 de julho e, deliberadamente, nenhum 3.5 Pro. A reportagem da Bloomberg citada nessa cobertura diz que a Google teve atrasos internos e dificuldade em cumprir os seus próprios objetivos de desempenho para o 3.5 Pro, por isso este permanece em testes com parceiros em vez de lançamento geral. O responsável de produto Logan Kilpatrick disse que a empresa continua a testá-lo e espera que «chegue em breve».

Isso deixa o Gemini 3.1 Pro, de fevereiro de 2026, como o modelo Pro mais recente que pode realmente usar. Entretanto, a linha Flash continuou a lançar modelos, o que explica porque os números de versão parecem desencontrados. A conclusão é simples: quando quiser o raciocínio Gemini de topo hoje, usa-se o 3.1 Pro, não um 3.5 ou 3.6 Pro que ainda não foi lançado. Em setembro, Koray Kavukcuoglu, da Google DeepMind, disse que a Google «deu um pequeno passo atrás» para se concentrar nos seus modelos Flash, e o modelo de topo seguinte que a Google anunciou, a 30 de setembro, foi o Gemini 4 Argon, e não um 3.5 Pro.

Gemini 2.5: a base legada de três níveis

A família 2.5 é a geração legada, lançada ao longo de 2025, e foi ela que definiu o padrão de três níveis que a Google ainda usa. O Gemini 2.5 Pro chegou a 25 de março, o 2.5 Flash a 17 de abril, e o 2.5 Flash-Lite a 17 de junho, cada um com uma janela de contexto de 1M de tokens. Estes modelos continuam a funcionar e mantêm-se como alternativa mais económica, mas ficam atrás da família 3.x em raciocínio, programação e tarefas agênticas.

Como as versões 2.5 se comparam em benchmarks e preço

No lançamento, o 2.5 Pro liderou a tabela classificativa da LMArena e obteve 63,8% no SWE-Bench Verified. O 2.5 Flash ficou bem abaixo, e o 2.5 Flash-Lite ficou ainda mais baixo, a $0.10 / $0.40, ainda a tarifa Gemini mais económica que a API já teve. O nosso guia aos benchmarks de IA explica o que cada um destes testes mede, na prática.

ModeloLançamentoPreço (entrada / saída por 1M)Destaque
Gemini 2.5 Pro25 de março de 2025$1.25 / $10.00N.º 1 na LMArena no lançamento; SWE-Bench 63,8%
Gemini 2.5 Flash17 de abril de 2025$0.30 / $2.50Cavalo de batalha rápido do dia a dia
Gemini 2.5 Flash-Lite17 de junho de 2025$0.10 / $0.40A tarifa Gemini mais económica de sempre

Quando escolher um modelo 2.5

Use o 2.5 apenas se estiver numa infraestrutura mais antiga ou precisar do custo mais baixo possível e não se importar com a qualidade de ponta. Para qualquer projeto novo, os níveis 3.x são uma melhoria clara, a preços semelhantes ou mais baixos.

Gemini 3.0: o reinício de geração

O modelo Gemini 3 abriu a geração atual. O Gemini 3 Pro foi lançado a 18 de novembro de 2025 como modelo de topo em pré-visualização, seguido do Gemini 3 Deep Think a 4 de dezembro, para raciocínio em várias etapas mais difícil, e do Gemini 3 Flash a 17 de dezembro. Foi este salto que reiniciou a posição da Google nos benchmarks face ao ChatGPT e ao Claude.

Benchmarks e preços do Gemini 3.0

O Gemini 3 Pro chegou com uma janela de contexto de 1M de tokens e 64K de saída, obtendo 91,9% no GPQA Diamond, 1501 Elo na LMArena, e 76,2% no SWE-Bench Verified. O Gemini 3 Flash superou depois o seu próprio irmão Pro em programação, alcançando 78% no SWE-Bench Verified por apenas $0.50 / $3.00 por 1M de tokens. O Deep Think, um modo de raciocínio alargado para assinantes do AI Ultra, elevou o ARC-AGI-2 a 45,1% com execução de código.

ModeloLançamentoPreço (entrada / saída por 1M)Benchmark principal
Gemini 3 Pro18 de novembro de 2025n/d (pré-visualização)GPQA 91,9%, SWE 76,2%, 1501 Elo
Gemini 3 Deep Think4 de dezembro de 2025apenas AI UltraARC-AGI-2 45,1%
Gemini 3 Flash17 de dezembro de 2025$0.50 / $3.00SWE-Bench 78%

Como a geração 3.0 se sustenta

Os modelos 3.0 introduziram a arquitetura e o trabalho de contexto longo em que as versões posteriores se basearam. A maioria já foi substituída pelo 3.1 e pelos lançamentos Flash mais recentes, por isso deve ver o 3.0 como a base e não como um modelo a escolher hoje.

Gemini 3.1 Pro: o modelo de topo que pode usar

Gemini 3.1 Pro, lançado a 19 de fevereiro de 2026, é o modelo a usar quando precisa da capacidade máxima. Usa um desenho de mistura de especialistas esparsa, lida com uma janela de contexto de 1M de tokens e produz até 64K tokens numa única resposta. Obtém 94,3% no GPQA Diamond e 80,6% no SWE-Bench Verified, ambos valores da própria Google. A medição independente é menos simpática: no Artificial Analysis Intelligence Index v4.3.2, lido a 25 de setembro de 2026, fica em 29,7, atrás dos atuais modelos de topo da OpenAI e da Anthropic e, de forma mais incómoda para a Google, onze pontos atrás do seu próprio Gemini 3.8 Flash, com 40,9. O Gemini 4 Argon da própria Google situa-se agora bem acima de ambos, com 52,6, mas até agora só os parceiros do Fairwind Program o podem usar.

Especificações e preços do Gemini 3.1 Pro

EspecificaçãoGemini 3.1 Pro
Lançamento19 de fevereiro de 2026
Contexto / saída máxima1M / 64K tokens
Preço (texto)$2.00 / $12.00 por 1M, um único nível
Preço (saída de imagem)$120.00 por 1M, cerca de $0.134 por imagem 1K/2K
GPQA Diamond94,3% (Google)
SWE-Bench Verified80,6% (Google)
AA Intelligence Index v4.3.229,7 (lido a 25 de set. 2026)

Quando usar o 3.1 Pro

É a escolha certa para raciocínio complexo, análise de documentos longos, investigação e as tarefas de programação agêntica mais exigentes. Como a Google não atualiza o nível Pro desde fevereiro, é provável que o 3.1 Pro continue a ser o Gemini mais forte que pode realmente usar até o Gemini 4 Argon se abrir além dos parceiros Fairwind da Google.

Gemini 3.5 Flash e Flash-Lite: os cavalos de batalha de meados de 2026

Gemini 3.5 Flash foi lançado na Google I/O a 19 de maio de 2026, a $1.50 / $9.00 por 1M de tokens, com uma janela de contexto de 1M de tokens, e superou, de forma notável, o 3.1 Pro em vários benchmarks de programação e agênticos, apesar de ser um modelo Flash. Serviu como cavalo de batalha do dia a dia até o 3.6 o substituir em julho.

Gemini 3.5 Flash-Lite: o campeão económico

Gemini 3.5 Flash-Lite, lançado a 21 de julho a $0.30 / $2.50 por 1M de tokens, é o atual campeão económico. A Google afirma que supera claramente o Gemini 3 Flash, mais antigo e maior, em algumas avaliações, incluindo o SWE-Bench Pro e o OSWorld-Verified, o que o torna uma opção forte em relação preço-desempenho para trabalho de grande volume.

ModeloLançamentoPreço (entrada / saída por 1M)ContextoNota
Gemini 3.5 Flash19 de maio de 2026$1.50 / $9.001MSuperou o 3.1 Pro em avaliações de programação
Gemini 3.5 Flash-Lite21 de julho de 2026$0.30 / $2.501MModelo atual mais económico

Porque é que o emparelhamento Flash importa

O ponto é precisamente esse emparelhamento. O Flash cobre o trabalho de qualidade do dia a dia, enquanto o Flash-Lite trata das tarefas de grande volume e sensíveis ao custo, e ambos mantêm uma janela completa de um milhão de tokens. Quando o 3.6 Flash chegou em julho, posicionou-se acima do 3.5 Flash; o 3.7 Flash assumiu o topo da linha Flash três semanas depois, e o 3.8 Flash assumiu-o três semanas depois disso, enquanto o Flash-Lite se manteve sempre como o patamar económico.

Gemini 3.8 Flash: o cavalo de batalha atual

Gemini 3.8 Flash tornou-se geralmente disponível a 2 de setembro de 2026, três semanas depois do 3.7 Flash e o terceiro lançamento Flash da Google em 43 dias. Todas as linhas da ficha técnica transitam inalteradas do antecessor: a mesma janela de contexto de 1M de tokens, o mesmo limite de saída de 64K, a mesma data de corte de conhecimento de março de 2026, a mesma lista de modalidades e o mesmo preço de lançamento. Todo o lançamento é sobre o que o modelo faz dentro desse enquadramento, e a Google afinou este modelo para agentes de longo horizonte, em vez do foco puro em programação do 3.7.

Preço e ganhos de benchmark do Gemini 3.8 Flash

O preço não mudou. O 3.8 Flash mantém o mesmo preço inicial de $0.75 / $3.75 por 1M de tokens que o 3.7 e o 3.6 Flash, e carrega a mesma nota de rodapé: a 1 de janeiro de 2027 os três sobem para $1.50 / $7.50. Supera o 3.7 Flash em todas as linhas que a Google publicou, com os maiores ganhos no BioMysteryBench Human Difficult (de 43,5% para 56,5%), no Terminal-bench 4.0 (de 11,2% para 19,1%) e no DeepSWE v1.1 (de 65,3% para 73,7%). Não varreu o campo inteiro: na própria comparação de lançamento da Google, de setembro de 2026, o Claude Opus 5 venceu os testes agênticos mais difíceis, ganhando no Terminal-bench 4.0 por 51,8% a 19,1% e no OSWorld-2.0 por 75,4% a 59,0%. A Anthropic já substituiu entretanto o Opus 5 pelo Opus 5.5 e moveu o Opus 5 para a sua lista legada, por isso deve ler-se esse par como a comparação que a Google publicou no lançamento, e não como o estado da arte atual. O nosso resumo do Gemini 3.8 Flash tem a tabela completa de 14 linhas e o valor de benchmark amplamente republicado que se revelou errado.

EspecificaçãoGemini 3.8 Flash
Lançamento2 de setembro de 2026
Preço$0.75 / $3.75 por 1M (inicial, duplica a 1 de janeiro de 2027)
Contexto1M tokens de entrada, 64K de saída
AA Intelligence Index v4.3.240,9 na definição de raciocínio elevado, contra 39,1 do 3.7 Flash (lido a 25 de set. 2026)
DeepSWE v1.1de 65,3% para 73,7%
Terminal-bench 4.0de 11,2% para 19,1%
BioMysteryBench (difícil)de 43,5% para 56,5%

Gemini 3.7 Flash: o cavalo de batalha anterior

Gemini 3.7 Flash chegou a 13 de agosto de 2026, apenas 23 dias depois do 3.6 Flash, no AI Studio, na API do Gemini, no Android Studio e na Gemini Enterprise Agent Platform, com a mesma janela de contexto de 1M de tokens e o mesmo limite de saída de 64K do antecessor. Ao contrário do lançamento do 3.6, este foi um verdadeiro salto de capacidade, e não apenas uma passagem de eficiência: as pontuações de programação e agênticas avançaram muito em três semanas. Manteve o topo da linha Flash durante exatamente três semanas, antes de o 3.8 Flash o substituir ao mesmo preço.

Preço e ganhos de benchmark do Gemini 3.7 Flash

O preço caiu para metade, para $0.75 / $3.75 por 1M de tokens, e a Google colocou o 3.6 Flash na mesma tarifa, que é também onde o 3.8 Flash acabou por aterrar, por isso os três custam hoje o mesmo. Leia a nota de rodapé antes de orçamentar: essas tarifas são iniciais e terminam a 31 de dezembro de 2026, subindo para $1.50 / $7.50 em janeiro. Em benchmarks, o DeepSWE v1.1 subiu de 49,0% para 65,3% e o AutomationBench quase duplicou, de 17,0% para 30,4%. Para o panorama completo, incluindo as regiões que a Google excluiu, veja o nosso resumo do Gemini 3.7 Flash.

EspecificaçãoGemini 3.7 Flash
Lançamento13 de agosto de 2026
Preço$0.75 / $3.75 por 1M (inicial, duplica a 1 de janeiro de 2027)
Contexto1M tokens de entrada, 64K de saída
AA Intelligence Index v4.3.239,1, contra 34,0 do 3.6 Flash (lido a 25 de set. 2026)
FrontierCode 1.1 Mainde 34,4% para 43,6%
DeepSWE v1.1de 49,0% para 65,3%
AutomationBenchde 17,0% para 30,4%

Gemini 3.6 Flash: o cavalo de batalha anterior

Gemini 3.6 Flash foi lançado a 21 de julho de 2026 e manteve-se como opção predefinida da app Gemini gratuita apenas até 9 de outubro de 2026, altura em que as contas gratuitas passam para o Flash-Lite, com uma janela de contexto de 1M de tokens. É uma melhoria de eficiência, e não um novo nível de ponta. Usa cerca de 17% menos tokens de saída do que o 3.5 Flash no Artificial Analysis Index, com reduções até 65% em algumas tarefas de engenharia de longo horizonte.

Preço e ganhos de benchmark do Gemini 3.6 Flash

A alteração de preço no lançamento foi muitas vezes mal reportada. O corte foi apenas na saída: a saída baixou de $9.00 para $7.50 por 1M de tokens, enquanto a entrada se manteve em $1.50. A Google já cortou o modelo novamente, para $0.75 / $3.75, para igualar o Gemini 3.7 Flash. Em benchmarks, o DeepSWE subiu de 37% para 49%, o MLE-Bench de 49,7% para 63,9%, e o OSWorld-Verified de 78,4% para 83,0%, segundo o anúncio da Google. Para uma análise mais profunda deste lançamento, veja o nosso resumo completo do Gemini 3.6 Flash.

EspecificaçãoGemini 3.6 Flash
Lançamento21 de julho de 2026
Preço$0.75 / $3.75 por 1M (reduzido para igualar o 3.7 Flash; lançado a $1.50 / $7.50)
Contexto1M tokens
AA Intelligence Index34,0 na v4.3.2, lido a 25 de set. 2026 (era 52 na v4.1.1, já descontinuada)
DeepSWEde 37% para 49%
MLE-Benchde 49,7% para 63,9%
OSWorld-Verifiedde 78,4% para 83,0%

Preços da API do Gemini comparados (2026)

É no preço que a divisão de níveis se torna prática. O Flash e o Flash-Lite são construídos para volume, enquanto o Pro custa mais e fica reservado para as tarefas que o justificam. A tabela abaixo mostra as tarifas atuais da API por 1 milhão de tokens.

ModeloEntrada (por 1M)Saída (por 1M)Contexto
Gemini 3.8 Flash$0.75$3.751M
Gemini 3.7 Flash$0.75$3.751M
Gemini 3.6 Flash$0.75$3.751M
Gemini 3.5 Flash$1.50$9.001M
Gemini 3.5 Flash-Lite$0.30$2.501M
Gemini 3.1 Pro$2.00$12.001M

Para a maioria das cargas de trabalho, o Gemini 3.8 Flash oferece agora os melhores resultados na linha Flash, e, como o 3.6 e o 3.7 Flash estão à mesma tarifa, não há argumento de preço para ficar num modelo mais antigo. As três tarifas Flash são iniciais e duplicam a 1 de janeiro de 2027. Se estiver a correr grandes volumes de pedidos mais simples, o 3.5 Flash-Lite reduz ainda mais os custos, mantendo uma qualidade surpreendentemente sólida.

O nível Pro costumava ser tarifado pelo tamanho do prompt, com uma segunda tarifa acima de 200K tokens. Já não é assim. A tabela de preços atual da API da Google lista uma única tarifa de texto para o Gemini 3.1 Pro, $2.00 / $12.00, nas suas tabelas Standard, Batch, Flex e Priority, sem divisão por contexto longo; o nível de $4.00 / $18.00 que este guia costumava mostrar já não existe. O que o Pro continua a tarifar em separado é a saída de imagem, a $120 por 1M de tokens, o que dá cerca de $0.134 por imagem 1K ou 2K e $0.24 por imagem 4K. O Batch e o Flex reduzem a tarifa de texto a metade, para $1.00 / $6.00.

Como o Gemini aparece na app (Gratuito, Plus, Pro, Ultra)

A maioria das pessoas nunca toca na API. Dentro da app Gemini, os modelos aparecem como planos de consumidor e não como números de versão, e o lançamento que recebe depende do que paga. A partir de 9 de outubro de 2026, o plano Gratuito executa apenas o Gemini Flash-Lite, o AI Plus adiciona o Flash, e só o AI Pro e o Ultra chegam ao modelo de raciocínio Pro, por isso os níveis pagos passam agora a comprar modelos, além de limites de utilização mais altos e das funcionalidades mais pesadas. Note-se que nenhum dos lançamentos Flash mais recentes aparece como nível de plano: o 3.7 Flash chega aos utilizadores da app apenas dentro do Spark, que exige AI Pro ou Ultra, e tem sido reportado que o 3.8 Flash está a chegar a assinantes do AI Pro e Ultra, embora as notas de lançamento das Gemini Apps ainda não tenham uma entrada para ele.

PlanoPreço / mêsAcesso a modelos e funcionalidades
Gratuito$0Apenas Gemini Flash-Lite a partir de 9 de out. (3.6 Flash e acesso variável ao 3.1 Pro antes)
Google AI Plus$4.99Flash-Lite e Flash, Pro removido em outubro; limites 2x mais altos do que o Gratuito, geração de vídeo, Daily Brief
Google AI Pro$19.99Limites 4x mais altos, acesso mais amplo ao raciocínio do Gemini 3.1 Pro, Deep Research, funcionalidades agênticas, Gemini Spark em mais de 160 países
Google AI Ultra$99.99 a $199.99Acesso máximo ao 3.1 Pro, Deep Think, Gemini Spark, Veo 3.1, até 20x os limites do plano Pro

A leitura prática é simples. Se só quiser um assistente rápido para perguntas do dia a dia, o plano Gratuito continua a cobrir isso, mas a partir de 9 de outubro passa a correr no Flash-Lite, por isso o AI Plus a $4.99 é a forma mais económica de manter o Flash. Suba para o AI Pro para raciocínio mais pesado, Deep Research e o agente Gemini Spark, que chegou ao Pro nos EUA a 23 de julho de 2026 e a mais de 160 países adicionais a 30 de julho. Só os planos AI Ultra adicionam o Deep Think. O Spark não está disponível no EEE, no Reino Unido, na Suíça nem na Nigéria.

Benchmarks do Gemini comparados

Os benchmarks contam a mesma história de linhagens divididas, e agora contam-na de forma muito mais evidente do que antes. No Artificial Analysis Intelligence Index v4.3.2, um composto de dez avaliações, a linha Flash não se limita a ultrapassar ligeiramente o Pro mais antigo, supera-o claramente. O Gemini 3.8 Flash obtém 40,9 na definição de raciocínio elevado e o Gemini 3.7 Flash, 39,1, contra 29,7 do modelo de topo Gemini 3.1 Pro. O Gemini 3.6 Flash fica em 34,0, o Gemini 3.5 Flash em 32,6, e o económico Gemini 3.5 Flash-Lite em 22,2. Todos estes são modelos Flash à frente do modelo Pro, exceto o Flash-Lite.

Um aviso sobre todos os números da Artificial Analysis que vai ver citados para o Gemini, incluindo os que este guia manteve até setembro de 2026. A AA já reescalou o seu índice quatro vezes em sete semanas, passando por v4.1.1, v4.2, v4.3 e v4.3.2, e cada reescala moveu todas as pontuações de uma vez, sem que nenhum modelo tivesse mudado. O Gemini 3.8 Flash marcava 59 na v4.1.1 e marca 40,9 na v4.3.2; nada no modelo piorou. Os valores nesta página foram todos relidos nas páginas dos modelos da AA a 25 de setembro de 2026 e são todos v4.3.2, por isso são comparáveis entre si, mas não com nada publicado antes de setembro. Note-se também que a dica da tabela classificativa da AA ainda indica v4.3, enquanto as páginas individuais dos modelos indicam v4.3.2; são as páginas dos modelos que devem ser tidas como válidas. Qualquer número de índice isolado, sem indicação de versão, deve ser considerado inutilizável.

ModeloAA Intelligence Index (v4.3.2, 25 de set. 2026)Velocidade de saída (tokens/seg)
Gemini 3.8 Flash40,9 (elevado)304,6
Gemini 3.7 Flash39,1 (elevado)279,4
Gemini 3.6 Flash34,0 (elevado)210,0
Gemini 3.5 Flash32,6 (elevado)189
Gemini 3.1 Pro29,7113
Gemini 3.5 Flash-Lite22,2463

Vale a pena destacar dois detalhes. O primeiro é que a linha Flash já não é uniforme: na v4.1 o 3.5 e o 3.6 Flash obtinham ambos 50, e na v4.3.2 separam-se para 32,6 e 34,0, com o 3.7 e o 3.8 a afastarem-se ainda mais. O segundo é que o Gemini 3.1 Pro é o terceiro modelo mais lento e o quarto com melhor pontuação na tabela da sua própria família, uma posição pouco habitual para um modelo de topo. Os ganhos do Gemini 3.6 continuam a notar-se sobretudo em eficiência e programação agêntica, com subidas de dois dígitos no DeepSWE e no MLE-Bench, ao usar cerca de 17% menos tokens de saída do que o 3.5 Flash. Em velocidade pura, o Flash-Lite está noutra categoria, com 463 tokens por segundo, contra 189 do 3.5 Flash e 113 do 3.1 Pro.

Progressão de benchmarks na família Gemini

Acompanhar algumas avaliações-chave ao longo dos lançamentos mostra claramente as duas trajetórias. A linha Pro sobe de forma constante nos testes de raciocínio e programação mais difíceis, enquanto a linha Flash alcança discretamente o modelo de topo no índice composto. As células vazias significam que a Google ou a Artificial Analysis ainda não publicaram esse valor para o modelo.

Benchmark2.5 Pro3 Pro3.1 Pro3.5 Flash3.6 Flash3.8 Flash
GPQA Diamondn/d91,9%94,3%n/dn/dn/d
SWE-Bench Verified63,8%76,2%80,6%n/dn/dn/d
AA Index v4.3.2n/dn/d29,732,634,040,9
DeepSWEn/dn/dn/d37%49%73,7% (v1.1)

Ao ler as colunas Pro de cima a baixo, a tendência é uma subida clara nas avaliações da própria Google: o GPQA Diamond vai de 91,9% para 94,3%, e o SWE-Bench Verified passa de 63,8%, por 76,2%, até 80,6%. Ao ler a linha AA na horizontal, a história inverte-se: o Flash não fechou a diferença, ultrapassou-a, subindo de 32,6 para 40,9 enquanto o modelo de topo fica em 29,7. A leitura honesta é que as duas medições discordam porque medem coisas diferentes. Os números da Google são pontuações de uma única avaliação em raciocínio e código, nas quais o 3.1 Pro lidera genuinamente; o composto da AA junta dez avaliações, incluindo trabalho de documentos de contexto longo e tarefas agênticas, e, nessa base, um modelo Pro com sete meses perde para um Flash com três semanas. Se o seu trabalho se parece com o GPQA, escolha o Pro. Se se parece com tudo o resto, escolha o Flash.

Que modelo Gemini deve usar?

Para a maioria das pessoas, o Gemini 3.8 Flash é a opção certa por defeito. É rápido, económico a $0.75 / $3.75 por 1M de tokens até janeiro, e trata bem a programação e as tarefas do dia a dia. Suba para o Gemini 3.1 Pro para o raciocínio mais exigente e o trabalho com documentos longos, e desça para o Gemini 3.5 Flash-Lite quando o custo for o mais importante. A tabela abaixo associa tarefas comuns ao modelo que melhor se adequa.

A sua tarefaMelhor modeloPorquê
Conversas e escrita do dia a diaGemini 3.8 FlashRápido, económico, boa qualidade geral
Programação em geralGemini 3.8 FlashMaiores ganhos em programação agêntica (DeepSWE v1.1 73,7%)
Raciocínio mais exigente e investigaçãoGemini 3.1 ProPontuações de topo, GPQA 94,3% e SWE 80,6%
Análise de documentos longosGemini 3.1 ProContexto de 1M com o raciocínio mais profundo
Trabalho de grande volume e económicoGemini 3.5 Flash-Lite$0.30 / $2.50 e o mais rápido, a 463 tok/s
Trabalho de vulnerabilidades de segurançaGemini 3.8 Flash CyberEspecialista de segurança atual da Google, lançado a 2 de setembro de 2026 no âmbito do programa Fairwind; substitui o 3.5 Flash Cyber

Se o seu trabalho principal for programação, o 3.8 Flash é a escolha de melhor relação qualidade-preço e o 3.1 Pro é o teto para os problemas mais difíceis. Um aviso para quem não é programador: nem o 3.7 nem o 3.8 Flash são gratuitos na app Gemini, e, a partir de 9 de outubro de 2026, o nível gratuito responde apenas com o Flash-Lite. Para uma visão mais ampla sobre associar tarefas a modelos entre fornecedores, o nosso guia sobre que modelo de IA usar em cada caso cobre todo o terreno.

Como o Gemini se compara ao ChatGPT e ao Claude

A estratégia da Google é diferente da dos seus rivais. Em vez de perseguir um único modelo de topo com o benchmark máximo, otimiza para versatilidade prática, multimodalidade e integração profunda com a Search, o Workspace e o Android. É por isso que o nível Flash recebe tanta atenção: é o modelo com que a maioria das pessoas realmente contacta todos os dias. Para o lado do Claude na íntegra, veja a comparação definitiva de modelos Claude.

Modelo de topoAA Index (v4.3.2, 25 de set. 2026)Contexto / SaídaPreço (entrada / saída por 1M)Lançamento
Gemini 3.1 Pro29,71M / 64K$2.00 / $12.00fev. 2026
GPT-6 Astra52,7 (máx.)1,05M / 128K$10.00 / $50.00set. 2026
Claude Opus 5.557,6 (máx.)1M / 128K$4.00 / $20.00set. 2026
Gemini 4 Argon (apenas parceiros Fairwind)52,6 (elevado)1M / 1M$2.00 / $10.00 inicial, depois $4.00 / $20.00set. 2026
Gemini 3.8 Flash, como referência40,9 (elevado)1M / 64K$0.75 / $3.75set. 2026

Esta é a tabela que mais mudou desde o verão, e não a favor da Google. Ambos os rivais substituíram os seus modelos de topo em setembro de 2026, e a resposta da Google só chegou a 30 de setembro, em lançamento limitado. Na v4.3.2, fica atrás do GPT-6 Astra, com 52,7, e do Claude Opus 5.5, com 57,6, por 23 e 28 pontos, quando a antiga leitura v4.1 colocava a diferença entre 13 e 15. O que sobrevive é o argumento do preço, e está agora mais forte do que estava: o Gemini 3.1 Pro custa um quinto do preço de entrada do Astra e um quarto do seu preço de saída, e metade da entrada do Opus 5.5. O novo modelo de topo da Google, o Gemini 4 Argon, fecha a maior parte da diferença de pontuação, com 52,6, a pouca distância do Astra, mas até agora só os especialistas em ciberdefesa do Fairwind Program o podem usar. Entre os Geminis que pode usar hoje, a verdadeira resposta da Google a ambos não é, de forma alguma, o seu nível Pro. É o Gemini 3.8 Flash, que obtém 40,9, mais do que o Pro, a $0.75 / $3.75, e é essa a linha que uma comparação de custo por qualidade deveria realmente usar.

Os três modelos de topo lidam agora com cerca de um milhão de tokens de contexto, por isso o verdadeiro compromisso está na profundidade do raciocínio e no preço, e não no tamanho da janela. Uma diferença prática: a OpenAI e a Anthropic permitem respostas únicas muito mais longas, com 128K tokens de saída, contra os 64K do Gemini, o que importa para geração de código extenso ou relatórios longos. O Gemini 4 Argon inverte isso, com até 1M tokens de saída, quando conseguir acesso a ele.

Nas avaliações da própria Google, o 3.1 Pro compete com os principais modelos GPT-6 e Claude 5 sem liderar o grupo; no composto independente, não compete de todo com eles, e é o Flash que supera a sua classe de preço. Para o panorama completo entre fornecedores, veja a nossa comparação dos melhores modelos de IA e a análise detalhada do Gemini 3.5.

O que vem a seguir para o Gemini (3.5 Pro e Gemini 4)

O primeiro é o Gemini 3.5 Pro, ainda preso em testes com parceiros, depois de a Google ter falhado os seus próprios objetivos internos. Em julho, a equipa de produto disse apenas que esperava que o modelo «chegasse em breve», e em setembro Koray Kavukcuoglu, da Google DeepMind, disse que a Google «deu um pequeno passo atrás» para se concentrar no Flash. A Google não disse se o 3.5 Pro ainda vai ser lançado.

O segundo já chegou, em parte. A Google confirmou em julho que tinha iniciado a sua «corrida de pré-treino mais ambiciosa até agora» para o Gemini 4, e a 30 de setembro de 2026 anunciou o Gemini 4 Argon, o primeiro modelo Gemini 4. Está a chegar primeiro aos especialistas em ciberdefesa do Fairwind Program da Google, depois aos clientes pagos da API e aos assinantes do Google AI Ultra, sem data para nenhum dos dois, por isso o panorama acima é o que a maioria das pessoas vai continuar a usar durante algum tempo.

Use todos os melhores modelos da classe Gemini sem escolher uma versão

O labirinto de versões que este artigo acabou de mapear é o verdadeiro custo de escolher um nível Gemini. O Google AI Pro custa $19.99 por mês e continua a responder com o lançamento que a app decidir dar, e, do lado da API, é preciso acompanhar qual a tarifa Flash que é inicial e qual o limiar Pro que duplica a fatura.

Fello AI é uma aplicação nativa para Mac, iPhone e iPad que lhe dá o Gemini numa única subscrição, junto com o ChatGPT, o Claude, o Grok, o DeepSeek, o Perplexity, o Kimi, o GLM e o Qwen. Começa em $9.99 por mês, metade do Google AI Pro, com uma versão gratuita para experimentar primeiro e uma classificação de 4,7 estrelas em mais de 27 000 avaliações. Os modelos Gemini mais recentes publicamente disponíveis estão simplesmente ali quando o abre, e pode colocar a mesma pergunta a um modelo rival na mesma conversa, em vez de se comprometer com uma versão e uma tabela de preços.

Conclusão

A comparação de modelos Gemini honesta para 2026 é uma história de duas trajetórias. O Flash disparou até ao 3.8, três lançamentos em 43 dias e mais económico do que nunca, enquanto o Pro se mantém no 3.1, com o 3.5 Pro ainda por lançar. Para quase todos, comece com o Gemini 3.8 Flash, suba para o 3.1 Pro para o trabalho mais exigente, e desça para o 3.5 Flash-Lite quando o orçamento mandar. Com o Gemini 4 Argon anunciado a 30 de setembro mas limitado a parceiros Fairwind, é de esperar que o panorama volte a mudar quando se abrir aos clientes pagos da API e aos assinantes do Google AI Ultra.

Perguntas frequentes

Existe um Gemini 3.5 Pro?

Não. A partir de setembro de 2026, o Gemini 3.5 Pro ainda não foi lançado e não tem qualquer entrada no changelog da API. A Google continua a testá-lo com parceiros, depois de atrasos internos, por isso o atual modelo de topo Pro continua a ser o Gemini 3.1 Pro, de fevereiro de 2026. A linha Flash, entretanto, avançou até ao 3.8 Flash. O modelo de topo seguinte da Google acabou por ser o Gemini 4 Argon, anunciado a 30 de setembro de 2026.

Que modelo Gemini devo usar?

Para a maioria das pessoas, o Gemini 3.8 Flash é a melhor opção por defeito, porque é rápido, económico a $0.75 / $3.75 por 1M de tokens, e o lançamento Flash mais forte em programação e trabalho agêntico. Escolha o Gemini 3.1 Pro para o raciocínio mais exigente e documentos longos, e o Gemini 3.5 Flash-Lite quando precisar do custo mais baixo.

Qual é a diferença entre o Gemini 3.5 Flash e o 3.6 Flash?

O Gemini 3.6 Flash substituiu o 3.5 Flash como cavalo de batalha. Usa cerca de 17% menos tokens de saída, reduziu o preço de saída de $9 para $7.50 por 1M no lançamento enquanto a entrada se manteve em $1.50, e registou grandes ganhos em programação, como o DeepSWE a subir de 37% para 49%. Foi uma melhoria de eficiência, não um novo nível de ponta, e agora corre a $0.75 / $3.75, a par do Gemini 3.7 Flash e do Gemini 3.8 Flash.

Qual é a diferença entre o Gemini 3.7 Flash e o 3.8 Flash?

Nada na ficha técnica e nada no preço. O Gemini 3.8 Flash, lançado a 2 de setembro de 2026, tem a mesma janela de contexto de 1M de tokens, o mesmo limite de saída de 64K, a mesma data de corte de conhecimento de março de 2026 e a mesma tarifa inicial de $0.75 / $3.75 do 3.7 Flash. A diferença está na qualidade medida: supera o 3.7 Flash em todas as linhas de benchmark que a Google publicou, com o DeepSWE v1.1 a passar de 65,3% para 73,7% e o Terminal-bench 4.0 de 11,2% para 19,1%. Como o preço é idêntico, não há motivo para começar um novo projeto no 3.7 Flash.

Que modelos Gemini estão incluídos nos planos da app?

A partir de 9 de outubro de 2026, o plano Gratuito executa apenas o Gemini Flash-Lite, o AI Plus adiciona o Flash, e o AI Pro e o Ultra adicionam o 3.1 Pro e o Deep Think. O Google AI Pro, a $19.99, aumenta os limites e dá acesso mais amplo ao modelo de raciocínio Pro, além do Deep Research, e os planos AI Ultra, de $99.99 a $199.99, adicionam o Deep Think. O Gemini Spark está disponível no AI Pro nos EUA e em mais de 160 países adicionais, mas não está disponível no EEE, no Reino Unido, na Suíça nem na Nigéria.

Qual é o modelo Gemini mais económico?

O Gemini 3.5 Flash-Lite, lançado a 21 de julho de 2026, é o modelo atual mais económico, a $0.30 de entrada e $2.50 de saída por 1M de tokens. A Google afirma que supera o Gemini 3 Flash, mais antigo, em alguns benchmarks de programação e agênticos, tornando-o uma opção de grande valor para trabalho de grande volume.

O Gemini 4 já saiu?

Já está aqui, de forma limitada. A Google anunciou o Gemini 4 Argon, o primeiro modelo Gemini 4, a 30 de setembro de 2026, mas até agora só os especialistas em ciberdefesa do seu Fairwind Program o podem usar. Os clientes pagos da API e os assinantes do Google AI Ultra vêm a seguir, sem data, e o Gemini 3.5 Pro ainda não foi lançado.