A Google gere agora duas linhas temporais do Gemini que já não avançam ao mesmo ritmo. A linha Flash avançou até ao Gemini 3.8 Flash, lançado a 2 de setembro de 2026, enquanto a linha Pro está congelada no Gemini 3.1 Pro desde fevereiro. Se tem andado à procura de um «Gemini 3.5 Pro» ou de um «3.6 Pro», isso é a primeira coisa a esclarecer em qualquer comparação de modelos Gemini honesta, porque nenhum dos dois existe ainda. Depois, a 30 de setembro de 2026, a Google anunciou o Gemini 4 Argon, o seu primeiro modelo de topo novo desde o 3.1 Pro, embora até agora só um pequeno grupo de especialistas em ciberdefesa aprovados o possa usar.
Este guia mapeia toda a gama, desde o Gemini 2.5 até ao 3.8 Flash e ao novo Gemini 4 Argon, versão a versão, com uma tabela de benchmarks e preços para cada uma, além de como os modelos aparecem dentro da app Gemini e uma recomendação clara para cada caso de uso. Verá exatamente porque é que a Google dividiu a família em duas, o que realmente mudou em cada lançamento e qual é o modelo certo por defeito para programação, conversas do dia a dia, documentos longos e orçamentos reduzidos.
As principais conclusões
- Gemini 3.8 Flash é o modelo mais recente que pode usar, disponível desde 2 de setembro de 2026, a um preço inicial de $0.75 / $3.75 por 1M de tokens. É o terceiro lançamento Flash da Google em 43 dias, e o 3.7 Flash e o 3.6 Flash estão à mesma tarifa.
- Não existe Gemini 3.5 Pro nem 3.6 Pro. O atual modelo de topo Pro continua a ser o Gemini 3.1 Pro, de fevereiro de 2026.
- Esse preço reduzido tem prazo. Os três, 3.8, 3.7 e 3.6 Flash, voltam a $1.50 / $7.50 a 1 de janeiro de 2027, por isso deve orçamentar com o valor mais alto a partir do novo ano.
- O Gemini 3.5 Flash-Lite é o modelo atual mais económico, a $0.30 / $2.50 por 1M de tokens.
- Na app, o plano Gratuito só executa o Gemini Flash-Lite a partir de 9 de outubro de 2026, com o 3.6 Flash a passar para o AI Plus e níveis superiores. Nem o 3.7 nem o 3.8 Flash são gratuitos: o 3.7 chega aos consumidores apenas através do Spark, e o acesso ao 3.8 foi reportado, até agora, para assinantes do AI Pro e Ultra. O Deep Think mantém-se exclusivo do AI Ultra, enquanto o Gemini Spark chega ao AI Pro nos EUA e em mais de 160 países.
- O Gemini 4 Argon, o primeiro modelo Gemini 4 da Google e o novo modelo de topo, foi anunciado a 30 de setembro de 2026 a um preço inicial de $2 / $10 por 1M de tokens, mas até agora só os especialistas em ciberdefesa do Fairwind Program o podem usar.
A gama Gemini em resumo (2026)
A Google organiza o Gemini em três níveis. O Pro é o nível de raciocínio de topo, o Flash é o cavalo de batalha rápido do dia a dia, e o Flash-Lite é a opção económica. A parte confusa é que estes níveis já não partilham um número de versão, por isso o Flash mais recente (3.8) está quatro lançamentos completos à frente do Pro mais recente (3.1). O Gemini 4 Argon, anunciado a 30 de setembro, quebra o padrão outra vez: tem um nome de código em vez de um nome de nível.
Eis a família atual, da mais antiga à mais recente, com os modelos mais importantes em negrito.
| Modelo | Lançamento | Nível | Estado | Melhor para |
|---|---|---|---|---|
| Gemini 2.5 Pro | mar. 2025 | Pro | Legado | Raciocínio de reserva mais económico |
| Gemini 2.5 Flash | abr. 2025 | Flash | Legado | Tarefas do dia a dia mais antigas |
| Gemini 2.5 Flash-Lite | jun. 2025 | Flash-Lite | Legado | Grande volume, baixo custo |
| Gemini 3 Pro | nov. 2025 | Pro | Pré-visualização | Primeiro modelo de topo «3.0» |
| Gemini 3 Flash | dez. 2025 | Flash | Pré-visualização | Valor equilibrado |
| Gemini 3.1 Pro | fev. 2026 | Pro | O Pro mais recente que pode usar | Raciocínio mais exigente, documentos longos |
| Gemini 3.1 Flash-Lite | mar. 2026 | Flash-Lite | Substituído | Trabalho agêntico económico |
| Gemini 3.5 Flash | mai. 2026 | Flash | Substituído | Cavalo de batalha anterior |
| Gemini 3.5 Flash-Lite | jul. 2026 | Flash-Lite | Atual | Opção de qualidade mais económica |
| Gemini 3.6 Flash | jul. 2026 | Flash | Substituído | Continua a ser a opção predefinida da app gratuita |
| Gemini 3.7 Flash | ago. 2026 | Flash | Substituído | Cavalo de batalha anterior |
| Gemini 3.8 Flash | set. 2026 | Flash | Cavalo de batalha atual | A maioria das pessoas, a maioria das tarefas |
| Gemini 4 Argon | set. 2026 | Modelo de topo (sem nome de nível) | Anunciado, apenas parceiros Fairwind | Programação longa, trabalho de conhecimento e tarefas de ciberdefesa |
Dois modelos especializados ficam fora da grelha principal. O Gemini 3 Deep Think é uma pré-visualização de raciocínio alargado de dezembro de 2025, e o Gemini 3.5 Flash Cyber, lançado a 21 de julho, é uma versão do 3.5 Flash afinada para encontrar e corrigir vulnerabilidades de segurança dentro do sistema CodeMender da Google.
Porque não há Gemini 3.5 Pro (nem 3.6 Pro)
A maior fonte de confusão em qualquer comparação de modelos Gemini é a ausência de lançamentos Pro. Quando a Google lançou o 3.5 Flash, depois o 3.6 Flash, depois o 3.7 Flash, depois o 3.8 Flash, muita gente assumiu que um Pro equivalente também tinha chegado. Não chegou.
Segundo o TechCrunch, a Google lançou três novos modelos a 21 de julho e, deliberadamente, nenhum 3.5 Pro. A reportagem da Bloomberg citada nessa cobertura diz que a Google teve atrasos internos e dificuldade em cumprir os seus próprios objetivos de desempenho para o 3.5 Pro, por isso este permanece em testes com parceiros em vez de lançamento geral. O responsável de produto Logan Kilpatrick disse que a empresa continua a testá-lo e espera que «chegue em breve».
Isso deixa o Gemini 3.1 Pro, de fevereiro de 2026, como o modelo Pro mais recente que pode realmente usar. Entretanto, a linha Flash continuou a lançar modelos, o que explica porque os números de versão parecem desencontrados. A conclusão é simples: quando quiser o raciocínio Gemini de topo hoje, usa-se o 3.1 Pro, não um 3.5 ou 3.6 Pro que ainda não foi lançado. Em setembro, Koray Kavukcuoglu, da Google DeepMind, disse que a Google «deu um pequeno passo atrás» para se concentrar nos seus modelos Flash, e o modelo de topo seguinte que a Google anunciou, a 30 de setembro, foi o Gemini 4 Argon, e não um 3.5 Pro.
Gemini 2.5: a base legada de três níveis
A família 2.5 é a geração legada, lançada ao longo de 2025, e foi ela que definiu o padrão de três níveis que a Google ainda usa. O Gemini 2.5 Pro chegou a 25 de março, o 2.5 Flash a 17 de abril, e o 2.5 Flash-Lite a 17 de junho, cada um com uma janela de contexto de 1M de tokens. Estes modelos continuam a funcionar e mantêm-se como alternativa mais económica, mas ficam atrás da família 3.x em raciocínio, programação e tarefas agênticas.
Como as versões 2.5 se comparam em benchmarks e preço
No lançamento, o 2.5 Pro liderou a tabela classificativa da LMArena e obteve 63,8% no SWE-Bench Verified. O 2.5 Flash ficou bem abaixo, e o 2.5 Flash-Lite ficou ainda mais baixo, a $0.10 / $0.40, ainda a tarifa Gemini mais económica que a API já teve. O nosso guia aos benchmarks de IA explica o que cada um destes testes mede, na prática.
| Modelo | Lançamento | Preço (entrada / saída por 1M) | Destaque |
|---|---|---|---|
| Gemini 2.5 Pro | 25 de março de 2025 | $1.25 / $10.00 | N.º 1 na LMArena no lançamento; SWE-Bench 63,8% |
| Gemini 2.5 Flash | 17 de abril de 2025 | $0.30 / $2.50 | Cavalo de batalha rápido do dia a dia |
| Gemini 2.5 Flash-Lite | 17 de junho de 2025 | $0.10 / $0.40 | A tarifa Gemini mais económica de sempre |
Quando escolher um modelo 2.5
Use o 2.5 apenas se estiver numa infraestrutura mais antiga ou precisar do custo mais baixo possível e não se importar com a qualidade de ponta. Para qualquer projeto novo, os níveis 3.x são uma melhoria clara, a preços semelhantes ou mais baixos.
Gemini 3.0: o reinício de geração
O modelo Gemini 3 abriu a geração atual. O Gemini 3 Pro foi lançado a 18 de novembro de 2025 como modelo de topo em pré-visualização, seguido do Gemini 3 Deep Think a 4 de dezembro, para raciocínio em várias etapas mais difícil, e do Gemini 3 Flash a 17 de dezembro. Foi este salto que reiniciou a posição da Google nos benchmarks face ao ChatGPT e ao Claude.
Benchmarks e preços do Gemini 3.0
O Gemini 3 Pro chegou com uma janela de contexto de 1M de tokens e 64K de saída, obtendo 91,9% no GPQA Diamond, 1501 Elo na LMArena, e 76,2% no SWE-Bench Verified. O Gemini 3 Flash superou depois o seu próprio irmão Pro em programação, alcançando 78% no SWE-Bench Verified por apenas $0.50 / $3.00 por 1M de tokens. O Deep Think, um modo de raciocínio alargado para assinantes do AI Ultra, elevou o ARC-AGI-2 a 45,1% com execução de código.
| Modelo | Lançamento | Preço (entrada / saída por 1M) | Benchmark principal |
|---|---|---|---|
| Gemini 3 Pro | 18 de novembro de 2025 | n/d (pré-visualização) | GPQA 91,9%, SWE 76,2%, 1501 Elo |
| Gemini 3 Deep Think | 4 de dezembro de 2025 | apenas AI Ultra | ARC-AGI-2 45,1% |
| Gemini 3 Flash | 17 de dezembro de 2025 | $0.50 / $3.00 | SWE-Bench 78% |
Como a geração 3.0 se sustenta
Os modelos 3.0 introduziram a arquitetura e o trabalho de contexto longo em que as versões posteriores se basearam. A maioria já foi substituída pelo 3.1 e pelos lançamentos Flash mais recentes, por isso deve ver o 3.0 como a base e não como um modelo a escolher hoje.
Gemini 3.1 Pro: o modelo de topo que pode usar
Gemini 3.1 Pro, lançado a 19 de fevereiro de 2026, é o modelo a usar quando precisa da capacidade máxima. Usa um desenho de mistura de especialistas esparsa, lida com uma janela de contexto de 1M de tokens e produz até 64K tokens numa única resposta. Obtém 94,3% no GPQA Diamond e 80,6% no SWE-Bench Verified, ambos valores da própria Google. A medição independente é menos simpática: no Artificial Analysis Intelligence Index v4.3.2, lido a 25 de setembro de 2026, fica em 29,7, atrás dos atuais modelos de topo da OpenAI e da Anthropic e, de forma mais incómoda para a Google, onze pontos atrás do seu próprio Gemini 3.8 Flash, com 40,9. O Gemini 4 Argon da própria Google situa-se agora bem acima de ambos, com 52,6, mas até agora só os parceiros do Fairwind Program o podem usar.
Especificações e preços do Gemini 3.1 Pro
| Especificação | Gemini 3.1 Pro |
|---|---|
| Lançamento | 19 de fevereiro de 2026 |
| Contexto / saída máxima | 1M / 64K tokens |
| Preço (texto) | $2.00 / $12.00 por 1M, um único nível |
| Preço (saída de imagem) | $120.00 por 1M, cerca de $0.134 por imagem 1K/2K |
| GPQA Diamond | 94,3% (Google) |
| SWE-Bench Verified | 80,6% (Google) |
| AA Intelligence Index v4.3.2 | 29,7 (lido a 25 de set. 2026) |
Quando usar o 3.1 Pro
É a escolha certa para raciocínio complexo, análise de documentos longos, investigação e as tarefas de programação agêntica mais exigentes. Como a Google não atualiza o nível Pro desde fevereiro, é provável que o 3.1 Pro continue a ser o Gemini mais forte que pode realmente usar até o Gemini 4 Argon se abrir além dos parceiros Fairwind da Google.
Gemini 3.5 Flash e Flash-Lite: os cavalos de batalha de meados de 2026
Gemini 3.5 Flash foi lançado na Google I/O a 19 de maio de 2026, a $1.50 / $9.00 por 1M de tokens, com uma janela de contexto de 1M de tokens, e superou, de forma notável, o 3.1 Pro em vários benchmarks de programação e agênticos, apesar de ser um modelo Flash. Serviu como cavalo de batalha do dia a dia até o 3.6 o substituir em julho.
Gemini 3.5 Flash-Lite: o campeão económico
Gemini 3.5 Flash-Lite, lançado a 21 de julho a $0.30 / $2.50 por 1M de tokens, é o atual campeão económico. A Google afirma que supera claramente o Gemini 3 Flash, mais antigo e maior, em algumas avaliações, incluindo o SWE-Bench Pro e o OSWorld-Verified, o que o torna uma opção forte em relação preço-desempenho para trabalho de grande volume.
| Modelo | Lançamento | Preço (entrada / saída por 1M) | Contexto | Nota |
|---|---|---|---|---|
| Gemini 3.5 Flash | 19 de maio de 2026 | $1.50 / $9.00 | 1M | Superou o 3.1 Pro em avaliações de programação |
| Gemini 3.5 Flash-Lite | 21 de julho de 2026 | $0.30 / $2.50 | 1M | Modelo atual mais económico |
Porque é que o emparelhamento Flash importa
O ponto é precisamente esse emparelhamento. O Flash cobre o trabalho de qualidade do dia a dia, enquanto o Flash-Lite trata das tarefas de grande volume e sensíveis ao custo, e ambos mantêm uma janela completa de um milhão de tokens. Quando o 3.6 Flash chegou em julho, posicionou-se acima do 3.5 Flash; o 3.7 Flash assumiu o topo da linha Flash três semanas depois, e o 3.8 Flash assumiu-o três semanas depois disso, enquanto o Flash-Lite se manteve sempre como o patamar económico.
Gemini 3.8 Flash: o cavalo de batalha atual
Gemini 3.8 Flash tornou-se geralmente disponível a 2 de setembro de 2026, três semanas depois do 3.7 Flash e o terceiro lançamento Flash da Google em 43 dias. Todas as linhas da ficha técnica transitam inalteradas do antecessor: a mesma janela de contexto de 1M de tokens, o mesmo limite de saída de 64K, a mesma data de corte de conhecimento de março de 2026, a mesma lista de modalidades e o mesmo preço de lançamento. Todo o lançamento é sobre o que o modelo faz dentro desse enquadramento, e a Google afinou este modelo para agentes de longo horizonte, em vez do foco puro em programação do 3.7.
Preço e ganhos de benchmark do Gemini 3.8 Flash
O preço não mudou. O 3.8 Flash mantém o mesmo preço inicial de $0.75 / $3.75 por 1M de tokens que o 3.7 e o 3.6 Flash, e carrega a mesma nota de rodapé: a 1 de janeiro de 2027 os três sobem para $1.50 / $7.50. Supera o 3.7 Flash em todas as linhas que a Google publicou, com os maiores ganhos no BioMysteryBench Human Difficult (de 43,5% para 56,5%), no Terminal-bench 4.0 (de 11,2% para 19,1%) e no DeepSWE v1.1 (de 65,3% para 73,7%). Não varreu o campo inteiro: na própria comparação de lançamento da Google, de setembro de 2026, o Claude Opus 5 venceu os testes agênticos mais difíceis, ganhando no Terminal-bench 4.0 por 51,8% a 19,1% e no OSWorld-2.0 por 75,4% a 59,0%. A Anthropic já substituiu entretanto o Opus 5 pelo Opus 5.5 e moveu o Opus 5 para a sua lista legada, por isso deve ler-se esse par como a comparação que a Google publicou no lançamento, e não como o estado da arte atual. O nosso resumo do Gemini 3.8 Flash tem a tabela completa de 14 linhas e o valor de benchmark amplamente republicado que se revelou errado.
| Especificação | Gemini 3.8 Flash |
|---|---|
| Lançamento | 2 de setembro de 2026 |
| Preço | $0.75 / $3.75 por 1M (inicial, duplica a 1 de janeiro de 2027) |
| Contexto | 1M tokens de entrada, 64K de saída |
| AA Intelligence Index v4.3.2 | 40,9 na definição de raciocínio elevado, contra 39,1 do 3.7 Flash (lido a 25 de set. 2026) |
| DeepSWE v1.1 | de 65,3% para 73,7% |
| Terminal-bench 4.0 | de 11,2% para 19,1% |
| BioMysteryBench (difícil) | de 43,5% para 56,5% |
Gemini 3.7 Flash: o cavalo de batalha anterior
Gemini 3.7 Flash chegou a 13 de agosto de 2026, apenas 23 dias depois do 3.6 Flash, no AI Studio, na API do Gemini, no Android Studio e na Gemini Enterprise Agent Platform, com a mesma janela de contexto de 1M de tokens e o mesmo limite de saída de 64K do antecessor. Ao contrário do lançamento do 3.6, este foi um verdadeiro salto de capacidade, e não apenas uma passagem de eficiência: as pontuações de programação e agênticas avançaram muito em três semanas. Manteve o topo da linha Flash durante exatamente três semanas, antes de o 3.8 Flash o substituir ao mesmo preço.
Preço e ganhos de benchmark do Gemini 3.7 Flash
O preço caiu para metade, para $0.75 / $3.75 por 1M de tokens, e a Google colocou o 3.6 Flash na mesma tarifa, que é também onde o 3.8 Flash acabou por aterrar, por isso os três custam hoje o mesmo. Leia a nota de rodapé antes de orçamentar: essas tarifas são iniciais e terminam a 31 de dezembro de 2026, subindo para $1.50 / $7.50 em janeiro. Em benchmarks, o DeepSWE v1.1 subiu de 49,0% para 65,3% e o AutomationBench quase duplicou, de 17,0% para 30,4%. Para o panorama completo, incluindo as regiões que a Google excluiu, veja o nosso resumo do Gemini 3.7 Flash.
| Especificação | Gemini 3.7 Flash |
|---|---|
| Lançamento | 13 de agosto de 2026 |
| Preço | $0.75 / $3.75 por 1M (inicial, duplica a 1 de janeiro de 2027) |
| Contexto | 1M tokens de entrada, 64K de saída |
| AA Intelligence Index v4.3.2 | 39,1, contra 34,0 do 3.6 Flash (lido a 25 de set. 2026) |
| FrontierCode 1.1 Main | de 34,4% para 43,6% |
| DeepSWE v1.1 | de 49,0% para 65,3% |
| AutomationBench | de 17,0% para 30,4% |
Gemini 3.6 Flash: o cavalo de batalha anterior
Gemini 3.6 Flash foi lançado a 21 de julho de 2026 e manteve-se como opção predefinida da app Gemini gratuita apenas até 9 de outubro de 2026, altura em que as contas gratuitas passam para o Flash-Lite, com uma janela de contexto de 1M de tokens. É uma melhoria de eficiência, e não um novo nível de ponta. Usa cerca de 17% menos tokens de saída do que o 3.5 Flash no Artificial Analysis Index, com reduções até 65% em algumas tarefas de engenharia de longo horizonte.
Preço e ganhos de benchmark do Gemini 3.6 Flash
A alteração de preço no lançamento foi muitas vezes mal reportada. O corte foi apenas na saída: a saída baixou de $9.00 para $7.50 por 1M de tokens, enquanto a entrada se manteve em $1.50. A Google já cortou o modelo novamente, para $0.75 / $3.75, para igualar o Gemini 3.7 Flash. Em benchmarks, o DeepSWE subiu de 37% para 49%, o MLE-Bench de 49,7% para 63,9%, e o OSWorld-Verified de 78,4% para 83,0%, segundo o anúncio da Google. Para uma análise mais profunda deste lançamento, veja o nosso resumo completo do Gemini 3.6 Flash.
| Especificação | Gemini 3.6 Flash |
|---|---|
| Lançamento | 21 de julho de 2026 |
| Preço | $0.75 / $3.75 por 1M (reduzido para igualar o 3.7 Flash; lançado a $1.50 / $7.50) |
| Contexto | 1M tokens |
| AA Intelligence Index | 34,0 na v4.3.2, lido a 25 de set. 2026 (era 52 na v4.1.1, já descontinuada) |
| DeepSWE | de 37% para 49% |
| MLE-Bench | de 49,7% para 63,9% |
| OSWorld-Verified | de 78,4% para 83,0% |
Preços da API do Gemini comparados (2026)
É no preço que a divisão de níveis se torna prática. O Flash e o Flash-Lite são construídos para volume, enquanto o Pro custa mais e fica reservado para as tarefas que o justificam. A tabela abaixo mostra as tarifas atuais da API por 1 milhão de tokens.
| Modelo | Entrada (por 1M) | Saída (por 1M) | Contexto |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.7 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.6 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.5 Flash | $1.50 | $9.00 | 1M |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 1M |
| Gemini 3.1 Pro | $2.00 | $12.00 | 1M |
Para a maioria das cargas de trabalho, o Gemini 3.8 Flash oferece agora os melhores resultados na linha Flash, e, como o 3.6 e o 3.7 Flash estão à mesma tarifa, não há argumento de preço para ficar num modelo mais antigo. As três tarifas Flash são iniciais e duplicam a 1 de janeiro de 2027. Se estiver a correr grandes volumes de pedidos mais simples, o 3.5 Flash-Lite reduz ainda mais os custos, mantendo uma qualidade surpreendentemente sólida.
O nível Pro costumava ser tarifado pelo tamanho do prompt, com uma segunda tarifa acima de 200K tokens. Já não é assim. A tabela de preços atual da API da Google lista uma única tarifa de texto para o Gemini 3.1 Pro, $2.00 / $12.00, nas suas tabelas Standard, Batch, Flex e Priority, sem divisão por contexto longo; o nível de $4.00 / $18.00 que este guia costumava mostrar já não existe. O que o Pro continua a tarifar em separado é a saída de imagem, a $120 por 1M de tokens, o que dá cerca de $0.134 por imagem 1K ou 2K e $0.24 por imagem 4K. O Batch e o Flex reduzem a tarifa de texto a metade, para $1.00 / $6.00.
Como o Gemini aparece na app (Gratuito, Plus, Pro, Ultra)
A maioria das pessoas nunca toca na API. Dentro da app Gemini, os modelos aparecem como planos de consumidor e não como números de versão, e o lançamento que recebe depende do que paga. A partir de 9 de outubro de 2026, o plano Gratuito executa apenas o Gemini Flash-Lite, o AI Plus adiciona o Flash, e só o AI Pro e o Ultra chegam ao modelo de raciocínio Pro, por isso os níveis pagos passam agora a comprar modelos, além de limites de utilização mais altos e das funcionalidades mais pesadas. Note-se que nenhum dos lançamentos Flash mais recentes aparece como nível de plano: o 3.7 Flash chega aos utilizadores da app apenas dentro do Spark, que exige AI Pro ou Ultra, e tem sido reportado que o 3.8 Flash está a chegar a assinantes do AI Pro e Ultra, embora as notas de lançamento das Gemini Apps ainda não tenham uma entrada para ele.
| Plano | Preço / mês | Acesso a modelos e funcionalidades |
|---|---|---|
| Gratuito | $0 | Apenas Gemini Flash-Lite a partir de 9 de out. (3.6 Flash e acesso variável ao 3.1 Pro antes) |
| Google AI Plus | $4.99 | Flash-Lite e Flash, Pro removido em outubro; limites 2x mais altos do que o Gratuito, geração de vídeo, Daily Brief |
| Google AI Pro | $19.99 | Limites 4x mais altos, acesso mais amplo ao raciocínio do Gemini 3.1 Pro, Deep Research, funcionalidades agênticas, Gemini Spark em mais de 160 países |
| Google AI Ultra | $99.99 a $199.99 | Acesso máximo ao 3.1 Pro, Deep Think, Gemini Spark, Veo 3.1, até 20x os limites do plano Pro |
A leitura prática é simples. Se só quiser um assistente rápido para perguntas do dia a dia, o plano Gratuito continua a cobrir isso, mas a partir de 9 de outubro passa a correr no Flash-Lite, por isso o AI Plus a $4.99 é a forma mais económica de manter o Flash. Suba para o AI Pro para raciocínio mais pesado, Deep Research e o agente Gemini Spark, que chegou ao Pro nos EUA a 23 de julho de 2026 e a mais de 160 países adicionais a 30 de julho. Só os planos AI Ultra adicionam o Deep Think. O Spark não está disponível no EEE, no Reino Unido, na Suíça nem na Nigéria.
Benchmarks do Gemini comparados
Os benchmarks contam a mesma história de linhagens divididas, e agora contam-na de forma muito mais evidente do que antes. No Artificial Analysis Intelligence Index v4.3.2, um composto de dez avaliações, a linha Flash não se limita a ultrapassar ligeiramente o Pro mais antigo, supera-o claramente. O Gemini 3.8 Flash obtém 40,9 na definição de raciocínio elevado e o Gemini 3.7 Flash, 39,1, contra 29,7 do modelo de topo Gemini 3.1 Pro. O Gemini 3.6 Flash fica em 34,0, o Gemini 3.5 Flash em 32,6, e o económico Gemini 3.5 Flash-Lite em 22,2. Todos estes são modelos Flash à frente do modelo Pro, exceto o Flash-Lite.
Um aviso sobre todos os números da Artificial Analysis que vai ver citados para o Gemini, incluindo os que este guia manteve até setembro de 2026. A AA já reescalou o seu índice quatro vezes em sete semanas, passando por v4.1.1, v4.2, v4.3 e v4.3.2, e cada reescala moveu todas as pontuações de uma vez, sem que nenhum modelo tivesse mudado. O Gemini 3.8 Flash marcava 59 na v4.1.1 e marca 40,9 na v4.3.2; nada no modelo piorou. Os valores nesta página foram todos relidos nas páginas dos modelos da AA a 25 de setembro de 2026 e são todos v4.3.2, por isso são comparáveis entre si, mas não com nada publicado antes de setembro. Note-se também que a dica da tabela classificativa da AA ainda indica v4.3, enquanto as páginas individuais dos modelos indicam v4.3.2; são as páginas dos modelos que devem ser tidas como válidas. Qualquer número de índice isolado, sem indicação de versão, deve ser considerado inutilizável.
| Modelo | AA Intelligence Index (v4.3.2, 25 de set. 2026) | Velocidade de saída (tokens/seg) |
|---|---|---|
| Gemini 3.8 Flash | 40,9 (elevado) | 304,6 |
| Gemini 3.7 Flash | 39,1 (elevado) | 279,4 |
| Gemini 3.6 Flash | 34,0 (elevado) | 210,0 |
| Gemini 3.5 Flash | 32,6 (elevado) | 189 |
| Gemini 3.1 Pro | 29,7 | 113 |
| Gemini 3.5 Flash-Lite | 22,2 | 463 |
Vale a pena destacar dois detalhes. O primeiro é que a linha Flash já não é uniforme: na v4.1 o 3.5 e o 3.6 Flash obtinham ambos 50, e na v4.3.2 separam-se para 32,6 e 34,0, com o 3.7 e o 3.8 a afastarem-se ainda mais. O segundo é que o Gemini 3.1 Pro é o terceiro modelo mais lento e o quarto com melhor pontuação na tabela da sua própria família, uma posição pouco habitual para um modelo de topo. Os ganhos do Gemini 3.6 continuam a notar-se sobretudo em eficiência e programação agêntica, com subidas de dois dígitos no DeepSWE e no MLE-Bench, ao usar cerca de 17% menos tokens de saída do que o 3.5 Flash. Em velocidade pura, o Flash-Lite está noutra categoria, com 463 tokens por segundo, contra 189 do 3.5 Flash e 113 do 3.1 Pro.
Progressão de benchmarks na família Gemini
Acompanhar algumas avaliações-chave ao longo dos lançamentos mostra claramente as duas trajetórias. A linha Pro sobe de forma constante nos testes de raciocínio e programação mais difíceis, enquanto a linha Flash alcança discretamente o modelo de topo no índice composto. As células vazias significam que a Google ou a Artificial Analysis ainda não publicaram esse valor para o modelo.
| Benchmark | 2.5 Pro | 3 Pro | 3.1 Pro | 3.5 Flash | 3.6 Flash | 3.8 Flash |
|---|---|---|---|---|---|---|
| GPQA Diamond | n/d | 91,9% | 94,3% | n/d | n/d | n/d |
| SWE-Bench Verified | 63,8% | 76,2% | 80,6% | n/d | n/d | n/d |
| AA Index v4.3.2 | n/d | n/d | 29,7 | 32,6 | 34,0 | 40,9 |
| DeepSWE | n/d | n/d | n/d | 37% | 49% | 73,7% (v1.1) |
Ao ler as colunas Pro de cima a baixo, a tendência é uma subida clara nas avaliações da própria Google: o GPQA Diamond vai de 91,9% para 94,3%, e o SWE-Bench Verified passa de 63,8%, por 76,2%, até 80,6%. Ao ler a linha AA na horizontal, a história inverte-se: o Flash não fechou a diferença, ultrapassou-a, subindo de 32,6 para 40,9 enquanto o modelo de topo fica em 29,7. A leitura honesta é que as duas medições discordam porque medem coisas diferentes. Os números da Google são pontuações de uma única avaliação em raciocínio e código, nas quais o 3.1 Pro lidera genuinamente; o composto da AA junta dez avaliações, incluindo trabalho de documentos de contexto longo e tarefas agênticas, e, nessa base, um modelo Pro com sete meses perde para um Flash com três semanas. Se o seu trabalho se parece com o GPQA, escolha o Pro. Se se parece com tudo o resto, escolha o Flash.
Que modelo Gemini deve usar?
Para a maioria das pessoas, o Gemini 3.8 Flash é a opção certa por defeito. É rápido, económico a $0.75 / $3.75 por 1M de tokens até janeiro, e trata bem a programação e as tarefas do dia a dia. Suba para o Gemini 3.1 Pro para o raciocínio mais exigente e o trabalho com documentos longos, e desça para o Gemini 3.5 Flash-Lite quando o custo for o mais importante. A tabela abaixo associa tarefas comuns ao modelo que melhor se adequa.
| A sua tarefa | Melhor modelo | Porquê |
|---|---|---|
| Conversas e escrita do dia a dia | Gemini 3.8 Flash | Rápido, económico, boa qualidade geral |
| Programação em geral | Gemini 3.8 Flash | Maiores ganhos em programação agêntica (DeepSWE v1.1 73,7%) |
| Raciocínio mais exigente e investigação | Gemini 3.1 Pro | Pontuações de topo, GPQA 94,3% e SWE 80,6% |
| Análise de documentos longos | Gemini 3.1 Pro | Contexto de 1M com o raciocínio mais profundo |
| Trabalho de grande volume e económico | Gemini 3.5 Flash-Lite | $0.30 / $2.50 e o mais rápido, a 463 tok/s |
| Trabalho de vulnerabilidades de segurança | Gemini 3.8 Flash Cyber | Especialista de segurança atual da Google, lançado a 2 de setembro de 2026 no âmbito do programa Fairwind; substitui o 3.5 Flash Cyber |
Se o seu trabalho principal for programação, o 3.8 Flash é a escolha de melhor relação qualidade-preço e o 3.1 Pro é o teto para os problemas mais difíceis. Um aviso para quem não é programador: nem o 3.7 nem o 3.8 Flash são gratuitos na app Gemini, e, a partir de 9 de outubro de 2026, o nível gratuito responde apenas com o Flash-Lite. Para uma visão mais ampla sobre associar tarefas a modelos entre fornecedores, o nosso guia sobre que modelo de IA usar em cada caso cobre todo o terreno.
Como o Gemini se compara ao ChatGPT e ao Claude
A estratégia da Google é diferente da dos seus rivais. Em vez de perseguir um único modelo de topo com o benchmark máximo, otimiza para versatilidade prática, multimodalidade e integração profunda com a Search, o Workspace e o Android. É por isso que o nível Flash recebe tanta atenção: é o modelo com que a maioria das pessoas realmente contacta todos os dias. Para o lado do Claude na íntegra, veja a comparação definitiva de modelos Claude.
| Modelo de topo | AA Index (v4.3.2, 25 de set. 2026) | Contexto / Saída | Preço (entrada / saída por 1M) | Lançamento |
|---|---|---|---|---|
| Gemini 3.1 Pro | 29,7 | 1M / 64K | $2.00 / $12.00 | fev. 2026 |
| GPT-6 Astra | 52,7 (máx.) | 1,05M / 128K | $10.00 / $50.00 | set. 2026 |
| Claude Opus 5.5 | 57,6 (máx.) | 1M / 128K | $4.00 / $20.00 | set. 2026 |
| Gemini 4 Argon (apenas parceiros Fairwind) | 52,6 (elevado) | 1M / 1M | $2.00 / $10.00 inicial, depois $4.00 / $20.00 | set. 2026 |
| Gemini 3.8 Flash, como referência | 40,9 (elevado) | 1M / 64K | $0.75 / $3.75 | set. 2026 |
Esta é a tabela que mais mudou desde o verão, e não a favor da Google. Ambos os rivais substituíram os seus modelos de topo em setembro de 2026, e a resposta da Google só chegou a 30 de setembro, em lançamento limitado. Na v4.3.2, fica atrás do GPT-6 Astra, com 52,7, e do Claude Opus 5.5, com 57,6, por 23 e 28 pontos, quando a antiga leitura v4.1 colocava a diferença entre 13 e 15. O que sobrevive é o argumento do preço, e está agora mais forte do que estava: o Gemini 3.1 Pro custa um quinto do preço de entrada do Astra e um quarto do seu preço de saída, e metade da entrada do Opus 5.5. O novo modelo de topo da Google, o Gemini 4 Argon, fecha a maior parte da diferença de pontuação, com 52,6, a pouca distância do Astra, mas até agora só os especialistas em ciberdefesa do Fairwind Program o podem usar. Entre os Geminis que pode usar hoje, a verdadeira resposta da Google a ambos não é, de forma alguma, o seu nível Pro. É o Gemini 3.8 Flash, que obtém 40,9, mais do que o Pro, a $0.75 / $3.75, e é essa a linha que uma comparação de custo por qualidade deveria realmente usar.
Os três modelos de topo lidam agora com cerca de um milhão de tokens de contexto, por isso o verdadeiro compromisso está na profundidade do raciocínio e no preço, e não no tamanho da janela. Uma diferença prática: a OpenAI e a Anthropic permitem respostas únicas muito mais longas, com 128K tokens de saída, contra os 64K do Gemini, o que importa para geração de código extenso ou relatórios longos. O Gemini 4 Argon inverte isso, com até 1M tokens de saída, quando conseguir acesso a ele.
Nas avaliações da própria Google, o 3.1 Pro compete com os principais modelos GPT-6 e Claude 5 sem liderar o grupo; no composto independente, não compete de todo com eles, e é o Flash que supera a sua classe de preço. Para o panorama completo entre fornecedores, veja a nossa comparação dos melhores modelos de IA e a análise detalhada do Gemini 3.5.
O que vem a seguir para o Gemini (3.5 Pro e Gemini 4)
O primeiro é o Gemini 3.5 Pro, ainda preso em testes com parceiros, depois de a Google ter falhado os seus próprios objetivos internos. Em julho, a equipa de produto disse apenas que esperava que o modelo «chegasse em breve», e em setembro Koray Kavukcuoglu, da Google DeepMind, disse que a Google «deu um pequeno passo atrás» para se concentrar no Flash. A Google não disse se o 3.5 Pro ainda vai ser lançado.
O segundo já chegou, em parte. A Google confirmou em julho que tinha iniciado a sua «corrida de pré-treino mais ambiciosa até agora» para o Gemini 4, e a 30 de setembro de 2026 anunciou o Gemini 4 Argon, o primeiro modelo Gemini 4. Está a chegar primeiro aos especialistas em ciberdefesa do Fairwind Program da Google, depois aos clientes pagos da API e aos assinantes do Google AI Ultra, sem data para nenhum dos dois, por isso o panorama acima é o que a maioria das pessoas vai continuar a usar durante algum tempo.
Use todos os melhores modelos da classe Gemini sem escolher uma versão
O labirinto de versões que este artigo acabou de mapear é o verdadeiro custo de escolher um nível Gemini. O Google AI Pro custa $19.99 por mês e continua a responder com o lançamento que a app decidir dar, e, do lado da API, é preciso acompanhar qual a tarifa Flash que é inicial e qual o limiar Pro que duplica a fatura.
Fello AI é uma aplicação nativa para Mac, iPhone e iPad que lhe dá o Gemini numa única subscrição, junto com o ChatGPT, o Claude, o Grok, o DeepSeek, o Perplexity, o Kimi, o GLM e o Qwen. Começa em $9.99 por mês, metade do Google AI Pro, com uma versão gratuita para experimentar primeiro e uma classificação de 4,7 estrelas em mais de 27 000 avaliações. Os modelos Gemini mais recentes publicamente disponíveis estão simplesmente ali quando o abre, e pode colocar a mesma pergunta a um modelo rival na mesma conversa, em vez de se comprometer com uma versão e uma tabela de preços.
Conclusão
A comparação de modelos Gemini honesta para 2026 é uma história de duas trajetórias. O Flash disparou até ao 3.8, três lançamentos em 43 dias e mais económico do que nunca, enquanto o Pro se mantém no 3.1, com o 3.5 Pro ainda por lançar. Para quase todos, comece com o Gemini 3.8 Flash, suba para o 3.1 Pro para o trabalho mais exigente, e desça para o 3.5 Flash-Lite quando o orçamento mandar. Com o Gemini 4 Argon anunciado a 30 de setembro mas limitado a parceiros Fairwind, é de esperar que o panorama volte a mudar quando se abrir aos clientes pagos da API e aos assinantes do Google AI Ultra.
Perguntas frequentes
Existe um Gemini 3.5 Pro?
Não. A partir de setembro de 2026, o Gemini 3.5 Pro ainda não foi lançado e não tem qualquer entrada no changelog da API. A Google continua a testá-lo com parceiros, depois de atrasos internos, por isso o atual modelo de topo Pro continua a ser o Gemini 3.1 Pro, de fevereiro de 2026. A linha Flash, entretanto, avançou até ao 3.8 Flash. O modelo de topo seguinte da Google acabou por ser o Gemini 4 Argon, anunciado a 30 de setembro de 2026.
Que modelo Gemini devo usar?
Para a maioria das pessoas, o Gemini 3.8 Flash é a melhor opção por defeito, porque é rápido, económico a $0.75 / $3.75 por 1M de tokens, e o lançamento Flash mais forte em programação e trabalho agêntico. Escolha o Gemini 3.1 Pro para o raciocínio mais exigente e documentos longos, e o Gemini 3.5 Flash-Lite quando precisar do custo mais baixo.
Qual é a diferença entre o Gemini 3.5 Flash e o 3.6 Flash?
O Gemini 3.6 Flash substituiu o 3.5 Flash como cavalo de batalha. Usa cerca de 17% menos tokens de saída, reduziu o preço de saída de $9 para $7.50 por 1M no lançamento enquanto a entrada se manteve em $1.50, e registou grandes ganhos em programação, como o DeepSWE a subir de 37% para 49%. Foi uma melhoria de eficiência, não um novo nível de ponta, e agora corre a $0.75 / $3.75, a par do Gemini 3.7 Flash e do Gemini 3.8 Flash.
Qual é a diferença entre o Gemini 3.7 Flash e o 3.8 Flash?
Nada na ficha técnica e nada no preço. O Gemini 3.8 Flash, lançado a 2 de setembro de 2026, tem a mesma janela de contexto de 1M de tokens, o mesmo limite de saída de 64K, a mesma data de corte de conhecimento de março de 2026 e a mesma tarifa inicial de $0.75 / $3.75 do 3.7 Flash. A diferença está na qualidade medida: supera o 3.7 Flash em todas as linhas de benchmark que a Google publicou, com o DeepSWE v1.1 a passar de 65,3% para 73,7% e o Terminal-bench 4.0 de 11,2% para 19,1%. Como o preço é idêntico, não há motivo para começar um novo projeto no 3.7 Flash.
Que modelos Gemini estão incluídos nos planos da app?
A partir de 9 de outubro de 2026, o plano Gratuito executa apenas o Gemini Flash-Lite, o AI Plus adiciona o Flash, e o AI Pro e o Ultra adicionam o 3.1 Pro e o Deep Think. O Google AI Pro, a $19.99, aumenta os limites e dá acesso mais amplo ao modelo de raciocínio Pro, além do Deep Research, e os planos AI Ultra, de $99.99 a $199.99, adicionam o Deep Think. O Gemini Spark está disponível no AI Pro nos EUA e em mais de 160 países adicionais, mas não está disponível no EEE, no Reino Unido, na Suíça nem na Nigéria.
Qual é o modelo Gemini mais económico?
O Gemini 3.5 Flash-Lite, lançado a 21 de julho de 2026, é o modelo atual mais económico, a $0.30 de entrada e $2.50 de saída por 1M de tokens. A Google afirma que supera o Gemini 3 Flash, mais antigo, em alguns benchmarks de programação e agênticos, tornando-o uma opção de grande valor para trabalho de grande volume.
O Gemini 4 já saiu?
Já está aqui, de forma limitada. A Google anunciou o Gemini 4 Argon, o primeiro modelo Gemini 4, a 30 de setembro de 2026, mas até agora só os especialistas em ciberdefesa do seu Fairwind Program o podem usar. Os clientes pagos da API e os assinantes do Google AI Ultra vêm a seguir, sem data, e o Gemini 3.5 Pro ainda não foi lançado.