O Google dividiu o Gemini 3.5 em dois lançamentos, e só um deles chegou de facto. O Gemini 3.5 Flash ficou disponível a 19 de maio de 2026, na Google I/O 2026, e fez algo que o Google nunca tinha feito antes: o nível «Flash», barato e rápido, superou o antigo modelo de topo em programação. A outra metade, o Gemini 3.5 Pro, é o modelo que todos esperam, e a sua data de lançamento já sofreu um atraso de vários meses. A própria posição do Google, publicada a 21 de julho de 2026, é que o Pro está «atualmente em fase de testes com parceiros», sem data associada.
Este artigo aborda os dois lados. Fica a saber o que o Gemini 3.5 Flash oferece hoje, os benchmarks completos face ao Gemini 3.1 Pro, e os preços. Fica também a saber tudo o que o Google já confirmou sobre o Gemini 3.5 Pro, e como distinguir esses factos dos rumores, porque a maioria das especificações que circulam sobre o Pro nunca veio do Google. O Google confirmou ainda que um modelo Gemini personalizado vai equipar o novo Siri reconstruído da Apple, o que eleva ainda mais a fasquia. Uma coisa a saber já de início: o nível Flash já mudou de geração, e a nossa análise do Gemini 3.6 Flash cobre o substituto lançado a 21 de julho de 2026.
Os Pontos Essenciais
- O Gemini 3.5 Flash foi lançado a 19 de maio de 2026 na Google I/O 2026, o primeiro modelo da família Gemini 3.5.
- Supera o maior Gemini 3.1 Pro nos benchmarks de programação e de agentes, sendo 4x mais rápido em tokens de saída por segundo.
- O preço da API é de $1.50 por milhão de tokens de entrada e $9.00 por milhão de tokens de saída, cerca de 25% mais barato do que o Gemini 3.1 Pro. O seu sucessor, o Gemini 3.6 Flash, mantém a entrada em $1.50 e reduz a saída para $7.50.
- Tem uma janela de contexto de 1M tokens. Foi o modelo do nível gratuito na aplicação Gemini a partir de maio de 2026, mas a página de planos do Google indica agora «Acesso ao 3.6 Flash» para o nível gratuito.
- O Gemini 3.5 Pro continua por lançar. O Google afirmou, a 21 de julho de 2026, que está «atualmente em fase de testes com parceiros». A Bloomberg noticiou que está meses atrasado em relação ao calendário. As especificações de janela de contexto de 2M tokens e de Deep Think que circulam online não foram confirmadas pelo Google.
O Que É o Gemini 3.5 Flash?
O Gemini 3.5 Flash é o novo modelo de velocidade e custo do Google, e é o lançamento em destaque da Google I/O 2026. No seu anúncio oficial, o Google chama à família «inteligência de fronteira com ação», e o enquadramento é deliberado. Os modelos Flash costumavam ser a opção económica a que se recorria quando não era preciso o modelo mais inteligente. O Gemini 3.5 Flash inverte isso, entregando um desempenho que, segundo o Google, «rivaliza com os grandes modelos de topo em várias dimensões», mantendo a velocidade e o preço próprios do nível Flash. A Alibaba lançou o seu próprio modelo de raciocínio de fronteira no dia seguinte; veja a nossa análise do Qwen3.7-Max para a comparação direta com o Flash em preços e benchmarks.
O modelo está otimizado para tarefas de programação e de agentes, o trabalho de longo alcance em que uma IA planeia, chama ferramentas e itera em vez de responder a uma única pergunta. Também lidera na compreensão multimodal, obtendo 84,2% no CharXiv Reasoning. O ID do modelo na API é gemini-3.5-flash, a janela de contexto é de 1.048.576 tokens de entrada com 64K tokens de saída, e a data de corte é janeiro de 2026. Se quiser perceber o percurso do Google até aqui, a nossa análise sobre o salto do Gemini 2.5 para o Gemini 3 traça o histórico de versões. Note-se que, entretanto, a geração já mudou. O ID gemini-3.5-flash continua estável e pode ser chamado, mas o gemini-3.6-flash é agora o modelo Flash atual no catálogo do Google.
Gemini 3.5 Flash vs Gemini 3.1 Pro: Os Benchmarks
Aqui está a parte que importa. Não se espera que um modelo Flash supere o modelo Pro da geração anterior, mas é exatamente isso que o Gemini 3.5 Flash faz nos benchmarks que mais interessam ao Google. A tabela abaixo compara-o com o Gemini 3.1 Pro, o modelo que substitui, na prática, para a maioria dos utilizadores. Para ver como todas as versões, de 2.5 a 3.6, se comparam, consulte a nossa comparação completa de modelos Gemini.
| Benchmark | Gemini 3.5 Flash | Gemini 3.1 Pro | Vencedor | O que mede |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 76,2% | 70,3% | 3.5 Flash | Programação real num terminal |
| GDPval-AA | 1.656 Elo | 1.314 Elo | 3.5 Flash | Tarefas de agentes no mundo real |
| MCP Atlas | 83,6% | 78,2% | 3.5 Flash | Uso de ferramentas em larga escala |
| CharXiv Reasoning | 84,2% | N/A | 3.5 Flash | Compreensão multimodal |
| Humanity’s Last Exam | 40,2% | 44,4% | 3.1 Pro | Raciocínio pericial mais difícil |
| ARC-AGI-2 | 72,1% | 77,1% | 3.1 Pro | Raciocínio abstrato |
| Velocidade de saída | ~4x mais rápido | referência | 3.5 Flash | Tokens de saída por segundo |
No GDPval-AA, o salto é dramático. O Gemini 3.1 Pro obtém 1.314 Elo; o Gemini 3.5 Flash obtém 1.656 Elo, uma variação de 342 pontos em tarefas de agentes no mundo real. O Google afirma que o Gemini 3.5 Flash é 4 vezes mais rápido do que outros modelos de fronteira quando medido em tokens de saída por segundo. Para agentes que percorrem dezenas de passos em ciclo, essa diferença de velocidade acumula-se rapidamente.
Onde o Gemini 3.1 Pro Ainda Vence
O Gemini 3.5 Flash não vence em toda a linha, e o Google é honesto quanto a isso. Nos testes de raciocínio puro mais difíceis, o mais antigo Gemini 3.1 Pro continua à frente. Lidera no Humanity’s Last Exam (44,4% vs 40,2%) e no ARC-AGI-2 (77,1% vs 72,1%), e mantém-se melhor na recuperação em contextos muito longos, obtendo 84,9% no MRCR v2 a 128k tokens, contra 77,3% para o Flash, de acordo com dados independentes de benchmarks e preços.
A leitura prática é simples. Para programação, uso de ferramentas e fluxos de trabalho com agentes, o Gemini 3.5 Flash é hoje a escolha melhor e mais barata. Para os problemas de raciocínio mais profundos ou para trabalho com documentos de contexto enorme, o Gemini 3.1 Pro ainda vale o custo extra até o Gemini 3.5 Pro chegar. A nossa análise completa do Gemini 3.1 Pro mostra onde esse modelo ainda brilha. Entretanto, o Google já lançou mais dois modelos Flash em vez do Pro: o Gemini 3.7 Flash em agosto de 2026 e o Gemini 3.8 Flash a 2 de setembro, alargando ainda mais a distância entre as duas linhas.
Preços do Gemini 3.5 Flash
Para a maioria das pessoas, a aplicação Gemini não custa nada, e isso não mudou. O que mudou foi o modelo que se obtém. O Gemini 3.5 Flash foi o modelo do nível gratuito a partir de maio de 2026, e a página de planos do Google lista agora «Acesso ao 3.6 Flash» para o nível gratuito, pelo que um utilizador gratuito chega hoje à geração mais recente. Os preços abaixo interessam se for um programador a chamar o gemini-3.5-flash diretamente através da API. Se só quiser a resposta curta, veja se o Gemini é gratuito.
Preços dos tokens da API
| Tipo de token | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|
| Entrada (por 1M) | $1.50 | $2.00 |
| Saída (por 1M) | $9.00 | $12.00 |
| Entrada em cache (por 1M) | $0.15 | N/A |
Isso torna o Gemini 3.5 Flash cerca de 25% mais barato tanto na entrada como na saída do que o Gemini 3.1 Pro, às tarifas oficiais da API do Google, que são de $2.00 na entrada / $12.00 na saída até 200k tokens e $4.00 na entrada / $18.00 na saída a partir daí, ao mesmo tempo que obtém pontuações mais altas nos benchmarks de programação e de agentes. É cerca de 3x o preço do antigo Gemini 3 Flash ($0.50 na entrada / $3.00 na saída), mas muito mais capaz, pelo que ocupa um novo ponto de equilíbrio. O sucessor já o superou dos dois lados. O Gemini 3.6 Flash foi lançado a $1.50 na entrada / $7.50 na saída, e depois o Google baixou-o para $0.75 / $3.75 a 13 de agosto de 2026, para igualar o Gemini 3.7 Flash, o que o coloca a metade do preço de entrada do 3.5 Flash e bem abaixo de metade na saída. As duas tarifas do Flash são introdutórias e duplicam a 1 de janeiro de 2027. Para o contexto mais alargado, veja a nossa análise completa dos preços do Gemini e a nossa comparação de preços de IA entre os principais modelos.
Como Usar o Gemini 3.5 Já
O Gemini 3.5 Flash já está disponível em todos os locais onde o Google distribui o Gemini. Não precisa de esperar nem de entrar numa lista. Há quatro formas de o usar hoje.
- Aplicação Gemini: abra a aplicação Gemini na web, no Android ou no iOS (a aplicação Gemini para iOS já figura entre as melhores aplicações de IA para iPhone). O Google não voltou a indicar um modelo predefinido para a aplicação desde o Gemini 3 Flash, mas o nível gratuito já chega ao 3.6 Flash.
- AI Mode na Pesquisa: o Gemini 3.5 Flash chegou ao AI Mode na Pesquisa Google, em todo o mundo, em maio de 2026, gratuito para todos. Desde então, o Google não publicou nenhuma alteração de modelo para o AI Mode.
- API do Gemini: os programadores podem chamar o gemini-3.5-flash através do Google AI Studio, da API do Gemini e do Android Studio.
- Empresas: está disponível através do Google Antigravity, da Gemini Enterprise Agent Platform e do Gemini Enterprise.
Se costuma usar o Gemini principalmente num Mac, a nossa análise da aplicação Gemini para Mac percorre a experiência no ambiente de trabalho. Prefere uma única subscrição que lhe dê acesso a vários modelos em vez de andar a alternar entre aplicações? A aplicação Fello AI para Mac reúne Gemini, ChatGPT, Claude, Grok e DeepSeek num único plano de $9.99/mês, permitindo mudar de modelo consoante a tarefa sem pagar por cada um em separado.
Gemini Spark e o Resto da Google I/O 2026
O Gemini 3.5 Flash faz muito mais do que conversas. O Google usou-o para lançar o Gemini Spark, um agente pessoal de IA disponível 24 horas por dia, 7 dias por semana, que trabalha em segundo plano para tratar de tarefas recorrentes em toda a sua vida digital. O Spark chegou primeiro a testadores de confiança, seguido de uma Beta para subscritores do Google AI Ultra nos EUA, segundo o relato da Engadget. Desde então, já deixou essa fase para trás: o Spark chegou ao Google AI Pro por $19.99/mês a 23 de julho de 2026 e a mais de 160 países adicionais a 30 de julho, embora continue indisponível no EEE, no Reino Unido, na Suíça e na Nigéria. O facto de o Spark funcionar sobre o Gemini 3.5 Flash, em vez do nível Pro mais pesado, é o que lhe permite manter-se online 24 horas por dia com preços de nível agente.
A keynote trouxe ainda um redesenho Neural Expressive da aplicação Gemini, um resumo matinal personalizado Daily Brief para os subscritores AI Plus, Pro e Ultra, e atualizações ao Gemini Omni. O Google AI Ultra custa a partir de $99.99/mês para 5x os limites do Google AI Pro, com um nível adicional a $199.99/mês para 20x. No campo da segurança, o Google diz que o Gemini 3.5 é lançado com salvaguardas reforçadas ao nível cibernético e CBRN, menos recusas incorretas em pedidos seguros, e novas ferramentas de interpretabilidade que inspecionam o raciocínio interno do modelo antes de a resposta ser devolvida. O Google também mostrou em antevisão os óculos inteligentes Android XR com o Gemini 3.5 Flash integrado, colocando o Google diretamente contra a Apple na corrida de 2027.
Quando é Que o Gemini 3.5 Pro Vai Ser Lançado?
O Gemini 3.5 Pro ainda não foi lançado, e o Google nunca voltou a dar uma data. Sundar Pichai anunciou-o na I/O a 19 de maio de 2026 e disse que chegaria no mês seguinte. Junho passou. A 21 de julho de 2026, no anúncio do Gemini 3.6 Flash, a única declaração pública do Google foi que «o Gemini 3.5 Pro está atualmente em fase de testes com parceiros e planeamos torná-lo amplamente disponível assim que estiver pronto». O modelo não aparece no catálogo de modelos da API do Gemini nem na lista de modelos do Vertex AI, em nenhuma forma, incluindo em pré-visualização.
A reportagem por trás do atraso é mais ténue do que a internet sugere. A Bloomberg noticiou, a 16 de julho de 2026, que o Gemini 3.5 Pro está meses atrasado em relação ao calendário porque o Google tem estado a trabalhar para melhorar as suas capacidades, sobretudo em programação. O Google atualizou os dados usados para treinar o modelo no final de junho, e os resultados ficaram aquém do esperado. Falando com 10 funcionários atuais e antigos, a Bloomberg descreveu frustração entre engenheiros, investigadores e gestores do Google, preocupados com o facto de a empresa estar a perder a sua vantagem enquanto a Anthropic e a OpenAI lançam modelos que superam o Gemini. Esse é todo o relato verificado.
Tenha cuidado com as especificações que lê noutros sítios. A janela de contexto de 2 milhões de tokens e o modo de raciocínio integrado Deep Think são as duas funcionalidades associadas ao Gemini 3.5 Pro em quase todos os resumos, e o Google não confirmou nenhuma delas para este modelo. O Deep Think é real e já está disponível dentro do Gemini para os subscritores do Google AI Ultra, mas isso é uma funcionalidade de produto que já se pode comprar hoje, não uma especificação publicada do 3.5 Pro. Os preços também não são oficiais, por isso trate todos os valores em circulação como um lugar reservado até o Google publicar as tarifas.
| Funcionalidade | Gemini 3.5 Flash | Gemini 3.5 Pro |
|---|---|---|
| Estado | Disponível desde 19 de maio de 2026 | Por lançar; «em fase de testes com parceiros» |
| Janela de contexto | 1M tokens | 2M rumorado, não confirmado |
| Modo Deep Think | Não | Rumorado, não confirmado |
| Ideal para | Velocidade, programação, agentes, conversas do dia a dia | Raciocínio mais difícil, trabalho com contexto enorme |
| Preço da API (por 1M) | $1.50 entrada / $9.00 saída | Não publicado |
Porque É Que o Gemini 3.5 Pro Está Atrasado
Vai encontrar online uma história detalhada sobre o Google ter descartado e reconstruído o modelo base depois de este falhar em chamadas de ferramentas recursivas e em esquemas SVG complexos. Nada disso aparece em nenhuma fonte primária. Essa história remonta a canais de comentário sobre IA e a agregadores de SEO, e tem sido repetida vezes suficientes para parecer reportagem. O que a Bloomberg descreveu de facto é mais estreito e mais monótono: uma atualização dos dados de treino no final de junho, focada em programação, que não trouxe os ganhos que o Google queria, num modelo já com meses de atraso.
O contexto que está documentado é sobre pessoas. A TechCrunch noticiou, a 24 de junho de 2026, que a Google DeepMind perdeu quatro investigadores seniores no espaço de duas semanas. Noam Shazeer, colíder do Gemini e coautor do artigo que introduziu o Transformer, saiu para a OpenAI. Dias depois, John Jumper, o diretor da DeepMind que partilhou o Prémio Nobel da Química de 2024 pelo AlphaFold, foi para a Anthropic, e os colaboradores do Gemini Jonas Adler e Alexander Pritzel seguiram-no até lá. Ninguém associou diretamente essas saídas ao atraso do Pro, mas encaixam com a frustração descrita pelas fontes da Bloomberg.
Até o Pro estar disponível para todos, o Gemini 3.6 Flash cobre quase tudo, e o gemini-3.1-pro-preview continua a ser a escolha para as tarefas de raciocínio mais profundas, ainda que valha notar que o Google continua a distribuir esse modelo como uma pré-visualização e não como um modelo estável. Vamos atualizar este artigo assim que o Gemini 3.5 Pro ficar disponível de forma geral.
O Gemini Está Prestes a Equipar o Novo Siri da Apple
O alcance do Gemini estende-se agora muito para além das próprias aplicações do Google. Ao abrigo de um acordo plurianual avaliado, segundo consta, em cerca de mil milhões de dólares por ano, um modelo Gemini personalizado, que se diz correr com cerca de 1,2 biliões de parâmetros dentro dos próprios centros de dados da Apple, equipa o Siri reconstruído da Apple, a maior reformulação que o assistente já teve. A Apple revelou o novo Siri AI na WWDC 2026 como uma aplicação autónoma, em estilo de chatbot, para iPhone, iPad e Mac, capaz de obter contexto das suas mensagens, e-mails e fotografias e de executar ações em várias etapas em diferentes aplicações.
A beta pública do iOS 27 ficou disponível em meados de julho de 2026, pelo que qualquer pessoa já pode testar o Siri AI com tecnologia Gemini antes do lançamento geral no outono, a par do próximo iPhone. Isso significa que a mesma família de modelos aqui analisada já está por trás do assistente para os primeiros testadores, e em breve estará em muitas centenas de milhões de dispositivos Apple adicionais. Para o panorama completo do que está a mudar, veja a nossa análise sobre se o Siri é agora IA a sério.
Como o Gemini 3.5 Pro e o Flash se Comparam ao ChatGPT e ao Claude
Face ao campo mais alargado, o retrato é competitivo, mas não dominante, e os números não são simpáticos. No Artificial Analysis Intelligence Index v4.1, o Claude Fable 5 lidera com 60, à frente do GPT-5.6 Sol com 59, do Kimi K3 com 57 e do Claude Opus 4.8 com 56. A melhor entrada do Google nessa tabela é o Gemini 3.6 Flash com 50, e o Gemini 3.1 Pro Preview fica ainda mais abaixo, com 46. O facto de o nível Flash do Google superar o seu próprio nível Pro é a medida mais clara de porque é que o 3.5 Pro importa, e de porque é que o atraso dói. Hoje, a vantagem do Gemini está na velocidade e no preço, com qualidade quase de topo de gama. O Gemini 3.5 Flash não reivindica a coroa geral, mas muda a equação de valor ao entregar este nível de desempenho ao custo e à velocidade do Flash, e o Gemini 3.5 Pro está construído para desafiar o nível de topo nas tarefas de raciocínio mais difíceis.
Para uma comparação direta no uso do dia a dia, veja como o Gemini se compara ao ChatGPT, ou a nossa análise a três, ChatGPT vs Claude vs Gemini, para utilizadores de Mac. A conclusão honesta é que nenhum modelo vence em tudo, e é exatamente por isso que escolher o modelo consoante a tarefa vale mais do que a lealdade a um só modelo.
Deve Usar o Gemini 3.5?
Para quem usa a aplicação, a pergunta praticamente responde-se sozinha: o nível gratuito já chega ao Gemini 3.6 Flash, e obtém a janela de contexto de 1M tokens sem custo. Para os programadores, a recomendação honesta é ignorar o gemini-3.5-flash e chamar antes o gemini-3.6-flash, já que este agora cobra $0.75 / $3.75 contra os $1.50 / $9.00 do 3.5 Flash, e produz ainda cerca de menos 17% de tokens de saída. O gemini-3.8-flash, lançado a 2 de setembro de 2026, tem a mesma tarifa e pontua ainda mais alto, por isso comece por aí, a menos que tenha um motivo para se manter num modelo mais antigo. O gemini-3.7-flash cobra o mesmo e continua a ser uma alternativa sólida. Recorra ao gemini-3.1-pro-preview apenas quando precisar do raciocínio mais profundo. E não construa nenhum plano à volta da chegada do Gemini 3.5 Pro numa data específica, porque o Google não associou nenhuma a ele. Se quiser que o modelo que escolher fique no Dock em vez de num separador do navegador, o nosso guia de clientes de ambiente de trabalho do Gemini para macOS cobre as opções nativas.
FAQ
Quando é que o Gemini 3.5 foi lançado?
O Gemini 3.5 Flash foi lançado a 19 de maio de 2026 na Google I/O 2026. Foi o primeiro modelo da família Gemini 3.5 e tornou-se o modelo do nível gratuito na aplicação Gemini. O Gemini 3.5 Pro, anunciado no mesmo dia, ainda não foi lançado.
O Gemini 3.5 é gratuito?
O Gemini 3.5 Flash foi o modelo do nível gratuito na aplicação Gemini a partir de maio de 2026. A página de planos do Google indica agora «Acesso ao 3.6 Flash» para o nível gratuito, pelo que os utilizadores gratuitos chegam ao modelo mais recente. Os programadores que chamam o gemini-3.5-flash pagam $1.50 por milhão de tokens de entrada e $9.00 por milhão de tokens de saída.
O Gemini 3.5 Flash é melhor do que o Gemini 3.1 Pro?
Nos benchmarks de programação e de agentes, sim. Supera o Gemini 3.1 Pro no Terminal-Bench 2.1, no MCP Atlas e no GDPval-AA, sendo cerca de 4x mais rápido. O Gemini 3.1 Pro continua a liderar nos testes de raciocínio puro mais difíceis.
Quando é que o Gemini 3.5 Pro vai ser lançado?
O Google não deu nenhuma data. Pichai anunciou-o na I/O a 19 de maio de 2026 para o mês seguinte, e a 21 de julho de 2026 o Google disse apenas que está «atualmente em fase de testes com parceiros». A Bloomberg noticiou, a 16 de julho, que está meses atrasado em relação ao calendário, depois de uma atualização dos dados de treino no final de junho ter ficado aquém no que toca à programação. A janela de contexto de 2M tokens e as especificações do Deep Think que circulam online não estão confirmadas.
O Gemini 3.5 Pro falhou um lançamento a 17 de julho?
Não. O Google nunca definiu uma data para 17 de julho. Essa alegação, juntamente com os relatos de uma pré-visualização no Vertex AI e de um modelo base descartado, vem de canais de comentário sobre IA e de blogues agregadores, e não do Google ou da Bloomberg. A única posição declarada do Google é que o Gemini 3.5 Pro está em fase de testes com parceiros.
O que é o Gemini Spark?
O Gemini Spark é um agente pessoal de IA disponível 24 horas por dia, 7 dias por semana, com tecnologia Gemini 3.5 Flash. Trata de tarefas recorrentes em segundo plano e chegou primeiro a testadores de confiança, com uma Beta para subscritores do Google AI Ultra nos EUA. Desde 23 de julho de 2026 está incluído no Google AI Pro por $19.99/mês, e chegou a mais de 160 países adicionais a 30 de julho.
