Google gestiona ahora dos líneas temporales de Gemini que ya no avanzan al mismo ritmo. La línea Flash ha corrido hasta Gemini 3.8 Flash, lanzado el 2 de septiembre de 2026, mientras que la línea Pro lleva congelada en Gemini 3.1 Pro desde febrero. Si has estado buscando un «Gemini 3.5 Pro» o un «3.6 Pro», eso es lo primero que hay que aclarar en cualquier comparativa de modelos Gemini honesta, porque ninguno de los dos existe todavía. Luego, el 30 de septiembre de 2026, Google anunció Gemini 4 Argon, su primer modelo insignia nuevo desde 3.1 Pro, aunque de momento solo puede usarlo un pequeño grupo de especialistas en ciberdefensa verificados.
Esta guía recorre toda la gama, desde Gemini 2.5 hasta 3.8 Flash y el nuevo Gemini 4 Argon, versión por versión, con una tabla de benchmarks y precios para cada una, además de cómo aparecen los modelos dentro de la app de Gemini y una recomendación clara para cada caso de uso. Verás exactamente por qué Google dividió la familia en dos, qué cambió realmente en cada lanzamiento y qué modelo es la opción por defecto adecuada para programación, chat del día a día, documentos largos y presupuestos ajustados.
Lo más importante
- Gemini 3.8 Flash es el modelo más reciente que puedes usar, disponible desde el 2 de septiembre de 2026, a un precio introductorio de $0.75 / $3.75 por millón de tokens. Es el tercer lanzamiento Flash de Google en 43 días, y 3.7 Flash y 3.6 Flash tienen la misma tarifa.
- No existe Gemini 3.5 Pro ni 3.6 Pro. El actual modelo insignia Pro sigue siendo Gemini 3.1 Pro, de febrero de 2026.
- Esa tarifa económica caduca. Los tres modelos, 3.8, 3.7 y 3.6 Flash, vuelven a $1.50 / $7.50 el 1 de enero de 2027, así que a partir de año nuevo conviene presupuestar con la cifra más alta.
- Gemini 3.5 Flash-Lite es el modelo actual más económico, a $0.30 / $2.50 por millón de tokens.
- En la app, el plan Gratis funciona solo con Gemini Flash-Lite desde el 9 de octubre de 2026, mientras que 3.6 Flash pasa a AI Plus y niveles superiores. Ni 3.7 ni 3.8 Flash son gratuitos: 3.7 llega a los usuarios particulares solo a través de Spark, y el acceso a 3.8 se ha reportado hasta ahora solo para los suscriptores de AI Pro y Ultra. Deep Think sigue reservado a AI Ultra, mientras que Gemini Spark llega a AI Pro en EE. UU. y más de 160 países adicionales.
- Gemini 4 Argon, el primer modelo de Gemini 4 de Google y su nuevo modelo insignia, se anunció el 30 de septiembre de 2026 a un precio introductorio de $2 / $10 por millón de tokens, pero por ahora solo pueden usarlo los especialistas en ciberdefensa del programa Fairwind.
La gama Gemini de un vistazo (2026)
Google organiza Gemini en tres niveles. Pro es el nivel insignia de razonamiento, Flash es el caballo de batalla rápido para el día a día, y Flash-Lite es la opción económica. Lo confuso es que estos niveles ya no comparten numeración de versión, así que el Flash más reciente (3.8) va cuatro lanzamientos completos por delante del Pro más reciente (3.1). Gemini 4 Argon, anunciado el 30 de septiembre, rompe el patrón de nuevo: lleva un nombre en código en lugar de un nombre de nivel.
Esta es la familia actual, de la más antigua a la más reciente, con los modelos que más importan en negrita.
| Modelo | Lanzamiento | Nivel | Estado | Ideal para |
|---|---|---|---|---|
| Gemini 2.5 Pro | Marzo de 2025 | Pro | Legado | Razonamiento de reserva más económico |
| Gemini 2.5 Flash | Abril de 2025 | Flash | Legado | Tareas cotidianas antiguas |
| Gemini 2.5 Flash-Lite | Junio de 2025 | Flash-Lite | Legado | Alto volumen, bajo coste |
| Gemini 3 Pro | Noviembre de 2025 | Pro | Vista previa | Primer modelo insignia «3.0» |
| Gemini 3 Flash | Diciembre de 2025 | Flash | Vista previa | Valor equilibrado |
| Gemini 3.1 Pro | Febrero de 2026 | Pro | El Pro más reciente que puedes usar | Razonamiento más difícil, documentos largos |
| Gemini 3.1 Flash-Lite | Marzo de 2026 | Flash-Lite | Superado | Trabajo agéntico con presupuesto ajustado |
| Gemini 3.5 Flash | Mayo de 2026 | Flash | Superado | Caballo de batalla anterior |
| Gemini 3.5 Flash-Lite | Julio de 2026 | Flash-Lite | Actual | Opción de calidad más económica |
| Gemini 3.6 Flash | Julio de 2026 | Flash | Superado | Sigue siendo el modelo por defecto de la app gratuita |
| Gemini 3.7 Flash | Agosto de 2026 | Flash | Superado | Caballo de batalla anterior |
| Gemini 3.8 Flash | Septiembre de 2026 | Flash | Caballo de batalla actual | Para la mayoría de personas y tareas |
| Gemini 4 Argon | Septiembre de 2026 | Insignia (sin nombre de nivel) | Anunciado, solo socios de Fairwind | Programación extensa, trabajo de conocimiento y tareas de ciberdefensa |
Dos modelos especializados quedan fuera de la tabla principal. Gemini 3 Deep Think es una vista previa de razonamiento extendido de diciembre de 2025, y Gemini 3.5 Flash Cyber, lanzado el 21 de julio, es una versión de 3.5 Flash ajustada para encontrar y corregir vulnerabilidades de seguridad dentro del sistema CodeMender de Google.
Por qué no existe Gemini 3.5 Pro (ni 3.6 Pro)
La mayor fuente de confusión en cualquier comparativa de modelos Gemini son los lanzamientos de Pro que faltan. Cuando Google lanzó 3.5 Flash, luego 3.6 Flash, luego 3.7 Flash y luego 3.8 Flash, mucha gente dio por hecho que llegaría un Pro equivalente. No fue así.
Según TechCrunch, Google lanzó tres modelos nuevos el 21 de julio y, deliberadamente, ningún 3.5 Pro. La información de Bloomberg citada en esa cobertura dice que Google sufrió retrasos internos y le costó cumplir sus propios objetivos de rendimiento para 3.5 Pro, por lo que sigue en pruebas con socios en lugar de en lanzamiento general. El responsable de producto Logan Kilpatrick dijo que la empresa todavía lo está probando y espera que «llegue pronto».
Eso deja a Gemini 3.1 Pro, de febrero de 2026, como el modelo Pro más reciente que realmente puedes usar. Mientras tanto, la línea Flash siguió lanzando versiones, lo que explica que los números de versión no coincidan. La conclusión es sencilla: cuando quieras el razonamiento de Gemini de primer nivel hoy, usas 3.1 Pro, no un 3.5 o 3.6 Pro que no se ha lanzado. En septiembre, Koray Kavukcuoglu, de Google DeepMind, dijo que Google «dio un pequeño paso atrás» para centrarse en sus modelos Flash, y el siguiente modelo insignia que Google anunció, el 30 de septiembre, fue Gemini 4 Argon y no un 3.5 Pro.
Gemini 2.5: la base heredada de tres niveles
La familia 2.5 es la generación heredada, lanzada a lo largo de 2025, y fue la que fijó el patrón de tres niveles que Google sigue usando. Gemini 2.5 Pro llegó el 25 de marzo, 2.5 Flash el 17 de abril y 2.5 Flash-Lite el 17 de junio, cada uno con una ventana de contexto de 1M de tokens. Estos modelos todavía funcionan y siguen siendo una alternativa más económica, pero quedan por detrás de la familia 3.x en razonamiento, programación y tareas agénticas.
Cómo rinden y cuánto cuestan los niveles de 2.5
En su lanzamiento, 2.5 Pro encabezó la clasificación de LMArena y obtuvo 63,8 % en SWE-Bench Verified. 2.5 Flash quedó muy por debajo en precio, y 2.5 Flash-Lite bajó todavía más, a $0.10 / $0.40, la tarifa de Gemini más económica que ha tenido jamás la API. Nuestra guía de benchmarks de IA explica qué mide realmente cada una de esas pruebas.
| Modelo | Lanzamiento | Precio (entrada / salida por 1M) | Destacado |
|---|---|---|---|
| Gemini 2.5 Pro | 25 de marzo de 2025 | $1.25 / $10.00 | N.º 1 en LMArena al lanzamiento; 63,8 % en SWE-Bench |
| Gemini 2.5 Flash | 17 de abril de 2025 | $0.30 / $2.50 | Caballo de batalla rápido para el día a día |
| Gemini 2.5 Flash-Lite | 17 de junio de 2025 | $0.10 / $0.40 | La tarifa de Gemini más económica de la historia |
Cuándo elegir un modelo 2.5
Usa 2.5 solo si trabajas con infraestructura más antigua o necesitas el coste más bajo posible y no te importa la calidad de frontera. Para cualquier proyecto nuevo, los niveles 3.x son una mejora clara a precios similares o más bajos.
Gemini 3.0: el reinicio de la generación
El modelo Gemini 3 abrió la generación actual. Gemini 3 Pro se lanzó el 18 de noviembre de 2025 como modelo insignia en vista previa, seguido de Gemini 3 Deep Think el 4 de diciembre para razonamiento multietapa más difícil, y de Gemini 3 Flash el 17 de diciembre. Fue el salto que reinició la posición de Google en los benchmarks frente a ChatGPT y Claude.
Benchmarks y precios de Gemini 3.0
Gemini 3 Pro se lanzó con una ventana de contexto de 1M de tokens y 64K de salida, con 91,9 % en GPQA Diamond, 1501 Elo en LMArena y 76,2 % en SWE-Bench Verified. Gemini 3 Flash superó entonces a su propio hermano Pro en programación, con 78 % en SWE-Bench Verified por solo $0.50 / $3.00 por millón de tokens. Deep Think, un modo de razonamiento extendido para los suscriptores de AI Ultra, llevó ARC-AGI-2 a 45,1 % con ejecución de código.
| Modelo | Lanzamiento | Precio (entrada / salida por 1M) | Benchmark clave |
|---|---|---|---|
| Gemini 3 Pro | 18 de noviembre de 2025 | n/d (vista previa) | GPQA 91,9 %, SWE 76,2 %, 1501 Elo |
| Gemini 3 Deep Think | 4 de diciembre de 2025 | Solo AI Ultra | ARC-AGI-2 45,1 % |
| Gemini 3 Flash | 17 de diciembre de 2025 | $0.50 / $3.00 | SWE-Bench 78 % |
Cómo aguanta la generación 3.0
Los modelos 3.0 introdujeron la arquitectura y el trabajo de contexto largo sobre el que se construyeron las versiones posteriores. La mayoría han sido superados desde entonces por 3.1 y los lanzamientos Flash más recientes, así que trata 3.0 como la base, no como un modelo que elegirías hoy.
Gemini 3.1 Pro: el modelo insignia que puedes usar
Gemini 3.1 Pro, lanzado el 19 de febrero de 2026, es el modelo al que recurrir cuando necesitas la máxima capacidad. Usa un diseño de mezcla de expertos disperso, maneja una ventana de contexto de 1M de tokens y genera hasta 64K tokens en una sola respuesta. Obtiene 94,3 % en GPQA Diamond y 80,6 % en SWE-Bench Verified, ambas cifras propias de Google. La medición independiente es menos generosa: en el Artificial Analysis Intelligence Index v4.3.2, leído el 25 de septiembre de 2026, se queda en 29,7, por detrás de los actuales modelos insignia de OpenAI y Anthropic y, más incómodo todavía para Google, once puntos por detrás de su propio Gemini 3.8 Flash, que obtiene 40,9. El propio Gemini 4 Argon de Google se sitúa ahora muy por encima de ambos, con 52,6, pero por ahora solo pueden usarlo los socios del programa Fairwind.
Especificaciones y precio de Gemini 3.1 Pro
| Especificación | Gemini 3.1 Pro |
|---|---|
| Lanzamiento | 19 de febrero de 2026 |
| Contexto / salida máx. | 1M / 64K tokens |
| Precio (texto) | $2.00 / $12.00 por 1M, un solo nivel |
| Precio (salida de imagen) | $120.00 por 1M, unos $0.134 por imagen de 1K/2K |
| GPQA Diamond | 94,3 % (Google) |
| SWE-Bench Verified | 80,6 % (Google) |
| AA Intelligence Index v4.3.2 | 29,7 (leído el 25 sept 2026) |
Cuándo usar 3.1 Pro
Es la opción correcta para razonamiento complejo, análisis de documentos largos, investigación y las tareas de programación agéntica más difíciles. Como Google no ha actualizado el nivel Pro desde febrero, 3.1 Pro probablemente seguirá siendo el Gemini más potente que realmente puedes usar hasta que Gemini 4 Argon se abra más allá de los socios del programa Fairwind de Google.
Gemini 3.5 Flash y Flash-Lite: los caballos de batalla de mediados de 2026
Gemini 3.5 Flash se lanzó en el Google I/O el 19 de mayo de 2026, a $1.50 / $9.00 por millón de tokens, con una ventana de contexto de 1M de tokens, y superó de forma notable a 3.1 Pro en varios benchmarks de programación y agénticos a pesar de ser un modelo Flash. Hizo de caballo de batalla para el día a día hasta que 3.6 lo sustituyó en julio.
Gemini 3.5 Flash-Lite: el campeón económico
Gemini 3.5 Flash-Lite, lanzado el 21 de julio a $0.30 / $2.50 por millón de tokens, es el actual campeón económico. Google dice que supera sin más al Gemini 3 Flash anterior, más grande, en algunas evaluaciones, incluidas SWE-Bench Pro y OSWorld-Verified, lo que lo convierte en una opción sólida de relación precio-rendimiento para trabajo de alto volumen.
| Modelo | Lanzamiento | Precio (entrada / salida por 1M) | Contexto | Nota |
|---|---|---|---|---|
| Gemini 3.5 Flash | 19 de mayo de 2026 | $1.50 / $9.00 | 1M | Superó a 3.1 Pro en evaluaciones de programación |
| Gemini 3.5 Flash-Lite | 21 de julio de 2026 | $0.30 / $2.50 | 1M | El modelo actual más económico |
Por qué importa el tándem Flash
El tándem es la clave. Flash cubre el trabajo cotidiano de calidad mientras Flash-Lite se encarga de los trabajos de alto volumen y sensibles al coste, y ambos mantienen una ventana completa de un millón de tokens. Cuando 3.6 Flash llegó en julio, se colocó por encima de 3.5 Flash; 3.7 Flash tomó la cabeza de la línea Flash tres semanas después, y 3.8 Flash la tomó otras tres semanas más tarde, mientras Flash-Lite se mantuvo todo el tiempo como el suelo de precio.
Gemini 3.8 Flash: el caballo de batalla actual
Gemini 3.8 Flash quedó disponible de forma general el 2 de septiembre de 2026, tres semanas después de 3.7 Flash y como tercer lanzamiento Flash de Google en 43 días. Todas las líneas de la ficha técnica se mantienen sin cambios respecto a su predecesor: la misma ventana de contexto de 1M de tokens, el mismo límite de salida de 64K, la misma fecha de corte de conocimiento de marzo de 2026, la misma lista de modalidades y el mismo precio de lanzamiento. Todo el lanzamiento gira en torno a lo que el modelo hace dentro de ese margen, y Google ajustó este para agentes de largo alcance en lugar del enfoque puramente de programación de 3.7.
Precio y mejoras de benchmark de Gemini 3.8 Flash
El precio no se movió. 3.8 Flash figura al mismo precio introductorio de $0.75 / $3.75 por millón de tokens que 3.7 y 3.6 Flash, y lleva la misma nota: el 1 de enero de 2027 los tres suben a $1.50 / $7.50. Supera a 3.7 Flash en todas las filas que publicó Google, con las mayores mejoras en BioMysteryBench Human Difficult (del 43,5 % al 56,5 %), Terminal-bench 4.0 (del 11,2 % al 19,1 %) y DeepSWE v1.1 (del 65,3 % al 73,7 %). No arrasó en todo el campo: en la propia comparativa de lanzamiento de Google, de septiembre de 2026, Claude Opus 5 ganó las pruebas agénticas más difíciles, con un 51,8 % frente a 19,1 % en Terminal-bench 4.0 y un 75,4 % frente a 59,0 % en OSWorld-2.0. Anthropic ha sustituido desde entonces Opus 5 por Opus 5.5 y ha movido Opus 5 a su lista de modelos heredados, así que lee ese par como la comparativa que Google publicó en el lanzamiento y no como el estado actual de la técnica. Nuestro análisis de Gemini 3.8 Flash tiene la tabla completa de 14 filas y la cifra de benchmark ampliamente republicada que resultó ser errónea.
| Especificación | Gemini 3.8 Flash |
|---|---|
| Lanzamiento | 2 de septiembre de 2026 |
| Precio | $0.75 / $3.75 por 1M (introductorio, se duplica el 1 de enero de 2027) |
| Contexto | 1M tokens de entrada, 64K de salida |
| AA Intelligence Index v4.3.2 | 40,9 en el ajuste de razonamiento alto, frente a 39,1 de 3.7 Flash (leído el 25 sept 2026) |
| DeepSWE v1.1 | Del 65,3 % al 73,7 % |
| Terminal-bench 4.0 | Del 11,2 % al 19,1 % |
| BioMysteryBench (difícil) | Del 43,5 % al 56,5 % |
Gemini 3.7 Flash: el caballo de batalla anterior
Gemini 3.7 Flash llegó el 13 de agosto de 2026, solo 23 días después de 3.6 Flash, en AI Studio, la API de Gemini, Android Studio y la Gemini Enterprise Agent Platform, con la misma ventana de contexto de 1M de tokens y el mismo límite de salida de 64K que su predecesor. A diferencia del lanzamiento de 3.6, este fue un salto de capacidad genuino y no un simple ajuste de eficiencia: las puntuaciones de programación y agénticas avanzaron mucho en tres semanas. Mantuvo la cabeza de la línea Flash durante exactamente tres semanas antes de que 3.8 Flash lo sustituyera al mismo precio.
Precio y mejoras de benchmark de Gemini 3.7 Flash
El precio se redujo a la mitad, a $0.75 / $3.75 por millón de tokens, y Google puso 3.6 Flash en la tarifa idéntica, que es también donde aterrizó más tarde 3.8 Flash, así que hoy los tres cuestan lo mismo. Lee la nota antes de presupuestar: esas tarifas son introductorias y caducan el 31 de diciembre de 2026, y suben a $1.50 / $7.50 en enero. En benchmarks, DeepSWE v1.1 subió del 49,0 % al 65,3 % y AutomationBench casi se duplicó, del 17,0 % al 30,4 %. Para el panorama completo, incluidas las regiones que Google excluyó, consulta nuestro análisis de Gemini 3.7 Flash.
| Especificación | Gemini 3.7 Flash |
|---|---|
| Lanzamiento | 13 de agosto de 2026 |
| Precio | $0.75 / $3.75 por 1M (introductorio, se duplica el 1 de enero de 2027) |
| Contexto | 1M tokens de entrada, 64K de salida |
| AA Intelligence Index v4.3.2 | 39,1, frente a 34,0 de 3.6 Flash (leído el 25 sept 2026) |
| FrontierCode 1.1 Main | Del 34,4 % al 43,6 % |
| DeepSWE v1.1 | Del 49,0 % al 65,3 % |
| AutomationBench | Del 17,0 % al 30,4 % |
Gemini 3.6 Flash: el caballo de batalla anterior
Gemini 3.6 Flash se lanzó el 21 de julio de 2026 y sigue siendo el modelo por defecto de la app gratuita de Gemini solo hasta el 9 de octubre de 2026, cuando las cuentas gratuitas pasan a Flash-Lite, con una ventana de contexto de 1M de tokens. Es una mejora de eficiencia, no un nuevo nivel de frontera. Usa alrededor de un 17 % menos de tokens de salida que 3.5 Flash en el Artificial Analysis Index, con reducciones de hasta un 65 % en algunas tareas de ingeniería de largo alcance.
Precio y mejoras de benchmark de Gemini 3.6 Flash
El cambio de precio en el lanzamiento se reportó mal muchas veces. El recorte fue solo en la salida: la salida bajó de $9.00 a $7.50 por millón de tokens mientras la entrada se mantuvo fija en $1.50. Desde entonces Google ha vuelto a recortar el modelo, a $0.75 / $3.75, para igualarlo con Gemini 3.7 Flash. En benchmarks, DeepSWE subió del 37 % al 49 %, MLE-Bench del 49,7 % al 63,9 %, y OSWorld-Verified del 78,4 % al 83,0 %, según el anuncio de Google. Para un análisis más detallado de este lanzamiento, consulta nuestro análisis completo de Gemini 3.6 Flash.
| Especificación | Gemini 3.6 Flash |
|---|---|
| Lanzamiento | 21 de julio de 2026 |
| Precio | $0.75 / $3.75 por 1M (recortado para igualar a 3.7 Flash; se lanzó a $1.50 / $7.50) |
| Contexto | 1M tokens |
| AA Intelligence Index | 34,0 en v4.3.2, leído el 25 sept 2026 (marcaba 52 en la v4.1.1, ya retirada) |
| DeepSWE | Del 37 % al 49 % |
| MLE-Bench | Del 49,7 % al 63,9 % |
| OSWorld-Verified | Del 78,4 % al 83,0 % |
Precios de la API de Gemini comparados (2026)
El precio es donde la división de niveles se vuelve práctica. Flash y Flash-Lite están pensados para el volumen, mientras que Pro cuesta más y queda reservado para las tareas que lo justifican. La tabla siguiente muestra las tarifas actuales de la API por millón de tokens.
| Modelo | Entrada (por 1M) | Salida (por 1M) | Contexto |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.7 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.6 Flash | $0.75 | $3.75 | 1M |
| Gemini 3.5 Flash | $1.50 | $9.00 | 1M |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 1M |
| Gemini 3.1 Pro | $2.00 | $12.00 | 1M |
Para la mayoría de las cargas de trabajo, Gemini 3.8 Flash ofrece ahora los mejores resultados de la línea Flash, y como 3.6 y 3.7 Flash están en la misma tarifa, no hay ningún argumento de precio para quedarse en un modelo más antiguo. Las tres tarifas Flash son introductorias y se duplican el 1 de enero de 2027. Si manejas volúmenes enormes de solicitudes más sencillas, 3.5 Flash-Lite recorta todavía más los costes manteniendo una calidad sorprendentemente sólida.
El nivel Pro solía medirse por el tamaño del prompt, con una segunda tarifa por encima de 200K tokens. Ya no es así. La ficha de precios actual de la API de Google muestra una sola tarifa de texto para Gemini 3.1 Pro, $2.00 / $12.00, en sus tablas Standard, Batch, Flex y Priority, sin ninguna división por contexto largo; el nivel de $4.00 / $18.00 que esta guía solía mostrar ha desaparecido. Lo que Pro sigue tarificando por separado es la salida de imagen, a $120 por millón de tokens, lo que equivale a unos $0.134 por imagen de 1K o 2K y $0.24 por imagen de 4K. Batch y Flex reducen la tarifa de texto a la mitad, a $1.00 / $6.00.
Cómo aparece Gemini en la app (Gratis, Plus, Pro, Ultra)
La mayoría de la gente nunca toca la API. Dentro de la app de Gemini, los modelos aparecen como planes de consumidor en lugar de números de versión, y qué versión obtienes depende de lo que pagas. Desde el 9 de octubre de 2026, el plan Gratis funciona solo con Gemini Flash-Lite, AI Plus añade Flash, y solo AI Pro y Ultra llegan al modelo de razonamiento Pro, así que los niveles de pago ahora compran modelos además de límites de uso más altos y las funciones más exigentes. Ten en cuenta que ninguno de los lanzamientos Flash más recientes aparece como nivel de plan: 3.7 Flash llega a los usuarios de la app solo dentro de Spark, que requiere AI Pro o Ultra, y se ha reportado que 3.8 Flash se está desplegando para los suscriptores de AI Pro y Ultra, aunque las notas de versión de las apps de Gemini todavía no tienen ninguna entrada sobre él.
| Plan | Precio / mes | Acceso a modelos y funciones |
|---|---|---|
| Gratis | $0 | Solo Gemini Flash-Lite desde el 9 de octubre (antes, 3.6 Flash y acceso variable a 3.1 Pro) |
| Google AI Plus | $4.99 | Flash-Lite y Flash, sin Pro desde octubre; límites 2x más altos que Gratis, generación de vídeo, Daily Brief |
| Google AI Pro | $19.99 | Límites 4x más altos, mayor acceso al razonamiento de Gemini 3.1 Pro, Deep Research, funciones agénticas, Gemini Spark en más de 160 países |
| Google AI Ultra | De $99.99 a $199.99 | El mayor acceso a 3.1 Pro, Deep Think, Gemini Spark, Veo 3.1, hasta 20x los límites del plan Pro |
La lectura práctica es sencilla. Si solo quieres un asistente rápido para preguntas del día a día, el plan Gratis sigue cubriéndolo, pero desde el 9 de octubre funciona con Flash-Lite, así que AI Plus a $4.99 es la forma más económica de conservar Flash. Sube a AI Pro para razonamiento más exigente, Deep Research y el agente Gemini Spark, que llegó a Pro en EE. UU. el 23 de julio de 2026 y a más de 160 países adicionales el 30 de julio. Solo los planes AI Ultra añaden Deep Think. Spark no se ofrece en absoluto en el EEE, el Reino Unido, Suiza ni Nigeria.
Benchmarks de Gemini comparados
Los benchmarks cuentan la misma historia de líneas divididas, y ahora la cuentan mucho más alto que antes. En el Artificial Analysis Intelligence Index v4.3.2, un compuesto de diez evaluaciones, la línea Flash no solo supera por poco al Pro más antiguo, lo supera sin más. Gemini 3.8 Flash obtiene 40,9 en el ajuste de razonamiento alto y Gemini 3.7 Flash, 39,1, frente a 29,7 del modelo insignia Gemini 3.1 Pro. Gemini 3.6 Flash se queda en 34,0, Gemini 3.5 Flash en 32,6, y el económico Gemini 3.5 Flash-Lite en 22,2. Todos esos son modelos Flash por delante del modelo Pro, excepto Flash-Lite.
Una advertencia sobre cualquier cifra de Artificial Analysis que veas citada para Gemini, incluidas las que esta guía manejó hasta septiembre de 2026. AA ha reescalado su índice cuatro veces en siete semanas, pasando por v4.1.1, v4.2, v4.3 y v4.3.2, y cada reescalado movió todas las puntuaciones a la vez sin que ningún modelo cambiara. Gemini 3.8 Flash marcaba 59 en v4.1.1 y marca 40,9 en v4.3.2; nada en el modelo empeoró. Las cifras de esta página se volvieron a leer todas en las páginas de modelo de AA el 25 de septiembre de 2026 y son todas de v4.3.2, así que son comparables entre sí, pero no con nada publicado antes de septiembre. Fíjate también en que el tooltip de la clasificación de AA todavía dice v4.3 mientras que las páginas de cada modelo dicen v4.3.2; las páginas de modelo son las que hay que creer. Trata cualquier cifra de índice sin marca de versión como inutilizable.
| Modelo | AA Intelligence Index (v4.3.2, 25 sept 2026) | Velocidad de salida (tokens/s) |
|---|---|---|
| Gemini 3.8 Flash | 40,9 (high) | 304,6 |
| Gemini 3.7 Flash | 39,1 (high) | 279,4 |
| Gemini 3.6 Flash | 34,0 (high) | 210,0 |
| Gemini 3.5 Flash | 32,6 (high) | 189 |
| Gemini 3.1 Pro | 29,7 | 113 |
| Gemini 3.5 Flash-Lite | 22,2 | 463 |
Vale la pena destacar dos detalles. El primero es que la línea Flash ya no es plana: en v4.1, 3.5 y 3.6 Flash obtenían ambos 50, y en v4.3.2 se separan a 32,6 y 34,0, con 3.7 y 3.8 alejándose todavía más. El segundo es que Gemini 3.1 Pro es el tercer modelo más lento y el cuarto con mejor puntuación en la tabla de su propia familia, una posición inusual para un modelo insignia. Las propias mejoras de Gemini 3.6 todavía se notan sobre todo en eficiencia y programación agéntica, con saltos de dos cifras en DeepSWE y MLE-Bench mientras usa alrededor de un 17 % menos de tokens de salida que 3.5 Flash. En velocidad bruta, Flash-Lite está en otra categoría, con 463 tokens por segundo, frente a 189 de 3.5 Flash y 113 de 3.1 Pro.
Progresión de benchmarks en toda la familia Gemini
Seguir unas pocas evaluaciones clave a lo largo de los lanzamientos muestra las dos trayectorias con claridad. La línea Pro sube de forma constante en las pruebas más difíciles de razonamiento y programación, mientras que la línea Flash alcanza en silencio al modelo insignia en el índice compuesto. Las celdas vacías significan que Google o Artificial Analysis no han publicado esa cifra para ese modelo.
| Benchmark | 2.5 Pro | 3 Pro | 3.1 Pro | 3.5 Flash | 3.6 Flash | 3.8 Flash |
|---|---|---|---|---|---|---|
| GPQA Diamond | n/d | 91,9 % | 94,3 % | n/d | n/d | n/d |
| SWE-Bench Verified | 63,8 % | 76,2 % | 80,6 % | n/d | n/d | n/d |
| AA Index v4.3.2 | n/d | n/d | 29,7 | 32,6 | 34,0 | 40,9 |
| DeepSWE | n/d | n/d | n/d | 37 % | 49 % | 73,7 % (v1.1) |
Si lees las columnas de Pro de arriba abajo, la tendencia es una subida limpia en las propias evaluaciones de Google: GPQA Diamond pasa del 91,9 % al 94,3 % y SWE-Bench Verified del 63,8 % al 76,2 % y de ahí al 80,6 %. Si lees la fila de AA en horizontal, la historia se invierte: Flash no ha cerrado la distancia, la ha superado, pasando de 32,6 a 40,9 mientras el modelo insignia se queda en 29,7. La lectura honesta es que las dos mediciones no coinciden porque miden cosas distintas. Las cifras de Google son puntuaciones de una sola evaluación en razonamiento y código, en las que 3.1 Pro realmente va por delante; el compuesto de AA incluye diez evaluaciones, entre ellas trabajo con documentos de contexto largo y tareas agénticas, y con ese criterio un modelo Pro de siete meses pierde ante un Flash de tres semanas. Si tu trabajo se parece a GPQA, elige Pro. Si se parece a todo lo demás, elige Flash.
¿Qué modelo de Gemini deberías usar?
Para la mayoría de la gente, Gemini 3.8 Flash es la opción por defecto correcta. Es rápido, económico, a $0.75 / $3.75 por millón de tokens hasta enero, y maneja bien la programación y las tareas cotidianas. Sube a Gemini 3.1 Pro para el razonamiento más difícil y el trabajo con documentos largos, y baja a Gemini 3.5 Flash-Lite cuando el coste importa por encima de todo. La tabla siguiente relaciona tareas habituales con el modelo que mejor encaja.
| Tu tarea | Mejor modelo | Por qué |
|---|---|---|
| Chat y escritura del día a día | Gemini 3.8 Flash | Rápido, económico, calidad general sólida |
| Programación general | Gemini 3.8 Flash | Las mayores mejoras en programación agéntica (DeepSWE v1.1, 73,7 %) |
| Razonamiento más difícil e investigación | Gemini 3.1 Pro | Las mejores puntuaciones, 94,3 % en GPQA y 80,6 % en SWE |
| Análisis de documentos largos | Gemini 3.1 Pro | Contexto de 1M con el razonamiento más profundo |
| Trabajo de alto volumen con presupuesto ajustado | Gemini 3.5 Flash-Lite | $0.30 / $2.50 y el más rápido, a 463 tok/s |
| Trabajo de vulnerabilidades de seguridad | Gemini 3.8 Flash Cyber | El especialista en seguridad actual de Google, lanzado el 2 de septiembre de 2026 dentro del programa Fairwind; sustituye a 3.5 Flash Cyber |
Si tu trabajo principal es programar, 3.8 Flash es la opción de mejor relación calidad-precio y 3.1 Pro es el techo para los problemas más difíciles. Una advertencia para quienes no son desarrolladores: ni 3.7 ni 3.8 Flash son gratuitos en la app de Gemini, y desde el 9 de octubre de 2026 el nivel gratuito solo responde con Flash-Lite. Para una mirada más amplia sobre qué modelo usar para cada tarea entre distintos proveedores, nuestra guía sobre cuándo usar cada modelo de IA cubre todo el panorama.
Cómo se compara Gemini con ChatGPT y Claude
La estrategia de Google es distinta a la de sus rivales. En lugar de perseguir un único modelo insignia con el benchmark máximo, optimiza para la versatilidad práctica, la multimodalidad y la integración profunda con Search, Workspace y Android. Por eso el nivel Flash recibe tanta atención: es el modelo que la mayoría de la gente realmente usa cada día. Para ver el lado de Claude al completo, consulta la comparativa definitiva de modelos Claude.
| Modelo insignia | AA Index (v4.3.2, 25 sept 2026) | Contexto / salida | Precio (entrada / salida por 1M) | Lanzamiento |
|---|---|---|---|---|
| Gemini 3.1 Pro | 29,7 | 1M / 64K | $2.00 / $12.00 | Feb. de 2026 |
| GPT-6 Astra | 52,7 (max) | 1,05M / 128K | $10.00 / $50.00 | Sept. de 2026 |
| Claude Opus 5.5 | 57,6 (max) | 1M / 128K | $4.00 / $20.00 | Sept. de 2026 |
| Gemini 4 Argon (solo socios de Fairwind) | 52,6 (high) | 1M / 1M | $2.00 / $10.00 intro., luego $4.00 / $20.00 | Sept. de 2026 |
| Gemini 3.8 Flash, como referencia | 40,9 (high) | 1M / 64K | $0.75 / $3.75 | Sept. de 2026 |
Esta es la tabla que más ha cambiado desde el verano, y no a favor de Google. Ambos rivales sustituyeron sus modelos insignia en septiembre de 2026, y la respuesta de Google llegó solo el 30 de septiembre, en lanzamiento limitado. En v4.3.2 queda por detrás de GPT-6 Astra, con 52,7, y de Claude Opus 5.5, con 57,6, por 23 y 28 puntos, mientras que la antigua lectura de v4.1 situaba esa distancia entre 13 y 15. Lo que se mantiene es el argumento del precio, y ahora es más fuerte que antes: Gemini 3.1 Pro cuesta una quinta parte del precio de entrada de Astra y una cuarta parte de su precio de salida, y la mitad de la entrada de Opus 5.5. El nuevo modelo insignia de Google, Gemini 4 Argon, cierra la mayor parte de la distancia en puntuación, con 52,6, apenas por detrás de Astra, pero por ahora solo pueden usarlo los especialistas en ciberdefensa del programa Fairwind. Entre los Gemini que puedes llamar hoy, la verdadera respuesta de Google a ambos no es su nivel Pro en absoluto. Es Gemini 3.8 Flash, que obtiene 40,9, más que Pro, a $0.75 / $3.75, y esa es la fila que una comparación de coste por calidad debería usar en realidad.
Los tres modelos insignia manejan ahora alrededor de un millón de tokens de contexto, así que el verdadero compromiso está en la profundidad de razonamiento y el precio, no en el tamaño de la ventana. Una diferencia práctica: OpenAI y Anthropic permiten respuestas individuales mucho más largas, con 128K tokens de salida frente a los 64K de Gemini, algo que importa para generar código extenso o informes largos. Gemini 4 Argon invierte eso con hasta 1M de tokens de salida, en cuanto puedas conseguirlo.
En las propias evaluaciones de Google, 3.1 Pro compite con los mejores modelos GPT-6 y Claude 5 sin liderar el grupo; en el compuesto independiente no compite con ellos en absoluto, y es Flash el que rinde por encima de su categoría de precio. Para el panorama completo entre proveedores, consulta nuestra comparativa de los mejores modelos de IA y el análisis en profundidad de Gemini 3.5.
Qué sigue para Gemini (3.5 Pro y Gemini 4)
El primero es Gemini 3.5 Pro, todavía atascado en pruebas con socios después de que Google no cumpliera sus propios objetivos internos. En julio, el equipo de producto solo dijo que esperaba que el modelo «llegara pronto», y en septiembre Koray Kavukcuoglu, de Google DeepMind, dijo que Google «dio un pequeño paso atrás» para centrarse en Flash. Google no ha dicho si 3.5 Pro llegará a lanzarse.
El segundo ya ha llegado en parte. Google confirmó en julio que había iniciado su «tanda de preentrenamiento más ambiciosa hasta la fecha» para Gemini 4, y el 30 de septiembre de 2026 anunció Gemini 4 Argon, el primer modelo de Gemini 4. Se está desplegando primero para los especialistas en ciberdefensa del programa Fairwind de Google, y después para los clientes de pago de la API y los suscriptores de Google AI Ultra, sin fecha para ninguno de los dos, así que el mapa anterior es el que manejará la mayoría de la gente durante un tiempo todavía.
Usa todos los principales modelos de clase Gemini sin elegir una versión
El laberinto de versiones que este artículo acaba de recorrer es el verdadero coste de elegir un nivel de Gemini. Google AI Pro cuesta $19.99 al mes y sigue respondiéndote con la versión que la app decida darte, y en el lado de la API estás pendiente de qué tarifa Flash es introductoria y qué umbral de Pro duplica tu factura.
Fello AI es una app nativa para Mac, iPhone y iPad que te da Gemini bajo una sola suscripción, junto con ChatGPT, Claude, Grok, DeepSeek, Perplexity, Kimi, GLM y Qwen. Empieza en $9.99 al mes, la mitad de Google AI Pro, con un nivel gratuito para probarla primero y una valoración de 4,7 estrellas en más de 27 000 reseñas. Los últimos modelos de Gemini disponibles públicamente simplemente están ahí cuando la abres, y puedes hacerle la misma pregunta a un modelo rival en la misma conversación en lugar de comprometerte con una versión y una tabla de precios.
Conclusión
La comparativa de modelos Gemini honesta para 2026 es una historia de dos trayectorias. Flash ha corrido hasta 3.8, tres lanzamientos en 43 días y más económico que nunca, mientras Pro se queda en 3.1 con 3.5 Pro todavía sin lanzar. Para casi todo el mundo, empieza con Gemini 3.8 Flash, sube a 3.1 Pro para el trabajo más difícil, y baja a 3.5 Flash-Lite cuando el presupuesto mande. Con Gemini 4 Argon anunciado el 30 de septiembre pero limitado a los socios de Fairwind, espera que el mapa vuelva a cambiar en cuanto se abra a los clientes de pago de la API y a los suscriptores de Google AI Ultra.
Preguntas frecuentes
¿Existe un Gemini 3.5 Pro?
No. Hasta septiembre de 2026, Gemini 3.5 Pro no se ha lanzado y no tiene ninguna entrada en el registro de cambios de la API. Google todavía lo está probando con socios tras varios retrasos internos, así que el actual modelo insignia Pro sigue siendo Gemini 3.1 Pro, de febrero de 2026. La línea Flash, mientras tanto, ha avanzado hasta 3.8 Flash. El siguiente modelo insignia de Google resultó ser Gemini 4 Argon, anunciado el 30 de septiembre de 2026.
¿Qué modelo de Gemini debería usar?
Para la mayoría de la gente, Gemini 3.8 Flash es la mejor opción por defecto porque es rápido, económico, a $0.75 / $3.75 por millón de tokens, y el lanzamiento Flash más potente en programación y trabajo agéntico. Elige Gemini 3.1 Pro para el razonamiento más difícil y los documentos largos, y Gemini 3.5 Flash-Lite cuando necesites el coste más bajo.
¿Cuál es la diferencia entre Gemini 3.5 Flash y 3.6 Flash?
Gemini 3.6 Flash sustituyó a 3.5 Flash como caballo de batalla. Usa alrededor de un 17 % menos de tokens de salida, recortó el precio de salida de $9 a $7.50 por millón en el lanzamiento mientras la entrada se mantuvo en $1.50, y presentó grandes mejoras de programación, como DeepSWE subiendo del 37 % al 49 %. Fue una mejora de eficiencia, no un nuevo nivel de frontera, y ahora funciona a $0.75 / $3.75 junto con Gemini 3.7 Flash y Gemini 3.8 Flash.
¿Cuál es la diferencia entre Gemini 3.7 Flash y 3.8 Flash?
Nada en la ficha técnica y nada en el precio. Gemini 3.8 Flash, lanzado el 2 de septiembre de 2026, tiene la misma ventana de contexto de 1M de tokens, el mismo límite de salida de 64K, la misma fecha de corte de conocimiento de marzo de 2026 y la misma tarifa introductoria de $0.75 / $3.75 que 3.7 Flash. La diferencia está en la calidad medida: supera a 3.7 Flash en todas las filas de benchmark que publicó Google, con DeepSWE v1.1 pasando del 65,3 % al 73,7 % y Terminal-bench 4.0 del 11,2 % al 19,1 %. Como el precio es idéntico, no hay ningún motivo para empezar un proyecto nuevo con 3.7 Flash.
¿Qué modelos de Gemini incluyen los planes de la app?
Desde el 9 de octubre de 2026, el plan Gratis funciona solo con Gemini Flash-Lite, AI Plus añade Flash, y AI Pro y Ultra añaden 3.1 Pro y Deep Think. Google AI Pro, a $19.99, sube los límites y da mayor acceso al modelo de razonamiento Pro más Deep Research, y los planes AI Ultra, de $99.99 a $199.99, añaden Deep Think. Gemini Spark está en AI Pro en EE. UU. y en más de 160 países adicionales, pero no se ofrece en el EEE, el Reino Unido, Suiza ni Nigeria.
¿Cuál es el modelo de Gemini más económico?
Gemini 3.5 Flash-Lite, lanzado el 21 de julio de 2026, es el modelo actual más económico, a $0.30 de entrada y $2.50 de salida por millón de tokens. Google dice que supera al Gemini 3 Flash anterior en algunos benchmarks de programación y agénticos, lo que lo convierte en una opción de gran valor para trabajo de alto volumen.
¿Ya está disponible Gemini 4?
Ya está aquí, en forma limitada. Google anunció Gemini 4 Argon, el primer modelo de Gemini 4, el 30 de septiembre de 2026, pero por ahora solo pueden usarlo los especialistas en ciberdefensa de su programa Fairwind. Después llegarán los clientes de pago de la API y los suscriptores de Google AI Ultra, sin fecha, y Gemini 3.5 Pro todavía no se ha lanzado.