La tarifa de GPT-6 de OpenAI, vigente desde el 22 de septiembre de 2026, ha zanjado el debate que esta comparativa solía resolver. La respuesta de DeepSeek al GPT-5.6 llegó el 31 de julio como V4-Flash-0731 y el 10 de septiembre la sustituyó DeepSeek-V4.1-Flash, que factura por horas punta y valle desde el 16 de agosto de 2026 y hoy cuesta $0.15 / $0.60 por millón de tokens en horas valle y $0.30 / $1.20 en horas punta. Frente al nivel insignia de OpenAI la diferencia sigue siendo enorme: GPT-6 Sol, a $2.00 / $10.00, es 13x más caro en entrada y 17x en salida que DeepSeek en horas valle, o 7x y 8x en horas punta. Frente al nivel más barato de OpenAI, en cambio, la comparación se ha invertido del todo. GPT-6 Luna cuesta $0.10 / $0.50, y eso deja por debajo a DeepSeek V4.1 Flash en ambos ejes a cualquier hora de la semana, horas valle incluidas. El modelo solvente más barato de esta comparativa ya es el de OpenAI.
Ambas mitades son reales, y la mayoría de las comparativas solo publican la primera. Esta guía compara a los dos cara a cara en rendimiento, precio, funciones, privacidad y casos de uso reales, y mantiene separadas las dos superficies de OpenAI, porque van una generación desacompasadas. En la API, OpenAI vende GPT-6 Sol a $2.00 / $10.00 y GPT-6 Luna a $0.10 / $0.50, con GPT-6 Astra por encima a $10.00 / $50.00, y los tres llevan una ventana de contexto de 1M de tokens. En ChatGPT, la ventana de chat sigue respondiendo con GPT-5.6: Astra llega al chat como GPT-6 Pro en los planes Pro, Business y Enterprise, Plus lo recibe en ChatGPT Work y Codex, no en el chat, y Free y Go se quedan en el chat con GPT-5.6 Luna. Los niveles heredados de GPT-5.6 siguen a la venta, Sol a $4.00 / $20.00 con un precio promocional que, según OpenAI, se mantiene al menos hasta el 21 de noviembre de 2026, y Terra a $2.00 / $12.00. OpenAI no ha vuelto a publicar los benchmarks aislados de programación para Sol, así que las cifras detalladas del cara a cara de abajo usan sus datos completos más recientes, los resultados de GPT-5.5 medidos frente a DeepSeek V4, y cada uno está etiquetado con la casa que lo ejecutó. Verás las cifras canónicas de los benchmarks, escenarios de coste mensual a distintas escalas, la realidad de privacidad y censura de cada plataforma, y un veredicto claro sobre cuál deberías usar en realidad. DeepSeek, fundada por Liang Wenfeng, es la startup de Hangzhou detrás de los modelos V4, y ChatGPT es el producto de OpenAI que la mayoría ya conoce.
Conclusiones clave
- GPT-5.6 alcanzó la disponibilidad general el 9 de julio de 2026, y la tarifa GPT-6 de OpenAI entró en vigor el 22 de septiembre de 2026. DeepSeek V4-Flash-0731 se lanzó el 31 de julio de 2026 y el 10 de septiembre de 2026 lo sustituyó DeepSeek-V4.1-Flash, que ahora sirve todas las llamadas a
deepseek-flashy al nombre heredadodeepseek-v4-flash.- El precio de la API de DeepSeek V4.1 Flash es de $0.15 entrada / $0.60 salida por 1M de tokens en horas valle, que se duplica a $0.30 / $1.20 en horas punta. Eso es de 13x a 17x más barato que GPT-6 Sol ($2.00 / $10.00) en horas valle, o de 7x a 8x en horas punta, pero GPT-6 Luna, a $0.10 / $0.50, es más barato que DeepSeek en ambos ejes a cualquier hora de la semana, horas valle incluidas.
- DeepSeek V4 Pro obtiene alrededor de un 91,2% en SWE-Bench Verified y alrededor de un 96,4% en HumanEval (informe de V4 de abril de DeepSeek), pero en el Intelligence Index v4.3.2 de Artificial Analysis es el más débil de los dos modelos de DeepSeek, 36,0 frente al 39,5 de V4.1 Flash. En Terminal-Bench 2.1 las casas no se ponen de acuerdo: la propia ficha de DeepSeek pone a V4-Flash-0731 en 82,7, la ejecución independiente de Artificial Analysis obtiene 78,7, y el marcador oficial de tbench.ai no incluye ningún modelo de DeepSeek.
- El chat web de DeepSeek es gratis y sin niveles de suscripción. ChatGPT Plus cuesta $20/mes, Pro cuesta $100, $200 o $500/mes.
- DeepSeek no tiene app nativa para Mac ni para Windows. ChatGPT sí.
- El contexto de 1M de DeepSeek ya no es una ventaja. Los modelos GPT-6 llevan también una ventana de 1M de tokens, y GPT-6 Luna deja por debajo a los dos modelos de DeepSeek en ambos ejes ($0.10 / $0.50 frente a los $0.15 / $0.60 de V4.1 Flash en horas valle y los $0.66 / $1.98 de V4 Pro).
DeepSeek frente a ChatGPT de un vistazo
Antes de entrar en los benchmarks, aquí tienes el cara a cara en cada dimensión que importa en 2026. La columna de ChatGPT pone precio a GPT-6 Sol, el modelo que OpenAI vende en la API; la ventana de chat en Plus sigue respondiendo con GPT-5.6.
| ChatGPT (GPT-6 Sol) | DeepSeek (V4 Pro) | |
|---|---|---|
| Lanzamiento | 22 de septiembre de 2026 | 24 de abril de 2026 |
| Arquitectura | No revelada | Mixture-of-Experts, 1,6 billones en total / 49.000 millones activos |
| Ventana de contexto | 1M (API) | 1M de tokens |
| Nivel gratuito | Acceso limitado al modelo insignia | Chat web ilimitado |
| Planes de pago | Plus $20, Pro de $100 a $500 | Ninguno para el chat (solo API) |
| Precio de entrada de la API (por 1M) | $2.00 | $0.66 en horas valle, $1.32 en horas punta |
| Precio de salida de la API (por 1M) | $10.00 | $1.98 en horas valle, $3.96 en horas punta |
| App nativa para Mac | Sí | No |
| Generación de imágenes | Sí | No |
| Modo de voz | Sí | No |
| Open source | No | Sí (licencia MIT) |
| Privacidad/enrutamiento de datos | EE. UU. (OpenAI) | China |
ChatGPT gana en acabado, ecosistema y amplitud de funciones. DeepSeek gana en apertura, y en precio frente a todo lo que está por encima del nivel barato de OpenAI. La ventana de contexto está ahora empatada. Todo lo que sigue explica por qué importan esos compromisos.
Qué hay de nuevo en 2026: GPT-5.6 y DeepSeek V4
Ambos productos dieron un salto generacional en la misma semana, así que cualquier comparativa escrita antes de finales de abril de 2026 ya está desfasada.
GPT-5.5 se lanzó el 23 de abril de 2026 como el nuevo modelo por defecto para los suscriptores de ChatGPT Plus, Pro, Business y Enterprise. OpenAI lo describe como más rápido, más eficiente en tokens y mejor en programación, investigación y análisis de datos que GPT-5.4 en el anuncio oficial de GPT-5.5. El mayor salto está en el razonamiento con contexto largo: MRCR v2 a 1 millón de tokens pasó de un 36,6% en GPT-5.4 a un 74,0% en GPT-5.5.
DeepSeek V4 llegó un día después, el 24 de abril de 2026, como lanzamiento de vista previa de código abierto. Se presenta en dos variantes. V4 Flash tiene 284.000 millones de parámetros en total, con 13.000 millones activos por consulta, y es el modelo de chat por defecto. V4 Pro tiene 1,6 billones de parámetros en total, con 49.000 millones activos, y es el modelo de razonamiento. Ambos admiten una ventana de contexto de 1 millón de tokens con hasta 384K de salida máxima, y ambos se publican bajo licencia MIT con los pesos completos disponibles en Hugging Face. Para el análisis completo del lanzamiento, consulta nuestra cobertura del lanzamiento de DeepSeek V4.
V4-Flash-0731 y luego V4.1-Flash: las actualizaciones que cambiaron el debate
El 31 de julio de 2026 DeepSeek lanzó V4-Flash-0731, el cambio más importante de esta comparativa desde abril. Es un nuevo post-entrenamiento y no una arquitectura nueva: los mismos 284.000 millones en total / 13.000 millones activos de parámetros, el mismo contexto de 1M y la misma salida máxima de 384K, la misma licencia MIT, y en el lanzamiento el mismo precio de $0.14 / $0.28, que DeepSeek sustituyó por la facturación en horas punta/valle el 16 de agosto de 2026. Sustituyó por completo a la vista previa y el 10 de septiembre de 2026 fue sustituido a su vez por DeepSeek-V4.1-Flash, el primer modelo de una nueva familia de arquitectura con visión multimodal nativa. La documentación de DeepSeek trata ahora deepseek-v4-flash como un nombre heredado que se enruta a V4.1-Flash y se factura a la tarifa Flash; el nombre actual del modelo es deepseek-flash.
Lo que se movió fue el rendimiento agéntico. En la propia tabla de benchmarks de DeepSeek, el modelo Flash, mucho más pequeño, ahora supera a la vista previa de V4 Pro, mucho mayor, en todas las pruebas agénticas listadas: Terminal Bench 2.1, 82,7 frente a 72,1, NL2Repo, 54,2 frente a 38,5, DeepSWE, 54,4 frente a 12,8, Toolathlon-Verified, 70,3 frente a 55,9. Un nuevo post-entrenamiento movió esas cifras más de lo que lo hizo un modelo con casi cuatro veces más parámetros activos, y por eso el nivel barato es ahora la opción por defecto sensata en lugar del compromiso.
La conclusión: ChatGPT y DeepSeek están ahora más cerca que nunca en capacidad bruta, y la pregunta práctica ha pasado de «¿cuál es más inteligente?» a «¿qué compromiso tiene sentido para ti?».
Rendimiento y benchmarks
En los benchmarks, los dos modelos insignia se reparten los golpes. DeepSeek V4 Pro lidera en algunas pruebas de programación y matemáticas; GPT-5.5 lidera en pruebas agénticas y de uso de herramientas.
| Benchmark | GPT-5.5 | DeepSeek V4 Pro | Ganador |
|---|---|---|---|
| SWE-Bench Verified | (sin publicar oficialmente) | ~91,2% | DeepSeek (iguala al nivel de Claude Opus 4.8) |
| SWE-Bench Pro | 58,6% | 55,4% | GPT-5.5 |
| HumanEval | ~95% | ~96,4% | Empate |
| MATH-500 | ~89% | ~88,3% | Empate |
| Terminal-Bench 2.0 (agéntico, informe de abril de DeepSeek) | 82,7% | 67,9% | GPT-5.5 |
| MRCR v2 @ 1M tokens | 74,0% | (admite contexto de 1M) | GPT-5.5 |
Para cifras independientes y comparadas lado a lado, Artificial Analysis mantiene una comparativa en vivo que se actualiza a medida que ambos fabricantes publican nuevos checkpoints.
Terminal-Bench es donde más cuidado hay que tener, porque tres casas publican tres cifras distintas y ninguna está equivocada. La propia ficha de modelo de DeepSeek sitúa a V4-Flash-0731 en 82,7 en Terminal Bench 2.1, por delante de GLM-5.2 con 81,0 y por detrás de Claude Opus 4.8 con 85,0, ejecutado con el propio arnés de DeepSeek al máximo esfuerzo de razonamiento. Artificial Analysis, al ejecutar el benchmark de forma independiente, obtiene 78,7. El marcador oficial de tbench.ai no incluye ningún modelo de DeepSeek; su tabla 2.1 la lidera Claude Fable 5 con 83,8%, seguido de GPT-5.5 vía Codex con 83,1% y GPT-5.6 Terra con 78,4% (marcador consultado el 1 de agosto de 2026). Trata con recelo cualquier cifra suelta de Terminal-Bench sin atribuir.
El patrón es constante. En tareas aisladas de programación y matemáticas, DeepSeek V4 Pro es competitivo o va ligeramente por delante. En flujos de trabajo agénticos y de uso de herramientas en varios pasos, donde el modelo tiene que encadenar llamadas, decidir cuándo parar y mantener el estado a lo largo de contextos largos, GPT-5.5 sigue teniendo la ventaja. Si le das al modelo un único problema difícil, DeepSeek gana en precio por respuesta correcta. Si ejecutas un agente que tiene que manejar Cursor o un navegador durante una hora, se nota el acabado de GPT-5.5.
DeepSeek frente a ChatGPT para programar
Esta es la comparativa más buscada del grupo, y la respuesta honesta es que ambos son excelentes. La diferencia es menor de lo que sugiere el marketing de cualquiera de los dos lados.
DeepSeek V4 Pro obtiene alrededor de un 91,2% en SWE-Bench Verified, lo que lo sitúa en el mismo nivel que Claude Opus 4.8 y ligeramente por detrás de GPT-5.5 en SWE-Bench Pro (58,6% frente a 55,4%). En HumanEval se sitúa en torno al 96,4%, por delante de GPT-5.5 por un pelo. En corrección pura de generación de código en problemas aislados, V4 Pro está prácticamente a la par de los mejores modelos cerrados. Nuestra comparativa completa de DeepSeek vs Claude pone a los dos frente a frente.
Donde realmente divergen es en el estilo. GPT-5.5 escribe código más limpio e idiomático, que parece escrito por un desarrollador sénior. Rellena los requisitos vagos con valores por defecto sensatos. DeepSeek V4 Pro es más defensivo: añade comprobaciones de nulos, comprobaciones de límites y manejo de casos extremos sin que se lo pidan, lo cual es genial para código de producción pero excesivo para prototipos rápidos. DeepSeek también sigue las instrucciones concretas de forma más literal, mientras que ChatGPT a veces «mejora» tu prompt antes de responder.
Para programación agéntica en herramientas como Cursor o Cline, la foto de abril tenía a GPT-5.5 muy por delante en Terminal-Bench 2.0 (82,7% frente a 67,9% en el propio informe de DeepSeek), lo que se traducía en menos descarrilamientos en refactorizaciones largas de varios archivos. V4-Flash-0731 redujo esa diferencia de forma drástica, y con el arnés de DeepSeek ahora obtiene 82,7 en Terminal Bench 2.1, aunque ningún marcador independiente ha ejecutado todavía ambos modelos en las mismas condiciones. Para generación de código de una sola pasada al menor coste posible, la opción barata ahora es GPT-6 Luna a $0.10 / $0.50, no DeepSeek: la generación de código consume mucha salida, y Luna es más barato en salida además de en entrada, tanto en horas valle como en horas punta. DeepSeek V4.1 Flash a $0.15 / $0.60 por millón de tokens en horas valle solo es mejor compra si quieres pesos abiertos o la puntuación más alta del Intelligence Index. También encabeza nuestra recopilación de las mejores IA gratuitas para programar.
DeepSeek frente a ChatGPT en coste: las cuentas reales
Aquí es donde la comparativa deja de ser académica. La diferencia de coste entre DeepSeek y ChatGPT es lo bastante grande como para decidir por sí sola las elecciones de API.
El precio para consumidores es sencillo. El chat web de DeepSeek en chat.deepseek.com es completamente gratuito y sin niveles de suscripción. El nivel gratuito de ChatGPT existe, pero limita el acceso al modelo insignia. Para ver cómo se posicionan ambos entre las opciones gratuitas, consulta nuestra guía sobre el mejor chatbot de IA gratuito. ChatGPT Plus cuesta $20/mes y da acceso completo a GPT-5.6 Sol en el chat, además de GPT-6 Sol y Luna en ChatGPT Work y Codex; los niveles superiores (Pro, Business, Enterprise) añaden GPT-6 Pro, impulsado por Astra, en el propio chat, más contexto y controles de equipo. También hay un nivel Go a $8/mes para usuarios ocasionales. Para el desglose de planes actual, consulta nuestra guía de precios de ChatGPT.
El precio de la API era donde DeepSeek defendía su caso sin réplica, y lo han recortado dos movimientos: la propia subida de DeepSeek del 16 de agosto de 2026 y la tarifa GPT-6 de OpenAI del 22 de septiembre. Aquí están las tarifas por millón de tokens, primero en horas valle:
| Modelo | Entrada (por 1M) | Salida (por 1M) |
|---|---|---|
| GPT-6 Luna | $0.10 | $0.50 |
| DeepSeek V4.1 Flash | $0.15 / $0.30 | $0.60 / $1.20 |
| DeepSeek V4 Pro | $0.66 / $1.32 | $1.98 / $3.96 |
| GPT-6 Sol | $2.00 | $10.00 |
| GPT-5.6 Sol (heredado, promoción) | $4.00 | $20.00 |
| GPT-6 Astra | $10.00 | $50.00 |
Ya no hay una única tarifa plana que citar. Cada celda de DeepSeek de arriba muestra primero la tarifa valle y luego la punta. La hora punta va de 01:00 a 04:00 y de 06:00 a 10:00 UTC, de lunes a viernes (de 09:00 a 12:00 y de 14:00 a 18:00, hora de Pekín), y el resto de horas factura a exactamente la mitad. Las lecturas de entrada en caché son aún más baratas, $0.003 por millón en horas valle para V4.1 Flash y $0.022 para V4 Pro.
DeepSeek llevaba meses avisando de esto en su documentación, diciendo solo que la API «pronto adoptará una política de precios en horas punta/valle», sin ninguna fecha concreta. Llegó el 16 de agosto de 2026 exactamente como se describía: un recargo en lugar de un descuento valle recuperado, con precios en horas punta al doble de las tarifas normales en todos los conceptos de facturación. El anterior descuento de lanzamiento de V4 Pro, que en su día debía expirar el 31 de mayo de 2026 y devolver el modelo a $1.74 / $3.48, nunca llegó a expirar; el cambio a horas punta/valle es lo que finalmente movió el precio. El 10 de septiembre de 2026 la tarifa Flash volvió a moverse, hasta $0.15 / $0.60 en horas valle, con el lanzamiento de DeepSeek-V4.1-Flash.
Ahora, el ejemplo práctico. Imagina que llevas un flujo de trabajo que procesa 100 millones de tokens al mes, repartidos a partes iguales entre entrada y salida (50M cada una). Esto es lo que cuesta.
| Modelo | Coste mensual (50M entrada + 50M salida) |
|---|---|
| GPT-6 Luna | $30 |
| DeepSeek V4.1 Flash | $38 en horas valle, $75 en horas punta |
| DeepSeek V4 Pro | $132 en horas valle, $264 en horas punta |
| GPT-6 Sol | $600 |
| GPT-5.6 Sol (heredado, promoción) | $1,200 |
| GPT-6 Astra | $3,000 |
Esta tabla es todo el argumento, y ya no se lee como hace un mes. La fila más barata es la de OpenAI. GPT-6 Luna, a $30 al mes, queda por debajo de los $38 de DeepSeek V4.1 Flash incluso en horas valle, y en horas punta es 2,5 veces más barato. Frente a los niveles superiores la ventaja de DeepSeek sigue siendo real y grande: en horas valle, V4.1 Flash es 16 veces más barato que GPT-6 Sol y 80 veces más barato que Astra; ejecuta la misma carga de trabajo en horas punta y esas cifras bajan a 8x y 40x. V4 Pro no compite con nada en esta tabla, porque a $132 en horas valle cuesta más de cuatro veces lo que GPT-6 Luna y puntúa por debajo. Si te convencieron de DeepSeek con un titular que decía «100 veces más barato que ChatGPT», esa cifra se medía frente al nivel más caro de OpenAI, y dejó de ser toda la historia cuando OpenAI recortó Luna un 80% el 30 de julio de 2026, DeepSeek subió sus propias tarifas el 16 de agosto de 2026 y las volvió a recortar el 10 de septiembre, y OpenAI sustituyó Luna el 22 de septiembre por GPT-6 Luna a $0.10 / $0.50, la mitad de la tarifa anterior de entrada y un 58% menos en salida. Para un desglose más detallado, consulta la guía completa de precios de DeepSeek.
La trampa: los precios de DeepSeek son tan bajos en parte porque la empresa funciona sobre infraestructura china, sin sobrecoste por residencia de datos en EE. UU. ni por cumplimiento normativo empresarial. Si esas restricciones no te afectan, el ahorro es real. Qwen ahora también impulsa Apple Intelligence en China. Para una alternativa china de gama más alta con benchmarks más cercanos a la vanguardia, consulta nuestra reseña de Qwen3.7-Max. Si sí te afectan, pagas los precios de GPT-6 por una razón.
Funciones y capacidades
Una cosa es la inteligencia pura del modelo, y otra el producto que lo envuelve. ChatGPT es un producto de consumo pulido. DeepSeek es un envoltorio de chatbot alrededor de un modelo de calidad de investigación.
ChatGPT incluye generación de imágenes, modo de voz, búsqueda web avanzada, subida de archivos, intérprete de código, GPT personalizados, memoria entre conversaciones, apps nativas para Mac y Windows, apps móviles, extensiones de navegador y un discurso de cumplimiento normativo empresarial. Toda la gama de ChatGPT, desde GPT-5.0 hasta GPT-6, está detallada en nuestra comparativa definitiva de modelos de ChatGPT.
DeepSeek es, por diseño, mucho más ligero. El chat web hace entrada y salida de texto con un interruptor «DeepThink» para el modelo de razonamiento V4 Pro y un botón básico de búsqueda web. No tiene generación de imágenes, ni modo de voz, ni intérprete de código, ni app nativa de escritorio, ni ecosistema de apps. La app móvil existe, pero le falta el acabado de la de ChatGPT. Lo que DeepSeek ofrece a cambio son pesos completamente abiertos bajo licencia MIT, lo que significa que puedes ejecutarlo en local, ajustarlo, integrarlo en tu propio producto o alojarlo detrás de tu propio límite de privacidad.
Para la mayoría de los usos de consumo, la ventaja de funciones de ChatGPT es decisiva. Para los desarrolladores que quieren un modelo de nivel de vanguardia sin restricciones de licencia ni de precio, DeepSeek es el mejor bloque de construcción.
Privacidad, censura y seguridad
Esta es la sección que toda comparativa minimiza, y es donde las dos plataformas difieren en naturaleza, no solo en grado.
DeepSeek envía los datos de los usuarios a servidores en China, donde caen bajo la Ley de Inteligencia Nacional de 2017, que exige a las empresas chinas cooperar con el trabajo de inteligencia del Estado cuando se lo pidan. Investigadores de seguridad también han señalado que DeepSeek transmite datos a infraestructura en la nube afiliada a ByteDance. ByteDance tiene sus propias ambiciones de modelo de vanguardia; su Seed 2.1 Pro figura clasificado en el marcador de programación WebDev de Arena.
El modelo aplica las normas chinas de moderación de contenido. Pregúntale a DeepSeek por la plaza de Tiananmén, el estatus político de Taiwán o críticas a Xi Jinping, y obtendrás una negativa o un enfoque alineado con el Estado. El 30 de enero de 2025, el Garante italiano ordenó a DeepSeek bloquear su chatbot en Italia después de que la empresa no atendiera las preocupaciones de privacidad del regulador. Desde entonces, varios otros reguladores han abierto investigaciones similares. Cubrimos el panorama completo en nuestra guía sobre si DeepSeek es seguro para usuarios de EE. UU. y la UE.
ChatGPT tiene sus propios problemas de privacidad, incluidas demandas por datos de entrenamiento, ventanas de retención opacas y un largo historial de escrutinio regulatorio en la UE. Pero OpenAI es una empresa con sede en EE. UU. sujeta a la ley estadounidense y europea, y ChatGPT no aplica normas de contenido de un Estado sobre temas políticos. Las entradas del nivel gratuito se usan para entrenamiento a menos que optes por no participar; los niveles Plus, Pro, Business y Enterprise ofrecen controles de datos más estrictos.
La guía práctica: si eres un usuario de EE. UU. o la UE que introduce material relacionado con el trabajo en un chatbot, el perfil de riesgo de ChatGPT es notablemente menor que el de DeepSeek. Si necesitas pesos abiertos que puedas ejecutar en hardware que controlas, DeepSeek gana por defecto porque no hay una alternativa de código cerrado en este nivel de precio y rendimiento.
DeepSeek frente a ChatGPT en Mac y escritorio
ChatGPT tiene una app nativa para Mac muy pulida, con atajos de teclado globales, arrastrar y soltar archivos e integración con Spotlight de macOS. DeepSeek no tiene nada de eso. La experiencia oficial de DeepSeek es una pestaña web y una app móvil. Nuestra guía sobre el cliente de escritorio de ChatGPT para Mac repasa lo que puede hacer esa app.
Si quieres DeepSeek en tu Mac, eliges entre tres opciones. Puedes usar el chat web en un navegador, que funciona pero resulta recargado. Puedes ejecutar los pesos abiertos en local en un Mac de gama alta con suficiente memoria unificada, algo técnicamente posible para V4 Flash pero que exige hardware considerable. O puedes usar un envoltorio de escritorio de terceros. Repasamos las opciones específicas para Mac en nuestra guía del cliente de escritorio de DeepSeek para macOS.
La tercera opción, una única app nativa que incluye ambos modelos y elimina por completo la cuestión del envoltorio, se trata más abajo. Para una comparación lado a lado de las principales apps de chat nativas en macOS, consulta nuestra comparativa de ChatGPT vs Claude vs Gemini en Mac.
Dónde encajan Gemini y Grok
Muchas búsquedas emparejan DeepSeek y ChatGPT con Gemini o Grok, así que aquí va la respuesta corta.
Gemini 3.1 Pro sigue siendo el modelo Pro de Google, y en el Intelligence Index v4.3.2 de Artificial Analysis obtiene 29,7 frente al 47,5 de GPT-6 Sol. La mejor puntuación de Google es ahora la de Gemini 4 Argon, con 52,6, por encima de GPT-6 Sol, pero de momento Google solo lo ha dado a especialistas en ciberdefensa verificados. Entre los modelos Gemini que puedes usar de verdad, la mejor puntuación no está en la línea Pro, sino en Gemini 3.8 Flash, con 40,9. Lo que ofrece Gemini en cambio es una propuesta multimodal más sólida (imagen, vídeo, audio) y una integración estrecha con Google Workspace. Si vives en Gmail y Docs, Gemini es la opción con más ventaja. Los comparamos directamente en nuestra guía de ChatGPT vs Gemini. Grok 4.7 es el modelo más capaz de xAI, con 46,4, es competitivo en programación y razonamiento, tiene la mejor generación de imágenes de su categoría con Grok Imagine, y va incluido en X Premium+. Lo enfrentamos cara a cara con el modelo insignia de OpenAI en nuestra comparativa de Grok vs ChatGPT, y frente a DeepSeek en nuestra comparativa de DeepSeek vs Grok. DeepSeek V4.1 Flash les gana a los dos en precio por un margen amplio y es el único de los cuatro con pesos totalmente abiertos.
Para la mayoría de los lectores que comparan DeepSeek y ChatGPT directamente, Gemini y Grok son alternativas dentro de la categoría de «asistente pulido de código cerrado» que define ChatGPT, no dentro de la categoría de «modelo de vanguardia barato y de pesos abiertos» que define DeepSeek. Resuelven problemas distintos. Kimi, el otro aspirante chino de pesos abiertos, también entra en la segunda categoría, y lo comparamos con ChatGPT en Kimi vs ChatGPT.
¿Cuál deberías usar?
La respuesta honesta depende de qué estés priorizando. Aquí van los veredictos según el caso de uso.
Elige ChatGPT si quieres el asistente de consumo más pulido, necesitas generación de imágenes o modo de voz, trabajas en un Mac y quieres una app nativa, estás en un sector regulado que exige el tratamiento de datos en EE. UU., o construyes agentes que encadenan muchas llamadas a herramientas. El plan Plus de $20/mes basta para casi cualquier uso personal.
Elige DeepSeek si quieres un chatbot gratuito y capaz sin suscripción, necesitas una ventana de contexto de 1M de tokens para trabajar con documentos largos, quieres pesos abiertos que puedas ejecutar o ajustar en local, o quieres la puntuación más alta disponible en la gama barata, que es V4.1 Flash con 39,5. Si lo único que importa es el coste bruto de la API, calcula primero GPT-6 Luna.
Usa ambos si eres un usuario avanzado. Muchos desarrolladores usan ChatGPT para las tareas diarias y llaman a la API de DeepSeek para trabajos en segundo plano de gran volumen donde la diferencia de coste importa. Los dos se complementan mejor de lo que se sustituyen.
Cómo usar ambos en una sola app
Usar ambos es la respuesta sensata, y la fricción no es el dinero. ChatGPT Plus cuesta $20 al mes y el chat web de DeepSeek no cuesta nada, así que la factura no es el problema. El problema es que DeepSeek no ofrece ninguna app nativa de escritorio, lo que significa que llevar bien el dúo te deja con una app pulida de Mac para un modelo y una pestaña del navegador para el otro.
Fello AI es una app nativa para Mac, iPhone y iPad que reúne a DeepSeek y ChatGPT bajo una sola suscripción, junto con Claude, Gemini, Grok, Perplexity, Kimi, GLM y Qwen. Empieza en $9.99 al mes, la mitad de lo que cuesta solo ChatGPT Plus, con un nivel gratuito para probar antes y una valoración de 4,7 estrellas en más de 27.000 reseñas. Cambias de modelo dentro de una misma conversación, que es exactamente lo que pide el veredicto de «usa ambos» de arriba, sin un segundo inicio de sesión ni una segunda ventana.
El veredicto final
DeepSeek V4 cerró la diferencia de capacidad hasta el punto de que, en la mayoría de los benchmarks aislados, los dos están a un par de puntos porcentuales, y V4-Flash-0731 redujo la brecha agéntica que era la ventaja más clara que le quedaba a ChatGPT. ChatGPT sigue ganando en acabado, ecosistema y residencia de datos en Occidente. DeepSeek gana sin discusión en apertura (pesos con licencia MIT completa frente a ninguno). En precio ahora solo gana en la franja media de OpenAI: 16x más barato que GPT-6 Sol y 80x más barato que Astra en horas valle, pero más caro que GPT-6 Luna a cualquier hora de la semana. La ventaja de ventana de contexto ha desaparecido: los modelos GPT-6 llevan una ventana de 1M de tokens, igualando a la de DeepSeek.
Para un chatbot de consumo cotidiano en EE. UU. o la UE, ChatGPT Plus a $20/mes es la opción por defecto acertada. Para una carga de trabajo de API de gran volumen donde el coste importa más que el acabado, calcula primero GPT-6 Luna: a $0.10 / $0.50 es más barato que DeepSeek V4.1 Flash a cualquier hora, y en el Intelligence Index v4.3.2 obtiene 37,3 frente al 36,0 de V4 Pro. DeepSeek V4.1 Flash es la elección cuando quieres pesos abiertos o la puntuación más alta, 39,5. Lo que ya no tiene sentido es recurrir a DeepSeek V4 Pro para el máximo razonamiento: a $0.66 / $1.98 por millón de tokens en horas valle cuesta más de cuatro veces lo que V4.1 Flash y puntúa por debajo, 36,0 frente a 39,5.
Se acabó la era en la que ChatGPT no tenía competencia real. También se acabó la era en la que «la opción barata» significaba un modelo peor.
Preguntas frecuentes
¿Es DeepSeek mejor que ChatGPT?
En los benchmarks, DeepSeek V4 Pro es competitivo con GPT-5.5 y va ligeramente por delante en algunas pruebas de programación y matemáticas. Como producto, ChatGPT es mejor: más funciones, más acabado, apps nativas de escritorio y un ecosistema más profundo. La respuesta correcta depende de si valoras más la capacidad por dólar o la capacidad por minuto de fricción.
¿Es gratis usar DeepSeek?
Sí. El chat web de DeepSeek en chat.deepseek.com es completamente gratuito, sin niveles ni límites de uso. La API es de pago, facturada por token contra un saldo que recargas. ChatGPT también tiene un nivel gratuito, pero limita el acceso al modelo insignia; GPT-5.6 Sol en el chat requiere el plan Plus de $20/mes o superior, y GPT-6 Pro, impulsado por Astra, requiere Pro, Business o Enterprise.
¿Es seguro usar DeepSeek en EE. UU. y la UE?
DeepSeek envía los datos de los usuarios a través de servidores en China y está sujeto a las leyes de inteligencia chinas. El Garante italiano ordenó bloquear la app el 30 de enero de 2025, y varios otros reguladores han abierto investigaciones. Para un uso personal no sensible, es válido para mucha gente. Para datos de trabajo, sectores regulados o cualquier cosa que no quieras que un gobierno extranjero pueda ver, el perfil de riesgo de ChatGPT es notablemente menor.
¿Es DeepSeek mejor que ChatGPT para programar?
Están muy igualados. DeepSeek V4 Pro ronda el 91% en SWE-Bench Verified y el 96% en HumanEval; GPT-5.5 iba por delante en programación agéntica en el propio informe de abril de DeepSeek, con Terminal-Bench 2.0 en 82,7% frente al 67,9% de V4 Pro. V4-Flash-0731 cerró la mayor parte de esa diferencia en julio, con un 82,7 en Terminal Bench 2.1 en el arnés de DeepSeek y un 78,7 en la ejecución independiente de Artificial Analysis. Para generación de código de una sola pasada, DeepSeek V4.1 Flash es el que más puntúa entre las opciones baratas, 39,5 en el Intelligence Index v4.3.2, pero GPT-6 Luna, a $0.10 / $0.50, es más barato tanto en entrada como en salida.
¿Puede DeepSeek sustituir a ChatGPT?
Para algunos flujos de trabajo, sí. Para otros, no. DeepSeek puede sustituir a ChatGPT para chat de solo texto, trabajo técnico, matemáticas y cargas de trabajo de API de gran volumen. No puede sustituir a ChatGPT para generación de imágenes, modo de voz, integración con app nativa de Mac ni nada que requiera el ecosistema más amplio de ChatGPT. La mayoría de los usuarios a los que les importa el coste terminan usando ambos.