Los precios de Qwen se dividen en dos caminos muy distintos, y la mayoría de las personas solo necesita el gratuito. La app Qwen Chat es completamente gratuita sin suscripción, mientras que los desarrolladores pagan por token a través de la API, con tarifas que van desde $0.05 por millón de tokens de entrada en el modelo más económico hasta $6.00 por millón de tokens de salida en el modelo estrella Qwen3.8-Max. Esa diferencia de 120x entre la tarifa más barata y la del modelo estrella es lo más importante que debes entender antes de elegir un modelo.

Esta guía desglosa todas las partes de los precios de Qwen para 2026, incluida la app Qwen Chat gratuita, las tarifas de API de pago por uso para cada modelo, los niveles por tamaño de entrada que elevan silenciosamente algunos precios, la prueba de tokens gratuita para nuevos desarrolladores y cómo Qwen se compara con DeepSeek y Claude en coste. También cubrimos el cambio que tomó por sorpresa a muchos desarrolladores: el fin del nivel gratuito de API el 15 de abril de 2026, y dónde Qwen sigue ofreciendo el mejor valor.

Puntos clave

  • Qwen Chat es gratuito, sin suscripción de consumidor como ChatGPT Plus o Claude Pro.
  • Los precios de la API van desde $0.05 / $0.40 por millón de tokens (Qwen-Flash) hasta $2.00 / $6.00 en el modelo estrella Qwen3.8-Max, disponible de forma general desde el 3 de agosto de 2026. El anterior modelo estrella Qwen3.7-Max sigue siendo más barato, a $1.25 / $3.75 con una promo del 50% (precio de lista $2.50 / $7.50).
  • El nivel medio Qwen-Plus empieza en $0.40 / $1.20 por millón de tokens, el mejor equilibrio entre precio y capacidad para la mayoría de las aplicaciones.
  • Varios modelos de Qwen están escalonados por tamaño de entrada, por lo que la cifra de titular es un precio «desde» que sube con prompts largos (Qwen3-Max va de $1.20 a $3.00 de entrada en su contexto de 262K). Qwen3.8-Max es la excepción, con una tarifa plana en toda su ventana de 1M.
  • El nivel gratuito de API para desarrolladores terminó el 15 de abril de 2026, sustituido por una prueba única de 1 millón de tokens por modelo (unos 70 millones en total) para nuevas cuentas.

Precios de Qwen de un vistazo

Del editor

Todos los modelos de IA en una sola app

Fello AI reúne GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 y más en una sola app nativa para Mac y iPhone.

¡Descárgala ahora!

Qwen es la familia de modelos de IA de Alibaba, y puedes usarla de dos formas. La app Qwen Chat para consumidores en chat.qwen.ai es gratuita, y la API para desarrolladores se factura por token a través de Alibaba Cloud Model Studio (la plataforma conocida anteriormente como DashScope). No hay un plan mensual plano de consumidor entre ambas opciones, lo que hace a Qwen inusual frente a sus rivales occidentales. Los modelos base open source de Qwen también sirven de base a fine-tunes de terceros, incluido Rio 3.5 Open 397B del gobierno de la ciudad de Río de Janeiro.

Esto es lo que cuestan los principales modelos de texto en la API, con precio por millón de tokens. La entrada es lo que pagas por el texto que envías, y la salida es lo que pagas por el texto que el modelo genera.

ModeloEntrada ($/1M)Salida ($/1M)Ventana de contextoIdeal para
Qwen-Flashdesde $0.05desde $0.401M tokensTareas simples de alto volumen
Qwen-Plusdesde $0.40desde $1.201M tokensEl modelo de uso diario
Qwen3.7-Plusdesde $0.32desde $1.281M tokensAplicaciones multimodales
Qwen3-Maxdesde $1.20desde $6.00262K tokensRazonamiento avanzado, programación
Qwen3.7-Max$1.25$3.751M tokensAnterior modelo estrella, más barato con promo
Qwen3.8-Max$2.00$6.001M tokensModelo estrella, tarifa plana a cualquier longitud

Qwen3.8-Max ocupó el puesto de modelo estrella el 3 de agosto de 2026 a un precio plano de $2.00 / $6.00. Su predecesor Qwen3.7-Max permanece en la tarifa a $1.25 / $3.75, un descuento promocional del 50% sobre un precio de lista de $2.50 / $7.50. Lee esas dos filas juntas, porque el modelo más antiguo es el más barato mientras dure la promo y el más caro cuando termine. Alibaba no ha publicado una fecha de fin para ese descuento, así que presupuesta alrededor de los precios de lista para cualquier cosa a largo plazo.

Un detalle importante al leer estas cifras: Model Studio escala varias tarifas según el tamaño de entrada de cada solicitud, por lo que los precios «desde» anteriores son las tarifas del nivel de entrada y tu coste sube con prompts más largos. Confirma siempre la tarifa vigente para tu modelo y región en la documentación de precios de Alibaba Cloud Model Studio antes de elaborar un presupuesto.

¿Es Qwen gratuito?

Sí. La app Qwen Chat en chat.qwen.ai es gratuita sin suscripción, de forma similar al nivel gratuito de ChatGPT o Gemini. Tienes acceso a los potentes modelos de Qwen para chat diario, escritura, ayuda con programación y tareas de imagen sin pagar nada, y Alibaba tiene claras razones comerciales para mantener la app de consumidor gratuita.

El precio de pago solo entra en juego cuando construyes sobre la API de Qwen a través de Alibaba Cloud Model Studio, que cobra por token. Así que si solo quieres hablar con Qwen, no pagas nada. Si quieres integrar Qwen en tu propio producto, pagas por uso.

Precios de la API de Qwen por modelo

A continuación desglosamos los precios de la API para cada uno de los modelos de Qwen, para que puedas elegir el nivel adecuado según tu carga de trabajo y presupuesto.

Qwen-Flash y Qwen-Turbo: desde $0.05 / $0.40

Qwen-Flash es el nivel económico, a desde $0.05 de entrada / $0.40 de salida por millón de tokens para prompts de hasta 256K, subiendo a $0.25 / $2.00 en entradas más largas. Está diseñado para velocidad y alto volumen, por lo que es adecuado para clasificación, preguntas y respuestas simples, etiquetado y cualquier tarea en la que envíes muchas solicitudes sin necesitar razonamiento de nivel estrella. Qwen-Flash reemplaza ahora al antiguo Qwen-Turbo, que Alibaba ha marcado como sin actualizaciones futuras, por lo que los nuevos proyectos deberían usar Flash por defecto. A estas tarifas puedes procesar millones de tokens por unos pocos dólares.

Qwen-Plus: desde $0.40 / $1.20

Qwen-Plus ocupa el nivel intermedio a desde $0.40 de entrada / $1.20 de salida por millón de tokens y es el modelo con el que debería empezar la mayoría de las aplicaciones. Está escalonado por longitud de prompt, por lo que la tarifa sube hacia $1.20 de entrada / $3.60 de salida cuando una sola solicitud supera los 256K tokens, y el modo de razonamiento eleva aún más la salida. Gestiona la mayor parte del trabajo real: resumen, redacción, asistencia con código y tareas de recuperación, a un precio que se mantiene razonable a escala.

Qwen3.7-Plus: desde $0.32 / $1.28

Qwen3.7-Plus es el nivel medio multimodal de Qwen, que acepta texto, imagen y vídeo como entrada. Funciona desde $0.32 de entrada / $1.28 de salida por millón de tokens, un descuento del 20% sobre el precio de lista de $0.40 / $1.60, y al igual que Qwen-Plus sube escalonadamente en contextos largos. Si estás construyendo aplicaciones que combinan imágenes o vídeo con texto y quieres mantenerte en un precio bajo, este es el nivel que probar antes de saltar a un modelo Max.

Qwen3-Max: desde $1.20 / $6.00

Qwen3-Max es el modelo de razonamiento intensivo, con precio desde $1.20 de entrada / $6.00 de salida por millón de tokens en prompts de hasta 32K. El coste sube por tramos: $2.40 / $12 de 32K a 128K y $3.00 / $15 hasta su límite, por lo que los trabajos de contexto largo cuestan notablemente más de lo que sugiere la tarifa de titular. Ten en cuenta que Qwen3-Max tiene un límite de 262K tokens de contexto, no el millón completo que alcanzan los modelos Qwen más pequeños.

Qwen3.8-Max: $2.00 / $6.00 (modelo estrella)

Qwen3.8-Max quedó disponible de forma general el 3 de agosto de 2026 y ocupa la cima de la gama: un modelo Mixture-of-Experts de 2,4 billones de parámetros que activa aproximadamente 95.000 millones de parámetros por token. Acepta texto, imagen y vídeo como entrada, genera hasta 128K tokens de salida y cuesta $2.00 de entrada / $6.00 de salida por millón de tokens. A diferencia de todos los demás modelos de esta página, esa tarifa es plana en toda la ventana de contexto de 1M tokens. Envía 5.000 o 900.000 tokens y el precio por token no cambia, lo que elimina el escalón por tamaño de entrada que hace difícil de prever las facturas de Qwen3-Max y Qwen-Plus.

El ahorro está en el caché. Las lecturas implícitas de entrada en caché cuestan $0.25 por millón, las lecturas explícitas en caché bajan a $0.17, y escribir en un caché explícito cuesta $2.50. A esas tarifas, una segunda pasada sobre un documento grande cuesta alrededor de un octavo de la primera, que es el punto de combinar una ventana de 1M tokens con precios de caché agresivos. Los trabajos en lote se facturan a la mitad de la tarifa. Para los benchmarks y la situación real de los pesos open source, consulta nuestro análisis completo de Qwen 3.8.

Las nuevas cuentas obtienen el modelo estrella gratis durante un tiempo. Model Studio ofrece una cuota gratuita de 1 millón de tokens válida durante 90 días en Qwen3.8-Max, la misma asignación por modelo que sustituyó al antiguo nivel gratuito permanente de Qwen, por lo que puedes compararlo con tu propia carga de trabajo antes de pagar nada. Una nota sobre las fuentes: las tablas de facturación internacional detalladas de Alibaba todavía encabezan Qwen3.7-Max como el modelo Max principal, así que si estás conciliando una factura, comprueba la tarifa de tu región y endpoint específicos en lugar de asumir $2 / $6 en todas partes.

Qwen3.7-Max: $1.25 / $3.75 (anterior modelo estrella)

Qwen3.7-Max ocupó el puesto de modelo estrella hasta agosto de 2026 y sigue siendo la opción de valor para razonamiento avanzado, matemáticas y trabajo de ingeniería de software mientras dure su descuento. Funciona a $1.25 de entrada / $3.75 de salida por millón de tokens con una promoción de lanzamiento del 50%, la mitad del precio de lista de $2.50 / $7.50, con una ventana de contexto completa de 1M tokens. El descuento es temporal, así que planifica con el precio de lista si presupuestas para meses adelante. Qwen3.7-Max obtuvo 56,6 en el Artificial Analysis Intelligence Index y 80,4 en SWE-Verified, colocándolo en el top 10 global en su lanzamiento. Para el análisis completo de benchmarks, consulta nuestra reseña de Qwen3.7-Max.

El cambio en el nivel gratuito que los desarrolladores deben conocer

Qwen solía ofrecer un nivel gratuito de API permanente, y eso terminó el 15 de abril de 2026. El nivel gratuito de OAuth para desarrolladores y el acceso gratuito a Qwen Code CLI se eliminaron en la misma fecha, por lo que los tutoriales antiguos que prometen «acceso gratuito a la API de Qwen» están ahora desactualizados.

Lo que lo sustituyó es una prueba de incorporación por única vez. Las nuevas cuentas de Alibaba Cloud Model Studio reciben 1 millón de tokens gratuitos por modelo en unos 70 modelos Qwen propietarios, unos 70 millones de tokens en total, válidos durante 90 días y solo en el endpoint de Singapur. Es generoso para prototipos, pero es una prueba, no un plan gratuito permanente, así que planifica tu presupuesto para cuando se agote.

Cómo reducir tu factura de Qwen

Dos funciones integradas reducen los costes reales muy por debajo de las tarifas de titular. La API de lotes asíncrona procesa trabajos no urgentes con un descuento de aproximadamente el 50% sobre las tarifas estándar, lo que es ideal para resúmenes masivos, etiquetado de datos o procesamiento nocturno donde no necesitas una respuesta inmediata.

El caché de prompts es la segunda palanca. Cuando reutilizas el mismo prompt largo o contexto del sistema en muchas solicitudes, las lecturas de entrada en caché cuestan solo una pequeña fracción de la tarifa normal de entrada, en algunos casos alrededor del 10%. Para chatbots y agentes que repiten un system prompt largo en cada llamada, esta es la diferencia entre una factura asumible y una cara.

Qwen vs DeepSeek, ChatGPT y Claude en coste

El atractivo de Qwen es la relación precio-rendimiento, y compite directamente con otros modelos de bajo coste. Frente a DeepSeek, otra familia china de open-weight conocida por sus precios agresivos, Qwen-Plus y Qwen-Flash se sitúan en el mismo rango presupuestario, por lo que la elección depende de qué modelo rinde mejor en tus tareas específicas. Otro modelo chino de open-weight que vale la pena seguir es Nex-N2-Pro, que se basa en la propia arquitectura de 397B de Qwen y apunta a la programación agéntica. Lo mismo ocurre con GLM 5.2, el modelo de open-weight con 1 millón de tokens que ahora lidera los benchmarks de programación open source; nuestra guía de precios de GLM muestra cómo se comparan sus tarifas con Qwen. Todos ellos están muy por debajo de los precios de los modelos estrella de EE.UU.

ModeloEntrada ($/1M)Salida ($/1M)ContextoIdeal para
Qwen-Plusdesde $0.40desde $1.201MModelo de uso diario económico
Qwen3.7-Max$1.25$3.751MAnterior modelo estrella, con promo
Qwen3.8-Max$2.00$6.001MModelo estrella actual de Qwen
DeepSeek V4$0.435$0.871MRival económico más cercano
Claude Opus 4.8$5.00$25.00200KReferencia del modelo estrella de EE.UU.

Comparado con ChatGPT y Claude, Qwen es dramáticamente más barato a nivel de API. Claude Opus 4.8 tiene un precio de lista de $5 / $25 por millón de tokens, por lo que incluso el modelo estrella de Qwen, Qwen3.8-Max, se sitúa en menos de un cuarto del coste de salida, y Qwen-Plus ofrece buenos resultados por céntimos. DeepSeek V4 es el más barato de todos a $0.435 / $0.87. Si el coste por token bruto es tu factor decisivo, Qwen y DeepSeek ganan; si necesitas lo mejor en los rankings de benchmarks o funciones específicas del ecosistema, el panorama es más ajustado. Puedes ver dónde se sitúan los laboratorios de EE.UU. en nuestro análisis de cómo se comparan Claude y GPT, y consultar las promos actuales en nuestra guía de pruebas gratuitas de IA, o compararlo con nuestra guía de precios de Mistral AI. Si quieres Qwen junto a otros modelos en un solo lugar, agregadores como OpenRouter también revenden Qwen con condiciones de pago por uso.

Una alternativa más sencilla a la facturación por token

La facturación por token de la API es poderosa, pero es excesiva si solo quieres usar los mejores modelos de IA en el día a día. Hacer un seguimiento de las tarifas de entrada y salida por modelo, ver cómo los niveles por tamaño de entrada elevan tu factura, que expire tu prueba gratuita y gestionar facturas separadas para cada proveedor añade una fricción que la mayoría de la gente no quiere.

Aquí es donde encaja Fello AI. Por una tarifa plana de $9.99 al mes, tienes acceso a muchos modelos líderes en una sola aplicación para Mac, incluidos Claude, ChatGPT, Gemini, Grok y DeepSeek, sin matemáticas de tokens ni malabares con múltiples suscripciones. En lugar de medir cada solicitud, eliges el mejor modelo para el trabajo y cambias libremente. El propio Qwen forma parte de ese catálogo como cliente de escritorio nativo de Qwen para Mac, sin necesidad de configurar una cuenta en Model Studio. Si quieres IA de alto nivel sin facturación por API, esa configuración de un precio y muchos modelos es mucho más sencilla; puedes comparar el catálogo en nuestro resumen de los mejores modelos de IA, y ver otras opciones económicas en nuestra guía de precios de MiniMax.

Conclusión

Para la mayoría de las personas, Qwen es esencialmente gratuito: la app Qwen Chat no cuesta nada y cubre el uso diario. Para los desarrolladores, Qwen es una de las APIs de mejor valor disponibles, desde $0.05 por millón de tokens en Qwen-Flash hasta un modelo estrella que sigue superando a los rivales de EE.UU. en precio. Solo recuerda que el nivel gratuito de API desapareció en abril de 2026, varias tarifas están escalonadas por longitud de prompt y el descuento de Qwen3.7-Max es temporal, así que elabora tu presupuesto alrededor de los precios de lista y apóyate en el procesamiento por lotes y el caché de prompts para mantener los costes bajos. Si prefieres saltarte la facturación por token por completo, una aplicación multimodelo de tarifa plana como Fello AI te da un valor equivalente a Qwen junto a Claude, ChatGPT y Gemini por un precio mensual único.

FAQ

¿Cuánto cuesta Qwen?

La app Qwen Chat es gratuita. En la API, los precios van desde $0.05 de entrada / $0.40 de salida por millón de tokens para Qwen-Flash hasta $2.00 / $6.00 para el modelo estrella Qwen3.8-Max, que cobra una tarifa plana en todo su contexto de 1M desde que quedó disponible de forma general el 3 de agosto de 2026. El anterior modelo estrella Qwen3.7-Max sigue en lista a $1.25 / $3.75 con una promo del 50% (precio de lista $2.50 / $7.50), y el popular nivel medio Qwen-Plus empieza a $0.40 / $1.20.

¿Es Qwen gratuito?

Sí, la app Qwen Chat para consumidores en chat.qwen.ai es gratuita sin suscripción. Solo pagas si usas la API de Qwen a través de Alibaba Cloud Model Studio, que factura por token.

¿Por qué subió mi factura de la API de Qwen con un prompt largo?

Varios modelos de Qwen están escalonados por tamaño de entrada, por lo que la tarifa por token sube a medida que crece tu prompt. Qwen3-Max, por ejemplo, va de $1.20 / $6.00 hasta $3.00 / $15.00 en su tramo de entrada más grande, y el modo de razonamiento también eleva el coste de salida. Los precios de titular son tarifas del nivel de entrada. Qwen3.8-Max es la excepción, con una tarifa plana de $2.00 / $6.00 a cualquier longitud de prompt.

¿Sigue existiendo un nivel gratuito de API de Qwen?

No como plan permanente. El nivel gratuito de API para desarrolladores terminó el 15 de abril de 2026. Las nuevas cuentas reciben en su lugar una prueba única de 1 millón de tokens por modelo, unos 70 millones en total, válida durante 90 días en el endpoint de Singapur.

¿Es Qwen más barato que ChatGPT?

A nivel de API, sí, significativamente. Qwen-Plus y Qwen-Flash cuestan una fracción de lo que cobran por token los modelos estrella premium de EE.UU., que es por qué Qwen y DeepSeek son opciones populares para proyectos donde el coste importa.