Qwen 3.8 ya no es una vista previa con una promesa de marketing. Alibaba puso Qwen3.8-Max a disposición general el 3 de agosto de 2026, y esta vez el modelo llegó con los datos que le faltaban en julio: 95 000 millones de parámetros activos por token de un total de 2,4 billones, una ventana de contexto confirmada de 1 millón de tokens y precios de API de $2 por millón de tokens de entrada y $6 por millón de tokens de salida.
Esto importa porque la afirmación con la que Alibaba se presentó, que Qwen 3.8 es «el segundo solo tras Fable 5», por fin se puede comprobar. Resulta ser cierta en un marcador y errónea en otro, y la diferencia entre ambas respuestas dice más del modelo que el titular. Este artículo cubre las especificaciones confirmadas, los precios reales, la situación real de los pesos abiertos y cómo resiste la afirmación de Fable 5 ante los rankings independientes.
Lo más importante
- Qwen3.8-Max quedó disponible de forma general el 3 de agosto de 2026, unas dos semanas después de su vista previa del 19 de julio.
- Cuenta con 2,4 billones de parámetros en total pero solo activa 95 000 millones por token, por lo que su coste de cómputo real se acerca más a un modelo de tamaño medio que lo que sugiere la cifra total.
- El precio de la API es de $2 de entrada y $6 de salida por millón de tokens, con lecturas en caché a $0,25.
- La afirmación de ser «el segundo solo tras Fable 5» es correcta en el tablero de visión de Arena (n.º 2) y errónea en el tablero de texto (n.º 5).
- Los pesos abiertos están prometidos para la semana del 10 de agosto de 2026, junto con un punto de control más pequeño, Qwen3.8-27B, pero aún no se ha publicado nada.
¿Qué es Qwen 3.8?
Qwen 3.8 es el modelo insignia actual de la familia Qwen de Alibaba Cloud y se distribuye como Qwen3.8-Max. Es un modelo de mezcla dispersa de expertos (MoE) con 2,4 billones de parámetros en total, de los cuales aproximadamente 95 000 millones se activan para cualquier token dado. Esta segunda cifra era la mayor laguna de la vista previa de julio, y reencuadra el modelo por completo: la carga de cómputo por solicitud se acerca más a un sistema denso de tamaño medio que a lo que cabría esperar de un modelo de 2,4 billones de parámetros.
El otro titular es lo que Qwen 3.8 puede procesar. Acepta texto, imágenes y vídeo como entrada y devuelve texto, lo que lo convierte en el primer modelo Qwen por encima del billón de parámetros en ser multimodal. La ventana de contexto se confirma ahora en 1 millón de tokens, con un techo práctico de 991 000 tokens de entrada (983 000 con el razonamiento activado) y 131 000 tokens de salida.
| Atributo | Detalle |
|---|---|
| Nombre del modelo | Qwen3.8-Max |
| Fabricante | Alibaba Cloud, equipo Qwen |
| Parámetros totales | 2,4 billones |
| Parámetros activos | 95 000 millones por token |
| Arquitectura | Mezcla dispersa de expertos |
| Modalidades de entrada | Texto, imágenes, vídeo |
| Salida | Texto |
| Ventana de contexto | 1M tokens (991K máx. entrada, 131K máx. salida) |
| Precio de API | $2 entrada / $6 salida por 1M tokens |
| Fecha de vista previa | 19 de julio de 2026 |
| Disponibilidad general | 3 de agosto de 2026 |
| Pesos abiertos | Prometidos para la semana del 10 de agosto de 2026 |
Compara esta tabla con la que Alibaba publicó en julio y la diferencia es notable. Cada fila que decía «no divulgado» tiene ahora un número detrás, que es la razón principal por la que vale la pena revisar el modelo. Los detalles del lanzamiento se recogieron en la cobertura del lanzamiento de MarkTechPost.
Precio de Qwen 3.8 y cómo acceder
La respuesta de la época de vista previa a «¿cuánto cuesta?» era un encogimiento de hombros y un descuento. Eso se acabó. Qwen3.8-Max tiene ahora una tarifa publicada por token y, con ella, es más barato que la mayoría de los modelos de frontera occidentales por un amplio margen, aunque algo por encima de su propio predecesor.
| Tipo de token | Precio por 1M tokens |
|---|---|
| Entrada (fallo de caché) | $2,00 |
| Salida | $6,00 |
| Entrada en caché (lectura implícita) | $0,25 |
| Entrada en caché (escritura explícita) | $2,50 |
| Entrada en caché (lectura explícita) | $0,17 |
Los niveles de caché merecen leerse con atención si planeas cargas de trabajo de contexto largo. A $0,25 por millón en lecturas en caché implícitas, reenviar un documento extenso en muchos turnos cuesta una fracción del primer pase, que es precisamente la razón de combinar una ventana de 1 millón de tokens con precios de caché agresivos.
Dónde puedes usar Qwen3.8-Max
El acceso cambió de forma en el lanzamiento. El modelo está disponible para desarrolladores globales a través de las APIs de Model Studio de Alibaba Cloud y, para el resto, a través de QwenWork, la plataforma de agentes de IA para el trabajo de Alibaba, que entró en beta pública el 2 de agosto de 2026.
Si probaste la vista previa de julio a través de QoderWork, ten en cuenta que ya no existe como producto independiente. Alibaba integró QoderWork, MuleRun y Wukong en la plataforma unificada QwenWork, que es donde ahora viven esos flujos de trabajo. El informe de lanzamiento de SCMP cubre el despliegue en ambas superficies.
Una advertencia para usuarios empresariales. QwenWork enruta los datos de flujo de trabajo empresarial a través de un proveedor chino, lo que conlleva las habituales preguntas sobre legislación estatal y residencia de datos. Es una conversación de adquisición, no técnica, pero vale la pena tenerla antes de conectarlo a nada sensible. Si estás evaluando modelos de frontera entre sí, nuestra guía sobre qué modelo de IA usar para cada tarea detalla las diferencias.
¿Es Qwen 3.8 realmente «el segundo solo tras Fable 5»?
Esta es la respuesta que el artículo de julio no podía darte. Qwen3.8-Max está ahora clasificado en Arena, el marcador de preferencia humana ciega, y la afirmación se divide claramente en dos. En el tablero de visión es correcta. En el tablero de texto no lo es.
En visión, la afirmación se sostiene
Qwen3.8-Max ocupa el n.º 2 en el marcador de visión de Arena con una puntuación de 1305, por detrás solo de claude-fable-5 con 1318. Es exactamente el ranking que describió Alibaba, y convierte a Qwen 3.8 en el modelo no Anthropic mejor clasificado para trabajo multimodal. Para un primer modelo multimodal insignia, es un debut genuinamente sólido.
En texto, queda en quinto lugar
El tablero de texto cuenta una historia diferente. Qwen3.8-Max ocupa el n.º 5 con 1496, por detrás de cuatro modelos Anthropic en lugar de uno.
| Posición | Modelo | Puntuación de texto en Arena |
|---|---|---|
| 1 | claude-fable-5 | 1509 |
| 2 | claude-opus-4-6-thinking | 1505 |
| 3 | claude-opus-4-7-thinking | 1502 |
| 4 | claude-opus-4-6 | 1497 |
| 5 | qwen3.8-max | 1496 |
Lee esa tabla con atención antes de descartar el resultado. Qwen 3.8 está un punto por detrás de claude-opus-4-6 y trece por detrás del líder, una diferencia lo suficientemente pequeña como para que el orden pueda cambiar. También es el modelo chino mejor clasificado en el tablero de texto, un hito real aunque no sea el que anunció Alibaba.
Dos advertencias honestas. Ambas puntuaciones de Arena están marcadas como preliminares, con márgenes de error más amplios que las entradas consolidadas, por lo que cambiarán a medida que se acumulen votos. Además, Arena mide la preferencia humana ciega, no la exactitud, así que premia a los modelos que producen respuestas que la gente disfruta leer. Trátalo como una señal sólida, no como un veredicto.
Resultados de benchmarks de Qwen 3.8
Alibaba publicó una tabla completa de benchmarks en la disponibilidad general, que es el mayor cambio respecto a la vista previa de julio. El patrón en los números es más interesante que cualquier puntuación individual: Qwen 3.8 destaca en investigación y trabajo con documentos y es apenas competitivo en ingeniería de software.
| Benchmark | Qué mide | Qwen3.8-Max |
|---|---|---|
| PaperBench | Reproducción de investigación en ML | 93,0 |
| GPQA Diamond | Razonamiento a nivel de posgrado | 92,6 |
| OmniDocBench 1.5 | Comprensión de documentos | 92,1 |
| RealWorldQA | Razonamiento visual | 88,0 |
| Terminal-Bench 2.1 | Tareas de agente en línea de comandos | 86,6 |
| OSWorld-Verified | Tareas de agente de uso del ordenador | 86,1 |
| SWE-bench Pro | Correcciones de código del mundo real | 67,7 |
| DeepSWE 1.1 | Ingeniería de software agéntica | 56,6 |
El punto débil está en la parte inferior de esa tabla. En DeepSWE 1.1, Qwen 3.8 obtiene 56,6 frente al 70,0 de Fable 5, una diferencia de más de trece puntos en ingeniería de software agéntica. Si tu caso de uso es programación autónoma, esa sola fila importa más que las cinco puntuaciones por encima de 85.
Alibaba también se apoyó en dos demostraciones de largo recorrido en lugar de solo benchmarks. En una, el modelo pasó más de diez días construyendo de forma autónoma un sistema de software autoevaluable, ejecutando sus propias pruebas e iterando sin intervención humana. En otra reprodujo un artículo de aprendizaje automático desde cero, ejecutando 33 rondas de entrenamiento en GPU a lo largo de aproximadamente 125 horas y escribiendo unas 7 600 líneas de código. Son demos realizadas por el propio proveedor, no evaluaciones independientes, así que pondera su peso con eso en mente.
Un número que hay que mantener aparte. Qwen3.8-Max aún no ha sido puntuado en el Artificial Analysis Intelligence Index, así que cualquiera que cite un número del índice está especulando.
La situación real de los pesos abiertos
Esta es la parte que más importa a los desarrolladores y la única afirmación que aún no ha pasado de promesa a realidad. Alibaba dice que los pesos se publican la semana del 10 de agosto de 2026, junto con un segundo punto de control mucho más pequeño, Qwen3.8-27B, pensado para quienes no pueden ejecutar un modelo de 2,4 billones de parámetros.
A 6 de agosto de 2026, no ha aparecido nada. La organización Qwen en Hugging Face no ha publicado ningún repositorio Qwen3.8, y su subida más reciente de cualquier tipo data del 26 de junio. Trata la ventana de lanzamiento como un plan, no como una fecha de entrega, porque los anteriores modelos insignia «Max» de Alibaba permanecieron como propietarios y disponibles solo por API.
Una advertencia práctica mientras esperas. Un repositorio de terceros llamado Qwen3.8_4B_Distilled ya acumula miles de descargas en Hugging Face, pero sus propios metadatos lo identifican como un ajuste fino de Qwen3-4B-Thinking, un modelo anterior y mucho más pequeño. No es una versión oficial de Qwen 3.8 ni una destilación de uno. Espera a que los pesos aparezcan bajo la organización oficial Qwen.
Si los pesos se publican en términos permisivos, este será el primer modelo de clase Max de Qwen que alguien podrá autoalojar, lo que supondría un cambio real en el campo de los pesos abiertos. El texto de la licencia decidirá si eso importa comercialmente, y Alibaba aún no la ha publicado. Mientras tanto, nuestra guía de los mejores modelos de IA open source cubre lo que puedes descargar hoy.
Qwen 3.8 frente a la competencia
Qwen 3.8 llegó en medio de una carrera de los laboratorios chinos hacia la categoría de multi-billones de parámetros. Ahora que tiene precios reales y puntuaciones reales, las comparaciones son por fin concretas en lugar de especulativas.
| Modelo | Parámetros totales | Precio (entrada/salida por 1M) | ¿Pesos abiertos? |
|---|---|---|---|
| Qwen3.8-Max | 2,4 billones | $2 / $6 | Prometidos en agosto de 2026 |
| Kimi K3 | 2,8 billones | $3 / $15 | Sí, publicados |
| Qwen3.7-Max | No divulgado | $1,25 / $3,75 promo ($2,50 / $7,50 tarifa oficial) | No (solo API) |
| Claude Fable 5 | No divulgado | No comparable | No (cerrado) |
Qwen 3.8 vs Kimi K3
Moonshot AI lanzó Kimi K3, un modelo de pesos abiertos con 2,8 billones de parámetros, el 16 de julio de 2026, tres días antes de la vista previa de Qwen 3.8. K3 es más grande sobre el papel y realmente publicó sus pesos, la ventaja que Qwen 3.8 solo está prometiendo.
El precio los separa ahora con claridad. Qwen 3.8 cuesta $2 / $6 frente a los $3 / $15 de Kimi K3, lo que hace que Qwen sea aproximadamente dos veces y media más barato en la salida. Qwen 3.8 también admite entrada de vídeo, mientras que K3 se limita a texto e imágenes. Para el análisis más detallado del modelo de Moonshot, consulta nuestra cobertura del lanzamiento de pesos abiertos de Kimi K3.
Qwen 3.8 vs Qwen 3.7-Max
El salto generacional es ahora medible. Qwen3.7-Max obtuvo 56,6 en el Artificial Analysis Intelligence Index en mayo de 2026, un quinto puesto en aquel momento, y era solo de texto. Qwen 3.8 añade entrada de imagen y vídeo, una ventana confirmada de 1 millón de tokens y una clasificación entre los cinco primeros en Arena.
Si la actualización te cuesta más depende enteramente de con qué precio de Qwen3.7-Max compares. Qwen 3.8 cuesta $2 / $6. Qwen3.7-Max está con un descuento promocional del 50 % que lo sitúa en $1,25 / $3,75 frente a un precio de lista de $2,50 / $7,50. Comparado con esa promo, la salida de Qwen 3.8 es aproximadamente un 60 % más cara; comparado con la tarifa oficial, es aproximadamente un 20 % más barata. Alibaba no ha publicado ninguna fecha de fin del descuento, así que para cargas de trabajo solo de texto donde el modelo anterior ya rinde bien, comprueba cuál de esos dos números te van a cobrar realmente antes de migrar.
Qwen 3.8 vs Claude Fable 5
Esta es la comparación que invitó Alibaba, y el veredicto dividido de arriba es la respuesta honesta. En trabajo multimodal, Qwen 3.8 es genuinamente lo más parecido a Fable 5 de Anthropic que alguien ha publicado. En texto queda quinto y, en programación agéntica, la diferencia en DeepSWE es amplia.
El precio es donde Qwen 3.8 hace su argumento más sólido. Ofrece resultados cercanos a la frontera a una tarifa muy por debajo de lo que cobran los modelos occidentales cerrados de élite, lo que para cargas de trabajo de alto volumen puede importar más que los últimos puntos del marcador.
Qué significa un modelo de mezcla dispersa de expertos
La cifra de 2,4 billones suena enorme, y lo es, pero ninguna solicitud usa todo eso. Un diseño de mezcla dispersa de expertos divide el modelo en muchas redes de expertos más pequeñas y una capa de enrutamiento envía cada token solo a las más relevantes. El resto del modelo permanece inactivo para ese token.
Con el recuento activo ya público, el panorama es concreto. Qwen 3.8 activa aproximadamente 95 000 millones de sus 2,4 billones de parámetros por token, alrededor del 4 % del modelo. Por eso Alibaba puede fijar el precio de un sistema de múltiples billones de parámetros en $2 por millón de tokens de entrada: pagas por el cómputo que realmente se ejecuta, no por los parámetros que están almacenados en disco.
Esto también explica el problema de los pesos abiertos. Una tasa de activación del 4 % mantiene la inferencia asequible en la infraestructura de Alibaba, pero descargar el modelo implica almacenar los 2,4 billones de parámetros. El autoalojamiento de Qwen3.8-Max necesitará hardware a escala de centro de datos, que es exactamente por qué el punto de control más pequeño Qwen3.8-27B importa para la mayoría de los equipos.
¿Qué hay de Qwen 4?
Qwen 3.8 puede que no ocupe la cima del mapa de ruta de Alibaba por mucho tiempo. Rumores de hoja de ruta filtrada, recogidos por medios como Geeky Gadgets, apuntan a Qwen 4.0 llegando en torno a septiembre de 2026. Trata ese calendario como un rumor, porque Alibaba no ha confirmado oficialmente ninguna fecha para Qwen 4 ni siquiera su existencia.
La afirmación más repetida es que Qwen 4 se adentrará en la programación y el diseño 3D, con usos en videojuegos, arquitectura y realidad virtual. Dos modelos de prueba en sigilo, reportadamente con los nombres en clave «Caleb» y «Terrania Alpha», han circulado como primeros experimentos de Qwen 4. Todo esto se remonta a una única cadena de filtraciones sin benchmarks ni fuente oficial, así que archívalo bajo «interesante si es cierto» y espera a que Alibaba hable.
¿Deberías usar Qwen 3.8?
Para los desarrolladores, el cálculo cambió con la disponibilidad general. Un modelo que se clasifica segundo en visión y quinto en texto a $2 / $6 es un argumento de coste serio para el procesamiento de documentos, el razonamiento visual y el trabajo de contexto largo. La ventana de 1 millón de tokens combinada con lecturas en caché a $0,25 hace que las pasadas repetidas sobre corpus extensos sean inusualmente baratas.
Dos razones para esperar. Si tu carga de trabajo es programación agéntica, la diferencia en DeepSWE 1.1 frente a Fable 5 es real y deberías hacer benchmarks antes de cambiar. Si eres una empresa, las preguntas sobre residencia de datos al enrutar el trabajo a través de un proveedor chino necesitan respuesta primero. La familia Qwen vale la pena seguirla de todos modos, incluyendo su papel impulsando Apple Intelligence en China.
Si prefieres comparar los principales modelos sin gestionar logins separados y claves de API, una aplicación como Fello AI enruta tus prompts a los mejores modelos actuales desde un solo lugar. Para el panorama más amplio, nuestro resumen de los mejores modelos de IA mantiene los rankings actualizados.
La conclusión
Qwen 3.8 se lanzó y cumplió en buena medida. La escala de 2,4 billones de parámetros es real, la cifra de 95 000 millones activos explica el precio agresivo y una clasificación n.º 2 en visión por detrás solo de Fable 5 es un resultado legítimo, no un comunicado de prensa. A $2 / $6 es el argumento precio-capacidad más sólido en la categoría de frontera ahora mismo.
Solo mantén la afirmación y la evidencia separadas. «El segundo solo tras Fable 5» es cierto en visión y erróneo en texto, donde Qwen 3.8 queda quinto. Los pesos abiertos siguen siendo una promesa con fecha, no un enlace de descarga. Comprueba los términos de la licencia cuando aparezcan, porque esos decidirán si este modelo cambia algo para el autoalojamiento.
Preguntas frecuentes
¿Cuál es la fecha de lanzamiento de Qwen 3.8?
Qwen3.8-Max se presentó en vista previa el 19 de julio de 2026 en la Conferencia Mundial de Inteligencia Artificial de Shanghái y quedó disponible de forma general el 3 de agosto de 2026 a través de las APIs de Model Studio de Alibaba Cloud y la plataforma QwenWork.
¿Cuánto cuesta Qwen 3.8?
Qwen3.8-Max cuesta $2 por millón de tokens de entrada y $6 por millón de tokens de salida. Las lecturas de entrada en caché bajan a $0,25 por millón de forma implícita, o a $0,17 con caché explícita, lo que abarata considerablemente el trabajo de contexto largo en pasadas repetidas.
¿Es Qwen 3.8 open source?
Todavía no. Alibaba dice que los pesos abiertos se publican la semana del 10 de agosto de 2026, junto con un punto de control más pequeño, Qwen3.8-27B, pero a 6 de agosto nada ha aparecido en la organización oficial Qwen de Hugging Face y no se ha publicado ninguna licencia. Pesos abiertos tampoco significa open source en el sentido estricto.
¿Es Qwen 3.8 realmente el segundo solo tras Fable 5?
Depende del marcador. En el tablero de visión de Arena, Qwen3.8-Max ocupa el n.º 2 con 1305, por detrás solo de claude-fable-5 con 1318, así que la afirmación se sostiene. En el tablero de texto ocupa el n.º 5 con 1496, por detrás de Fable 5 y tres variantes de Claude Opus, así que la afirmación no se sostiene ahí.
¿Cuántos parámetros usa realmente Qwen 3.8?
Qwen3.8-Max tiene 2,4 billones de parámetros en total pero activa solo unos 95 000 millones por token, aproximadamente el 4 % del modelo. Ese diseño de mezcla dispersa de expertos es por qué un modelo de múltiples billones de parámetros puede tener un precio de $2 por millón de tokens de entrada.
¿Cómo se compara Qwen 3.8 con Kimi K3?
Kimi K3 tiene 2,8 billones de parámetros y publicó sus pesos abiertos el 16 de julio de 2026, mientras que Qwen 3.8 tiene 2,4 billones y sus pesos siguen pendientes. Qwen 3.8 es más barato a $2/$6 frente a los $3/$15 de K3, y admite entrada de vídeo donde K3 solo gestiona texto e imágenes.
