El precio de GLM es la razón principal por la que los desarrolladores siguen cambiando a los modelos de Zhipu AI. El GLM-5.2 de gama alta cuesta solo $1.40 por millón de tokens de entrada y $4.40 por millón de tokens de salida en la API oficial, aproximadamente un sexto de lo que cobra GPT-5.5, y el más antiguo GLM-4.7 es aún más barato. También puedes usar GLM de forma gratuita en el navegador, y dos de los modelos no cuestan nada a través de la API. El modelo más reciente, GLM 5.3, es la excepción a todo esto, porque Z.ai aún no ha publicado una tarifa por token para él.

Esta guía desglosa cada forma de pagar por GLM en 2026: el nivel gratuito, las tarifas por token de la API para cada modelo y la suscripción del GLM Coding Plan que comienza en $18 al mes. Terminamos con una comparativa de costes frente a Claude, ChatGPT, Gemini y DeepSeek, actualizada tras el recorte de la API de OpenAI del 30 de julio de 2026 que bajó GPT-5.6 Luna a $0.20 / $1.20 y ahora supera en precio a GLM-5.2, más una alternativa de tarifa plana si prefieres evitar las matemáticas por token. El precio es solo la mitad de la historia, así que consulta cómo se compara GLM con los principales modelos cerrados en calidad también. Si eres nuevo en la familia, empieza por qué es GLM.

Lo más importante

  • GLM es gratuito en chat.z.ai, y GLM-4.7 Flash y GLM-4.5 Flash son completamente gratuitos en la API también.
  • El precio de la API de GLM-5.2 es de $1.40 entrada / $4.40 salida por millón de tokens, aproximadamente un séptimo de GPT-5.6 Sol en salida y muy por debajo de Claude Opus 5, aunque GPT-5.6 Luna ahora es más barato que ambos.
  • GLM-4.7 es la opción económica de programación a $0.60 entrada / $2.20 salida por millón de tokens, con entrada en caché tan baja como $0.11.
  • El GLM Coding Plan es una suscripción de tarifa plana a $18 (Lite), $72 (Pro) y $160 (Max) al mes, o un 30 % menos con facturación anual.
  • GLM-5.3 no tiene precio por token publicado. Se lanzó el 14 de agosto de 2026 solo dentro del Coding Plan y ZCode, así que la tarjeta de precios de la API sigue con GLM-5.2 en la cima.
  • Dentro de Fello AI, GLM-5.2 está incluido junto a Claude, GPT y Gemini por una tarifa plana de $9.99 al mes, sin facturación por token.

Precio de GLM de un vistazo

Del editor

Todos los modelos de IA en una sola app

Fello AI reúne GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 y más en una sola app nativa para Mac y iPhone.

¡Descárgala ahora!

Aquí está todo el panorama de precios de GLM en una tabla. Las opciones gratuitas son genuinamente gratuitas, las tarifas de la API son de las más bajas de cualquier modelo de clase frontera, y el Coding Plan es una tarifa mensual fija para uso intensivo.

Por qué pagasCoste
Chat GLM (chat.z.ai)Gratis
API de GLM-4.7 Flash / GLM-4.5 FlashGratis
API de GLM-5.2$1.40 entrada / $4.40 salida por millón de tokens
API de GLM-5.3No publicado; solo Coding Plan y ZCode
API de GLM-4.7$0.60 entrada / $2.20 salida por millón de tokens
GLM Coding Plan$18 / $72 / $160 al mes

¿Es GLM gratuito?

Sí, de más formas que la mayoría de los rivales. Puedes chatear con GLM-5.2 de forma gratuita en chat.z.ai sin suscripción, de la misma forma que usarías una cuenta gratuita de ChatGPT. Dado que todos los modelos hasta GLM-5.2 son de pesos abiertos con licencia MIT, también puedes descargar los pesos desde Hugging Face y ejecutarlos tú mismo sin ningún coste de licencia. GLM-5.3 es la excepción, con sus pesos retenidos pendientes de una revisión de seguridad.

Lo sorprendente es que la API también tiene modelos gratuitos. GLM-4.7 Flash, GLM-4.5 Flash y el modelo de visión GLM-4.6V Flash están listados a $0 para entrada, entrada en caché y salida, así que puedes crear aplicaciones reales sobre ellos sin pagar por token. Eso hace de GLM uno de los modelos serios más baratos para prototipar, y es una gran parte de por qué aparece en listas de los mejores modelos de IA open source.

Precio de la API de GLM por modelo

En la API oficial de Z.ai, cada modelo se factura por millón de tokens, dividido en entrada, entrada en caché y salida. La entrada en caché se aplica cuando reutilizas el mismo contexto y reduce la tarifa de entrada a aproximadamente un quinto. Las tarifas completas por modelo están a continuación, tomadas de la documentación de precios de Z.ai.

ModeloEntrada / MEntrada en caché / MSalida / M
GLM-5.2$1.40$0.26$4.40
GLM-5-Turbo$1.20$0.24$4.00
GLM-4.7$0.60$0.11$2.20
GLM-4.7 FlashGratisGratisGratis
GLM-4.5 Air$0.20$0.03$1.10

GLM-5.2 (tarifa modelo estrella)

GLM-5.2 es el modelo al que más gente se refiere cuando habla del precio de GLM, y el GLM más caro con tarifa publicada. A $1.40 de entrada y $4.40 de salida por millón de tokens, cuesta aproximadamente un séptimo de GPT-5.6 Sol en salida y menos de un quinto de la tarifa de salida de $25.00 de Claude Opus 5, mientras publica puntuaciones competitivas en benchmarks independientes. La entrada en caché baja a $0.26, así que los contextos largos y repetidos salen aún más baratos. Los benchmarks completos están en nuestro análisis de GLM 5.2.

GLM-5.3 (sin precio publicado)

GLM-5.3 se lanzó el 14 de agosto de 2026 y no aparece en la tarjeta de precios. Z.ai está organizando su despliegue tras una revisión de seguridad, así que a la fecha de publicación el modelo solo es accesible a través del GLM Coding Plan y el agente ZCode de Z.ai, con acceso más amplio a la API prometido más adelante. Si estás calculando el gasto en la API, sigues trabajando desde la línea de GLM-5.2 anterior. Lo que obtienes con la suscripción, y los benchmarks detrás de ello, está en nuestro análisis de GLM 5.3.

GLM-5-Turbo

GLM-5-Turbo es el hermano optimizado para velocidad a $1.20 de entrada y $4.00 de salida por millón de tokens. Sacrifica un poco de calidad bruta por respuestas más rápidas y un coste ligeramente menor, lo que lo hace ideal para aplicaciones de alto volumen o sensibles a la latencia.

GLM-4.7 (la opción económica de programación)

GLM-4.7 es el campeón en valor a $0.60 de entrada y $2.20 de salida por millón de tokens, con entrada en caché tan baja como $0.11. Sigue obteniendo un 73,8 % en SWE-bench Verified, uno de los mejores resultados que cualquier modelo abierto ha publicado, así que obtienes programación seria a una fracción de los precios de frontera. También es el modelo predeterminado dentro del GLM Coding Plan.

GLM-4.7 Flash (gratis)

GLM-4.7 Flash es completamente gratuito en la API, tanto para entrada como para entrada en caché y salida. Es un modelo más pequeño y rápido orientado a la programación local y de alto volumen, y junto a GLM-4.5 Flash te permite publicar un producto que funcione sin pagar por token.

GLM-4.5 Air

GLM-4.5 Air es la opción heredada ligera a $0.20 de entrada y $1.10 de salida por millón de tokens, con entrada en caché a solo $0.03. Es el modelo de pago más barato de la línea y sigue gestionando bien el chat y el razonamiento cotidianos.

El GLM Coding Plan: Lite, Pro y Max

Si programas todo el día, la facturación por token resulta engorrosa, así que Zhipu vende en su lugar un GLM Coding Plan de tarifa plana. Es la suscripción que se hizo viral entre los desarrolladores que buscaban una alternativa más barata a Claude, porque incluye GLM-5.2, GLM-5-Turbo, GLM-4.7 y GLM-4.5-Air con amplias asignaciones de prompts. Cada nivel incluye ahora también GLM-5.3, que es la única forma de acceder a ese modelo hoy. Los tres niveles, de la página de suscripción de Z.ai, están abajo.

NivelMensualFacturación anual (-30 %)Asignación de uso
Lite$18$12.60~80 prompts / 5 h, ~400 / semana
Pro$72$50.40~400 prompts / 5 h, ~2.000 / semana
Max$160$112~1.600 prompts / 5 h, ~8.000 / semana

Los tres niveles dan acceso a la misma línea de modelos y funcionan dentro de herramientas de programación como Claude Code, Cline, Roo Code y más de 20 clientes adicionales. Los prompts en GLM-5.2 y GLM-5-Turbo consumen cuota a 3x durante las horas pico y 2x fuera de ellas, aunque hay una promo de 1x fuera de horas pico vigente hasta septiembre de 2026. La facturación anual reduce los precios aún más, a aproximadamente $151, $605 y $1.344 al año.

Cómo reducir tu factura de GLM

GLM ya es barato, pero tres hábitos reducen el coste aún más. Primero, apóyate en la entrada en caché. Reutilizar el mismo prompt de sistema o contexto de documento se factura a la tarifa en caché, que es aproximadamente un quinto del precio de entrada estándar. Segundo, asigna el modelo al trabajo, ya que GLM-4.7 o los modelos Flash gratuitos gestionan la mayoría de la programación y el chat sin tocar el modelo estrella.

Tercero, vigila el reloj. El Coding Plan cobra menos cuota fuera de las horas pico, y la API estándar sigue siendo mucho más barata que los niveles superiores de Estados Unidos a cualquier hora. Esa diferencia ya no se mantiene frente a todos los modelos de Estados Unidos; desde el recorte de OpenAI de julio de 2026, GPT-5.6 Luna a $0.20 / $1.20 es más barato por token que cualquier modelo GLM de pago excepto GLM-4.5 Air. Si tu carga de trabajo es irregular, un plan por token puede superar a una suscripción; si programas de forma constante todo el día, el Coding Plan de tarifa plana suele ganar.

GLM vs Claude, ChatGPT, Gemini y DeepSeek en coste

Toda la propuesta de GLM es rendimiento de clase frontera sin precios de frontera. La tabla siguiente alinea los modelos estrella de GLM con los que probablemente ya pagas, usando las tarifas estándar de la API por millón de tokens. GLM ya no tiene el precio más bajo: DeepSeek y GPT-5.6 Luna están ambos por debajo.

ModeloEntrada / MSalida / M
GLM-5.2 (Zhipu)$1.40$4.40
GLM-4.7 (Zhipu)$0.60$2.20
Claude Opus 5$5.00$25.00
Claude Sonnet 5$2.00*$10.00*
GPT-5.6 Sol$4.00$20.00
GPT-5.6 Terra$2.00$12.00
GPT-5.6 Luna$0.20$1.20
Gemini 3.1 Pro$2.00$12.00
DeepSeek V4 Pro$0.44$0.87
Qwen3.7 Max$1.25$3.75

*Claude Sonnet 5 está en precios introductorios hasta el 31 de agosto de 2026; las tarifas estándar de $3.00 / $15.00 se reanudan en septiembre.

El panorama cambió el 30 de julio de 2026. GLM-5.2 sigue costando menos de la mitad de Gemini 3.1 Pro en salida y aproximadamente un séptimo de GPT-5.6 Sol, pero el recorte de OpenAI significa que GPT-5.6 Luna ahora supera a GLM-5.2 en precio por entrada en aproximadamente 7x y en salida en aproximadamente 3,7x, y supera también a GLM-4.7 en ambos lados. La ventaja restante de GLM no es el precio más bajo por token; son los pesos abiertos que puedes autoalojar, un Coding Plan de tarifa plana y los modelos Flash gratuitos que Luna no tiene respuesta alguna. Para un panorama más completo de todos los modelos principales, consulta nuestra comparativa de precios de IA, y para la otra gran opción de valor entre los pesos abiertos consulta el precio de Qwen.

Una alternativa más sencilla a la facturación por token

Las matemáticas por token son potentes pero agotadoras, y la mayoría de la gente no quiere rastrear las tarifas de entrada frente a salida ni gestionar una cuenta separada en z.ai. Si ese es tu caso, la ruta más sencilla es una suscripción de tarifa plana que incluya GLM junto a los otros modelos de frontera.

Dentro de Fello, GLM-5.2 está junto a Claude, GPT y Gemini por una sola tarifa de $9.99 al mes. Puedes ejecutar el mismo prompt en varios modelos a la vez y quedarte con la mejor respuesta, sin facturación por token, sin gestionar cuotas y sin tener que crear una cuenta alojada en China. Es la forma más sencilla de probar GLM sin preocuparte por el precio antes de comprometerte con la API. En un Mac se instala como un cliente nativo de escritorio de GLM, así que el precio plano cubre una aplicación real en lugar de una pestaña del navegador.

Conclusión

El precio de GLM es tan asequible como se puede encontrar para un modelo de clase frontera. El chat es gratuito, dos modelos de la API no cuestan nada, GLM-5.2 funciona a aproximadamente un séptimo de GPT-5.6 Sol en salida y el GLM Coding Plan limita el uso intensivo a una tarifa mensual fija. Ya no es la opción más barata por token, sin embargo, ahora que DeepSeek y GPT-5.6 Luna están ambos por debajo de él.

Para la mayoría de las personas, el movimiento inteligente es empezar de forma gratuita en chat.z.ai, usar GLM-4.7 cuando necesites programación barata vía API y subir a GLM-5.2 para el modelo estrella. Y si prefieres evitar completamente la facturación por token, ejecuta GLM junto a Claude y GPT en Fello por un precio plano.

FAQ

¿Cuánto cuesta GLM?

GLM-5.2 cuesta $1.40 por millón de tokens de entrada y $4.40 por millón de tokens de salida en la API oficial de Z.ai, aproximadamente un séptimo de GPT-5.6 Sol en salida. GLM-4.7 es más barato a $0.60 / $2.20, y el chat más dos modelos Flash son gratuitos. El más reciente GLM-5.3 no tiene precio por token publicado y se vende solo dentro del Coding Plan.

¿Es gratuito usar GLM?

Sí. Puedes chatear con GLM de forma gratuita en chat.z.ai, los pesos del modelo hasta GLM-5.2 son open source bajo la licencia MIT, y GLM-4.7 Flash y GLM-4.5 Flash son gratuitos en la API para entrada, entrada en caché y salida. GLM-5.3 aún no tiene pesos públicos.

¿Cuánto cuesta el GLM Coding Plan?

El GLM Coding Plan tiene tres niveles: Lite a $18, Pro a $72 y Max a $160 al mes, o un 30 % menos con facturación anual. Todos los niveles incluyen GLM-5.2, GLM-5-Turbo, GLM-4.7, GLM-4.5-Air y el más reciente GLM-5.3 para usar en herramientas como Claude Code y Cline.

¿Es GLM más barato que ChatGPT y Claude?

Más barato que los modelos estrella, sí. GLM-5.2 funciona a aproximadamente un séptimo de GPT-5.6 Sol en salida y muy por debajo de Claude Opus 5 ($5.00 / $25.00), mientras iguala en la mayoría de las tareas cotidianas. Sin embargo, no es la opción más barata en general: DeepSeek y GPT-5.6 Luna ($0.20 / $1.20) están ambos por debajo.

¿Cuál es el modelo GLM más barato?

GLM-4.7 Flash y GLM-4.5 Flash son gratuitos en la API. Entre los modelos de pago, GLM-4.5 Air es el más barato a $0.20 de entrada y $1.10 de salida por millón de tokens, seguido de GLM-4.7 a $0.60 / $2.20.