El precio de GLM es la razón principal por la que los desarrolladores siguen cambiando a los modelos de Zhipu AI. El GLM-5.3 de gama alta cuesta solo $1.40 por millón de tokens de entrada y $4.40 por millón de tokens de salida en la API oficial, lo que antes era un sexto de lo que cobraba GPT-5.5, y el más antiguo GLM-4.7 es aún más barato. OpenAI ha recortado sus propias tarifas dos veces desde entonces, así que la diferencia hoy está más cerca de la mitad. También puedes usar GLM de forma gratuita en el navegador, y tres de los modelos no cuestan nada a través de la API. GLM 5.3 lleva la misma tarjeta de precios que el GLM-5.2 al que sustituye, así que subir de versión no cambia tu factura.
Esta guía desglosa cada forma de pagar por GLM en 2026: el nivel gratuito, las tarifas por token de la API para cada modelo y la suscripción del GLM Coding Plan que comienza en $18 al mes. Terminamos con una comparativa de costes frente a Claude, ChatGPT, Gemini y DeepSeek, actualizada para la escala GPT-6 de OpenAI, donde Luna a $0.10 / $0.50 queda por debajo de cualquier modelo GLM de pago, más una alternativa de tarifa plana si prefieres evitar las matemáticas por token. El precio es solo la mitad de la historia, así que consulta cómo se compara GLM con los principales modelos cerrados en calidad también. Si eres nuevo en la familia, empieza por qué es GLM.
Lo más importante
- GLM es gratuito en chat.z.ai, y GLM-4.7 Flash, GLM-4.5 Flash y el modelo de visión GLM-4.6V Flash son completamente gratuitos en la API también.
- El precio de la API de GLM-5.3 es de $1.40 entrada / $4.40 salida por millón de tokens, menos de la mitad de GPT-6.1 Sol en salida y un quinto de Claude Opus 5.5, aunque GPT-6 Luna es más barato que ambos.
- GLM-4.7 es la opción económica de programación a $0.60 entrada / $2.20 salida por millón de tokens, con entrada en caché tan baja como $0.11.
- El GLM Coding Plan es una suscripción de tarifa plana a $18 (Lite), $80 (Pro) y $168 (Max) al mes, o un 30 % menos con facturación anual.
- GLM-5.3 está en la tarjeta de precios a los mismos $1.40 / $4.40 que GLM-5.2, y desde el 30 de julio de 2026 el Coding Plan se mide en créditos y no en prompts, y ya no sirve GLM-5.2 en absoluto.
- Dentro de Fello AI, GLM-5.3 está incluido junto a Claude, GPT y Gemini por una tarifa plana de $9.99 al mes, sin facturación por token.
Precio de GLM de un vistazo
Aquí está todo el panorama de precios de GLM en una tabla. Las opciones gratuitas son genuinamente gratuitas, las tarifas de la API quedan por debajo de todos los modelos estrella cerrados salvo el nivel más barato de OpenAI, y el Coding Plan es una tarifa mensual fija para uso intensivo.
| Por qué pagas | Coste |
|---|---|
| Chat GLM (chat.z.ai) | Gratis |
| API de GLM-4.7 Flash / GLM-4.5 Flash / GLM-4.6V Flash | Gratis |
| API de GLM-5.3 | $1.40 entrada / $4.40 salida por millón de tokens |
| API de GLM-5.3 Flash | $0.15 entrada / $0.50 salida por millón de tokens |
| API de GLM-4.7 | $0.60 entrada / $2.20 salida por millón de tokens |
| GLM Coding Plan | $18 / $80 / $168 al mes |
¿Es GLM gratuito?
Sí, de más formas que la mayoría de los rivales. Puedes chatear con GLM-5.3 de forma gratuita en chat.z.ai sin suscripción, de la misma forma que usarías una cuenta gratuita de ChatGPT. Todos los GLM hasta GLM-5.2 son de pesos abiertos con licencia MIT, así que puedes descargar los pesos desde Hugging Face y ejecutarlos tú mismo sin ningún coste de licencia. Los pesos de GLM-5.3 también son públicos, en Hugging Face desde el 28 de agosto de 2026, pero bajo una licencia GLM 5.3 propia en lugar de MIT, y con 753.000 millones de parámetros necesitan un servidor con varias GPU, no un portátil.
Lo sorprendente es que la API también tiene modelos gratuitos. GLM-4.7 Flash, GLM-4.5 Flash y el modelo de visión GLM-4.6V Flash están listados a $0 para entrada, entrada en caché y salida, así que puedes crear aplicaciones reales sobre ellos sin pagar por token. Eso hace de GLM uno de los modelos serios más baratos para prototipar, y es una gran parte de por qué aparece en listas de los mejores modelos de IA open source.
Precio de la API de GLM por modelo
En la API oficial de Z.ai, cada modelo se factura por millón de tokens, dividido en entrada, entrada en caché y salida. La entrada en caché se aplica cuando reutilizas el mismo contexto y reduce la tarifa de entrada a aproximadamente un quinto. Las tarifas completas por modelo están a continuación, tomadas de la documentación de precios de Z.ai.
| Modelo | Entrada / M | Entrada en caché / M | Salida / M |
|---|---|---|---|
| GLM-5.3 | $1.40 | $0.26 | $4.40 |
| GLM-5.3 Flash | $0.15 | $0.03 | $0.50 |
| GLM-4.7 | $0.60 | $0.11 | $2.20 |
| GLM-4.7 Flash | Gratis | Gratis | Gratis |
| GLM-4.5 Air | $0.20 | $0.03 | $1.10 |
GLM-5.3 (tarifa modelo estrella)
GLM-5.3 es el modelo al que más gente se refiere hoy cuando habla del precio de GLM, y el GLM cuya tarifa cita casi todo el mundo. A $1.40 de entrada y $4.40 de salida por millón de tokens, cuesta menos de la mitad de GPT-6.1 Sol en salida y un quinto de la tarifa de salida de $20.00 de Claude Opus 5.5. La entrada en caché baja a $0.26, así que los contextos largos y repetidos salen aún más baratos. Conviene saberlo antes de venderlo como la opción barata: en el Intelligence Index v4.3.2 de Artificial Analysis, GPT-6.1 Sol saca 52 puntos frente a los 45 de GLM-5.3 y cuesta $0.72 por tarea del índice frente a los $2.01 de GLM, así que el argumento de calidad comparable por una fracción del precio se invierte frente a la gama media de OpenAI. Los benchmarks completos están en nuestro análisis de GLM 5.3.
GLM-5.2 (misma tarifa, modelo anterior)
GLM-5.2 sigue en la tarjeta de precios, a exactamente los mismos $1.40 / $0.26 / $4.40, así que las dos generaciones cuestan lo mismo y la guía de migración de Z.ai se limita a decir a los desarrolladores que apunten el identificador del modelo a glm-5.3. En el GLM Coding Plan ya no puedes elegirlo: desde el 30 de julio de 2026 las peticiones de GLM-5.2 y GLM-5.1 se enrutan a GLM-5.3, y GLM-4.7 a GLM-5.3 Flash. Lo que conserva GLM-5.2 es su licencia, es el GLM más grande publicado bajo MIT, y sus propias cifras, que están en nuestro análisis de GLM 5.2. Su hermano más barato, GLM 5.3 Flash, llegó el 26 de agosto de 2026 a $0.15 de entrada y $0.50 de salida por millón de tokens, y la promoción que reducía esas tarifas a la mitad terminó el 9 de septiembre.
GLM-5.3 Flash y FlashX
GLM-5.3 Flash es el hermano barato y nativamente multimodal a $0.15 de entrada y $0.50 de salida por millón de tokens, con GLM-5.3 FlashX entre él y el modelo estrella a $0.37 / $1.25. Flash saca 42 puntos en el Intelligence Index v4.3.2 de Artificial Analysis frente a los 45 del modelo estrella, a $0.25 por tarea del índice en lugar de $2.01, lo que lo convierte en la mejor relación de los dos para casi todo el trabajo de alto volumen.
GLM-4.7 (la opción económica de programación)
GLM-4.7 es el campeón en valor a $0.60 de entrada y $2.20 de salida por millón de tokens, con entrada en caché tan baja como $0.11. Sigue obteniendo un 73,8 % en SWE-bench Verified, uno de los mejores resultados que cualquier modelo abierto ha publicado, así que obtienes programación seria a una fracción de los precios de frontera. En el Coding Plan, sin embargo, ya no llegas a él directamente: desde el 30 de julio de 2026 las peticiones de GLM-4.7 se enrutan a GLM-5.3 Flash.
GLM-4.7 Flash (gratis)
GLM-4.7 Flash es completamente gratuito en la API, tanto para entrada como para entrada en caché y salida. Es un modelo más pequeño y rápido orientado a la programación local y de alto volumen, y junto a GLM-4.5 Flash te permite publicar un producto que funcione sin pagar por token.
GLM-4.5 Air
GLM-4.5 Air es la opción heredada ligera a $0.20 de entrada y $1.10 de salida por millón de tokens, con entrada en caché a solo $0.03. Ya no es el modelo de pago más barato de la línea, GLM-4.7-FlashX a $0.07 / $0.40 y GLM-5.3 Flash a $0.15 / $0.50 quedan por debajo, pero sigue gestionando bien el chat y el razonamiento cotidianos.
El GLM Coding Plan: Lite, Pro y Max
Si programas todo el día, la facturación por token resulta engorrosa, así que Zhipu vende en su lugar un GLM Coding Plan de tarifa plana. Es la suscripción que se hizo viral entre los desarrolladores que buscaban una alternativa más barata a Claude. Desde el 30 de julio de 2026 solo sirve GLM-5.3 y GLM-5.3 Flash, enruta las peticiones de GLM-5.2 y GLM-5.1 a GLM-5.3 y las de GLM-4.7 a GLM-5.3 Flash, y mide el uso en créditos en lugar de prompts. Los tres niveles, de la página de suscripción de Z.ai, están abajo.
| Nivel | Mensual | Facturación anual (-30 %) | Asignación de uso |
|---|---|---|---|
| Lite | $18 | $12.60 | 2.000 créditos / 5 h, 10.000 / semana |
| Pro | $80 | $56 | 12.000 créditos / 5 h, 60.000 / semana |
| Max | $168 | $117.60 | 28.000 créditos / 5 h, 140.000 / semana |
Los tres niveles dan acceso a la misma línea de modelos y funcionan dentro de herramientas de programación como Claude Code, Cline, OpenCode y más de 20 clientes adicionales. El coste en créditos varía según el modelo: GLM-5.3 se factura con multiplicadores de 6,9 en entrada, 1,7 en entrada en caché y 24 en salida, GLM-5.3 Flash con 2,3, 0,56 y 8, y fuera de las horas pico el consumo cuesta la mitad de la tarifa estándar de créditos, siendo hora pico de lunes a viernes de 14:00 a 18:00 hora de Singapur. Del 25 de septiembre al 7 de octubre de 2026 Z.ai aplica la tarifa fuera de pico las 24 horas. La facturación anual baja los precios a $151.20, $672 y $1.411,20 al año.
Cómo reducir tu factura de GLM
GLM ya es barato, pero tres hábitos reducen el coste aún más. Primero, apóyate en la entrada en caché. Reutilizar el mismo prompt de sistema o contexto de documento se factura a la tarifa en caché, que es aproximadamente un quinto del precio de entrada estándar. Segundo, asigna el modelo al trabajo, ya que GLM-4.7 o los modelos Flash gratuitos gestionan la mayoría de la programación y el chat sin tocar el modelo estrella.
Tercero, vigila el reloj. El Coding Plan cobra la mitad de la tarifa de créditos fuera de las horas pico, y la API estándar sigue siendo mucho más barata que los niveles superiores de Estados Unidos a cualquier hora. Esa diferencia ya no se mantiene frente a todos los modelos de Estados Unidos: GPT-6 Luna a $0.10 / $0.50 es más barato por token que cualquier modelo GLM de pago, incluido GLM-4.5 Air. Si tu carga de trabajo es irregular, un plan por token puede superar a una suscripción; si programas de forma constante todo el día, el Coding Plan de tarifa plana suele ganar.
GLM vs Claude, ChatGPT, Gemini y DeepSeek en coste
Toda la propuesta de GLM es rendimiento de clase frontera sin precios de frontera. La tabla siguiente alinea los modelos estrella de GLM con los que probablemente ya pagas, usando las tarifas estándar de la API por millón de tokens. GLM ya no tiene el precio más bajo: DeepSeek y GPT-6 Luna están ambos por debajo.
| Modelo | Entrada / M | Salida / M |
|---|---|---|
| GLM-5.3 (Zhipu) | $1.40 | $4.40 |
| GLM-4.7 (Zhipu) | $0.60 | $2.20 |
| Claude Opus 5.5 | $4.00 | $20.00 |
| Claude Sonnet 5.5 | $2.00* | $10.00* |
| GPT-6.1 Sol | $2.00 | $10.00 |
| GPT-6 Astra | $10.00 | $50.00 |
| GPT-6 Luna | $0.10 | $0.50 |
| Gemini 3.1 Pro | $2.00 | $12.00 |
| DeepSeek V4 Pro | $0.66** | $1.98** |
| GLM-5.3 Flash (Zhipu) | $0.15 | $0.50 |
*Claude Sonnet 5.5, lanzado el 28 de septiembre de 2026, mantiene el precio de Sonnet 5, $2.00 / $10.00. **DeepSeek factura en hora pico y fuera de pico: V4 Pro cuesta $0.66 / $1.98 fuera de pico y $1.32 / $3.96 en hora pico, que va de 01:00 a 04:00 y de 06:00 a 10:00 UTC en días laborables.
El panorama cambió dos veces. La escala GPT-6 de OpenAI sustituyó a las tarifas de GPT-5.6 sobre las que se apoyaba esta comparativa, y la nueva gama media aterriza justo encima de GLM. GLM-5.3 sigue costando menos de la mitad de GPT-6.1 Sol en salida y algo más de un tercio de Gemini 3.1 Pro, pero GPT-6 Luna a $0.10 / $0.50 queda por debajo de GLM-5.3 en 14x en entrada y casi 9x en salida, y supera a GLM-4.7 en ambos lados. Peor para el argumento: Sol no solo está cerca en precio, también va por delante en calidad, 52 frente a 45 en el Intelligence Index v4.3.2 de Artificial Analysis, y a $0.72 por tarea del índice frente a los $2.01 de GLM. La ventaja restante de GLM no es el precio más bajo ni calidad comparable por menos dinero; son los pesos abiertos que puedes autoalojar, un Coding Plan de tarifa plana y los modelos Flash gratuitos a los que Luna no tiene respuesta. En la cima de la escala de OpenAI, GPT-6 Astra figura en la tarjeta de precios a $10.00 / $50.00. Para un panorama más completo de todos los modelos principales, consulta nuestra comparativa de precios de IA, y para la otra gran opción de valor entre los pesos abiertos consulta el precio de Qwen.
Una alternativa más sencilla a la facturación por token
Las matemáticas por token son potentes pero agotadoras, y la mayoría de la gente no quiere rastrear las tarifas de entrada frente a salida ni gestionar una cuenta separada en z.ai. Si ese es tu caso, la ruta más sencilla es una suscripción de tarifa plana que incluya GLM junto a los otros modelos de frontera.
Dentro de Fello, GLM-5.3 está junto a Claude, GPT y Gemini por una sola tarifa de $9.99 al mes. Puedes ejecutar el mismo prompt en varios modelos a la vez y quedarte con la mejor respuesta, sin facturación por token, sin gestionar cuotas y sin tener que crear una cuenta alojada en China. Es la forma más sencilla de probar GLM sin preocuparte por el precio antes de comprometerte con la API. En un Mac se instala como un cliente nativo de escritorio de GLM, así que el precio plano cubre una aplicación real en lugar de una pestaña del navegador.
Conclusión
El precio de GLM es tan asequible como se puede encontrar para un modelo de clase frontera. El chat es gratuito, tres modelos de la API no cuestan nada, GLM-5.3 funciona a menos de la mitad de GPT-6.1 Sol en salida y el GLM Coding Plan limita el uso intensivo a una tarifa mensual fija. Ya no es la opción más barata por token, sin embargo, ahora que DeepSeek y GPT-6 Luna están ambos por debajo de él.
Para la mayoría de las personas, el movimiento inteligente es empezar de forma gratuita en chat.z.ai, usar GLM-4.7 o GLM-5.3 Flash cuando necesites programación barata vía API y subir a GLM-5.3 para el modelo estrella. Y si prefieres evitar completamente la facturación por token, ejecuta GLM junto a Claude y GPT en Fello por un precio plano.
FAQ
¿Cuánto cuesta GLM?
GLM-5.3 cuesta $1.40 por millón de tokens de entrada y $4.40 por millón de tokens de salida en la API oficial de Z.ai, menos de la mitad de GPT-6.1 Sol en salida. GLM-4.7 es más barato a $0.60 / $2.20 y GLM-5.3 Flash a $0.15 / $0.50, y el chat más tres modelos Flash son gratuitos. GLM-5.2 sigue listado exactamente a la misma tarifa que GLM-5.3.
¿Es gratuito usar GLM?
Sí. Puedes chatear con GLM de forma gratuita en chat.z.ai, los pesos del modelo hasta GLM-5.2 son open source bajo la licencia MIT, y GLM-4.7 Flash, GLM-4.5 Flash y GLM-4.6V Flash son gratuitos en la API para entrada, entrada en caché y salida. Los pesos de GLM-5.3 también son públicos, en Hugging Face desde el 28 de agosto de 2026, pero bajo una licencia GLM 5.3 propia en lugar de MIT.
¿Cuánto cuesta el GLM Coding Plan?
El GLM Coding Plan tiene tres niveles: Lite a $18, Pro a $80 y Max a $168 al mes, o un 30 % menos con facturación anual. Desde el 30 de julio de 2026 cada nivel sirve solo GLM-5.3 y GLM-5.3 Flash, medido en créditos en lugar de prompts, para usar en herramientas como Claude Code y Cline.
¿Es GLM más barato que ChatGPT y Claude?
Más barato que los modelos estrella, sí. GLM-5.3 funciona a menos de la mitad de GPT-6.1 Sol en salida y a un quinto de Claude Opus 5.5 ($4.00 / $20.00). Sin embargo, no es la opción más barata en general, y tampoco es el modelo más fuerte: DeepSeek y GPT-6 Luna ($0.10 / $0.50) están ambos por debajo, y GPT-6.1 Sol lo supera 52 a 45 en el Intelligence Index v4.3.2 de Artificial Analysis.
¿Cuál es el modelo GLM más barato?
GLM-4.7 Flash, GLM-4.5 Flash y GLM-4.6V Flash son gratuitos en la API. Entre los modelos de texto de pago, el más barato es GLM-4.7-FlashX a $0.07 de entrada y $0.40 de salida por millón de tokens, luego GLM-5.3 Flash a $0.15 / $0.50 y GLM-4.5 Air a $0.20 / $1.10.