Os preços do GLM são o principal motivo pelo qual os programadores continuam a migrar para os modelos da Zhipu AI. O GLM-5.2 de topo custa apenas $1.40 por milhão de tokens de entrada e $4.40 por milhão de saída na API oficial, cerca de um sexto do que cobra o GPT-5.5, e o GLM-4.7 mais antigo é ainda mais barato. Também pode usar o GLM gratuitamente no navegador, e dois dos modelos não têm qualquer custo através da API. O modelo mais recente, o GLM 5.3, é a exceção a tudo isto, pois a Z.ai ainda não publicou um preço por token.
Este guia explica todas as formas de pagar pelo GLM em 2026: a versão gratuita, as tarifas por token da API para cada modelo, e o GLM Coding Plan, uma subscrição de taxa fixa que começa em $18 por mês. Terminamos com uma comparação de custos face ao Claude, ChatGPT, Gemini e DeepSeek, atualizada para o corte de preços na API da OpenAI a 30 de julho de 2026, que reduziu o GPT-5.6 Luna para $0.20 / $1.20 e agora é mais barato do que o GLM-5.2, mais uma alternativa de taxa fixa se preferir evitar a aritmética por token. O preço é apenas metade da história, por isso veja como o GLM se compara aos principais modelos fechados em termos de qualidade. Se é novo na família, comece por perceber o que é o GLM.
Os pontos-chave
- O GLM é gratuito em chat.z.ai, e o GLM-4.7 Flash e o GLM-4.5 Flash são completamente gratuitos na API.
- O preço da API do GLM-5.2 é de $1.40 entrada / $4.40 saída por milhão de tokens, cerca de um sétimo do GPT-5.6 Sol em saída e bem abaixo do Claude Opus 5, embora o GPT-5.6 Luna seja agora mais barato do que ambos.
- O GLM-4.7 é a escolha económica para programação a $0.60 entrada / $2.20 saída por milhão de tokens, com entrada em cache tão baixa quanto $0.11.
- O GLM Coding Plan é uma subscrição de taxa fixa a $18 (Lite), $72 (Pro) e $160 (Max) por mês, ou 30% menos na faturação anual.
- O GLM-5.3 não tem preço por token publicado. Lançado a 14 de agosto de 2026 exclusivamente dentro do Coding Plan e do ZCode, por isso a tabela de preços da API ainda tem o topo no GLM-5.2.
- No Fello AI, o GLM-5.2 está incluído com Claude, GPT e Gemini por um único preço fixo de $9.99 por mês, sem faturação por token.
Preços do GLM de relance
Aqui está a visão completa dos preços do GLM numa só tabela. As opções gratuitas são genuinamente gratuitas, as tarifas da API estão entre as mais baixas de qualquer modelo de classe frontier, e o Coding Plan é uma taxa mensal fixa para uso intensivo.
| O que paga | Custo |
|---|---|
| Chat GLM (chat.z.ai) | Grátis |
| GLM-4.7 Flash / GLM-4.5 Flash API | Grátis |
| GLM-5.2 API | $1.40 entrada / $4.40 saída por milhão de tokens |
| GLM-5.3 API | Não publicado; apenas Coding Plan e ZCode |
| GLM-4.7 API | $0.60 entrada / $2.20 saída por milhão de tokens |
| GLM Coding Plan | $18 / $72 / $160 por mês |
O GLM é gratuito?
Sim, em mais formas do que a maioria dos concorrentes. Pode conversar com o GLM-5.2 gratuitamente em chat.z.ai sem subscrição, da mesma forma que usaria uma conta gratuita do ChatGPT. Como todos os modelos até ao GLM-5.2 são open-weight com licença MIT, também pode descarregar os pesos do Hugging Face e executá-los sem qualquer custo de licenciamento. O GLM-5.3 é a exceção, com os seus pesos retidos à espera de uma revisão de segurança.
A surpresa é que a API também tem modelos gratuitos. O GLM-4.7 Flash, o GLM-4.5 Flash e o modelo de visão GLM-4.6V Flash estão listados a $0 para entrada, entrada em cache e saída, pelo que pode construir aplicações reais sem pagar por token. Isso faz do GLM um dos modelos mais baratos para prototipagem, e é uma parte importante do motivo pelo qual aparece nas listas dos melhores modelos de IA open source.
Preços da API GLM por modelo
Na API oficial Z.ai, cada modelo é faturado por milhão de tokens, dividido em entrada, entrada em cache e saída. A entrada em cache aplica-se quando reutiliza o mesmo contexto, reduzindo a tarifa de entrada para cerca de um quinto. As tarifas completas por modelo estão abaixo, retiradas da documentação de preços da Z.ai.
| Modelo | Entrada / M | Entrada em cache / M | Saída / M |
|---|---|---|---|
| GLM-5.2 | $1.40 | $0.26 | $4.40 |
| GLM-5-Turbo | $1.20 | $0.24 | $4.00 |
| GLM-4.7 | $0.60 | $0.11 | $2.20 |
| GLM-4.7 Flash | Grátis | Grátis | Grátis |
| GLM-4.5 Air | $0.20 | $0.03 | $1.10 |
GLM-5.2 (tarifa flagship)
O GLM-5.2 é o modelo que a maioria das pessoas tem em mente quando fala dos preços do GLM, e o GLM mais caro com uma tarifa publicada. A $1.40 de entrada e $4.40 de saída por milhão de tokens, custa cerca de um sétimo do GPT-5.6 Sol em saída e menos de um quinto da tarifa de saída de $25.00 do Claude Opus 5, ao mesmo tempo que obtém resultados competitivos em benchmarks independentes. A entrada em cache desce para $0.26, tornando os contextos longos e repetidos ainda mais baratos. Os benchmarks completos estão na nossa análise do GLM 5.2.
GLM-5.3 (sem preço publicado)
O GLM-5.3 foi lançado a 14 de agosto de 2026 e não aparece na tabela de preços. A Z.ai está a fazer o seu lançamento de forma faseada, por detrás de uma revisão de segurança, pelo que à data de publicação o modelo só é acessível através do GLM Coding Plan e do agente ZCode da Z.ai, com acesso mais amplo à API prometido para mais tarde. Se estiver a orçamentar gastos com a API, ainda está a trabalhar com a linha GLM-5.2 acima. O que obtém com a subscrição e os benchmarks são explicados na nossa análise do GLM 5.3.
GLM-5-Turbo
O GLM-5-Turbo é o irmão otimizado para velocidade a $1.20 de entrada e $4.00 de saída por milhão de tokens. Troca um pouco de qualidade bruta por respostas mais rápidas e custo ligeiramente inferior, o que o torna adequado para aplicações de alto volume ou sensíveis à latência.
GLM-4.7 (escolha económica para programação)
O GLM-4.7 é o campeão de valor a $0.60 de entrada e $2.20 de saída por milhão de tokens, com entrada em cache tão baixa quanto $0.11. Ainda obtém 73,8% no SWE-bench Verified, um dos melhores resultados de qualquer modelo open, pelo que obtém programação a sério por uma fração dos preços frontier. É também o modelo padrão dentro do GLM Coding Plan.
GLM-4.7 Flash (gratuito)
O GLM-4.7 Flash é completamente gratuito na API, para entrada, entrada em cache e saída. É um modelo mais pequeno e rápido orientado para programação local e de alto volume, e juntamente com o GLM-4.5 Flash permite lançar um produto funcional sem pagar por token.
GLM-4.5 Air
O GLM-4.5 Air é a opção legada mais leve a $0.20 de entrada e $1.10 de saída por milhão de tokens, com entrada em cache apenas a $0.03. É o modelo pago mais barato da gama e ainda lida bem com conversas e raciocínio do dia a dia.
O GLM Coding Plan: Lite, Pro e Max
Se programa o dia todo, a faturação por token torna-se complicada, por isso a Zhipu vende um GLM Coding Plan de taxa fixa. É a subscrição que se tornou viral entre programadores à procura de uma alternativa mais barata ao Claude, porque inclui o GLM-5.2, GLM-5-Turbo, GLM-4.7 e GLM-4.5-Air com generosas quotas de prompts. Todos os níveis incluem agora também o GLM-5.3, que é a única forma de aceder a esse modelo hoje. Os três níveis, retirados da página de subscrição da Z.ai, são os seguintes.
| Nível | Mensal | Faturação anual (-30%) | Quota de utilização |
|---|---|---|---|
| Lite | $18 | $12.60 | ~80 prompts / 5 h, ~400 / semana |
| Pro | $72 | $50.40 | ~400 prompts / 5 h, ~2.000 / semana |
| Max | $160 | $112 | ~1.600 prompts / 5 h, ~8.000 / semana |
Os três níveis dão-lhe a mesma gama de modelos e funcionam em ferramentas de programação como Claude Code, Cline, Roo Code e mais de 20 outros clientes. Os prompts no GLM-5.2 e GLM-5-Turbo consomem quota a 3x nas horas de pico e 2x fora de pico, embora haja uma promoção de 1x fora de pico em vigor até setembro de 2026. A faturação anual reduz ainda mais os preços, para cerca de $151, $605 e $1,344 por ano.
Como reduzir a sua fatura GLM
O GLM já é barato, mas três hábitos reduzem ainda mais o custo. Primeiro, aproveite a entrada em cache. Reutilizar o mesmo prompt de sistema ou contexto de documento é faturado à tarifa em cache, que é cerca de um quinto do preço de entrada padrão. Segundo, ajuste o modelo à tarefa, pois o GLM-4.7 ou os modelos Flash gratuitos lidam com a maioria das tarefas de programação e conversação sem precisar do modelo de topo.
Terceiro, fique de olho no relógio. O Coding Plan cobra menos quota fora de pico, e a API padrão ainda custa muito menos do que os níveis US de topo a qualquer hora. Essa vantagem já não se mantém face a todos os modelos US, porém; desde o corte da OpenAI em julho de 2026, o GPT-5.6 Luna a $0.20 / $1.20 é mais barato por token do que qualquer modelo GLM pago, exceto o GLM-4.5 Air. Se a sua carga de trabalho for irregular, um plano por token pode ganhar a uma subscrição; se programa de forma constante o dia todo, o Coding Plan de taxa fixa normalmente ganha.
GLM vs Claude, ChatGPT, Gemini e DeepSeek em termos de custo
O argumento de venda do GLM é output de classe frontier sem preços frontier. A tabela abaixo compara os modelos de topo do GLM com os modelos que provavelmente já paga, usando tarifas padrão da API por milhão de tokens. O GLM já não detém o piso de preços: o DeepSeek e o GPT-5.6 Luna ficam ambos abaixo.
| Modelo | Entrada / M | Saída / M |
|---|---|---|
| GLM-5.2 (Zhipu) | $1.40 | $4.40 |
| GLM-4.7 (Zhipu) | $0.60 | $2.20 |
| Claude Opus 5 | $5.00 | $25.00 |
| Claude Sonnet 5 | $2.00* | $10.00* |
| GPT-5.6 Sol | $5.00 | $30.00 |
| GPT-5.6 Terra | $2.00 | $12.00 |
| GPT-5.6 Luna | $0.20 | $1.20 |
| Gemini 3.1 Pro | $2.00 | $12.00 |
| DeepSeek V4 Pro | $0.44 | $0.87 |
| Qwen3.7 Max | $1.25 | $3.75 |
*O Claude Sonnet 5 está em preços introdutórios até 31 de agosto de 2026; as tarifas padrão de $3.00 / $15.00 retomam em setembro.
A situação mudou a 30 de julho de 2026. O GLM-5.2 ainda custa menos de metade do Gemini 3.1 Pro em saída e cerca de um sétimo do GPT-5.6 Sol, mas o corte da OpenAI significa que o GPT-5.6 Luna agora é mais barato do que o GLM-5.2 em cerca de 7x na entrada e 3,7x na saída, e bate o GLM-4.7 em ambos. A vantagem restante do GLM não é o piso de preço bruto; são os pesos open que pode alojar localmente, um Coding Plan de taxa fixa e modelos Flash gratuitos aos quais o Luna não tem resposta. Para uma visão mais completa de todos os principais modelos, veja a nossa comparação de preços de IA, e para a outra grande aposta open-weight consulte os preços do Qwen.
Uma alternativa mais simples à faturação por token
A aritmética por token é poderosa, mas cansativa, e a maioria das pessoas não quer monitorizar tarifas de entrada e saída ou gerir uma conta z.ai separada. Se é o seu caso, a rota mais simples é uma subscrição de taxa fixa que inclui o GLM juntamente com os outros modelos frontier.
No Fello, o GLM-5.2 fica lado a lado com Claude, GPT e Gemini por um único preço de $9.99 por mês. Pode correr o mesmo prompt por vários modelos ao mesmo tempo e ficar com a melhor resposta, sem faturação por token, sem gestão de quotas e sem precisar de criar uma conta na China. É a forma mais fácil de experimentar o GLM sem se preocupar com preços antes de se comprometer com a API. No Mac instala-se como um cliente desktop nativo do GLM, pelo que o preço fixo cobre uma aplicação a sério em vez de um separador de navegador.
Conclusão
Os preços do GLM são tão amigáveis quanto é possível para um modelo de classe frontier. O chat é gratuito, dois modelos da API não custam nada, o GLM-5.2 funciona a cerca de um sétimo do GPT-5.6 Sol em saída, e o GLM Coding Plan limita o uso intensivo a uma taxa mensal fixa. Já não é a opção mais barata por token, no entanto, agora que o DeepSeek e o GPT-5.6 Luna ficam abaixo dele.
Para a maioria das pessoas, o passo inteligente é começar de graça em chat.z.ai, usar o GLM-4.7 para programação barata via API, e avançar para o GLM-5.2 quando precisar do modelo de topo. E se preferir evitar a faturação por token, execute o GLM juntamente com Claude e GPT no Fello por um preço fixo.
FAQ
Quanto custa o GLM?
O GLM-5.2 custa $1.40 por milhão de tokens de entrada e $4.40 por milhão de saída na API oficial Z.ai, cerca de um sétimo do GPT-5.6 Sol em saída. O GLM-4.7 é mais barato a $0.60 / $2.20, e o chat mais dois modelos Flash são gratuitos. O GLM-5.3 mais recente não tem preço por token publicado e é vendido apenas dentro do Coding Plan.
O GLM é gratuito?
Sim. Pode conversar com o GLM gratuitamente em chat.z.ai, os pesos do modelo até ao GLM-5.2 são open-source sob a licença MIT, e o GLM-4.7 Flash e o GLM-4.5 Flash são gratuitos na API para entrada, entrada em cache e saída. O GLM-5.3 ainda não tem pesos públicos.
Quanto custa o GLM Coding Plan?
O GLM Coding Plan tem três níveis: Lite a $18, Pro a $72 e Max a $160 por mês, ou 30% menos na faturação anual. Todos os níveis incluem GLM-5.2, GLM-5-Turbo, GLM-4.7, GLM-4.5-Air e o GLM-5.3 mais recente para uso em ferramentas como Claude Code e Cline.
O GLM é mais barato do que o ChatGPT e o Claude?
Mais barato do que os modelos de topo, sim. O GLM-5.2 funciona a cerca de um sétimo do GPT-5.6 Sol em saída e bem abaixo do Claude Opus 5 ($5.00 / $25.00), igualando-os na maioria das tarefas do dia a dia. Não é a opção mais barata no geral, no entanto: o DeepSeek e o GPT-5.6 Luna ($0.20 / $1.20) ficam ambos abaixo.
Qual é o modelo GLM mais barato?
O GLM-4.7 Flash e o GLM-4.5 Flash são gratuitos na API. Entre os modelos pagos, o GLM-4.5 Air é o mais barato a $0.20 de entrada e $1.10 de saída por milhão de tokens, seguido do GLM-4.7 a $0.60 / $2.20.