Os preços do GLM são o principal motivo pelo qual os programadores continuam a migrar para os modelos da Zhipu AI. O GLM-5.3 de topo custa apenas $1.40 por milhão de tokens de entrada e $4.40 por milhão de saída na API oficial, o que era cerca de um sexto do que cobrava o GPT-5.5, e o GLM-4.7 mais antigo é ainda mais barato. A OpenAI cortou as suas próprias tarifas duas vezes desde então, pelo que hoje a diferença está mais perto de metade. Também pode usar o GLM gratuitamente no navegador, e três dos modelos não têm qualquer custo através da API. O GLM 5.3 tem a mesma tabela de preços do GLM-5.2 que substituiu, pelo que mudar de versão não altera a sua fatura.

Este guia explica todas as formas de pagar pelo GLM em 2026: a versão gratuita, as tarifas por token da API para cada modelo, e o GLM Coding Plan, uma subscrição de taxa fixa que começa em $18 por mês. Terminamos com uma comparação de custos face ao Claude, ChatGPT, Gemini e DeepSeek, atualizada para a escala GPT-6 da OpenAI, onde o Luna a $0.10 / $0.50 fica abaixo de qualquer modelo GLM pago, mais uma alternativa de taxa fixa se preferir evitar a aritmética por token. O preço é apenas metade da história, por isso veja como o GLM se compara aos principais modelos fechados em termos de qualidade. Se é novo na família, comece por perceber o que é o GLM.

Os pontos-chave

  • O GLM é gratuito em chat.z.ai, e o GLM-4.7 Flash, o GLM-4.5 Flash e o modelo de visão GLM-4.6V Flash são completamente gratuitos na API.
  • O preço da API do GLM-5.3 é de $1.40 entrada / $4.40 saída por milhão de tokens, menos de metade do GPT-6 Sol em saída e um quinto do Claude Opus 5.5, embora o GPT-6 Luna seja mais barato do que ambos.
  • O GLM-4.7 é a escolha económica para programação a $0.60 entrada / $2.20 saída por milhão de tokens, com entrada em cache tão baixa quanto $0.11.
  • O GLM Coding Plan é uma subscrição de taxa fixa a $18 (Lite), $80 (Pro) e $168 (Max) por mês, ou 30% menos na faturação anual.
  • O GLM-5.3 está na tabela de preços aos mesmos $1.40 / $4.40 do GLM-5.2 e, desde 30 de julho de 2026, o Coding Plan é medido em créditos e não em prompts, e já não serve o GLM-5.2 de forma alguma.
  • No Fello AI, o GLM-5.3 está incluído com Claude, GPT e Gemini por um único preço fixo de $9.99 por mês, sem faturação por token.

Preços do GLM de relance

Do editor

Todos os modelos de IA numa só aplicação

Fello AI reúne GPT-6, Claude 5, Gemini 3.8, Grok 4.7 e mais numa só aplicação nativa para Mac e iPhone.

Descarregue já!

Aqui está a visão completa dos preços do GLM numa só tabela. As opções gratuitas são genuinamente gratuitas, as tarifas da API ficam abaixo de todos os modelos de topo fechados, exceto o nível mais barato da OpenAI, e o Coding Plan é uma taxa mensal fixa para uso intensivo.

O que pagaCusto
Chat GLM (chat.z.ai)Grátis
GLM-4.7 Flash / GLM-4.5 Flash / GLM-4.6V Flash APIGrátis
GLM-5.3 API$1.40 entrada / $4.40 saída por milhão de tokens
GLM-5.3 Flash API$0.15 entrada / $0.50 saída por milhão de tokens
GLM-4.7 API$0.60 entrada / $2.20 saída por milhão de tokens
GLM Coding Plan$18 / $80 / $168 por mês

O GLM é gratuito?

Sim, em mais formas do que a maioria dos concorrentes. Pode conversar com o GLM-5.3 gratuitamente em chat.z.ai sem subscrição, da mesma forma que usaria uma conta gratuita do ChatGPT. Todos os GLM até ao GLM-5.2 são open-weight com licença MIT, pelo que pode descarregar os pesos do Hugging Face e executá-los sem qualquer custo de licenciamento. Os pesos do GLM-5.3 também são públicos, no Hugging Face desde 28 de agosto de 2026, mas sob uma licença GLM 5.3 própria e não MIT, e com 753 mil milhões de parâmetros exigem um servidor com várias GPU, não um portátil.

A surpresa é que a API também tem modelos gratuitos. O GLM-4.7 Flash, o GLM-4.5 Flash e o modelo de visão GLM-4.6V Flash estão listados a $0 para entrada, entrada em cache e saída, pelo que pode construir aplicações reais sem pagar por token. Isso faz do GLM um dos modelos mais baratos para prototipagem, e é uma parte importante do motivo pelo qual aparece nas listas dos melhores modelos de IA open source.

Preços da API GLM por modelo

Na API oficial Z.ai, cada modelo é faturado por milhão de tokens, dividido em entrada, entrada em cache e saída. A entrada em cache aplica-se quando reutiliza o mesmo contexto, reduzindo a tarifa de entrada para cerca de um quinto. As tarifas completas por modelo estão abaixo, retiradas da documentação de preços da Z.ai.

ModeloEntrada / MEntrada em cache / MSaída / M
GLM-5.3$1.40$0.26$4.40
GLM-5.3 Flash$0.15$0.03$0.50
GLM-4.7$0.60$0.11$2.20
GLM-4.7 FlashGrátisGrátisGrátis
GLM-4.5 Air$0.20$0.03$1.10

GLM-5.3 (tarifa flagship)

O GLM-5.3 é o modelo que a maioria das pessoas tem hoje em mente quando fala dos preços do GLM, e o GLM cuja tarifa quase todos citam. A $1.40 de entrada e $4.40 de saída por milhão de tokens, custa menos de metade do GPT-6 Sol em saída e um quinto da tarifa de saída de $20.00 do Claude Opus 5.5. A entrada em cache desce para $0.26, tornando os contextos longos e repetidos ainda mais baratos. Vale a pena saber isto antes de o vender como a opção barata: no Intelligence Index v4.3.2 da Artificial Analysis, o GPT-6 Sol obtém 48 pontos contra os 45 do GLM-5.3 e custa $1.06 por tarefa do índice contra os $2.01 do GLM, pelo que o argumento de qualidade comparável por uma fração do preço se inverte face à gama média da OpenAI. Os benchmarks completos estão na nossa análise do GLM 5.3.

GLM-5.2 (mesma tarifa, modelo anterior)

O GLM-5.2 continua na tabela de preços, exatamente aos mesmos $1.40 / $0.26 / $4.40, pelo que as duas gerações custam o mesmo e o guia de migração da Z.ai apenas diz aos programadores para apontarem o identificador do modelo para glm-5.3. No GLM Coding Plan já não o pode escolher: desde 30 de julho de 2026, os pedidos de GLM-5.2 e GLM-5.1 são encaminhados para o GLM-5.3, e o GLM-4.7 para o GLM-5.3 Flash. O que o GLM-5.2 mantém é a sua licença, é o maior GLM publicado sob MIT, e os seus próprios números, que estão na nossa análise do GLM 5.2. O seu irmão mais barato, o GLM 5.3 Flash, chegou a 26 de agosto de 2026 a $0.15 de entrada e $0.50 de saída por milhão de tokens, e a promoção que reduzia essas tarifas para metade terminou a 9 de setembro.

GLM-5.3 Flash e FlashX

O GLM-5.3 Flash é o irmão barato e nativamente multimodal a $0.15 de entrada e $0.50 de saída por milhão de tokens, com o GLM-5.3 FlashX entre ele e o modelo de topo a $0.37 / $1.25. O Flash obtém 42 pontos no Intelligence Index v4.3.2 da Artificial Analysis contra os 45 do modelo de topo, e a $0.25 por tarefa do índice em vez de $2.01, o que o torna a melhor relação dos dois para a maior parte do trabalho de grande volume.

GLM-4.7 (escolha económica para programação)

O GLM-4.7 é o campeão de valor a $0.60 de entrada e $2.20 de saída por milhão de tokens, com entrada em cache tão baixa quanto $0.11. Ainda obtém 73,8% no SWE-bench Verified, um dos melhores resultados de qualquer modelo open, pelo que obtém programação a sério por uma fração dos preços frontier. No Coding Plan, porém, já não chega a ele diretamente: desde 30 de julho de 2026 os pedidos de GLM-4.7 são encaminhados para o GLM-5.3 Flash.

GLM-4.7 Flash (gratuito)

O GLM-4.7 Flash é completamente gratuito na API, para entrada, entrada em cache e saída. É um modelo mais pequeno e rápido orientado para programação local e de alto volume, e juntamente com o GLM-4.5 Flash permite lançar um produto funcional sem pagar por token.

GLM-4.5 Air

O GLM-4.5 Air é a opção legada mais leve a $0.20 de entrada e $1.10 de saída por milhão de tokens, com entrada em cache apenas a $0.03. Já não é o modelo pago mais barato da gama, o GLM-4.7-FlashX a $0.07 / $0.40 e o GLM-5.3 Flash a $0.15 / $0.50 ficam abaixo, mas ainda lida bem com conversas e raciocínio do dia a dia.

O GLM Coding Plan: Lite, Pro e Max

Se programa o dia todo, a faturação por token torna-se complicada, por isso a Zhipu vende um GLM Coding Plan de taxa fixa. É a subscrição que se tornou viral entre programadores à procura de uma alternativa mais barata ao Claude. Desde 30 de julho de 2026 serve apenas o GLM-5.3 e o GLM-5.3 Flash, encaminha os pedidos de GLM-5.2 e GLM-5.1 para o GLM-5.3 e os de GLM-4.7 para o GLM-5.3 Flash, e mede o consumo em créditos e não em prompts. Os três níveis, retirados da página de subscrição da Z.ai, são os seguintes.

NívelMensalFaturação anual (-30%)Quota de utilização
Lite$18$12.602.000 créditos / 5 h, 10.000 / semana
Pro$80$5612.000 créditos / 5 h, 60.000 / semana
Max$168$117.6028.000 créditos / 5 h, 140.000 / semana

Os três níveis dão-lhe a mesma gama de modelos e funcionam em ferramentas de programação como Claude Code, Cline, OpenCode e mais de 20 outros clientes. O custo em créditos varia por modelo: o GLM-5.3 é faturado com multiplicadores de 6,9 na entrada, 1,7 na entrada em cache e 24 na saída, o GLM-5.3 Flash com 2,3, 0,56 e 8, e fora de pico o consumo custa metade da tarifa padrão de créditos, sendo o pico de segunda a sexta das 14:00 às 18:00 hora de Singapura. De 25 de setembro a 7 de outubro de 2026 a Z.ai cobra a tarifa fora de pico a toda a hora. A faturação anual reduz os preços para $151.20, $672 e $1.411,20 por ano.

Como reduzir a sua fatura GLM

O GLM já é barato, mas três hábitos reduzem ainda mais o custo. Primeiro, aproveite a entrada em cache. Reutilizar o mesmo prompt de sistema ou contexto de documento é faturado à tarifa em cache, que é cerca de um quinto do preço de entrada padrão. Segundo, ajuste o modelo à tarefa, pois o GLM-4.7 ou os modelos Flash gratuitos lidam com a maioria das tarefas de programação e conversação sem precisar do modelo de topo.

Terceiro, fique de olho no relógio. O Coding Plan cobra metade da tarifa de créditos fora de pico, e a API padrão ainda custa muito menos do que os níveis US de topo a qualquer hora. Essa vantagem já não se mantém face a todos os modelos US: o GPT-6 Luna a $0.10 / $0.50 é mais barato por token do que qualquer modelo GLM pago, incluindo o GLM-4.5 Air. Se a sua carga de trabalho for irregular, um plano por token pode ganhar a uma subscrição; se programa de forma constante o dia todo, o Coding Plan de taxa fixa normalmente ganha.

GLM vs Claude, ChatGPT, Gemini e DeepSeek em termos de custo

O argumento de venda do GLM é output de classe frontier sem preços frontier. A tabela abaixo compara os modelos de topo do GLM com os modelos que provavelmente já paga, usando tarifas padrão da API por milhão de tokens. O GLM já não detém o piso de preços: o DeepSeek e o GPT-6 Luna ficam ambos abaixo.

ModeloEntrada / MSaída / M
GLM-5.3 (Zhipu)$1.40$4.40
GLM-4.7 (Zhipu)$0.60$2.20
Claude Opus 5.5$4.00$20.00
Claude Sonnet 5$2.00*$10.00*
GPT-6 Sol$2.00$10.00
GPT-6 Astra$10.00$50.00
GPT-6 Luna$0.10$0.50
Gemini 3.1 Pro$2.00$12.00
DeepSeek V4 Pro$0.66**$1.98**
GLM-5.3 Flash (Zhipu)$0.15$0.50

*Os $2.00 / $10.00 do Claude Sonnet 5 eram preços introdutórios; a Anthropic cancelou a subida para $3.00 / $15.00 prevista para 1 de setembro de 2026 e confirmou-o a 10 de agosto de 2026, pelo que $2.00 / $10.00 é agora a tarifa padrão. **O DeepSeek cobra em pico e fora de pico: o V4 Pro custa $0.66 / $1.98 fora de pico e $1.32 / $3.96 em pico, que vai das 01:00 às 04:00 e das 06:00 às 10:00 UTC nos dias de semana.

A situação mudou duas vezes. A escala GPT-6 da OpenAI substituiu as tarifas GPT-5.6 em que esta comparação assentava, e a nova gama média aterra em cima do GLM. O GLM-5.3 ainda custa menos de metade do GPT-6 Sol em saída e pouco mais de um terço do Gemini 3.1 Pro, mas o GPT-6 Luna a $0.10 / $0.50 fica abaixo do GLM-5.3 em 14x na entrada e quase 9x na saída, e bate o GLM-4.7 em ambos. Pior para o argumento: o Sol não está apenas perto no preço, está à frente na qualidade, 48 contra 45 no Intelligence Index v4.3.2 da Artificial Analysis, e a $1.06 por tarefa do índice contra os $2.01 do GLM. A vantagem restante do GLM não é o piso de preço nem qualidade comparável por menos; são os pesos open que pode alojar localmente, um Coding Plan de taxa fixa e modelos Flash gratuitos aos quais o Luna não tem resposta. No topo da escala da OpenAI, o GPT-6 Astra está na tabela de preços a $10.00 / $50.00. Para uma visão mais completa de todos os principais modelos, veja a nossa comparação de preços de IA, e para a outra grande aposta open-weight consulte os preços do Qwen.

Uma alternativa mais simples à faturação por token

A aritmética por token é poderosa, mas cansativa, e a maioria das pessoas não quer monitorizar tarifas de entrada e saída ou gerir uma conta z.ai separada. Se é o seu caso, a rota mais simples é uma subscrição de taxa fixa que inclui o GLM juntamente com os outros modelos frontier.

No Fello, o GLM-5.3 fica lado a lado com Claude, GPT e Gemini por um único preço de $9.99 por mês. Pode correr o mesmo prompt por vários modelos ao mesmo tempo e ficar com a melhor resposta, sem faturação por token, sem gestão de quotas e sem precisar de criar uma conta na China. É a forma mais fácil de experimentar o GLM sem se preocupar com preços antes de se comprometer com a API. No Mac instala-se como um cliente desktop nativo do GLM, pelo que o preço fixo cobre uma aplicação a sério em vez de um separador de navegador.

Conclusão

Os preços do GLM são tão amigáveis quanto é possível para um modelo de classe frontier. O chat é gratuito, três modelos da API não custam nada, o GLM-5.3 funciona a menos de metade do GPT-6 Sol em saída, e o GLM Coding Plan limita o uso intensivo a uma taxa mensal fixa. Já não é a opção mais barata por token, no entanto, agora que o DeepSeek e o GPT-6 Luna ficam abaixo dele.

Para a maioria das pessoas, o passo inteligente é começar de graça em chat.z.ai, usar o GLM-4.7 ou o GLM-5.3 Flash para programação barata via API, e avançar para o GLM-5.3 quando precisar do modelo de topo. E se preferir evitar a faturação por token, execute o GLM juntamente com Claude e GPT no Fello por um preço fixo.

FAQ

Quanto custa o GLM?

O GLM-5.3 custa $1.40 por milhão de tokens de entrada e $4.40 por milhão de saída na API oficial Z.ai, menos de metade do GPT-6 Sol em saída. O GLM-4.7 é mais barato a $0.60 / $2.20 e o GLM-5.3 Flash a $0.15 / $0.50, e o chat mais três modelos Flash são gratuitos. O GLM-5.2 continua listado exatamente à mesma tarifa do GLM-5.3.

O GLM é gratuito?

Sim. Pode conversar com o GLM gratuitamente em chat.z.ai, os pesos do modelo até ao GLM-5.2 são open-source sob a licença MIT, e o GLM-4.7 Flash, o GLM-4.5 Flash e o GLM-4.6V Flash são gratuitos na API para entrada, entrada em cache e saída. Os pesos do GLM-5.3 também são públicos, no Hugging Face desde 28 de agosto de 2026, mas sob uma licença GLM 5.3 própria e não MIT.

Quanto custa o GLM Coding Plan?

O GLM Coding Plan tem três níveis: Lite a $18, Pro a $80 e Max a $168 por mês, ou 30% menos na faturação anual. Desde 30 de julho de 2026 cada nível serve apenas o GLM-5.3 e o GLM-5.3 Flash, medido em créditos e não em prompts, para uso em ferramentas como Claude Code e Cline.

O GLM é mais barato do que o ChatGPT e o Claude?

Mais barato do que os modelos de topo, sim. O GLM-5.3 funciona a menos de metade do GPT-6 Sol em saída e a um quinto do Claude Opus 5.5 ($4.00 / $20.00). Não é a opção mais barata no geral, no entanto, e também não é o modelo mais forte: o DeepSeek e o GPT-6 Luna ($0.10 / $0.50) ficam ambos abaixo, e o GPT-6 Sol supera-o 48 a 45 no Intelligence Index v4.3.2 da Artificial Analysis.

Qual é o modelo GLM mais barato?

O GLM-4.7 Flash, o GLM-4.5 Flash e o GLM-4.6V Flash são gratuitos na API. Entre os modelos de texto pagos, o mais barato é o GLM-4.7-FlashX a $0.07 de entrada e $0.40 de saída por milhão de tokens, depois o GLM-5.3 Flash a $0.15 / $0.50 e o GLM-4.5 Air a $0.20 / $1.10.