Les tarifs GLM sont la principale raison pour laquelle les développeurs continuent de basculer vers les modèles de Zhipu AI. Le haut de gamme GLM-5.2 ne coûte que $1.40 par million de tokens en entrée et $4.40 par million en sortie sur l’API officielle, soit environ un sixième de ce que facture GPT-5.5, et le GLM-4.7 plus ancien est encore moins cher. Vous pouvez aussi utiliser GLM gratuitement dans le navigateur, et deux des modèles ne coûtent rien du tout via l’API. Le modèle le plus récent, GLM 5.3, fait exception à tout cela, car Z.ai n’a pas encore publié de tarif au token pour lui.

Ce guide détaille chaque façon de payer GLM en 2026 : le niveau gratuit, les tarifs API au token pour chaque modèle, et l’abonnement GLM Coding Plan, qui démarre à $18 par mois. Nous terminons par une comparaison de coût face à Claude, ChatGPT, Gemini et DeepSeek, mise à jour après la baisse tarifaire d’OpenAI du 30 juillet 2026, qui a fait passer GPT-5.6 Luna à $0.20 / $1.20 et le fait désormais passer sous GLM-5.2. Le prix ne fait que la moitié de l’histoire, alors consultez notre comparatif de GLM face aux meilleurs modèles fermés côté qualité aussi. Si vous découvrez la famille, commencez par ce qu’est GLM.

Les points clés à retenir

  • GLM est gratuit sur chat.z.ai, et GLM-4.7 Flash et GLM-4.5 Flash sont aussi entièrement gratuits sur l’API.
  • Le tarif API de GLM-5.2 est de $1.40 en entrée / $4.40 en sortie par million de tokens, soit environ un septième de GPT-5.6 Sol sur la sortie et bien en dessous de Claude Opus 5, même si GPT-5.6 Luna est désormais moins cher que les deux.
  • GLM-4.7 est le choix économique pour le code à $0.60 en entrée / $2.20 en sortie par million de tokens, avec une entrée en cache jusqu’à $0.11.
  • Le GLM Coding Plan est un abonnement à tarif fixe à $18 (Lite), $72 (Pro) et $160 (Max) par mois, ou 30 % de moins en facturation annuelle.
  • GLM-5.3 n’a aucun tarif au token publié. Il a été lancé le 14 août 2026 uniquement dans le Coding Plan et ZCode, si bien que la grille tarifaire de l’API s’arrête encore à GLM-5.2.
  • Dans Fello AI, GLM-5.2 est réuni avec Claude, GPT et Gemini pour un tarif fixe unique de $9.99 par mois, sans facturation au token.

Les tarifs GLM en un coup d’œil

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

Voici l’ensemble des tarifs GLM dans un seul tableau. Les options gratuites le sont réellement, les tarifs API comptent parmi les plus bas de tous les modèles de niveau frontière, et le Coding Plan est un tarif mensuel fixe pour un usage intensif.

Ce que vous payezCoût
Chat GLM (chat.z.ai)Gratuit
API GLM-4.7 Flash / GLM-4.5 FlashGratuit
API GLM-5.2$1.40 en entrée / $4.40 en sortie par million de tokens
API GLM-5.3Non publié ; Coding Plan et ZCode uniquement
API GLM-4.7$0.60 en entrée / $2.20 en sortie par million de tokens
GLM Coding Plan$18 / $72 / $160 par mois

GLM est-il gratuit ?

Oui, et de plus de façons que la plupart des concurrents. Vous pouvez discuter gratuitement avec GLM-5.2 sur chat.z.ai, sans abonnement, de la même manière que vous utiliseriez un compte ChatGPT gratuit. Comme chaque modèle jusqu’à GLM-5.2 est en poids ouverts et sous licence MIT, vous pouvez aussi télécharger les poids depuis Hugging Face et les exécuter vous-même sans aucun coût de licence. GLM-5.3 fait exception, ses poids étant retenus en attendant une revue de sécurité.

La surprise, c’est que l’API propose aussi des modèles gratuits. GLM-4.7 Flash, GLM-4.5 Flash et le modèle de vision GLM-4.6V Flash sont affichés à $0 pour l’entrée, l’entrée en cache et la sortie, si bien que vous pouvez créer de vraies applications avec eux sans payer au token. Cela fait de GLM l’un des modèles sérieux les moins chers pour prototyper, et c’est une grande partie de la raison pour laquelle il figure dans les listes des meilleurs modèles d’IA open source.

Tarifs de l’API GLM par modèle

Sur l’API officielle de Z.ai, chaque modèle est facturé par million de tokens, réparti entre entrée, entrée en cache et sortie. L’entrée en cache s’applique lorsque vous réutilisez le même contexte, et elle réduit le tarif d’entrée à environ un cinquième. Les tarifs complets par modèle sont ci-dessous, tirés de la documentation tarifaire de Z.ai.

ModèleEntrée / MEntrée en cache / MSortie / M
GLM-5.2$1.40$0.26$4.40
GLM-5-Turbo$1.20$0.24$4.00
GLM-4.7$0.60$0.11$2.20
GLM-4.7 FlashGratuitGratuitGratuit
GLM-4.5 Air$0.20$0.03$1.10

GLM-5.2 (tarif du modèle phare)

GLM-5.2 est le modèle que la plupart des gens visent en parlant des tarifs GLM, et le GLM le plus cher à avoir un tarif publié. À $1.40 en entrée et $4.40 en sortie par million de tokens, il coûte environ un septième de GPT-5.6 Sol sur la sortie et moins d’un cinquième du tarif de sortie de $25.00 de Claude Opus 5, tout en affichant des scores compétitifs sur des benchmarks indépendants. L’entrée en cache descend à $0.26, donc les contextes longs et répétés reviennent encore moins cher. Les benchmarks complets se trouvent dans notre analyse de GLM 5.2.

GLM-5.3 (tarif non publié)

GLM-5.3 a été lancé le 14 août 2026 et n’apparaît pas du tout sur la grille tarifaire. Z.ai déploie ce modèle progressivement derrière une revue de sécurité, si bien qu’au moment de la publication il n’est accessible que via le GLM Coding Plan et l’agent ZCode de Z.ai, avec un accès API plus large promis plus tard. Si vous établissez un budget pour l’API, vous travaillez encore sur la base de la ligne GLM-5.2 ci-dessus. Ce que vous obtenez pour l’abonnement, et les benchmarks qui vont avec, se trouvent dans notre analyse de GLM 5.3. Son petit frère moins cher GLM 5.3 Flash est arrivé le 26 août 2026 et apparaît bien, à $0.15 en entrée et $0.50 en sortie par million de tokens, actuellement réduit de moitié par une promotion de lancement qui court jusqu’au 9 septembre.

GLM-5-Turbo

GLM-5-Turbo est le frère jumeau optimisé pour la vitesse, à $1.20 en entrée et $4.00 en sortie par million de tokens. Il sacrifie un peu de qualité brute pour des réponses plus rapides et un coût légèrement inférieur, ce qui en fait un bon choix pour les applications à fort volume ou sensibles à la latence.

GLM-4.7 (choix économique pour le code)

GLM-4.7 est le champion du rapport qualité-prix à $0.60 en entrée et $2.20 en sortie par million de tokens, avec une entrée en cache aussi basse que $0.11. Il obtient encore 73,8 % sur SWE-bench Verified, l’un des meilleurs résultats jamais publiés par un modèle ouvert, si bien que vous obtenez du code sérieux pour une fraction des prix des modèles phares. C’est aussi le modèle par défaut à l’intérieur du GLM Coding Plan.

GLM-4.7 Flash (gratuit)

GLM-4.7 Flash est entièrement gratuit sur l’API, pour l’entrée, l’entrée en cache et la sortie. C’est un modèle plus petit et plus rapide destiné au code local et à fort volume, et avec GLM-4.5 Flash, il vous permet de lancer un produit fonctionnel sans jamais payer au token.

GLM-4.5 Air

GLM-4.5 Air est l’option légère héritée de la gamme à $0.20 en entrée et $1.10 en sortie par million de tokens, avec une entrée en cache à seulement $0.03. C’est le modèle payant le moins cher de la gamme, et il gère encore très bien le chat et le raisonnement du quotidien.

Le GLM Coding Plan : Lite, Pro et Max

Si vous codez toute la journée, la facturation au token devient fastidieuse, alors Zhipu vend à la place un GLM Coding Plan à tarif fixe. C’est l’abonnement devenu viral chez les développeurs à la recherche d’une alternative moins chère à Claude, car il regroupe GLM-5.2, GLM-5-Turbo, GLM-4.7 et GLM-4.5-Air avec des quotas de prompts généreux. Chaque palier inclut désormais aussi GLM-5.3, la seule façon d’atteindre ce modèle aujourd’hui. Les trois paliers, tirés de la page d’abonnement de Z.ai, sont ci-dessous.

PalierMensuelFacturation annuelle (-30 %)Quota d’usage
Lite$18$12.60~80 prompts / 5 h, ~400 / semaine
Pro$72$50.40~400 prompts / 5 h, ~2 000 / semaine
Max$160$112~1 600 prompts / 5 h, ~8 000 / semaine

Les trois paliers donnent accès à la même gamme de modèles et fonctionnent dans des outils de code comme Claude Code, Cline, Roo Code et plus de 20 autres clients. Les prompts sur GLM-5.2 et GLM-5-Turbo consomment le quota à 3x aux heures de pointe et 2x en dehors, même si une promotion à 1x en heures creuses court jusqu’en septembre 2026. La facturation annuelle fait encore baisser les prix, à environ $151, $605 et $1,344 par an.

Comment réduire votre facture GLM

GLM est déjà bon marché, mais trois habitudes font encore baisser le coût. D’abord, appuyez-vous sur l’entrée en cache. Réutiliser le même prompt système ou contexte documentaire se facture au tarif en cache, qui représente environ un cinquième du tarif d’entrée standard. Ensuite, adaptez le modèle à la tâche, car GLM-4.7 ou les modèles Flash gratuits gèrent la plupart du code et du chat sans toucher au modèle phare.

Enfin, surveillez l’horloge. Le Coding Plan facture moins de quota en heures creuses, et l’API standard reste bien moins chère que les paliers phares américains à toute heure. Cet écart ne tient toutefois plus face à tous les modèles américains : depuis la baisse tarifaire d’OpenAI de juillet 2026, GPT-5.6 Luna à $0.20 / $1.20 coûte moins cher au token que tout modèle GLM payant à l’exception de GLM-4.5 Air. Si votre charge de travail est irrégulière, un forfait au token peut battre un abonnement ; si vous codez régulièrement toute la journée, le Coding Plan à tarif fixe l’emporte généralement.

GLM face à Claude, ChatGPT, Gemini et DeepSeek côté coût

Tout l’argument de GLM, c’est une sortie de niveau frontière sans les prix qui vont avec. Le tableau ci-dessous compare les modèles phares GLM à ceux que vous payez sans doute déjà, avec les tarifs API standard par million de tokens. GLM ne détient plus le prix plancher : DeepSeek et GPT-5.6 Luna passent tous les deux en dessous.

ModèleEntrée / MSortie / M
GLM-5.2 (Zhipu)$1.40$4.40
GLM-4.7 (Zhipu)$0.60$2.20
Claude Opus 5$5.00$25.00
Claude Sonnet 5$2.00*$10.00*
GPT-5.6 Sol$4.00$20.00
GPT-5.6 Terra$2.00$12.00
GPT-5.6 Luna$0.20$1.20
Gemini 3.1 Pro$2.00$12.00
DeepSeek V4 Pro$0.44$0.87
Qwen3.7 Max$1.25$3.75

*Claude Sonnet 5 bénéficie d’un tarif de lancement de $2.00 / $10.00. Les tarifs standard de $3.00 / $15.00 devaient entrer en vigueur le 1er septembre 2026, mais Anthropic a annulé la hausse le 10 août 2026.

Le tableau a changé le 30 juillet 2026. GLM-5.2 coûte encore moins de la moitié de Gemini 3.1 Pro sur la sortie et environ un septième de GPT-5.6 Sol, mais la baisse d’OpenAI fait que GPT-5.6 Luna passe désormais sous GLM-5.2 d’environ 7x en entrée et 3,7x en sortie, et bat aussi GLM-4.7 sur les deux plans. L’avantage restant de GLM n’est pas le prix plancher brut ; ce sont des poids ouverts que vous pouvez auto-héberger, un Coding Plan à tarif fixe, et des modèles Flash gratuits auxquels Luna n’a aucune réponse. OpenAI a depuis encore déplacé le sommet de sa propre gamme : GPT-6 Astra a été lancé le 3 septembre 2026 à $10.00 / $50.00, soit environ 2,5x GPT-5.6 Sol, et il n’est pas encore accessible via l’API, si bien que la ligne Sol ci-dessus reste le tarif phare que vous pouvez réellement acheter. Pour une vue d’ensemble sur tous les grands modèles, consultez notre comparatif des tarifs IA, et pour l’autre grande référence à poids ouverts côté rapport qualité-prix, découvrez les tarifs de Qwen.

Une alternative plus simple à la facturation au token

La facturation au token est puissante mais épuisante, et la plupart des gens ne veulent pas suivre les tarifs d’entrée et de sortie ni gérer un compte z.ai séparé. Si c’est votre cas, la voie la plus simple est un abonnement à tarif fixe qui inclut GLM aux côtés des autres modèles phares.

Dans Fello, GLM-5.2 se trouve aux côtés de Claude, GPT et Gemini pour un tarif unique de $9.99 par mois. Vous pouvez lancer le même prompt sur plusieurs modèles à la fois et garder la meilleure réponse, sans facturation au token, sans jonglage de quotas et sans compte hébergé en Chine à configurer. C’est le moyen le plus simple d’essayer GLM sans frais avant de vous engager sur l’API. Sur Mac, il s’installe comme un client de bureau GLM natif, si bien que le tarif fixe couvre une vraie application plutôt qu’un onglet de navigateur.

Conclusion

Les tarifs GLM sont à peu près aussi accueillants que possible pour un modèle de niveau frontière. Le chat est gratuit, deux modèles de l’API ne coûtent rien, GLM-5.2 tourne à environ un septième de GPT-5.6 Sol sur la sortie, et le GLM Coding Plan plafonne l’usage intensif à un tarif mensuel fixe. Ce n’est plus l’option la moins chère au token, cela dit, maintenant que DeepSeek et GPT-5.6 Luna se situent tous les deux en dessous.

Pour la plupart des gens, le bon réflexe est de commencer gratuitement sur chat.z.ai, de passer à GLM-4.7 quand vous avez besoin de code bon marché via l’API, puis de monter en gamme vers GLM-5.2 pour le modèle phare. Et si vous préférez éviter complètement la facturation au token, faites tourner GLM aux côtés de Claude et GPT dans Fello pour un tarif fixe unique.

FAQ

Combien coûte GLM ?

GLM-5.2 coûte $1.40 par million de tokens en entrée et $4.40 par million en sortie sur l’API officielle de Z.ai, soit environ un septième de GPT-5.6 Sol sur la sortie. GLM-4.7 est moins cher à $0.60 / $2.20, et le chat plus deux modèles Flash sont gratuits. Le plus récent GLM-5.3 n’a aucun tarif au token publié et n’est vendu qu’à l’intérieur du Coding Plan.

GLM est-il gratuit ?

Oui. Vous pouvez discuter gratuitement avec GLM sur chat.z.ai, les poids des modèles jusqu’à GLM-5.2 sont open source sous licence MIT, et GLM-4.7 Flash et GLM-4.5 Flash sont gratuits sur l’API pour l’entrée, l’entrée en cache et la sortie. GLM-5.3 n’a pas encore de poids publics.

Combien coûte le GLM Coding Plan ?

Le GLM Coding Plan compte trois paliers : Lite à $18, Pro à $72 et Max à $160 par mois, ou 30 % de moins en facturation annuelle. Tous les paliers regroupent GLM-5.2, GLM-5-Turbo, GLM-4.7, GLM-4.5-Air et le plus récent GLM-5.3 pour un usage dans des outils comme Claude Code et Cline.

GLM est-il moins cher que ChatGPT et Claude ?

Moins cher que les modèles phares, oui. GLM-5.2 tourne à environ un septième de GPT-5.6 Sol sur la sortie et bien en dessous de Claude Opus 5 ($5.00 / $25.00), tout en les égalant sur la plupart des tâches courantes. Ce n’est pas l’option la moins chère dans l’absolu, cela dit : DeepSeek et GPT-5.6 Luna ($0.20 / $1.20) passent tous les deux en dessous.

Quel est le modèle GLM le moins cher ?

GLM-4.7 Flash et GLM-4.5 Flash sont gratuits sur l’API. Parmi les modèles payants, GLM-4.5 Air est le moins cher à $0.20 en entrée et $1.10 en sortie par million de tokens, suivi de GLM-4.7 à $0.60 / $2.20.