Mise à jour, 28 juillet 2026 : GLM 5.2 n'est plus le modèle à poids ouverts le plus puissant. Kimi K3 a publié ses poids le 27 juillet 2026 et le devance dans l'Artificial Analysis Intelligence Index par 57 à 51. GLM 5.2 conserve un vrai avantage en matière de licence et de matériel, et la section des benchmarks ci-dessous a été réévaluée.

GLM 5.2 est arrivé le 13 juin 2026 avec trois chiffres marquants. Il s'agit d'une architecture Mixture-of-Experts à 744 milliards de paramètres dotée d'une fenêtre de contexte d'un million de tokens, sous licence MIT, ce qui rend les poids libres de téléchargement et d'utilisation pour tous. Le laboratoire chinois d'IA Zhipu AI (qui opère sous le nom de Z.ai) l'a présenté comme un modèle de pointe pensé d'abord pour le code, et le timing n'avait rien de discret. Il a été rendu public deux jours seulement après que les États-Unis ont ordonné à Anthropic de couper l'accès étranger à ses modèles Fable 5 et Mythos 5. Pour une vue d'ensemble, consultez notre comparatif sur la façon dont GLM se positionne face aux autres modèles de référence comme Claude, GPT et Gemini.

GLM 5.2 n'est plus le modèle open source le mieux classé, mais il reste celui vers lequel la plupart des gens devraient se tourner. Notre comparatif des meilleurs modèles d'IA open source place désormais Kimi K3 en tête sur la capacité brute, tandis que GLM 5.2 reste le choix pratique en tant que modèle le plus puissant à porter une simple licence MIT. Si la catégorie elle-même vous est nouvelle, notre explication sur ce qu'est l'IA open source détaille le fonctionnement réel des poids ouverts et des licences de modèles. Vous trouverez ci-dessous les caractéristiques techniques, ce qui le différencie de GLM 5.1, les benchmarks face à des rivaux comme le Seed 2.1 Pro de ByteDance, et ce que coûte réellement le GLM Coding Plan.

Les points essentiels

  • GLM 5.2 a été lancé le 13 juin 2026 en tant que modèle Mixture-of-Experts à 744B de paramètres avec 40B de paramètres actifs par token.
  • La fenêtre de contexte d'un million de tokens est environ 5 fois plus grande que la limite de ~200K de GLM 5.1, avec une sortie allant jusqu'à 131 072 tokens.
  • Il est distribué sous licence MIT, avec des poids ouverts, une API autonome, et le chatbot Z.ai arrivé la semaine suivant le lancement.
  • Le tarif du GLM Coding Plan commence à $18/mois (Lite), avec Pro à $72/mois et Max à $160/mois, et la facturation annuelle offre 20 % de réduction.
  • GLM 5.2 obtient 62,1 sur SWE-bench Pro et 81,0 sur Terminal-Bench 2.1, devant GPT-5.5 et derrière Claude Opus 4.8, mais Kimi K3 a depuis pris la tête des modèles à poids ouverts.

Qu'est-ce que GLM 5.2 ?

De l'éditeur

Tous les modèles d'IA dans une seule app

Fello AI réunit GPT-5.6, Claude 5, Gemini 3.6, Grok 4.5 et plus dans une seule app native pour Mac et iPhone.

Téléchargez maintenant !

GLM 5.2 est le dernier grand modèle de langage phare de Zhipu AI, un laboratoire basé à Pékin devenu l'un des éditeurs de modèles à poids ouverts les plus offensifs de Chine. C'est la dernière sortie de la famille complète de modèles GLM de Zhipu. Il repose sur la base GLM-5 et utilise une architecture Mixture-of-Experts à 744 milliards de paramètres au total, dont seulement 40 milliards s'activent pour chaque token. Cette conception rapproche le coût d'exécution de celui d'un modèle à 40 milliards de paramètres tout en s'appuyant sur les connaissances d'un modèle bien plus vaste.

Cette sortie vise clairement les développeurs. Zhipu a positionné GLM 5.2 autour du code sur des horizons longs et du travail agentique, le genre de tâches en plusieurs étapes où un modèle écrit, exécute et révise du code sur l'ensemble d'un projet. Il se connecte aux clients de code populaires via un point d'accès compatible Anthropic, si bien que des outils comme Claude Code, Cline, OpenCode et OpenClaw peuvent s'y connecter sans SDK propriétaire.

Une chose a changé rapidement après le lancement. Zhipu a livré GLM 5.2 sans scores de benchmark publiés, comme le note la couverture du lancement par MarkTechPost, ce qui a laissé les premières affirmations « bat GPT-5 » comme de simples déclarations du vendeur. En quelques jours, des testeurs indépendants et la fiche technique de l'entreprise ont comblé ce vide, et les chiffres se sont révélés bien supérieurs à ceux du précédent GLM 5.1, qui avait obtenu 58,4 sur SWE-bench Pro. Les résultats complets figurent dans la section benchmarks ci-dessous.

GLM 5.2 face à GLM 5.1 : ce qui a changé

Le saut de GLM 5.1 (sorti le 7 avril 2026) à GLM 5.2 est incrémental sur le papier, mais significatif sur une dimension : le contexte. Le nouveau modèle traite cinq fois plus d'entrée, ce qui change ce que vous pouvez lui fournir en un seul prompt. Voici la comparaison côte à côte.

CaractéristiqueGLM 5.2GLM 5.1Ce qui a changéPourquoi c'est important
Date de sortie13 juin 20267 avril 2026~2 mois d'écartCycle d'itération rapide
Paramètres744B (40B actifs)744B (40B actifs)InchangéMême calcul par token
Fenêtre de contexte1 000 000 tokens~200 000 tokens5 fois plus grandeDes dépôts entiers en un seul prompt
Sortie maximale131 072 tokens~128K tokensÀ peu près égalLongues générations de code
Modes de raisonnementHigh et MaxMode uniqueDeux niveaux d'effortAjuster profondeur et coût
LicenceMIT (poids publiés)MITInchangéPoids entièrement ouverts
SWE-bench Pro62,158,4+3,7 pointsCode plus solide

Les deux modes de raisonnement sont nouveaux et pratiques. High gère la génération courante, tandis que Max est le réglage que Zhipu recommande pour le code complexe en plusieurs étapes, sacrifiant la vitesse pour un raisonnement plus approfondi. Le nombre de paramètres n'a pas bougé entre les deux versions. Les deux comptent 744B au total avec 40B actifs, si bien que le coût d'inférence par token reste inchangé. Ce que Zhipu a changé, c'est l'architecture autour. La fiche du modèle cite IndexShare, qui réutilise un seul indexeur toutes les quatre couches d'attention parcimonieuse et réduit les FLOPs par token de 2,9 fois à un contexte d'un million de tokens. Elle mentionne aussi une couche MTP améliorée pour le décodage spéculatif qui augmente la longueur d'acceptation jusqu'à 20 %.

Benchmarks de GLM 5.2 : ses performances réelles

Le lancement a laissé un vide, mais les données l'ont comblé rapidement. La propre fiche technique de Zhipu et des testeurs indépendants placent GLM 5.2 près de la frontière des modèles fermés sur le code à horizon long. Sur certains tests, l'écart avec Claude Opus 4.8 se réduit à environ un seul point, comme le détaille la couverture de The Decoder. Ce cadrage a depuis évolué à trois reprises. Claude Opus 5 a remplacé Opus 4.8 en tant que modèle phare d'Anthropic le 24 juillet 2026, Claude Fable 5.1 a pris cette place le 1er septembre 2026 et domine l'Artificial Analysis Intelligence Index avec 66 contre 63 pour Opus 5, et Kimi K3 a pris la tête des modèles à poids ouverts avec 57 contre 51 pour GLM 5.2. Le tableau ci-dessous conserve la comparaison réellement effectuée par Zhipu, face à Opus 4.8 et GPT-5.5.

BenchmarkGLM 5.2Claude Opus 4.8GPT-5.5GLM 5.1
SWE-bench Pro (code)62,169,258,658,4
Terminal-Bench 2.1, Terminus-2 (agentique)81,0858463,5
FrontierSWE (horizon long)74,4 %75,1 %72,6 %n/a

Le résultat marquant est SWE-bench Pro, où le 62,1 de GLM 5.2 dépasse GPT-5.5 à 58,6 et son propre prédécesseur à 58,4, tout en restant derrière Claude Opus 4.8 à 69,2. Sur Terminal-Bench 2.1, il a bondi à 81,0 depuis le 63,5 de GLM 5.1 sur le harnais Terminus-2, et sur FrontierSWE, il se situe à moins d'un point derrière Opus 4.8 tout en devançant GPT-5.5. Le choix du harnais compte plus qu'il n'y paraît. Artificial Analysis, qui exécute lui-même Terminal-Bench 2.1, attribue à GLM 5.2 un score de 77,9 contre 85,0 pour Kimi K3 et 84,6 pour Opus 4.8, il faut donc lire tout chiffre isolé en gardant le harnais à l'esprit. Il affiche aussi 99,2 % au test de mathématiques AIME 2026. Pour donner une idée de ce que l'orchestration peut apporter à ces chiffres, le Fugu de Sakana AI atteint 73,7 sur SWE-Bench Pro en répartissant les tâches sur un ensemble de modèles plutôt qu'en s'exécutant seul.

Le véritable titre, c'est l'économie. GLM 5.2 égale ou bat GPT-5.5 sur ces marathons de code pour environ un sixième du coût. Cela le fait passer du statut d'alternative bon marché à celui de concurrent sérieux. Le seul bémol vient de la plateforme indépendante Artificial Analysis, qui a constaté que le modèle consomme bien plus de tokens que ses rivaux pour atteindre ces scores, ce qui en fait l'une des options les moins efficaces en tokens de sa catégorie. Zhipu répercute directement cet appétit dans le prix. Sur le Coding Plan, l'utilisation de GLM 5.2 est décomptée à 3x en heures de pointe et 2x en heures creuses, avec un tarif temporaire de 1x en heures creuses valable jusqu'à fin septembre. Sur des tests de raisonnement en un seul coup difficiles comme Humanity's Last Exam, il reste derrière Opus 4.8 et Gemini 3.1 Pro de plusieurs points, ce qui en fait avant tout un spécialiste du code et des agents.

Pourquoi la fenêtre de contexte d'un million de tokens compte

Une fenêtre de contexte d'un million de tokens signifie que GLM 5.2 peut contenir environ 750 000 mots d'entrée en une seule fois. En pratique, vous pouvez y coller une base de code entière de taille moyenne, un jeu complet de documentation d'API, ou un long corpus de recherche, et demander au modèle de raisonner sur l'ensemble sans découpage. Le modèle est étiqueté glm-5.2[1m] pour signaler la fenêtre étendue, et Z.ai décrit cette capacité comme « utilisable » plutôt que comme un plafond marketing.

Pour le code en particulier, c'est la différence entre donner au modèle un seul fichier et lui donner tout le dépôt. Les outils agentiques qui devaient auparavant résumer ou récupérer des fragments d'un projet peuvent désormais garder bien plus en mémoire de travail. Cela réduit les erreurs qui apparaissent quand un modèle perd la trace de code qu'il ne peut pas voir. Cette force en contexte long est la même raison pour laquelle les modèles ouverts conçus pour tourner sur un Mac ont gagné en popularité auprès des développeurs qui veulent garder le contrôle en local.

GLM 5.2 et le contexte du contrôle des exportations

La date de lancement compte. Dans les jours précédant l'annonce de GLM 5.2, le secrétaire au Commerce des États-Unis a ordonné à Anthropic de bloquer l'accès étranger à Fable 5 et Mythos 5 sous 48 heures, en vertu d'une nouvelle directive de contrôle des exportations. Anthropic a désactivé les deux modèles dans le monde entier en quelques heures, et vous pouvez lire le déroulé complet dans notre couverture de l'arrêt de Fable 5.

Zhipu a présenté GLM 5.2 comme un contrepoids direct. En publiant un modèle de pointe sous licence MIT sans restriction régionale, l'entreprise a vendu les poids ouverts comme une assurance contre le contrôle de l'IA fondamentale par une seule nation ou un seul fournisseur. Les investisseurs ont réagi vite, et l'action de Zhipu a grimpé après l'annonce open source, selon le South China Morning Post. Cela s'inscrit dans une vague plus large de sorties ouvertes chinoises qui inclut la famille Qwen et DeepSeek V4.

Tarifs et disponibilité de GLM 5.2

GLM 5.2 a été déployé immédiatement sur tous les niveaux du GLM Coding Plan, avec l'API autonome, le chatbot Z.ai et les poids MIT téléchargeables, tous publiés dans la semaine suivant le lancement. Le Coding Plan est un abonnement qui passe par le même point d'accès compatible Anthropic, facturé mensuellement, avec une réduction de 20 % sur chaque niveau en facturation annuelle. Chaque niveau est mesuré en prompts, sur une fenêtre glissante de 5 heures et un plafond hebdomadaire.

GLM Coding Plan Lite ($18/mois)

Le niveau d'entrée coûte $18/mois, soit $172.80 par an, ce qui revient à $14.40/mois. Il couvre environ 80 prompts toutes les 5 heures et environ 400 par semaine, ce qui convient aux développeurs individuels ayant une assistance de code modérée. C'est le moyen le moins cher de tester GLM 5.2 dans un outil comme Claude Code.

GLM Coding Plan Pro ($72/mois)

Pro coûte $72/mois, soit $691.20 par an à $57.60/mois, et relève le plafond à environ 400 prompts toutes les 5 heures et 2 000 par semaine. Il vise les utilisateurs avancés qui font des refontes multi-fichiers et des tâches agentiques au quotidien.

GLM Coding Plan Max ($160/mois)

Max coûte $160/mois, soit $1,536 par an à $128/mois, et permet environ 1 600 prompts toutes les 5 heures et 8 000 par semaine, pour les développeurs qui font tourner un agent toute la journée de travail. La tarification par équipe se fait au poste pour les organisations. Pour voir comment cela se compare aux modèles ouverts rivaux, notre analyse de Rio 3.5 Open couvre une autre sortie chinoise à poids ouverts qui mérite la comparaison.

Faut-il utiliser GLM 5.2 ?

Si vous écrivez du code et voulez un modèle à contexte long que vous pouvez exécuter vous-même, GLM 5.2 est le modèle ouvert le plus puissant disponible sous une simple licence MIT, ce qui supprime les restrictions habituelles sur l'usage commercial. Son successeur, GLM 5.3, code mieux mais n'a pas encore de poids publics, si bien que GLM 5.2 reste le plus grand GLM que vous puissiez réellement auto-héberger. Kimi K3 obtient un meilleur score, mais il est distribué sous une licence Moonshot personnalisée et pèse 1,56 To à télécharger contre 1,51 To pour GLM 5.2. Le contexte d'1M de tokens est un vrai avantage pour le travail à l'échelle d'un dépôt, et le point d'accès compatible Anthropic signifie que vous pouvez l'intégrer aux outils existants avec un minimum de friction. Z.ai a depuis publié GLM 5.3 Flash, également sous MIT, un modèle multimodal plus petit de 320B dont les propres benchmarks le placent devant GLM 5.2, si bien que le choix de l'auto-hébergement se joue désormais entre échelle et efficacité.

Les benchmarks ont tranché la question des performances, si bien que les vraies considérations sont désormais la structure des coûts et la juridiction des données. GLM 5.2 est gourmand en tokens, ce qui signifie qu'un usage agentique intensif peut faire grimper la facture plus vite que ne le suggère le prix affiché. Et si les poids ouverts vous permettent de l'auto-héberger en toute confidentialité, passer par l'API hébergée de Z.ai envoie votre code vers des serveurs soumis aux règles chinoises sur les données. C'est un compromis qui mérite réflexion pour un travail sensible ou propriétaire. Si vous préférez ne gérer aucun modèle, des applications comme Fello AI vous donnent accès à Claude, ChatGPT, Gemini, Grok et DeepSeek via un seul abonnement à $9.99/mois. Vous pouvez comparer les résultats sans jongler entre plusieurs comptes ou clés API. GLM 5.2 a lui-même rejoint cette offre dans la mise à jour Fello AI 6.7.0. Sur Mac, il tourne en tant que client de bureau GLM natif, donc sans onglet de navigateur ni clé API à gérer.

Conclusion

GLM 5.2 est une déclaration claire : un modèle de pointe, à contexte d'1M, sous licence MIT, livré quelques jours après un durcissement majeur des exportations américaines. Et contrairement au lancement, les chiffres soutiennent désormais ce cadrage. Il bat GPT-5.5 sur SWE-bench Pro et se rapproche à moins d'un point de Claude Opus 4.8 sur les tâches à horizon long, le tout pour environ un sixième du coût. Ce qui a changé depuis, c'est la compagnie qu'il fréquente, avec Kimi K3 désormais devant lui sur les classements à poids ouverts et Claude Opus 5 devant Opus 4.8 côté fermé. Les réserves restantes sont son fort appétit en tokens et la question de la juridiction des données autour de l'API hébergée. Si vous voulez l'essayer maintenant, le chemin le moins cher est le GLM Coding Plan Lite à $18/mois via un outil comme Claude Code, avec les poids ouverts désormais disponibles pour l'auto-hébergement. La prochaine sortie de Zhipu, GLM 5.5, est déjà attendue plus tard en 2026.

FAQ

GLM 5.2 est-il gratuit ?

Les poids sont publiés sous licence MIT, donc l'auto-hébergement est gratuit et sans restriction pour un usage commercial. L'utiliser via le GLM Coding Plan coûte à partir de $18/mois, tandis que l'API autonome revient à $1.40 par million de tokens en entrée, $0.26 en cas de succès du cache, et $4.40 par million en sortie.

Quelle est la taille de la fenêtre de contexte de GLM 5.2 ?

Il traite jusqu'à 1 000 000 tokens en entrée, soit environ cinq fois la limite de ~200 000 tokens de GLM 5.1, avec une sortie allant jusqu'à 131 072 tokens.

Qui a créé GLM 5.2 ?

Zhipu AI, un laboratoire basé à Pékin qui opère sous le nom de Z.ai, l'un des principaux éditeurs de modèles à poids ouverts en Chine.

GLM 5.2 bat-il GPT-5 ou Claude ?

Sur le code, en partie oui. Les benchmarks publiés après le lancement montrent GLM 5.2 à 62,1 sur SWE-bench Pro, devant GPT-5.5 à 58,6 mais derrière Claude Opus 4.8 à 69,2. Il a été le modèle à poids ouverts le plus puissant disponible pendant environ un mois. Kimi K3 l'a dépassé en juillet 2026, et les leaders fermés, dont Claude Opus 5, conservent toujours une nette avance sur les tâches à horizon long les plus difficiles.

Puis-je utiliser GLM 5.2 avec Claude Code ?

Oui. GLM 5.2 expose un point d'accès compatible Anthropic, donc Claude Code, Cline, OpenCode et des outils similaires peuvent s'y connecter directement.