(Essayez l'IA de Yiaho, c'est gratuit !)
L’essentiel
- GLM-5.2 est le nouveau modèle d’IA du laboratoire chinois Zhipu AI (Z.ai), sorti le 13 juin 2026.
- Il est open source (licence MIT, sans restriction de pays), gratuit à tester en ligne, et coûterait environ 6 fois moins cher que GPT-5.5 sur l’API.
- Sur le code « longue durée », il se classe 2ᵉ derrière Claude Opus 4.8 et devance GPT-5.5 — c’est le meilleur modèle ouvert du moment.
- Son atout phare : une fenêtre de contexte d’1 million de tokens qui tient sur des tâches très longues.
- Vous cherchez « klm 5.2 » ? C’est la même chose : il s’agit d’une faute de frappe courante pour GLM-5.2.
Le calendrier est presque ironique. Quelques jours après que les États-Unis ont durci l’accès à leurs IA de pointe, un laboratoire chinois sort un modèle gratuit, ouvert et redoutable. Le 13 juin 2026, Zhipu AI (qui commercialise ses produits sous la marque Z.ai) a publié GLM-5.2 : un modèle taillé pour le code, capable de rivaliser avec les meilleurs systèmes fermés du marché tout en restant téléchargeable par n’importe qui.
Si vous êtes tombé sur le terme « klm 5.2 », pas d’inquiétude : c’est simplement une coquille fréquente. Le vrai nom est GLM-5.2 (pour « General Language Model »). Voici, en clair, ce qu’il faut retenir de cette sortie qui agite déjà la communauté de l’IA.

GLM-5.2, c’est quoi exactement ?
GLM-5.2 est un grand modèle de langage (le type d’IA derrière les agents conversationnels comme ChatGPT) conçu par Zhipu AI, l’un des laboratoires d’IA les plus en vue de Chine. Son nom de marque grand public est Z.ai.
Là où la plupart des modèles de pointe restent fermés (impossible de récupérer leur « cerveau »), Zhipu a fait le choix inverse : GLM-5.2 est ouvert. Ses poids sont publiés sur Hugging Face et ModelScope, son code sur GitHub, le tout sous licence MIT — l’une des plus permissives qui soit.
En clair
Mixture-of-Experts (MoE) : le modèle compte 744 milliards de paramètres au total, mais n’en active qu’une fraction à chaque réponse, en aiguillant la requête vers les « experts » utiles. Résultat : la puissance d’un très gros modèle sans en payer tout le coût de calcul.
Fenêtre de contexte : la quantité de texte que l’IA peut garder « en tête » d’un coup. 1 million de tokens, c’est l’équivalent de plusieurs gros livres — assez pour analyser un projet logiciel entier ou des milliers de pages.
Autre nouveauté pratique : on peut régler l’effort de réflexion du modèle sur trois niveaux — Non-Thinking (réponse rapide), High et Max. Le mode « Max » mobilise beaucoup plus de calcul pour s’attaquer aux problèmes les plus coriaces, tandis que « High » suffit déjà à atteindre l’essentiel des performances.
— Zhipu AI, à propos du défi technique de GLM-5.2
Des performances qui talonnent les leaders
C’est sur le code de longue haleine — des tâches qui s’étalent sur des heures et des milliers d’étapes — que GLM-5.2 impressionne. Sur les principaux tests de référence, il se place juste derrière Claude Opus 4.8 (le modèle d’Anthropic) et devant GPT-5.5 d’OpenAI. Surtout, il devient le meilleur modèle « à poids ouverts » disponible, devant DeepSeek, MiniMax ou Kimi.

| Test (benchmark) | Ce qu’il mesure | GLM-5.2 | Repère |
|---|---|---|---|
| FrontierSWE | Projets de code de plusieurs heures | 74,4 % | 1 point derrière Opus 4.8, devant GPT-5.5 |
| Terminal-Bench 2.1 | Code en ligne de commande | 81,0 % | contre 63,5 % pour GLM-5.1 |
| SWE-bench Pro | Correction de bugs réels | 62,1 % | contre 58,4 % pour GLM-5.1 |
| AIME 2026 | Mathématiques de concours | 99,2 % | niveau quasi parfait |
| Indice Artificial Analysis | Intelligence générale (agrégat) | 51 | 1ᵉʳ des modèles ouverts |
Là où il brille
- Code agentique et long contexte : c’est sa spécialité, et il y rivalise avec les meilleurs.
- Mathématiques : 99,2 % sur AIME 2026, un quasi sans-faute.
- Modèles ouverts : selon la plateforme indépendante Artificial Analysis, c’est le modèle à poids ouverts le plus performant du moment.
Là où il reste en retrait
- Raisonnement « pur » : sur le test exigeant Humanity’s Last Exam, il reste derrière Claude Opus 4.8 (~10 points) et Gemini 3.1 Pro (~5 points).
- Tâches très longues : sur SWE-Marathon (construction de compilateur, optimisation de noyau), il n’atteint que la moitié du score d’Opus 4.8.
- Gourmandise en tokens : pour atteindre ces résultats, il consomme nettement plus de tokens que ses rivaux ouverts — un des modèles les moins « économes » de sa catégorie.
À nuancer
« 2ᵉ derrière Opus 4.8 » concerne avant tout le code. Pour du raisonnement complexe, de la recherche scientifique ou un usage généraliste très exigeant, les modèles fermés gardent une avance. GLM-5.2 brille surtout pour les développeurs et les tâches longues.
Gratuit, ouvert… et environ 6 fois moins cher
Le mot qui revient partout, c’est « gratuit » — et c’est en partie vrai. On peut discuter avec GLM-5.2 sans payer via l’assistant en ligne de Z.ai. Pour les développeurs qui passent par l’API (paiement à l’usage), les tarifs restent très agressifs.

| Accès | Coût |
|---|---|
| Assistant en ligne (chat Z.ai) | Gratuit à l’essai |
| API — tokens d’entrée | 1,40 $ / million |
| API — tokens de sortie | 4,40 $ / million |
| API — entrée « mise en cache » | 0,26 $ / million |
| Télécharger les poids (Hugging Face) | Gratuit (licence MIT) |
Selon plusieurs analyses, GLM-5.2 battrait GPT-5.5 sur plusieurs tests de code longue durée pour environ un sixième du prix (source : VentureBeat). C’est l’argument massue du modèle : des performances proches du sommet, à une fraction du coût.
« Open source » : ça change quoi ?
Une licence MIT « sans restriction de pays » signifie que n’importe qui, partout, peut télécharger, modifier et déployer le modèle — y compris en entreprise et hors ligne. C’est rare pour un modèle de pointe venu d’un labo chinois, et c’est précisément ce qui rend cette sortie remarquée.
Comment tester GLM-5.2 (gratuitement) ?
Plusieurs portes d’entrée, du plus simple au plus technique :
- L’assistant en ligne Z.ai — rendez-vous sur le chat de Z.ai pour discuter directement avec le modèle, sans installation. Le plus rapide pour se faire une idée.
- Le GLM Coding Plan — un abonnement décliné en quatre formules (Lite, Pro, Max, Team) pensé pour les développeurs, avec un quota d’usage du modèle dans les outils de code.
- L’API — pour intégrer GLM-5.2 dans vos propres applications, ou le brancher sur des agents de code comme ZCode, Claude Code ou OpenCode. Disponible aussi via des plateformes comme OpenRouter.
- En local — les développeurs avertis peuvent faire tourner les poids chez eux (Ollama, Hugging Face, vLLM, SGLang…). Prévoir une machine costaude : 744 milliards de paramètres, ça ne tient pas sur un ordinateur portable.
Pas envie d’installer quoi que ce soit ? Vous pouvez aussi tester une IA conversationnelle gratuite et en français directement sur Yiaho — pratique pour comparer les réponses avant de choisir un outil. Pour bien démarrer, notre guide complet de l’IA explique comment comprendre et utiliser ces modèles au quotidien.
Pourquoi cette sortie compte vraiment
Au-delà des chiffres, GLM-5.2 est un signal géopolitique. Le modèle arrive dans un climat de tensions sur l’accès aux IA : Washington a resserré ses contrôles à l’export et imposé des limites à certains modèles américains pour les utilisateurs étrangers. En face, la Chine répond par l’ouverture totale — un modèle de pointe, gratuit, sans barrière de frontière.
La concurrence entre laboratoires chinois est féroce. GLM-5.2 affronte directement Kimi K2.7-Code (Moonshot AI), MiniMax M3, ou encore Qwen3-Max d’Alibaba, tous lancés à un rythme effréné. De quoi alimenter le débat sur la course mondiale à l’IA entre la Chine et les États-Unis.
Pour les entreprises et développeurs européens, c’est aussi une opportunité : un modèle puissant, librement déployable sur ses propres serveurs (donc sans envoyer ses données à un tiers), à un coût maîtrisé. Une dynamique que l’on retrouve dans le premier classement officiel des modèles d’IA publié par le gouvernement français.
Questions fréquentes sur GLM-5.2
GLM-5.2 est-il vraiment gratuit ?
Oui pour l’essentiel : on peut l’utiliser sans payer via l’assistant en ligne de Z.ai, et télécharger gratuitement ses poids (licence MIT). En revanche, l’usage intensif via l’API est payant (à partir de 1,40 $ par million de tokens d’entrée), et le faire tourner en local suppose un matériel coûteux.
« klm 5.2 » et « glm 5.2 », c’est pareil ?
Oui. « klm 5.2 » est une faute de frappe répandue : le vrai nom est GLM-5.2 (« General Language Model », version 5.2), de Zhipu AI / Z.ai. KLM est par ailleurs une compagnie aérienne, sans aucun rapport avec ce modèle d’IA.
GLM-5.2, ChatGPT ou Claude : lequel choisir ?
Pour du code long et exigeant à petit prix, GLM-5.2 est très compétitif. Pour du raisonnement général très poussé ou un usage grand public clé en main, GPT-5.5 (ChatGPT) et Claude Opus 4.8 gardent l’avantage. Le bon choix dépend donc surtout de votre usage et de votre budget.
Peut-on utiliser GLM-5.2 en français ?
Oui, comme la plupart des grands modèles récents, GLM-5.2 gère le français. Pour un usage 100 % en français sans inscription, vous pouvez aussi tester directement l’IA de Yiaho.
Quelle configuration pour le faire tourner chez soi ?
Avec 744 milliards de paramètres, GLM-5.2 vise les serveurs équipés de plusieurs GPU haut de gamme, pas les ordinateurs personnels. Zhipu prend en charge des moteurs comme vLLM, SGLang, transformers ou ktransformers pour le déploiement local.
Qui est Zhipu AI (Z.ai) ?
Zhipu AI est un laboratoire d’intelligence artificielle chinois, l’un des plus avancés du pays. Il développe la famille de modèles GLM et les commercialise sous la marque Z.ai. GLM-5.2 succède à GLM-5.1, déjà réputé pour ses capacités de codage autonome.
Envie d’essayer une IA gratuitement, dès maintenant ?
Pas besoin d’installer GLM-5.2 pour profiter de l’IA. Testez gratuitement l’assistant Yiaho, en français et sans inscription, et jugez par vous-même.
Sources : Zhipu AI / Z.ai (blog officiel et documentation) ; The Decoder ; DeepLearning.AI (The Batch) ; VentureBeat ; Artificial Analysis. Données vérifiées au 18 juin 2026.


