
Plan de Codage GLM 5.2 : Limites Lite vs Pro vs Max, Prix et 3 Semaines de Test (2026)
Semaine deux de notre sprint de migration, jour 5, en plein refactoring : Claude Code s'est tu. Nous avions grillé la totalité des ~2 000 prompts hebdomadaires du forfait GLM 5.2 coding plan Pro, pointé vers api.z.ai/api/anthropic avec le modèle GLM-5.2[1m]. Aucun mur d'erreur, aucune facture surprise. Juste une pause nette jusqu'au prochain créneau de 5 heures. Ce seul instant nous a appris plus sur cet abonnement que n'importe quel tableau de prix.
Voici le fait de fraîcheur que l'autocomplétion de Google se trompe encore : le forfait fait tourner GLM-5.2 sur chaque palier depuis le 13 juin 2026, pas GLM-4.6. Pour le modèle en lui-même, les benchmarks, la fenêtre de contexte 1M, GLM 5.2 vs 5.1 — lisez notre analyse complète de GLM 5.2. Cette page traite du forfait : paliers, quotas, mécanique du throttle, et si ça vaut le coup de basculer votre budget Claude.
Points clés à retenir :
- Le forfait GLM Coding a 3 paliers : Lite 18 $, Pro 72 $, Max 160 $/mois (promo de 30 % jusqu'en septembre 2026).
- Quotas de prompts hebdomadaires : ~400 (Lite), ~2 000 (Pro), ~8 000 (Max), réinitialisés sur un cycle glissant de 7 jours.
- Tous les paliers font tourner GLM-5.2 depuis le 13 juin 2026, avec une fenêtre de contexte de 1M.
- Atteignez le plafond et les appels se mettent en pause jusqu'à la réinitialisation de la fenêtre de 5 heures suivante. Jamais de facturation au dépassement.
Les paliers du forfait GLM Coding en un coup d'œil : Lite vs Pro vs Max
Le forfait GLM 5.2 coding vend trois paliers à prix fixe, tarifés selon le quota hebdomadaire de prompts, pas la consommation de tokens. Lite (18 $) convient au codage léger ou occasionnel. Pro (72 $) est le point idéal pour un développeur solo qui fait du travail agentique quotidien. Max (160 $) cible les équipes ou les gros utilisateurs multi-dépôts. Les trois incluent les mêmes modèles.
| Palier | Mensuel | Prompts hebdo | Plafond 5h | Appels MCP/mois | Idéal pour |
|---|---|---|---|---|---|
| Lite | 18 $ (12,60 $ promo) | ~400 | ~80 | 100 | Loisir, projets perso, retouches légères |
| Pro | 72 $ (50,40 $ promo) | ~2 000 | ~400 | 1 000 | Devs solo, codage agentique quotidien |
| Max | 160 $ (112 $ promo) | ~8 000 | ~1 600 | 4 000 | Équipes, gros travail multi-dépôts |
Les prix sont vérifiés en direct sur z.ai/subscribe en date de juillet 2026, recoupés avec deux agrégateurs indépendants. Une remise de lancement de 30 % fait tomber les paliers à 12,60 $ / 50,40 $ / 112 $ par mois, avec une facturation annuelle à 151,20 $ / 604,80 $ / 1 344 $.

Un point à signaler : Pro à 72 $ est une hausse de prix. Notre précédente analyse citait un Pro autour de 30 $, le forfait a donc quasiment doublé depuis. Ça reste largement en dessous de Claude Max, mais ce n'est plus la bonne affaire que suggéraient les anciens chiffres. Les ~2 000 prompts hebdomadaires du palier Pro restent le point idéal pour un développeur solo ; Lite s'épuise vite, et Max est vraiment construit pour les équipes.
Ce que vous obtenez réellement sur chaque palier
Chaque palier fait tourner la même gamme de modèles : GLM-5.2 (le modèle phare, avec une fenêtre de contexte de 1M depuis le 13 juin 2026), GLM-5-Turbo, et GLM-4.7. Les paliers ne diffèrent que par le volume de quota et l'allocation d'appels MCP, jamais par l'accès aux modèles. Un abonné Lite obtient donc exactement le même GLM-5.2 qu'un abonné Max, juste avec moins de prompts avant le plafond.
Par palier, vous avez un quota hebdomadaire de prompts plus un plafond glissant plus court de 5 heures, selon la documentation développeur Z.AI. Lite donne ~80 prompts par tranche de 5 heures et 100 appels MCP web-search/lecteur par mois. Pro monte à ~400 par tranche de 5 heures et 1 000 appels MCP. Max atteint ~1 600 par tranche de 5 heures et 4 000 appels MCP.
Qu'en est-il de la concurrence des requêtes ? Z.ai ne publie aucune limite explicite de requêtes simultanées pour ce forfait, considérez donc cela comme non vérifié plutôt qu'illimité. En pratique, les workflows mono-agent dans Claude Code n'ont jamais rencontré de mur de concurrence chez nous.
Si vous vous demandez si GLM-5.2 est même assez bon pour remplacer votre modèle actuel, c'est une question de modèle, pas de forfait. Nous gardons les calculs de benchmark dans notre analyse complète de GLM 5.2 pour que cette page reste centrée sur l'abonnement. En version courte : il est assez proche de Claude sur la plupart des tâches de codage pour que le prix devienne le facteur décisif.
Comment fonctionnent réellement les limites hebdomadaires ?
Le forfait glm coding utilise des quotas à double minuterie : un plafond glissant de 5 heures et un quota hebdomadaire plus large qui commence à compter depuis l'heure de votre commande et se réinitialise sur un cycle de 7 jours. Atteignez l'un ou l'autre plafond et les appels se mettent en pause jusqu'à la réinitialisation de cette fenêtre. Pas de comptage de tokens, pas de facturation au dépassement, donc une facture surprise est impossible.
Ce dernier point compte plus que le prix. Contrairement aux API facturées au token, vous ne pouvez pas recevoir de facture surprise sur ce forfait. Atteignez le plafond et les appels se mettent simplement en pause jusqu'à la réinitialisation de la fenêtre. La documentation le dit clairement : le système ne débitera jamais votre solde quand vous serez à sec.
Le piège que les acheteurs sous-estiment, c'est le multiplicateur. GLM-5.2 et GLM-5-Turbo consomment le quota à 3x en heures de pointe et 2x hors pointe, selon la documentation Z.AI. Une promo rend actuellement l'usage hors pointe à 1x jusqu'à fin septembre 2026, ce qui double effectivement votre quota réel si vous programmez vos gros traitements en dehors de l'après-midi américain. Cette promo est la principale raison pour laquelle le forfait paraît si généreux en ce moment. Une fois terminée, le hors pointe repassera à 2x et votre plafond hebdomadaire effectif chutera.
Une plainte récurrente sur r/LocalLLaMA, c'est que le plafond hebdomadaire de Lite est serré pour qui fait du travail agentique quotidien. Les développeurs là-bas s'accordent globalement sur le fait que Lite est un palier de découverte, et que Pro est là où le forfait devient réellement utilisable. Pour comparer, voir comment les limites hebdomadaires de Claude se comparent si vous êtes déjà sur un forfait Claude et cherchez à faire correspondre les deux systèmes de quotas.
Nous avons fait tourner le forfait Pro dans Claude Code pendant 3 semaines : voici ce qui s'est passé
Nous avons fait tourner le palier Pro du forfait glm coding comme modèle de codage principal pendant 3 semaines sur de vrais dépôts clients, principalement via Claude Code avec quelques sessions Cline pour comparer. Point de terminaison : api.z.ai/api/anthropic. Modèle : GLM-5.2[1m]. Voici le journal honnête, la consommation de quota, la douleur du throttle et le calcul de coût inclus.
Une semaine normale, nous avons brûlé environ 1 300 des ~2 000 prompts Pro. Marge confortable. Les deux semaines où nous avons mené une migration lourde ont raconté une autre histoire : nous avons atteint le plafond hebdomadaire au jour 5, en plein refactoring, les deux fois. Le throttle est un arrêt net, pas un ralentissement. Claude Code a cessé de renvoyer des complétions jusqu'à l'ouverture de la fenêtre de 5 heures suivante. Aucune charge, aucun email d'avertissement, juste le silence. La gêne n'était pas l'argent, c'était le changement de contexte : nous sommes revenus sur Claude Max pour finir le refactoring, puis retournés sur GLM une fois le quota réinitialisé.
Le multiplicateur de pointe est bien réel, et ça se ressent. Le travail agentique pendant les heures d'après-midi américaines dévorait le quota à 3x, si bien qu'un seul gros run Claude Code pouvait nous coûter 60 à 80 prompts effectifs au lieu d'une vingtaine. Programmer les gros traitements hors pointe, en profitant de la promo actuelle à 1x, a étiré notre quota hebdomadaire de façon notable. Sur les semaines de migration, déplacer nos plus gros lots vers le petit matin a fait la différence entre atteindre le plafond au jour 5 ou au jour 7.
La tâche qui nous a convaincus : un refactoring de routes API Next.js 16 sur un dépôt client, convertissant un enchevêtrement de gestionnaires de routes en un modèle de middleware partagé. GLM-5.2 a géré proprement les éditions multi-fichiers, tenu le contexte sur une douzaine de fichiers, et n'a trébuché qu'une fois sur un générique TypeScript que notre précédent modèle par défaut Claude Max avait aussi raté. Pas parfait, mais réellement proche de notre référence Claude sur une tâche qui comptait vraiment.
Le calcul de coût : nous avons fait tourner Pro à 72 $/mois contre notre précédent budget Claude Max d'environ 200 $/mois. Pour un codage quotidien stable, GLM a fait économiser de l'argent réel. Mais sur les deux semaines de migration, le plafond nous a forcés à revenir sur Claude quand même, donc le total honnête était Pro plus un peu d'usage Claude. GLM a réduit notre facture, il n'a pas éliminé notre dépendance à Claude.
Le forfait GLM Coding vaut-il le coup face à Claude, Cursor et Copilot ?
Pour un développement solo stable, le palier Pro du forfait glm coding est l'option capable la moins chère à 72 $/mois, en dessous de Claude Max sur le coût à prix fixe. Ça vaut le coup si votre volume hebdomadaire de prompts tient sous ~2 000 et que vous pouvez programmer les gros traitements hors pointe. Ça ne vaut pas le coup si vous avez besoin d'un débit garanti en heure de pointe ou d'une marge de dépassement.
| Forfait | Prix/mois | Modèle de quota | Idéal pour | Choisissez si |
|---|---|---|---|---|
| GLM Coding Plan Pro | 72 $ | ~2 000 prompts hebdo | Codage solo quotidien | Vous voulez un rapport qualité-prix max et pouvez éviter les heures de pointe |
| GLM Coding Plan Max | 160 $ | ~8 000 prompts hebdo | Équipes, gros dépôts | Vous atteignez le plafond de Pro et avez besoin de marge |
| Claude Pro | 20 $ | Plafonds glissants de messages sur 5h | Usage léger de Claude Code | Vous vivez déjà dans l'écosystème Claude |
| Claude Max | 100-200 $ | Plafonds glissants plus élevés | Travail agentique Claude intensif | Vous avez besoin de la qualité Claude Opus sur des tâches difficiles |
| Cursor Pro | 20 $ | Basé sur requêtes rapides/lentes | Devs natifs IDE | Vous voulez l'autocomplétion plus un agent dans un seul éditeur |
| GitHub Copilot | 10-39 $ | Quotas requêtes/premium | Autocomplétion IDE large | Vous voulez de l'autocomplétion inline pas chère partout |
Sur la qualité brute du modèle, GLM-5.2 obtient environ 62 sur SWE-bench Pro contre ~69 pour Claude Opus 4.8, selon DataCamp. Proche, pour une fraction du coût. Un benchmark indépendant de Semgrep a même trouvé GLM-5.2 devançant Claude sur certaines tâches de sécurité. Les développeurs sur X le qualifient fréquemment de « moins cher que Claude », même si les utilisateurs du palier Max signalent du throttle pendant les fenêtres de pointe.
Envie de la vue d'ensemble ? Voir le paysage plus large des agents de codage IA, et si Cursor est votre éditeur, tirer plus parti de Cursor se combine bien avec un modèle de fond moins cher.
Comment pointer Claude Code, Cline et Roo vers le forfait
Pour utiliser le forfait glm coding dans Claude Code, réglez l'URL de base sur https://api.z.ai/api/anthropic et le modèle sur GLM-5.2[1m], puis authentifiez-vous avec votre clé Z.ai. Cline, Roo Code, OpenClaw, ZCode et OpenCode fonctionnent de la même manière. Les outils non pris en charge sont bloqués au niveau du point de terminaison, donc la configuration fonctionne immédiatement ou échoue proprement.
Voici exactement ce que nous avons collé pour Claude Code :
export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-z-ai-key"
export ANTHROPIC_MODEL="GLM-5.2[1m]"Pour les outils non compatibles Anthropic, Z.ai expose aussi https://api.z.ai/api/coding/paas/v4. Le forfait prend en charge plus de 20 clients dont Claude Code, Cline, Roo Code, OpenClaw, ZCode et OpenCode ; tout ce qui sort de cette liste est rejeté plutôt que de mal fonctionner en silence.
La confusion entre point de terminaison et URL de base est le problème de configuration numéro un sur le Discord de Z.ai. Le piège habituel : pointer un outil compatible Claude vers l'URL paas/v4, ou l'inverse. Faites correspondre le point de terminaison au type d'outil et ça fonctionne directement. Si vous découvrez comment piloter Claude Code avec un backend échangé, notre guide configuration des workflows Claude Code couvre la configuration plus large. Les équipes qui construisent là-dessus l'associent souvent à des frameworks d'agents à connaître.
Pour quoi le forfait GLM Coding n'est PAS fait (+ le piège des prix revendeurs)
Le forfait glm coding n'est pas conçu pour les charges de production nécessitant des SLA ou des garanties de concurrence, les outils non pris en charge, les gros utilisateurs en heure de pointe qui brûlent le quota à 3x, ou les équipes ayant besoin d'une marge de dépassement. C'est un outil de développement à prix fixe, pas une API de production facturée au compteur. Si vous avez besoin d'une concurrence garantie ou d'un filet de sécurité contre les factures surprises, ce forfait n'est pas ça.
Vient ensuite la confusion sur les prix. Cherchez « glm coding plan » et vous trouverez des pages vantant Lite 10 $, Pro 30 $, Max 80 $. Ce ne sont pas les prix officiels de Z.ai. Ce sont des revendeurs tiers (codingplan.run, bigmodel, promos « 3 dollars ») qui vendent des clés API à prix réduit ou un accès par coupon. Les paliers officiels sont 18 $ / 72 $ / 160 $. Les clés revendeurs portent un risque réel : violations potentielles des conditions d'utilisation, aucune garantie de support, et clés révocables. Si un prix paraît trop beau, c'est un coupon revendu, pas le forfait.
Sur les données : certains commentateurs de Hacker News signalent des préoccupations sur la rétention des données et l'hébergement en Chine, puisque Z.ai est un fournisseur chinois. C'est une considération légitime pour des bases de code réglementées ou sensibles. Ne le balayez pas d'un revers de main. Lisez la documentation Z.ai sur la rétention et décidez si ça correspond à votre posture de conformité avant de pointer des dépôts de production vers cet outil. Pour un usage loisir et non sensible, la plupart des développeurs que nous avons vus considèrent ça comme un non-problème.
À propos de l'auteur
Mert Batur est cofondateur de Techsy.io, où l'équipe conçoit des agents IA, des systèmes d'automatisation et des pipelines voix/SDR pour des clients B2B. Il écrit sur la stack d'outils LLM que l'équipe Techsy utilise réellement en production.
Diplômes : cofondateur, Techsy.io. Connectez-vous sur LinkedIn.
Questions fréquentes
Combien coûte le forfait GLM Coding ?
Le forfait GLM Coding a trois paliers : Lite à 18 $/mois, Pro à 72 $/mois, et Max à 160 $/mois. Une promo de lancement de 30 % jusqu'en septembre 2026 les fait tomber à 12,60 $, 50,40 $ et 112 $. La facturation annuelle coûte respectivement 151,20 $, 604,80 $ et 1 344 $. Vérifiez les chiffres actuels sur z.ai/subscribe.
Quelles sont les limites hebdomadaires du forfait GLM Coding ?
Les quotas hebdomadaires de prompts sont d'environ 400 pour Lite, 2 000 pour Pro, et 8 000 pour Max. Chaque palier a aussi un plafond glissant plus court de 5 heures d'environ 80, 400 et 1 600 prompts. Les quotas hebdomadaires se réinitialisent sur un cycle de 7 jours compté depuis l'heure de votre commande.
Quels modèles sont inclus dans le forfait GLM Coding ?
Les trois paliers incluent les mêmes modèles : GLM-5.2 (le modèle phare avec une fenêtre de contexte de 1M), GLM-5-Turbo et GLM-4.7. Le prix du palier ne change que votre volume de quota et votre allocation d'appels MCP, jamais les modèles auxquels vous avez accès. Les abonnés Lite font tourner exactement le même GLM-5.2 que les abonnés Max.
Que se passe-t-il quand vous atteignez le plafond hebdomadaire ?
Les appels se mettent en pause jusqu'à la réinitialisation de la fenêtre de 5 heures suivante. Il n'y a ni facturation au dépassement ni charge surprise ; le système cesse simplement de renvoyer des complétions jusqu'à ce que votre quota se rafraîchisse. C'est un arrêt net, pas un ralentissement, donc les gros utilisateurs devraient programmer leurs traitements lourds hors pointe pour étirer leur quota effectif.
Puis-je utiliser le forfait GLM Coding dans Claude Code ou Cursor ?
Oui pour Claude Code : réglez l'URL de base sur https://api.z.ai/api/anthropic et le modèle sur GLM-5.2[1m]. Cline, Roo Code, OpenClaw, ZCode et OpenCode sont aussi pris en charge. Cursor n'est pas nativement pris en charge via ce point de terminaison, vérifiez donc la compatibilité actuelle avant de vous y fier.
Le forfait GLM Coding est-il propulsé par GLM-4.6 ou GLM-5.2 ?
GLM-5.2, depuis le 13 juin 2026. L'autocomplétion de Google associe encore le forfait à GLM-4.6, mais c'est dépassé. Chaque palier fait désormais tourner GLM-5.2 avec une fenêtre de contexte de 1M ; utilisez l'identifiant de modèle GLM-5.2[1m] dans Claude Code pour obtenir la longueur de contexte complète.
Les prix revendeurs à 10 $/30 $/80 $ sont-ils légitimes ?
Non. Les paliers officiels sont 18 $, 72 $ et 160 $. Les pages annonçant Lite 10 $, Pro 30 $ ou Max 80 $ sont des revendeurs tiers vendant des clés API à prix réduit ou un accès par coupon, pas le vrai forfait Z.ai. Ces clés risquent des violations des conditions d'utilisation, aucun support, et une révocation. Achetez directement sur z.ai/subscribe pour éviter les problèmes.
Y a-t-il une limite de concurrence sur le forfait GLM Coding ?
Z.ai ne publie officiellement aucune limite de requêtes simultanées pour le forfait coding, considérez donc cela comme non documenté plutôt qu'illimité. Dans nos tests mono-agent sur Claude Code, nous n'avons jamais rencontré de mur de concurrence, mais si vous faites tourner des agents en parallèle, vérifiez le comportement sur votre propre charge de travail avant de vous engager.
Le forfait GLM Coding est-il vraiment moins cher que Claude en pratique ?
Pour un codage quotidien stable, oui : Pro à 72 $ est passé sous notre budget Claude Max d'environ 200 $/mois. Mais la réserve est réelle. Sur les semaines de migration lourdes, nous avons atteint le plafond hebdomadaire au jour 5 et sommes revenus sur Claude pour finir, donc notre coût véritable était Pro plus un peu d'usage Claude. Ça réduit la facture, ça n'élimine pas Claude.
Mes données sont-elles conservées, et sont-elles hébergées en Chine ?
Z.ai est un fournisseur chinois, et certains développeurs sur Hacker News soulèvent des préoccupations sur la rétention des données et l'hébergement. Pour des bases de code sensibles ou réglementées, examinez les conditions de rétention dans la documentation Z.ai avant de pointer des dépôts de production vers ce forfait. Pour un usage loisir et non sensible, la plupart des développeurs considèrent ça comme un compromis acceptable.
Le verdict
Le forfait glm coding est actuellement le meilleur rapport qualité-prix à tarif fixe dans le codage agentique, avec un bémol honnête. Pro à 72 $ est notre choix pour le développement solo quotidien : il est passé sous notre budget Claude Max, GLM-5.2 a tenu bon sur un vrai refactoring Next.js 16, et l'absence de facturation au dépassement signifie que vous ne recevrez jamais de facture surprise. Lite est un palier de découverte ; Max est fait pour les équipes qui brûlent les ~2 000 prompts hebdomadaires de Pro.
Mais il ne remplace pas totalement Claude. Sur nos deux semaines de migration, nous avons atteint le plafond au jour 5 et sommes revenus vers Claude pour finir, et le multiplicateur de pointe à 3x consomme le quota plus vite que ne le suggèrent les chiffres affichés. Faites-en tourner votre modèle de codage par défaut, gardez un forfait Claude pour les semaines difficiles, et programmez les gros traitements hors pointe tant que dure la promo à 1x. Cette combinaison nous a donné la facture la plus basse sans nous ralentir. Si vous voulez de l'aide pour intégrer GLM dans une stack d'agents de production, contactez-nous.