
GLM 5.2 Coding Plan: Limiti Lite vs Pro vs Max, Prezzi e 3 Settimane di Test (2026)
Seconda settimana del nostro sprint di migrazione, giorno 5, in pieno refactor: Claude Code si è ammutolito. Avevamo bruciato tutti i circa 2.000 prompt settimanali del livello Pro del GLM 5.2 coding plan, puntato su api.z.ai/api/anthropic con modello GLM-5.2[1m]. Nessun muro di errore, nessuna fattura a sorpresa. Solo una pausa netta fino alla finestra successiva di 5 ore. Quel momento ci ha detto più cose su questo abbonamento di qualsiasi tabella prezzi.
Ecco il dato di freschezza che l'autocompletamento di Google ancora sbaglia: il piano esegue GLM-5.2 su ogni livello dal 13 giugno 2026, non GLM-4.6. Per il modello in sé — benchmark, la finestra di contesto a 1M token, GLM 5.2 vs 5.1 — leggi la nostra recensione completa del modello GLM 5.2. Questa pagina parla del piano: livelli, quote, meccanica del throttling e se conviene spostare la tua spesa Claude.
Punti chiave:
- Il GLM Coding Plan ha 3 livelli: Lite 18$, Pro 72$, Max 160$/mese (promo del 30% fino a settembre 2026).
- Quote settimanali di prompt: circa 400 (Lite), 2.000 (Pro), 8.000 (Max), con reset su ciclo mobile di 7 giorni.
- Tutti i livelli eseguono GLM-5.2 dal 13 giugno 2026, con finestra di contesto da 1M token.
- Raggiunto il tetto, le chiamate si fermano fino al reset della finestra successiva di 5 ore. Nessun addebito extra, mai.
I livelli del GLM Coding Plan in breve: Lite vs Pro vs Max
Il GLM 5.2 coding plan vende tre livelli a canone fisso, prezzati sulla quota settimanale di prompt, non sui token consumati. Lite (18$) è adatto a chi programma per hobby o in modo leggero. Pro (72$) è il punto giusto per uno sviluppatore solo che fa lavoro agentico quotidiano. Max (160$) punta a team o utenti pesanti multi-repo. Tutti e tre includono gli stessi modelli.
| Livello | Mensile | Prompt settimanali | Tetto 5h | Chiamate MCP/mese | Ideale per |
|---|---|---|---|---|---|
| Lite | 18$ (12,60$ promo) | ~400 | ~80 | 100 | Hobby, progetti personali, modifiche leggere |
| Pro | 72$ (50,40$ promo) | ~2.000 | ~400 | 1.000 | Sviluppatori solo, coding agentico quotidiano |
| Max | 160$ (112$ promo) | ~8.000 | ~1.600 | 4.000 | Team, lavoro pesante multi-repo |
I prezzi sono confermati in tempo reale su z.ai/subscribe a luglio 2026, incrociati con due aggregatori indipendenti. Uno sconto introduttivo del 30% porta i livelli a 12,60$ / 50,40$ / 112$ al mese, con fatturazione annuale a 151,20$ / 604,80$ / 1.344$.

Un avvertimento da segnalare: Pro a 72$ è un aumento di prezzo. La nostra recensione precedente citava Pro intorno ai 30$, quindi il piano è più o meno raddoppiato da allora. Resta comunque molto più economico di Claude Max, ma non è più l'affare che suggerivano i vecchi numeri. I circa 2.000 prompt settimanali del livello Pro restano il punto di equilibrio pratico per uno sviluppatore solo; Lite si esaurisce in fretta, e Max è pensato davvero per i team.
Cosa ottieni realmente su ogni livello
Ogni livello esegue la stessa gamma di modelli: GLM-5.2 (il modello di punta, con finestra di contesto da 1M token dal 13 giugno 2026), GLM-5-Turbo e GLM-4.7. I livelli differiscono solo per volume di quota e limite di chiamate MCP, non per accesso ai modelli. Quindi un abbonato Lite ottiene esattamente lo stesso GLM-5.2 di un abbonato Max, solo con meno prompt prima del tetto.
Per ogni livello ricevi una quota settimanale di prompt più un tetto mobile più breve di 5 ore, secondo la documentazione per sviluppatori di Z.AI. Lite offre circa 80 prompt ogni 5 ore e 100 chiamate al mese per ricerca web/lettura via MCP. Pro alza il tetto a circa 400 ogni 5 ore e 1.000 chiamate MCP. Max arriva a circa 1.600 ogni 5 ore e 4.000 chiamate MCP.
E la concorrenza di richieste simultanee? Z.ai non pubblica un limite esplicito di richieste concorrenti per il piano, quindi consideralo non verificato piuttosto che illimitato. Nella pratica, i flussi di lavoro a singolo agente in Claude Code non hanno mai incontrato un muro di concorrenza dalla nostra parte.
Se ti stai chiedendo se GLM-5.2 sia abbastanza buono da sostituire il tuo modello attuale, quella è una domanda sul modello, non sul piano. Teniamo la matematica dei benchmark nella recensione completa del modello GLM 5.2 così questa pagina resta concentrata sull'abbonamento. Versione breve: è abbastanza vicino a Claude sulla maggior parte dei task di coding da rendere il prezzo il fattore decisivo.
Come funzionano davvero i limiti settimanali?
Il glm coding plan usa quote a doppio tempo: un tetto mobile di 5 ore e una quota settimanale più ampia che inizia a contare dal momento dell'ordine e si resetta su ciclo di 7 giorni. Raggiunto uno dei due tetti, le chiamate si fermano fino a quando quella finestra non ripassa. Non c'è misurazione a token né fatturazione per superamento, quindi una bolletta a sorpresa è impossibile.
Quest'ultimo punto conta più del prezzo. A differenza delle API a token misurato, su questo piano non puoi ricevere una bolletta a sorpresa. Raggiungi il tetto e le chiamate si fermano fino al reset della finestra. La documentazione lo dice chiaramente: il sistema non scala nulla dal saldo del tuo account quando finisci la quota.
L'insidia che gli acquirenti sottovalutano è il moltiplicatore. GLM-5.2 e GLM-5-Turbo consumano la quota a 3x nelle ore di picco e 2x fuori picco, secondo la documentazione Z.AI. Una promo attuale rende l'uso fuori picco 1x fino a fine settembre 2026, il che di fatto raddoppia la tua quota reale se pianifichi le sessioni pesanti fuori dal picco pomeridiano statunitense. Quella promo è il singolo motivo principale per cui il piano sembra generoso adesso. Una volta finita, il fuori picco torna a 2x e il tuo tetto settimanale effettivo scende.
Una lamentela ricorrente su r/LocalLLaMA è che il tetto settimanale di Lite risulta stretto per chi fa lavoro agentico quotidiano. Gli sviluppatori lì concordano generalmente che Lite è un livello di assaggio, e che è con Pro che il piano diventa usabile. Per un confronto, vedi come si confrontano i limiti settimanali di Claude se sei già su un piano Claude e vuoi mappare i due sistemi di quote l'uno contro l'altro.
Abbiamo usato il piano Pro in Claude Code per 3 settimane: ecco cosa è successo
Abbiamo usato il livello Pro del glm coding plan come modello di coding principale per 3 settimane su repository reali di clienti, facendolo passare per lo più tramite Claude Code con qualche sessione Cline per confronto. Endpoint: api.z.ai/api/anthropic. Modello: GLM-5.2[1m]. Ecco il diario onesto, il consumo di quota, il dolore del throttling e i conti economici inclusi.
In una settimana normale abbiamo bruciato circa 1.300 dei circa 2.000 prompt Pro. Margine confortevole. Le due settimane in cui abbiamo gestito una migrazione pesante sono state un'altra storia: abbiamo raggiunto il tetto settimanale al giorno 5, in pieno refactor, entrambe le volte. Il throttling è uno stop netto, non un rallentamento. Claude Code ha smesso di restituire completamenti fino all'apertura della finestra successiva di 5 ore. Nessun addebito, nessuna email di avviso, solo silenzio. Il fastidio non era il denaro, era il cambio di contesto: siamo tornati su Claude Max per finire il refactor, poi siamo tornati su GLM appena la quota si è resettata.
Il moltiplicatore di picco è reale e si sente. Il lavoro agentico nelle ore pomeridiane statunitensi divorava la quota a 3x, quindi una singola sessione grande in Claude Code poteva costarci 60-80 prompt effettivi invece di una ventina. Programmare le sessioni pesanti fuori picco, sfruttando la promo attuale a 1x, ha allungato sensibilmente la nostra quota settimanale. Nelle settimane di migrazione, spostare i batch job più grandi al primo mattino ha fatto la differenza tra raggiungere il tetto al giorno 5 o al giorno 7.
Il task che ci ha convinti: un refactor delle API route di Next.js 16 su un repository cliente, per convertire un groviglio di route handler in uno schema di middleware condiviso. GLM-5.2 ha gestito le modifiche multi-file con pulizia, ha mantenuto il contesto su circa una dozzina di file e ha inciampato una sola volta su un generic TypeScript che anche il nostro precedente default Claude Max aveva sbagliato. Non impeccabile, ma davvero vicino al nostro standard Claude su un task che contava davvero.
I conti: abbiamo eseguito Pro a 72$/mese contro la nostra precedente spesa Claude Max di circa 200$/mese. Per un coding quotidiano costante, GLM ha fatto risparmiare soldi veri. Ma nelle due settimane di migrazione il tetto ci ha comunque costretti a tornare su Claude, quindi il totale onesto era Pro più un po' di uso Claude. GLM ha tagliato la bolletta, non ha azzerato la nostra dipendenza da Claude.
Il GLM Coding Plan conviene rispetto a Claude, Cursor e Copilot?
Per uno sviluppo solo costante, il livello Pro del glm coding plan è l'opzione capace più economica a 72$/mese, sotto Claude Max sul costo a canone fisso. Conviene se il tuo volume settimanale di prompt sta sotto i circa 2.000 e puoi programmare le sessioni pesanti fuori picco. Non conviene se hai bisogno di throughput garantito nelle ore di picco o di margine per superamenti.
| Piano | Prezzo/mese | Modello di quota | Ideale per | Scegli questo se |
|---|---|---|---|---|
| GLM Coding Plan Pro | 72$ | ~2.000 prompt settimanali | Coding quotidiano da solo | Vuoi il massimo valore e puoi evitare le ore di picco |
| GLM Coding Plan Max | 160$ | ~8.000 prompt settimanali | Team, repo pesanti | Superi il tetto di Pro e serve margine |
| Claude Pro | 20$ | Tetti mobili di messaggi ogni 5h | Uso leggero di Claude Code | Vivi già nell'ecosistema Claude |
| Claude Max | 100-200$ | Tetti mobili più alti | Lavoro agentico Claude pesante | Serve la qualità di Claude Opus su task difficili |
| Cursor Pro | 20$ | Basato su richieste veloci/lente | Sviluppatori nativi IDE | Vuoi tab-complete più agente in un solo editor |
| GitHub Copilot | 10-39$ | Quote di richieste/premium | Autocompletamento IDE ampio | Vuoi completamento inline economico ovunque |
Sulla qualità grezza del modello, GLM-5.2 ottiene circa 62 su SWE-bench Pro contro il circa 69 di Claude Opus 4.8, secondo DataCamp. Vicino, a una frazione del costo. Un benchmark indipendente di Semgrep ha persino trovato GLM-5.2 in vantaggio su Claude in alcuni task di sicurezza. Gli sviluppatori su X lo definiscono spesso "più economico di Claude", anche se gli utenti del livello Max segnalano throttling nelle finestre di picco.
Vuoi il quadro più ampio? Guarda il panorama più vasto degli agenti di coding, e se Cursor è il tuo editor, ottenere di più da Cursor si abbina bene a un modello di backend più economico.
Come collegare Claude Code, Cline e Roo al piano
Per usare il glm coding plan in Claude Code, imposta l'URL base su https://api.z.ai/api/anthropic e il modello su GLM-5.2[1m], poi autenticati con la tua chiave Z.ai. Cline, Roo Code, OpenClaw, ZCode e OpenCode funzionano allo stesso modo. Gli strumenti non supportati vengono bloccati all'endpoint, quindi la configurazione o funziona subito o fallisce in modo pulito.
Ecco esattamente cosa abbiamo incollato per Claude Code:
export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-z-ai-key"
export ANTHROPIC_MODEL="GLM-5.2[1m]"Per strumenti non compatibili con Anthropic, Z.ai espone anche https://api.z.ai/api/coding/paas/v4. Il piano supporta oltre 20 client tra cui Claude Code, Cline, Roo Code, OpenClaw, ZCode e OpenCode; tutto ciò che è fuori da questa lista viene rifiutato invece di comportarsi male in silenzio.
La confusione tra endpoint e URL base è il problema di configurazione numero uno sul Discord di Z.ai. La trappola più comune è puntare uno strumento compatibile con Claude sull'URL paas/v4, o viceversa. Fai combaciare l'endpoint con il tipo di strumento e funziona subito. Se sei nuovo nel far girare Claude Code con un backend sostituito, la nostra guida configurazione dei workflow di Claude Code copre la configurazione più ampia. I team che costruiscono sopra questo spesso lo abbinano a framework per agenti da conoscere.
Per cosa NON serve il GLM Coding Plan (+ la trappola dei prezzi da rivenditore)
Il glm coding plan non è pensato per carichi di lavoro API in produzione che richiedono SLA o garanzie di concorrenza, per strumenti non supportati, per power user nelle ore di picco che bruciano quota a 3x, o per team che hanno bisogno di margine per superamenti. È uno strumento di sviluppo a canone fisso, non un'API di produzione misurata. Se ti serve concorrenza garantita o una rete di sicurezza contro fatture a sorpresa, questo piano non fa per te.
Poi c'è la confusione sui prezzi. Cerca "glm coding plan" e troverai pagine che pubblicizzano Lite 10$, Pro 30$, Max 80$. Non sono i prezzi ufficiali di Z.ai. Sono rivenditori terzi (codingplan.run, bigmodel, promo "3 dollari") che vendono chiavi API scontate o accesso a coupon. I livelli ufficiali sono 18$ / 72$ / 160$. Le chiavi da rivenditore comportano rischi reali: possibili violazioni dei termini di servizio, nessuna garanzia di supporto e chiavi che possono essere revocate. Se un prezzo sembra troppo bello, è un coupon rivenduto, non il piano vero.
Sui dati: alcuni commentatori su Hacker News segnalano preoccupazioni su conservazione dei dati e hosting in Cina, dato che Z.ai è un fornitore cinese. È una considerazione legittima per codebase regolamentate o sensibili. Non liquidarla con una scrollata di spalle. Leggi la documentazione Z.ai sulla conservazione dei dati e decidi se si adatta alla tua postura di conformità prima di puntare repository di produzione su questo servizio. Per lavoro hobbistico e non sensibile, la maggior parte degli sviluppatori che abbiamo visto lo tratta come un non-problema.
Chi è l'autore
Mert Batur è co-fondatore di Techsy.io, dove il team costruisce agenti AI, sistemi di automazione e pipeline voice/SDR per clienti B2B. Scrive sullo stack di strumenti LLM che il team Techsy usa davvero in produzione.
Credenziali: co-fondatore, Techsy.io. Contatto su LinkedIn.
Domande frequenti
Quanto costa il GLM Coding Plan?
Il GLM Coding Plan ha tre livelli: Lite a 18$/mese, Pro a 72$/mese e Max a 160$/mese. Una promo introduttiva del 30% fino a settembre 2026 li porta a 12,60$, 50,40$ e 112$. La fatturazione annuale costa rispettivamente 151,20$, 604,80$ e 1.344$. Verifica le cifre attuali su z.ai/subscribe.
Quali sono i limiti settimanali del GLM Coding Plan?
Le quote settimanali di prompt sono circa 400 per Lite, 2.000 per Pro e 8.000 per Max. Ogni livello ha anche un tetto mobile più breve di 5 ore di circa 80, 400 e 1.600 prompt. Le quote settimanali si resettano su un ciclo di 7 giorni contato dal momento dell'ordine.
Quali modelli sono inclusi nel GLM Coding Plan?
Tutti e tre i livelli includono gli stessi modelli: GLM-5.2 (il modello di punta con finestra di contesto da 1M token), GLM-5-Turbo e GLM-4.7. Il prezzo del livello cambia solo il volume della tua quota e il limite di chiamate MCP, non quali modelli puoi usare. Gli abbonati Lite eseguono esattamente lo stesso GLM-5.2 degli abbonati Max.
Cosa succede quando raggiungi il tetto settimanale?
Le chiamate si fermano fino al reset della finestra successiva di 5 ore. Non c'è fatturazione per superamento né addebito a sorpresa; il sistema smette semplicemente di restituire completamenti finché la tua quota non si rinnova. È uno stop netto, non un rallentamento, quindi gli utenti pesanti dovrebbero programmare le sessioni grandi fuori picco per allungare la loro quota effettiva.
Posso usare il GLM Coding Plan in Claude Code o Cursor?
Sì per Claude Code: imposta l'URL base su https://api.z.ai/api/anthropic e il modello su GLM-5.2[1m]. Sono supportati anche Cline, Roo Code, OpenClaw, ZCode e OpenCode. Cursor non è supportato nativamente tramite questo endpoint, quindi verifica la compatibilità attuale prima di farci affidamento.
Il GLM Coding Plan gira su GLM-4.6 o su GLM-5.2?
Su GLM-5.2, dal 13 giugno 2026. L'autocompletamento di Google associa ancora il piano a GLM-4.6, ma è un'informazione superata. Ogni livello ora esegue GLM-5.2 con finestra di contesto da 1M token; usa l'id modello GLM-5.2[1m] in Claude Code per ottenere la lunghezza di contesto completa.
I prezzi da rivenditore a 10$/30$/80$ sono legittimi?
No. I livelli ufficiali sono 18$, 72$ e 160$. Le pagine che pubblicizzano Lite 10$, Pro 30$ o Max 80$ sono rivenditori terzi che vendono chiavi API scontate o accesso a coupon, non il piano Z.ai reale. Quelle chiavi rischiano violazioni dei termini di servizio, assenza di supporto e revoca. Compra direttamente su z.ai/subscribe per evitare problemi.
C'è un limite di concorrenza sul GLM Coding Plan?
Z.ai non pubblica ufficialmente un limite di richieste concorrenti per il coding plan, quindi consideralo non documentato piuttosto che illimitato. Nei nostri test a singolo agente con Claude Code non abbiamo mai incontrato un muro di concorrenza, ma se esegui agenti in parallelo verifica il comportamento sul tuo carico di lavoro prima di impegnarti.
Il GLM Coding Plan è davvero più economico di Claude nella pratica?
Per un coding quotidiano costante, sì: Pro a 72$ è sceso sotto la nostra spesa Claude Max di circa 200$/mese. Ma l'avvertenza è reale. Nelle settimane di migrazione pesante abbiamo raggiunto il tetto settimanale al giorno 5 e siamo tornati su Claude per finire, quindi il nostro costo vero era Pro più un po' di uso Claude. Taglia la bolletta, non elimina Claude.
I miei dati vengono conservati, e sono ospitati in Cina?
Z.ai è un fornitore cinese, e alcuni sviluppatori su Hacker News sollevano preoccupazioni su conservazione dei dati e hosting. Per codebase sensibili o regolamentate, rivedi i termini di conservazione nella documentazione Z.ai prima di puntare repository di produzione sul piano. Per lavoro hobbistico e non sensibile, la maggior parte degli sviluppatori lo considera un compromesso accettabile.
Il verdetto
Il glm coding plan è il miglior rapporto qualità-prezzo a canone fisso nel coding agentico oggi, con un onesto asterisco. Pro a 72$ è la nostra scelta per lo sviluppo solo quotidiano: è sceso sotto la nostra spesa Claude Max, GLM-5.2 ha retto su un vero refactor Next.js 16, e il design senza superamenti significa che non ricevi mai una bolletta a sorpresa. Lite è un assaggio; Max è per i team che bruciano i circa 2.000 prompt settimanali di Pro.
Ma non sostituisce del tutto Claude. Nelle nostre due settimane di migrazione abbiamo raggiunto il tetto al giorno 5 e siamo tornati su Claude per finire, e il moltiplicatore di picco a 3x consuma la quota più in fretta di quanto suggeriscano i numeri principali. Usalo come modello di coding predefinito, tieni un piano Claude per le settimane difficili e programma le sessioni pesanti fuori picco finché dura la promo a 1x. Questa combinazione ci ha dato la bolletta più bassa senza rallentarci. Se vuoi una mano a integrare GLM in uno stack di agenti in produzione, mettiti in contatto.