
GLM 5.2 Coding Plan: Limites do Lite vs Pro vs Max, Preços e 3 Semanas de Testes (2026)
Segunda semana do nosso sprint de migração, dia 5, a meio de um refactor: o Claude Code ficou em silêncio. Tínhamos gasto todos os ~2.000 prompts semanais do nível Pro do GLM 5.2 coding plan, apontado para api.z.ai/api/anthropic com o modelo GLM-5.2[1m]. Sem muro de erro, sem fatura surpresa. Apenas uma pausa total até a próxima janela de 5 horas recomeçar. Aquele único momento disse-nos mais sobre esta subscrição do que qualquer tabela de preços.
Aqui fica o facto de frescura que o autocomplete do Google continua a errar: o plano corre o GLM-5.2 em todos os níveis desde 13 de junho de 2026, não o GLM-4.6. Para o modelo em si, benchmarks, a janela de contexto de 1M, GLM 5.2 vs 5.1 — leia a nossa análise completa do GLM 5.2. Esta página é sobre o plano: níveis, quotas, a mecânica do throttle e se compensa trocar o seu gasto em Claude.
Principais conclusões:
- O GLM Coding Plan tem 3 níveis: Lite $18, Pro $72, Max $160/mês (promoção de 30% até setembro de 2026).
- Quotas semanais de prompts: ~400 (Lite), ~2.000 (Pro), ~8.000 (Max), com reposição num ciclo contínuo de 7 dias.
- Todos os níveis correm o GLM-5.2 desde 13 de junho de 2026, com janela de contexto de 1M.
- Ao atingir o limite, as chamadas pausam até a próxima janela de 5 horas reiniciar. Sem faturação por excedente, nunca.
Níveis do GLM Coding Plan num Relance: Lite vs Pro vs Max
O GLM 5.2 coding plan vende três níveis de tarifa fixa com preço definido pela quota semanal de prompts, não pelo uso de tokens. Lite ($18) adequa-se a programação leve ou por hobby. Pro ($72) é o ponto ideal para um developer a solo que faz trabalho agêntico diário. Max ($160) destina-se a equipas ou utilizadores intensivos com múltiplos repositórios. Os três incluem os mesmos modelos.
| Nível | Mensal | Prompts semanais | Limite 5h | Chamadas MCP/mês | Ideal para |
|---|---|---|---|---|---|
| Lite | $18 ($12,60 promo) | ~400 | ~80 | 100 | Hobby, projetos paralelos, edições leves |
| Pro | $72 ($50,40 promo) | ~2.000 | ~400 | 1.000 | Developers a solo, programação agêntica diária |
| Max | $160 ($112 promo) | ~8.000 | ~1.600 | 4.000 | Equipas, trabalho intenso multi-repo |
Preços confirmados em direto em z.ai/subscribe em julho de 2026, cruzados com dois agregadores independentes. Um desconto introdutório de 30% reduz os níveis para $12,60 / $50,40 / $112 por mês, com faturação anual a $151,20 / $604,80 / $1.344.

Uma ressalva que merece destaque: o Pro a $72 é um aumento de preço. A nossa análise anterior citava o Pro a cerca de $30, pelo que o plano praticamente duplicou desde então. Continua a ficar abaixo do Claude Max por uma margem larga, mas já não é a pechincha que os números antigos sugeriam. Os ~2.000 prompts semanais do nível Pro são o ponto ideal prático para um developer a solo; o Lite esgota-se depressa, e o Max é realmente construído para equipas.
O Que Realmente se Obtém em Cada Nível
Todos os níveis correm a mesma gama de modelos: GLM-5.2 (o flagship, com janela de contexto de 1M desde 13 de junho de 2026), GLM-5-Turbo e GLM-4.7. Os níveis diferem apenas no volume de quota e na permissão de chamadas MCP, não no acesso a modelos. Portanto, um subscritor Lite obtém exatamente o mesmo GLM-5.2 que um subscritor Max, apenas menos prompts antes do limite.
Por nível, obtém uma quota semanal de prompts mais um limite contínuo de 5 horas mais curto, de acordo com a Documentação de Developer da Z.AI. O Lite dá ~80 prompts por 5 horas e 100 chamadas MCP de web-search/reader por mês. O Pro sobe para ~400 por 5 horas e 1.000 chamadas MCP. O Max atinge ~1.600 por 5 horas e 4.000 chamadas MCP.
E a concorrência? A Z.ai não publica um limite explícito de pedidos concorrentes para o plano, pelo que deve tratar isso como não verificado em vez de ilimitado. Na prática, fluxos de trabalho single-agent no Claude Code nunca esbarraram num muro de concorrência connosco.
Se está a ponderar se o GLM-5.2 é sequer bom o suficiente para substituir o seu modelo atual, isso é uma questão de modelo, não de plano. Guardamos a matemática dos benchmarks na análise completa do GLM 5.2 para que esta página se mantenha focada na subscrição. Versão curta: é suficientemente próximo do Claude na maioria das tarefas de programação para que o preço se torne o fator decisivo.
Como Funcionam Realmente os Limites Semanais?
O glm coding plan usa quotas de dupla temporização: um limite de janela contínua de 5 horas e uma quota semanal maior que começa a contar a partir da hora do pedido e repõe num ciclo de 7 dias. Ao atingir qualquer dos tetos, as chamadas pausam até essa janela rodar. Não há medição de tokens nem faturação por excedente, pelo que uma fatura surpresa é impossível.
Esse último ponto importa mais do que o preço. Ao contrário das APIs com medição por tokens, não é possível receber uma fatura surpresa neste plano. Ao atingir o limite, as chamadas simplesmente pausam até a janela reiniciar. A documentação diz claramente: o sistema não debita do saldo da sua conta quando fica sem quota.
A armadilha que os compradores subestimam é o multiplicador. O GLM-5.2 e o GLM-5-Turbo consomem quota a 3x durante as horas de pico e 2x fora de pico, segundo a documentação da Z.AI. Uma promoção atual torna o uso fora de pico 1x até ao final de setembro de 2026, o que efetivamente duplica a sua quota real se agendar execuções pesadas fora do pico da tarde dos EUA. Essa promoção é a maior razão pela qual o plano parece generoso neste momento. Quando terminar, o fora de pico volta a 2x e o seu teto semanal efetivo desce.
Uma queixa recorrente no r/LocalLLaMA é que o limite semanal do Lite parece apertado para quem faz trabalho agêntico diário. Os developers por lá concordam geralmente que o Lite é um nível de experimentação, e o Pro é onde o plano se torna utilizável. Para comparação, veja como os limites semanais do Claude se comparam se já está num plano Claude e tenta mapear os dois sistemas de quotas entre si.
Corremos o Plano Pro no Claude Code Durante 3 Semanas: Eis o Que Aconteceu
Corremos o nível Pro do glm coding plan como modelo de programação principal durante 3 semanas em repositórios reais de clientes, conduzindo-o maioritariamente através do Claude Code com algumas sessões de Cline para comparação. Endpoint: api.z.ai/api/anthropic. Modelo: GLM-5.2[1m]. Aqui fica o registo honesto, consumo de quota, dor do throttle e matemática de custos incluídos.
Numa semana normal, gastámos aproximadamente 1.300 dos ~2.000 prompts do Pro. Margem confortável. As duas semanas em que fizemos uma migração pesada foram outra história: atingimos o limite semanal no dia 5, a meio do refactor, ambas as vezes. O throttle é uma paragem total, não uma desaceleração. O Claude Code deixou de devolver conclusões até a próxima janela de 5 horas abrir. Sem cobrança, sem email de aviso, apenas silêncio. O incómodo não era o dinheiro, era a troca de contexto: voltámos ao Claude Max para terminar o refactor, depois regressámos ao GLM quando a quota repôs.
O multiplicador de pico é real e sente-se. Trabalho agêntico durante as horas da tarde dos EUA devorou quota a 3x, pelo que uma única execução grande no Claude Code podia custar-nos 60-80 prompts efetivos em vez de uns vinte e tal. Agendar as execuções pesadas fora de pico, aproveitando a promoção atual de 1x, esticou a nossa quota semanal de forma notável. Nas semanas de migração, mover os maiores batch jobs para o início da manhã foi a diferença entre atingir o limite no dia 5 versus dia 7.
A tarefa que nos convenceu: um refactor de API-routes do Next.js 16 num repositório de cliente, convertendo um emaranhado de route handlers para um padrão de middleware partilhado. O GLM-5.2 lidou com as edições multi-ficheiro de forma limpa, manteve contexto através de cerca de uma dúzia de ficheiros, e apenas tropeçou uma vez num genérico de TypeScript que o nosso Claude Max padrão anterior também tinha falhado. Não impecável, mas genuinamente próximo do nosso baseline Claude numa tarefa que realmente importava.
A matemática de custos: corremos o Pro a $72/mês contra o nosso gasto anterior em Claude Max de aproximadamente $200/mês. Para programação diária constante, o GLM poupou dinheiro real. Mas nas duas semanas de migração, o limite forçou-nos de volta ao Claude de qualquer forma, pelo que o total honesto foi Pro mais algum uso de Claude. O GLM cortou a nossa fatura, não eliminou a nossa dependência do Claude.
O GLM Coding Plan Compensa vs Claude, Cursor e Copilot?
Para desenvolvimento a solo constante, o nível Pro do glm coding plan é a opção capaz mais barata a $72/mês, ficando abaixo do Claude Max em custo de tarifa fixa. Compensa se o seu volume semanal de prompts couber abaixo de ~2.000 e conseguir agendar execuções pesadas fora de pico. Não compensa se precisar de débito garantido em horas de pico ou margem de excedente.
| Plano | Preço/mês | Modelo de quota | Ideal para | Escolha este se |
|---|---|---|---|---|
| GLM Coding Plan Pro | $72 | ~2.000 prompts semanais | Programação diária a solo | Quer o máximo valor e consegue evitar horas de pico |
| GLM Coding Plan Max | $160 | ~8.000 prompts semanais | Equipas, repos intensivos | Esgota o limite do Pro e precisa de margem |
| Claude Pro | $20 | Limites contínuos de mensagens por 5h | Uso leve do Claude Code | Já vive no ecossistema Claude |
| Claude Max | $100-200 | Limites contínuos mais altos | Trabalho agêntico pesado no Claude | Precisa da qualidade do Claude Opus em tarefas difíceis |
| Cursor Pro | $20 | Rápido/lento baseado em pedidos | Developers nativos de IDE | Quer tab-complete mais agente num só editor |
| GitHub Copilot | $10-39 | Quotas de pedidos/premium | Autocomplete alargado em IDE | Quer conclusão inline barata em todo o lado |
Em qualidade bruta do modelo, o GLM-5.2 pontua cerca de 62 no SWE-bench Pro versus ~69 do Claude Opus 4.8, segundo a DataCamp. Perto, a uma fração do custo. Um benchmark independente da Semgrep até encontrou o GLM-5.2 a superar o Claude em algumas tarefas de segurança. Developers no X chamam-lhe frequentemente "mais barato que o Claude," embora utilizadores do nível Max relatem throttling durante janelas de pico.
Quer o panorama mais amplo? Veja o panorama mais vasto dos coding agents, e se o Cursor é o seu editor, tirar mais partido do Cursor combina bem com um modelo de backend mais barato.
Como Apontar o Claude Code, Cline e Roo para o Plano
Para usar o glm coding plan no Claude Code, defina o URL base como https://api.z.ai/api/anthropic e o modelo como GLM-5.2[1m], depois autentique com a sua chave Z.ai. Cline, Roo Code, OpenClaw, ZCode e OpenCode funcionam da mesma forma. Ferramentas não suportadas são bloqueadas no endpoint, pelo que a configuração ou funciona imediatamente ou falha de forma limpa.
Aqui está exatamente o que colámos para o Claude Code:
export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-z-ai-key"
export ANTHROPIC_MODEL="GLM-5.2[1m]"Para ferramentas não compatíveis com Anthropic, a Z.ai também expõe https://api.z.ai/api/coding/paas/v4. O plano suporta mais de 20 clientes, incluindo Claude Code, Cline, Roo Code, OpenClaw, ZCode e OpenCode; qualquer coisa fora dessa lista é rejeitada em vez de se comportar mal silenciosamente.
A confusão de endpoint e URL base é a queixa número um de configuração no Discord da Z.ai. A armadilha habitual é apontar uma ferramenta compatível com Claude para o URL paas/v4, ou vice-versa. Faça corresponder o endpoint ao tipo de ferramenta e simplesmente funciona. Se é novo a conduzir o Claude Code com um backend trocado, o nosso guia de configuração de fluxos de trabalho do Claude Code cobre a configuração mais ampla. Equipas a construir em cima disto frequentemente combinam-no com frameworks de agentes que vale a pena conhecer.
Para Que NÃO Serve o GLM Coding Plan (+ a Armadilha dos Preços de Revenda)
O glm coding plan não foi construído para cargas de trabalho de API de produção que necessitem de SLAs ou garantias de concorrência, ferramentas não suportadas, power users de horas de pico a queimar quota a 3x, ou equipas que precisam de margem de excedente. É uma ferramenta de desenvolvimento de tarifa fixa, não uma API de produção medida. Se precisa de concorrência garantida ou uma rede de segurança contra faturas surpresa, este plano não é isso.
Depois há a confusão de preços. Pesquise "glm coding plan" e encontrará páginas a vender Lite $10, Pro $30, Max $80. Esses não são preços oficiais da Z.ai. São revendedores terceiros (codingplan.run, bigmodel, promoções de "3 dólares") a vender chaves de API com desconto ou acesso por cupão. Os níveis oficiais são $18 / $72 / $160. As chaves de revendedores acarretam risco real: potenciais violações dos termos de serviço, sem garantia de suporte, e chaves que podem ser revogadas. Se um preço parece bom demais, é um cupão revendido, não o plano.
Sobre dados: alguns comentadores no Hacker News sinalizam preocupações de retenção de dados e alojamento na China, uma vez que a Z.ai é um fornecedor chinês. É uma consideração legítima para codebases regulados ou sensíveis. Não o minimize. Leia a documentação da Z.ai sobre retenção e decida se se adequa à sua postura de conformidade antes de apontar repositórios de produção para lá. Para hobby e trabalho não sensível, a maioria dos developers que vimos tratam-no como uma não-questão.
Sobre o Autor
Mert Batur Gurbuz é Co-Fundador da Techsy.io, onde a equipa entrega agentes de IA, sistemas de automação e pipelines de voz/SDR para clientes B2B. Estuda na University of Birmingham e escreve sobre a stack de ferramentas LLM que a equipa da Techsy realmente usa em produção.
Credenciais: Co-Fundador, Techsy.io, University of Birmingham. Ligue-se no LinkedIn.
Perguntas Frequentes
Quanto custa o GLM Coding Plan?
O GLM Coding Plan tem três níveis: Lite a $18/mês, Pro a $72/mês e Max a $160/mês. Uma promoção introdutória de 30% até setembro de 2026 reduz para $12,60, $50,40 e $112. A faturação anual custa $151,20, $604,80 e $1.344 respetivamente. Verifique os valores atuais em z.ai/subscribe.
Quais são os limites semanais do GLM Coding Plan?
As quotas semanais de prompts são aproximadamente 400 para o Lite, 2.000 para o Pro e 8.000 para o Max. Cada nível tem também um limite contínuo de 5 horas mais curto, de cerca de 80, 400 e 1.600 prompts. As quotas semanais repõem num ciclo de 7 dias contado a partir da hora do pedido.
Quais modelos estão incluídos no GLM Coding Plan?
Todos os três níveis incluem os mesmos modelos: GLM-5.2 (o flagship com janela de contexto de 1M), GLM-5-Turbo e GLM-4.7. O preço do nível apenas altera o volume de quota e a permissão de chamadas MCP, não os modelos a que pode aceder. Subscritores Lite correm exatamente o mesmo GLM-5.2 que subscritores Max.
O que acontece quando atinge o limite semanal?
As chamadas pausam até a próxima janela de 5 horas reiniciar. Não há faturação por excedente nem cobrança surpresa; o sistema simplesmente deixa de devolver conclusões até a sua quota renovar. É uma paragem total, não uma desaceleração, pelo que utilizadores intensivos devem agendar grandes execuções fora de pico para esticar a sua quota efetiva.
Posso usar o GLM Coding Plan no Claude Code ou Cursor?
Sim para o Claude Code: defina o URL base como https://api.z.ai/api/anthropic e o modelo como GLM-5.2[1m]. Cline, Roo Code, OpenClaw, ZCode e OpenCode também são suportados. O Cursor não é suportado nativamente através deste endpoint, pelo que deve verificar a compatibilidade atual antes de depender dele.
O GLM Coding Plan é alimentado pelo GLM-4.6 ou GLM-5.2?
GLM-5.2, desde 13 de junho de 2026. O autocomplete do Google ainda associa o plano ao GLM-4.6, mas isso está desatualizado. Todos os níveis correm agora o GLM-5.2 com janela de contexto de 1M; use o id de modelo GLM-5.2[1m] no Claude Code para obter o comprimento de contexto completo.
Os preços de revendedores $10/$30/$80 são legítimos?
Não. Os níveis oficiais são $18, $72 e $160. Páginas a anunciar Lite $10, Pro $30 ou Max $80 são revendedores terceiros a vender chaves de API com desconto ou acesso por cupão, não o verdadeiro plano da Z.ai. Essas chaves arriscam violações dos termos de serviço, sem suporte e revogação. Compre diretamente em z.ai/subscribe para evitar problemas.
Existe um limite de concorrência no GLM Coding Plan?
A Z.ai não publica oficialmente um limite de pedidos concorrentes para o coding plan, pelo que deve tratá-lo como não documentado em vez de ilimitado. Nos nossos testes single-agent no Claude Code nunca atingimos um muro de concorrência, mas se corre agentes em paralelo, verifique o comportamento contra a sua própria carga de trabalho antes de se comprometer.
O GLM Coding Plan é realmente mais barato que o Claude na prática?
Para programação diária constante, sim: o Pro a $72 ficou abaixo do nosso gasto de aproximadamente $200/mês em Claude Max. Mas a ressalva é real. Nas semanas de migração pesada atingimos o limite semanal no dia 5 e voltámos ao Claude para terminar, pelo que o nosso custo real foi Pro mais algum uso de Claude. Corta a fatura, não elimina o Claude.
Os meus dados são retidos e estão alojados na China?
A Z.ai é um fornecedor chinês, e alguns developers no Hacker News levantam preocupações de retenção de dados e alojamento. Para codebases sensíveis ou regulados, reveja os termos de retenção na documentação da Z.ai antes de apontar repositórios de produção para o plano. Para hobby e trabalho não sensível, a maioria dos developers trata-o como um compromisso aceitável.
O Veredicto
O glm coding plan é o melhor valor de tarifa fixa em programação agêntica neste momento, com um asterisco honesto. O Pro a $72 é a nossa escolha para desenvolvimento diário a solo: ficou abaixo do nosso gasto em Claude Max, o GLM-5.2 aguentou-se num refactor real de Next.js 16, e o design sem excedente significa que nunca recebe uma fatura surpresa. O Lite é uma experimentação; o Max é para equipas que esgotam os ~2.000 prompts semanais do Pro.
Mas não substitui totalmente o Claude. Nas nossas duas semanas de migração atingimos o limite no dia 5 e voltámos ao Claude para terminar, e o multiplicador de 3x em pico come quota mais depressa do que os números de capa sugerem. Corra-o como modelo de programação padrão, mantenha um plano Claude para as semanas difíceis, e agende execuções pesadas fora de pico enquanto a promoção de 1x durar. Essa combinação deu-nos a fatura mais baixa sem nos abrandar. Se quer ajuda a integrar o GLM numa stack de agentes de produção, entre em contacto.