
GLM 5.2 코딩 플랜: Lite vs Pro vs Max 한도, 가격 및 3주 실사용 테스트 (2026)
마이그레이션 스프린트 2주차, 5일째, 리팩토링 도중이었다: Claude Code가 멈췄다. GLM 5.2 코딩 플랜 Pro 등급의 주간 프롬프트 약 2,000개를 모두 소진한 것이다. 엔드포인트는 api.z.ai/api/anthropic을 가리키고 모델은 GLM-5.2[1m]이었다. 오류 화면도, 예상치 못한 청구서도 없었다. 그저 다음 5시간 창이 다시 열릴 때까지 단단히 일시정지될 뿐이었다. 그 한 순간이 어떤 가격표보다 이 구독에 대해 더 많은 것을 말해주었다.
Google 자동완성이 여전히 틀리게 알려주는 최신 정보가 하나 있다: 이 플랜은 2026년 6월 13일부터 모든 등급에서 GLM-4.6이 아닌 GLM-5.2로 구동된다. 모델 자체, 벤치마크, 1M 컨텍스트 창, GLM 5.2 vs 5.1에 대해서는 GLM 5.2 모델 전체 리뷰를 참고하시라. 이 페이지는 플랜에 대한 것이다: 등급, 쿼터, 스로틀 메커니즘, 그리고 Claude 지출을 바꿀 가치가 있는지 여부.
핵심 요약:
- GLM 코딩 플랜은 3개 등급: Lite $18, Pro $72, Max $160/월 (2026년 9월까지 30% introductory 프로모션).
- 주간 프롬프트 쿼터: 약 400개(Lite), 약 2,000개(Pro), 약 8,000개(Max), 7일 롤링 주기로 리셋.
- 2026년 6월 13일부터 모든 등급에서 GLM-5.2 구동, 1M 컨텍스트 창 제공.
- 한도에 도달하면 다음 5시간 창이 리셋될 때까지 호출이 일시정지. 초과 청구는 절대 없음.
GLM 코딩 플랜 등급 한눈에 보기: Lite vs Pro vs Max
GLM 5.2 코딩 플랜은 토큰 사용량이 아닌 주간 프롬프트 쿼터 기준으로 가격이 매겨진 3가지 정액제 등급을 판매한다. **Lite($18)**는 가벼운 취미 코딩에 적합하다. **Pro($72)**는 매일 에이전틱 작업을 하는 솔로 개발자에게 최적의 지점이다. **Max($160)**는 팀이나 헤비 멀티 레포 사용자를 대상으로 한다. 세 등급 모두 동일한 모델을 포함한다.
| 등급 | 월정액 | 주간 프롬프트 | 5시간 한도 | MCP 호출/월 | 최적 대상 |
|---|---|---|---|---|---|
| Lite | $18 (프로모 $12.60) | 약 400 | 약 80 | 100 | 취미, 사이드 프로젝트, 가벼운 편집 |
| Pro | $72 (프로모 $50.40) | 약 2,000 | 약 400 | 1,000 | 솔로 개발자, 일상적 에이전틱 코딩 |
| Max | $160 (프로모 $112) | 약 8,000 | 약 1,600 | 4,000 | 팀, 헤비 멀티 레포 작업 |
가격은 2026년 7월 기준 z.ai/subscribe에서 실시간 확인했으며, 두 개의 독립적인 애그리게이터와 교차 검증했다. 30% introductory 할인으로 등급별 월 $12.60 / $50.40 / $112로 내려가며, 연간 결제 시 $151.20 / $604.80 / $1,344다.

꼭 짚고 넘어갈 주의사항이 하나 있다: $72의 Pro는 가격 인상이다. 이전 리뷰에서는 Pro를 약 $30으로 인용했으니, 그 이후 플랜 가격이 거의 두 배로 오른 셈이다. 그래도 Claude Max보다는 훨씬 저렴하지만, 예전 숫자가 시사했던 만큼의 파격적인 가성비는 아니다. Pro 등급의 주간 약 2,000 프롬프트가 솔로 개발자에게 실질적인 최적 지점이다. Lite는 금방 소진되고, Max는 사실상 팀용으로 설계되었다.
각 등급에서 실제로 얻는 것
모든 등급이 동일한 모델 라인업을 구동한다: GLM-5.2(2026년 6월 13일부터 1M 컨텍스트 창을 갖춘 플래그십), GLM-5-Turbo, 그리고 GLM-4.7. 등급은 쿼터 용량과 MCP 호출 허용량에서만 차이가 날 뿐, 모델 접근권은 동일하다. 즉 Lite 구독자도 Max 구독자와 정확히 같은 GLM-5.2를 쓰며, 단지 한도 도달 전 프롬프트 수만 적을 뿐이다.
등급별로 주간 프롬프트 쿼터와 더 짧은 5시간 롤링 한도를 받으며, 이는 Z.AI 개발자 문서에 따라 정해진다. Lite는 5시간당 약 80 프롬프트와 월 100회의 MCP 웹 검색/리더 호출을 제공한다. Pro는 이를 5시간당 약 400회와 MCP 호출 1,000회로 올린다. Max는 5시간당 약 1,600회와 MCP 호출 4,000회에 달한다.
동시성은 어떨까? Z.ai는 이 플랜에 대한 명시적인 동시 요청 한도를 공개하지 않으므로, 무제한이라기보다는 미검증 상태로 간주해야 한다. 실제로 Claude Code에서의 단일 에이전트 워크플로에서는 동시성 벽에 부딪힌 적이 한 번도 없었다.
GLM-5.2가 현재 모델을 대체할 만큼 충분히 좋은지 저울질하고 있다면, 그건 플랜의 문제가 아니라 모델의 문제다. 벤치마크 계산은 GLM 5.2 모델 전체 리뷰에 남겨두고, 이 페이지는 구독에 집중하도록 했다. 짧게 말하면: 대부분의 코딩 작업에서 Claude에 충분히 근접하기 때문에 가격이 결정적 요인이 된다.
주간 한도는 실제로 어떻게 작동하나?
glm 코딩 플랜은 이중 타이밍 쿼터를 사용한다: 롤링 5시간 창 한도와, 주문 시점부터 카운트를 시작해 7일 주기로 리셋되는 더 큰 주간 쿼터다. 둘 중 어느 쪽 천장에 닿아도 해당 창이 롤오버될 때까지 호출이 일시정지된다. 토큰 계량도, 초과 청구도 없으므로 예상치 못한 청구서는 불가능하다.
마지막 항목은 가격보다 더 중요하다. 토큰 계량식 API와 달리, 이 플랜에서는 예상치 못한 청구서를 받을 수 없다. 한도에 도달하면 창이 리셋될 때까지 호출이 그냥 멈춘다. 문서도 이를 명확히 말한다: 쿼터가 바닥나도 시스템이 계정 잔액에서 차감하지 않는다.
구매자들이 과소평가하는 함정은 **배수(multiplier)**다. Z.AI 문서에 따르면 GLM-5.2와 GLM-5-Turbo는 피크 시간대에 3배, 비피크 시간대에 2배의 쿼터를 소모한다. 현재 프로모션으로 2026년 9월 말까지 비피크 사용량이 1배로 적용되는데, 헤비 작업을 미국 오후 피크 시간대 밖으로 스케줄링하면 실질 쿼터가 사실상 두 배가 된다. 지금 이 플랜이 넉넉하게 느껴지는 가장 큰 단 하나의 이유가 바로 이 프로모션이다. 이것이 끝나면 비피크는 2배로 돌아가고 실효 주간 천장은 내려간다.
r/LocalLLaMA에서 반복적으로 나오는 불만은, 매일 에이전틱 작업을 하는 사람에게는 Lite의 주간 한도가 빡빡하다는 것이다. 그곳 개발자들은 대체로 Lite는 체험용 등급이고, 플랜이 쓸 만해지는 건 Pro부터라는 데 동의한다. 비교를 위해, 이미 Claude 플랜을 사용 중이라 두 쿼터 체계를 서로 대조해 보고 싶다면 Claude의 주간 한도 비교를 참고하시라.
Pro 플랜을 Claude Code에서 3주간 돌려봤다: 결과는 이렇다
우리는 glm 코딩 플랜 Pro 등급을 실제 고객 레포지토리 전반에 걸쳐 3주간 주력 코딩 모델로 사용했으며, 주로 Claude Code로 구동하고 비교를 위해 Cline 세션도 몇 번 곁들였다. 엔드포인트: api.z.ai/api/anthropic. 모델: GLM-5.2[1m]. 다음은 솔직한 기록이다. 쿼터 소진, 스로틀의 고통, 비용 계산까지 모두 포함했다.
평범한 주에는 Pro 프롬프트 약 2,000개 중 대략 1,300개를 소진했다. 여유로운 헤드룸이었다. 헤비 마이그레이션을 돌린 2주는 다른 이야기였다: 두 번 모두 5일째에, 리팩토링 도중에 주간 한도에 도달했다. 스로틀은 감속이 아니라 완전 정지다. Claude Code는 다음 5시간 창이 열릴 때까지 완성본 반환을 멈췄다. 과금도, 경고 이메일도 없이 그저 침묵뿐이었다. 짜증의 원인은 돈이 아니라 컨텍스트 전환이었다: 리팩토링을 끝내려고 Claude Max로 돌아갔다가, 쿼터가 리셋되면 다시 GLM으로 복귀했다.
피크 배수는 실재하며 체감된다. 미국 오후 시간대의 에이전틱 작업은 쿼터를 3배로 갉아먹어서, 큰 Claude Code 실행 한 번에 20여 개 대신 유효 프롬프트 60~80개가 나갈 수 있었다. 헤비 실행을 비피크로 스케줄링하고 현재의 1배 프로모션을 활용하니 주간 쿼터가 눈에 띄게 늘어났다. 마이그레이션 주에는 가장 큰 배치 작업을 이른 아침으로 옮긴 것이 5일째 한도 도달과 7일째 도달의 차이를 만들었다.
우리를 설득한 작업: 고객 레포에서의 Next.js 16 API 라우트 리팩토링. 뒤엉킨 라우트 핸들러들을 공유 미들웨어 패턴으로 전환하는 작업이었다. GLM-5.2는 다중 파일 편집을 깔끔하게 처리했고, 약 12개 파일에 걸쳐 컨텍스트를 유지했으며, 이전 Claude Max 기본 모델도 버벅였던 TypeScript 제네릭에서 딱 한 번 걸렸다. 완벽하진 않았지만, 실제로 중요한 작업에서 우리의 Claude 기준선에 진심으로 근접했다.
비용 계산: 우리는 Pro를 월 $72로 돌렸고, 이전 Claude Max 지출은 대략 월 $200이었다. 꾸준한 일상 코딩에서는 GLM이 실제로 돈을 아껴주었다. 하지만 두 번의 마이그레이션 주에는 한도 때문에 어차피 Claude로 돌아가야 했으니, 솔직한 총액은 Pro에 약간의 Claude 사용량을 더한 것이었다. GLM은 청구서를 줄여주었지만, Claude 의존도를 0으로 만들지는 못했다.
GLM 코딩 플랜, Claude·Cursor·Copilot 대비 쓸 만한가?
꾸준한 솔로 개발이라면, glm 코딩 플랜 Pro 등급은 월 $72로 가장 저렴한 유능한 옵션이며, 정액제 비용에서 Claude Max를 밑돈다. 주간 프롬프트 용량이 약 2,000개 이하로 맞고 헤비 실행을 비피크로 스케줄링할 수 있다면 가치가 있다. 피크 시간대 처리량 보장이나 초과 사용 헤드룸이 필요하다면 가치가 없다.
| 플랜 | 가격/월 | 쿼터 모델 | 최적 대상 | 이런 경우 선택 |
|---|---|---|---|---|
| GLM 코딩 플랜 Pro | $72 | 주간 프롬프트 약 2,000 | 솔로 일상 코딩 | 최대 가성비를 원하고 피크 시간을 피할 수 있을 때 |
| GLM 코딩 플랜 Max | $160 | 주간 프롬프트 약 8,000 | 팀, 헤비 레포 | Pro 한도를 소진하고 헤드룸이 필요할 때 |
| Claude Pro | $20 | 롤링 5시간 메시지 한도 | 가벼운 Claude Code 사용 | 이미 Claude 생태계에 살고 있을 때 |
| Claude Max | $100-200 | 더 높은 롤링 한도 | 헤비 Claude 에이전틱 작업 | 어려운 작업에서 Claude Opus 품질이 필요할 때 |
| Cursor Pro | $20 | 요청 기반 fast/slow | IDE 네이티브 개발자 | 탭 완성 플러스 에이전트를 하나의 에디터에서 원할 때 |
| GitHub Copilot | $10-39 | 요청/프리미엄 쿼터 | 폭넓은 IDE 자동완성 | 어디서나 저렴한 인라인 완성을 원할 때 |
순수 모델 품질에서 GLM-5.2는 SWE-bench Pro에서 약 62점을 받으며, Claude Opus 4.8의 약 69점과 비교된다(DataCamp 기준). 비용의 일부로 근접한 수치다. 독립적인 Semgrep 벤치마크에서는 GLM-5.2가 일부 보안 작업에서 Claude를 앞서는 결과까지 나왔다. X의 개발자들은 자주 이를 "Claude보다 저렴하다"고 부르지만, Max 등급 사용자들은 피크 시간대 윈도우에서 스로틀링을 보고한다.
더 큰 그림을 원하시나? 더 넓은 코딩 에이전트 지형도를 참고하고, Cursor가 당신의 에디터라면 Cursor 더 효율적으로 쓰기가 더 저렴한 백엔드 모델과 궁합이 좋다.
Claude Code, Cline, Roo를 이 플랜에 연결하는 법
Claude Code에서 glm 코딩 플랜을 사용하려면 베이스 URL을 https://api.z.ai/api/anthropic으로, 모델을 GLM-5.2[1m]으로 설정한 뒤 Z.ai 키로 인증하면 된다. Cline, Roo Code, OpenClaw, ZCode, OpenCode도 같은 방식으로 작동한다. 지원되지 않는 도구는 엔드포인트에서 차단되므로, 설정은 즉시 작동하거나 깔끔하게 실패한다.
Claude Code에 우리가 정확히 붙여넣은 내용은 이렇다:
export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-z-ai-key"
export ANTHROPIC_MODEL="GLM-5.2[1m]"비 Anthropic 호환 도구의 경우, Z.ai는 https://api.z.ai/api/coding/paas/v4도 노출한다. 이 플랜은 Claude Code, Cline, Roo Code, OpenClaw, ZCode, OpenCode를 포함한 20개 이상의 클라이언트를 지원하며, 그 목록 밖의 것은 조용히 오작동하는 대신 거부된다.
엔드포인트와 베이스 URL 혼동은 Z.ai Discord에서 가장 많은 설정 불만 사항이다. 흔한 함정은 Claude 호환 도구를 paas/v4 URL에 연결하거나 그 반대로 하는 것이다. 엔드포인트를 도구 유형에 맞추면 그냥 작동한다. 백엔드를 교체해 Claude Code를 구동하는 것이 처음이라면, 우리의 Claude Code 워크플로 설정 가이드가 더 넓은 설정을 다룬다. 이 위에 무언가를 구축하는 팀은 종종 이를 알아둘 만한 에이전트 프레임워크와 짝짓는다.
GLM 코딩 플랜에 맞지 않는 용도(+ 리셀러 가격의 함정)
glm 코딩 플랜은 SLA나 동시성 보장이 필요한 프로덕션 API 워크로드, 지원되지 않는 도구, 3배 쿼터를 소모하는 피크 시간대 파워 유저, 초과 사용 헤드룸이 필요한 팀을 위해 설계되지 않았다. 이것은 정액제 개발 도구이지 계량제 프로덕션 API가 아니다. 동시성 보장이나 예상치 못한 청구서 안전망이 필요하다면, 이 플랜은 그것이 아니다.
그리고 가격 혼동이 있다. "glm 코딩 플랜"을 검색하면 Lite $10, Pro $30, Max $80을 파는 페이지들을 보게 될 것이다. 그것들은 공식 Z.ai 가격이 아니다. 할인된 API 키나 쿠폰 접근권을 파는 서드파티 리셀러(codingplan.run, bigmodel, "3 dollars" 프로모션)다. 공식 등급은 $18 / $72 / $160이다. 리셀러 키에는 실질적인 위험이 따른다: 잠재적인 서비스 약관 위반, 지원 보장 없음, 그리고 취소될 수 있는 키. 가격이 너무 좋아 보인다면, 그것은 플랜이 아니라 재판매된 쿠폰이다.
데이터에 관해서: Z.ai가 중국 제공업체이기 때문에 일부 Hacker News 댓글러들은 데이터 보존 및 중국 호스팅 우려를 지적한다. 이는 규제 대상이거나 민감한 코드베이스에는 정당한 고려사항이다. 대충 넘기지 마시라. 프로덕션 레포를 연결하기 전에 Z.ai 문서의 보존 정책을 읽고 당신의 컴플라이언스 자세에 맞는지 판단하시라. 취미나 비민감 작업의 경우, 우리가 본 대부분의 개발자들은 이를 비이슈로 취급한다.
저자 소개
Mert Batur Gurbuz는 Techsy.io의 공동 창업자로, 이 팀은 B2B 고객을 위해 AI 에이전트, 자동화 시스템, 음성/SDR 파이프라인을 구축한다. 그는 University of Birmingham에서 공부하며 Techsy 팀이 실제 프로덕션에서 사용하는 LLM 도구 스택에 대해 글을 쓴다.
이력: Techsy.io 공동 창업자, University of Birmingham. LinkedIn에서 연결하세요.
자주 묻는 질문
GLM 코딩 플랜의 가격은 얼마인가?
GLM 코딩 플랜은 3개 등급이다: Lite 월 $18, Pro 월 $72, Max 월 $160. 2026년 9월까지의 30% introductory 프로모션으로 각각 $12.60, $50.40, $112로 내려간다. 연간 결제 비용은 각각 $151.20, $604.80, $1,344다. 현재 수치는 z.ai/subscribe에서 확인하시라.
GLM 코딩 플랜의 주간 한도는?
주간 프롬프트 쿼터는 대략 Lite 400, Pro 2,000, Max 8,000이다. 각 등급에는 또한 약 80, 400, 1,600 프롬프트의 더 짧은 5시간 롤링 한도가 있다. 주간 쿼터는 주문 시점부터 계산되는 7일 주기로 리셋된다.
GLM 코딩 플랜에 포함된 모델은?
세 등급 모두 동일한 모델을 포함한다: GLM-5.2(1M 컨텍스트 창을 갖춘 플래그십), GLM-5-Turbo, GLM-4.7. 등급 가격은 쿼터 용량과 MCP 호출 허용량만 바꿀 뿐, 접근 가능한 모델은 바뀌지 않는다. Lite 구독자도 Max 구독자와 정확히 같은 GLM-5.2를 구동한다.
주간 한도에 도달하면 어떻게 되나?
다음 5시간 창이 리셋될 때까지 호출이 일시정지된다. 초과 청구도, 예상치 못한 과금도 없으며, 쿼터가 새로고침될 때까지 시스템이 단순히 완성본 반환을 멈춘다. 이는 감속이 아닌 완전 정지이므로, 헤비 사용자는 큰 실행을 비피크로 스케줄링해 실효 쿼터를 늘려야 한다.
GLM 코딩 플랜을 Claude Code나 Cursor에서 쓸 수 있나?
Claude Code는 가능하다: 베이스 URL을 https://api.z.ai/api/anthropic으로, 모델을 GLM-5.2[1m]으로 설정하시라. Cline, Roo Code, OpenClaw, ZCode, OpenCode도 지원된다. Cursor는 이 엔드포인트를 통해 네이티브로 지원되지 않으므로, 의존하기 전에 현재 호환성을 확인하시라.
GLM 코딩 플랜은 GLM-4.6으로 구동되나, GLM-5.2로 구동되나?
2026년 6월 13일부터 GLM-5.2다. Google 자동완성은 여전히 이 플랜을 GLM-4.6과 연관 짓지만, 이는 구식 정보다. 현재 모든 등급이 1M 컨텍스트 창을 갖춘 GLM-5.2로 구동되며, 전체 컨텍스트 길이를 얻으려면 Claude Code에서 GLM-5.2[1m] 모델 ID를 사용하시라.
$10/$30/$80 리셀러 가격은 정품인가?
아니다. 공식 등급은 $18, $72, $160이다. Lite $10, Pro $30, Max $80을 광고하는 페이지들은 실제 Z.ai 플랜이 아니라 할인된 API 키나 쿠폰 접근권을 파는 서드파티 리셀러다. 그 키들은 서비스 약관 위반, 지원 없음, 취소 위험을 안고 있다. 문제를 피하려면 z.ai/subscribe에서 직접 구매하시라.
GLM 코딩 플랜에 동시성 한도가 있나?
Z.ai는 코딩 플랜에 대한 동시 요청 한도를 공식적으로 공개하지 않으므로, 무제한이라기보다는 문서화되지 않은 것으로 간주하시라. 우리의 단일 에이전트 Claude Code 테스트에서는 동시성 벽에 부딪힌 적이 없지만, 병렬 에이전트를 돌린다면 계약하기 전에 자신의 워크로드에 맞춰 동작을 검증하시라.
GLM 코딩 플랜은 실제로 Claude보다 저렴한가?
꾸준한 일상 코딩이라면 그렇다: 월 $72의 Pro는 우리의 대략 월 $200 Claude Max 지출을 밑돌았다. 하지만 주의사항은 실재한다. 헤비 마이그레이션 주에는 5일째에 주간 한도에 도달해 마무리를 위해 Claude로 돌아갔으므로, 우리의 실제 비용은 Pro에 약간의 Claude 사용량을 더한 것이었다. 청구서를 줄여주지만, Claude를 없애주지는 않는다.
내 데이터는 보존되나, 그리고 중국에서 호스팅되나?
Z.ai는 중국 제공업체이며, Hacker News의 일부 개발자들은 데이터 보존 및 호스팅 우려를 제기한다. 민감하거나 규제 대상인 코드베이스의 경우, 프로덕션 레포를 이 플랜에 연결하기 전에 Z.ai 문서의 보존 약관을 검토하시라. 취미나 비민감 작업의 경우, 대부분의 개발자들은 이를 수용 가능한 트레이드오프로 취급한다.
결론
glm 코딩 플랜은 현재 에이전틱 코딩에서 최고의 정액제 가성비이며, 정직한 별표 하나가 붙는다. 월 $72의 Pro는 솔로 일상 개발을 위한 우리의 선택이다: Claude Max 지출을 밑돌았고, GLM-5.2는 실제 Next.js 16 리팩토링에서 제 몫을 했으며, 초과 청구 없는 설계 덕분에 예상치 못한 청구서를 절대 받지 않는다. Lite는 체험판이고, Max는 Pro의 주간 약 2,000 프롬프트를 소진하는 팀을 위한 것이다.
하지만 Claude를 완전히 대체하지는 못한다. 우리의 두 번의 마이그레이션 주에는 5일째에 한도에 도달해 마무리를 위해 Claude에 다시 손을 뻗었고, 3배 피크 배수는 헤드라인 숫자가 시사하는 것보다 빠르게 쿼터를 잡아먹는다. 이를 기본 코딩 모델로 돌리고, 힘든 주를 위해 Claude 플랜을 유지하며, 1배 프로모션이 지속되는 동안 헤비 실행을 비피크로 스케줄링하시라. 그 조합이 우리를 늦추지 않으면서 가장 낮은 청구서를 안겨주었다. GLM을 프로덕션 에이전트 스택에 연결하는 데 도움이 필요하다면, 문의하시라.