
GLM 5.2 je model Z.ai (Zhipu AI) zaměřený především na kódování, jehož hlavním tahákem je kontextové okno o 1 milionu tokenů. Vyšel 13. června 2026 a teď ta upřímná část, kterou většina textů k uvedení vynechává: model přišel bez oficiálních benchmarků. Tato recenze GLM 5.2 proto odděluje, co je skutečně potvrzené, od toho, co je teprve na roadmapě, a řekne vám, jestli si už dnes zaslouží místo ve vašem stacku.
Co je GLM 5.2? (rychlé shrnutí)
GLM 5.2 je velký jazykový model od Z.ai (Zhipu AI) se zaměřením na kódování, vydaný 13. června 2026, s kontextovým oknem o 1 milionu tokenů stavěným pro agentní vývoj softwaru v měřítku celého repozitáře. Běží přes GLM Coding Plan uvnitř agentů typu Claude Code a Cline a jeho váhy vycházejí pod licencí MIT.
GLM 5.2 je nejnovější model z rodiny GLM od Z.ai a míří jednoznačně na jednu věc: agentní kódování v měřítku celého repozitáře. Linie je přehledná – GLM-4.5 → GLM-5 → GLM-5.1 → 5.2 – a každý krok se víc opíral o softwarové inženýrství na delším horizontu místo obecného chatu. Představte si 5.2 jako verzi, která vám konečně dává kontextové okno dost velké na to, abyste do něj vložili celý projekt najednou.
Háček, a budeme ho opakovat několikrát, protože je důležitý: Z.ai při vydání nepublikoval pro 5.2 žádné oficiální benchmarky. Každé tvrdé výkonnostní číslo, které teď koluje, je zděděné z GLM-5.1. Jasně je označíme, abyste výsledek 5.1 nikdy nespletli s naměřeným výsledkem 5.2.
Co je skutečně potvrzené, na jeden pohled:
- kontextové okno 1 000 000 tokenů (živé ve všech tarifech GLM Coding Plan)
- 131 072 tokenů jako maximální výstup na odpověď
- ID modelu:
glm-5.2[1m](varianta s plným oknem) - Dva režimy uvažování: High a Max (pro složité kódování je doporučený Max)
- Otevřené váhy pod licencí MIT (záměr potvrzen, váhy vyjdou krátce po vydání)
- Podpora v osmi oblíbených coding agentech hned od začátku
To je kostra. Teď od sebe oddělíme potvrzená fakta a sliby typu „už brzy“, protože právě tahle mezera je celý příběh.
Co je potvrzené a co teprve přijde
Právě tady bývají texty z uvedení nedbalé. GLM 5.2 vyšel jako skutečný, použitelný model, ale několik jeho hlavních prodejních bodů (otevřené váhy, samostatná API, přístup přes chatbota) bylo oznámeno jako slib „příští týden“, ne jako dodaná funkce. Než se rozhodnete, ujasněte si stav každé části.
| Funkce | Stav | Podrobnosti |
|---|---|---|
| Kontext 1M tokenů | Potvrzeno | Živý ve všech tarifech Coding Plan |
| Max. výstup 131 072 | Potvrzeno | Na odpověď |
| Integrace coding agentů | Potvrzeno | Claude Code, Cline, OpenCode, Roo Code, Goose, Crush, OpenClaw, Kilo Code |
| Režimy uvažování High / Max | Potvrzeno | Pro složité kódování je doporučený Max |
| Otevřené váhy MIT | Přijde | Při vydání slíbeno „příští týden“ |
| Samostatná API | Přijde | Naplánováno krátce po vydání |
| Chatbot chat.z.ai | Přijde | Při vydání nedostupné |
| Oficiální benchmarky 5.2 | Nepublikovány | Při vydání žádná čísla ze SWE-bench, Terminal-Bench ani Code Arena |
Vzorec je jasný: všechno, co dnes potřebujete, abyste s GLM 5.2 kódovali, je živé, pokud jdete přes GLM Coding Plan v podporovaném agentovi. Co je stále na cestě, záleží pro vlastní hosting, pro jiné než kódovací využití a pro každého, kdo před nasazením chce nezávislé důkazy. Nic z toho není zásadní překážka, jen to znamená, že věta „GLM 5.2 je open source a má API“ je tento týden z poloviny pravdivá. Položky roadmapy berte jako sliby, ne jako funkce, dokud skutečně nedorazí.
Hlavní zpráva: použitelné kontextové okno o 1 milionu tokenů
Kontextové okno GLM 5.2 má 1 000 000 tokenů (1M), zhruba pětkrát víc než GLM 5.1, a najdete ho v každém tarifu Coding Plan. Neskrývá se za enterprise nabídkou. Každé uvedení modelu miluje velká čísla, ale tohle je jedno z těch opravdu užitečných.

Proč 1M tokenů mění práci v měřítku repozitáře
Každodenní analogie: kontextové okno 200K je, jako když řemeslníkovi předáte pár místností domu a chcete po něm rekonstrukci, aniž by viděl zbytek. Okno 1M vám dovolí předat celý plán, tedy středně velkou codebase, dokumentaci, otevřené tickety i stylovou příručku, všechno v jednom promptu.
Pro agentní kódování je to skutečná změna workflow. Přestanete dělat gymnastiku s chunkováním, přestanete ručně krmit soubory jeden po druhém a přestanete sledovat, jak model ztrácí funkci, kterou četl před 40 zprávami. Při refaktoringu v měřítku repozitáře, kdy model musí chápat, jak se změna v jednom modulu propíše do dvaceti dalších, se větší okno přesně projeví tam, kde dlouhý kontext přináší návratnost.
Maximální výstup: 131 072 tokenů
Kontext je to, co model čte, výstup je to, co zpátky zapíše. GLM 5.2 zvládne vyprodukovat až 131 072 tokenů v jedné odpovědi. V praxi to znamená velký diff přes několik souborů na jeden zátah místo výzev „pokračovat?“ každých pár set řádků. Hodí se, když agent generuje kostru celé funkce nebo rozsáhlý refaktoring.
ID modelu: glm-5.2[1m]
Když model zapojujete do agenta, identifikátor varianty s plným oknem je glm-5.2[1m]. Štítek [1m] dělá skutečnou práci: říká endpointu, že chcete variantu s milionem tokenů kontextu. Když tenhle řetězec napíšete v konfiguraci správně, máte vyhráno. Přesný snippet ukážeme níž.
GLM 5.2 vs. GLM 5.1: co se vlastně změnilo
Pokud už GLM 5.1 používáte, otázka je jednoduchá: vyplatí se přechod na 5.2? Tady je upřímné srovnání vedle sebe.
| Parametr | GLM 5.1 | GLM 5.2 |
|---|---|---|
| Kontextové okno | ~200K (200 000–202 752) | 1 000 000 (5× skok) |
| Max. výstup | baseline 5.1 | 131 072 tokenů |
| Režimy uvažování | dřívější předvolby | High / Max (bez Auto/Low) |
| Zaměření | silný univerzál | kódování na prvním místě / agentní |
| Otevřené váhy | MIT, na Hugging Face | MIT (vyjdou krátce po vydání) |
Ve skutečnosti jde o dvě věci: pětinásobný skok v kontextu a ostřejší zaměření na kódování. Všechno ostatní je postupné ladění. Z.ai zúžil režimy uvažování jen na High a Max, Auto ani Low už neexistují, a to je jemná nápověda, že tenhle model počítá s vážnou prací, ne s rychlým dohledáváním. Pokud vaše zátěž stojí na dlouhém kontextu nebo celých repozitářích, je 5.2 skutečný upgrade. Jestli vám 5.1 vyhovovala na malé, soustředěné úlohy, je přínos menší, než marketing naznačuje.
Benchmarky: co víme (a upřímná poznámka)
Řekněme to znovu a naplno: k vydání neexistují žádné oficiální benchmarky GLM 5.2. Žádná čísla ze SWE-bench, žádný Terminal-Bench, žádné Elo z Code Arena pro 5.2 konkrétně. Kdo tento týden tvrdí, že má naměřené skóre 5.2, buď hádá, nebo tiše přebírá data 5.1.
Co tedy můžeme o pravděpodobném výkonu říct poctivě? Nejlepší dostupná proxy je GLM-5.1, na kterém 5.2 přímo staví. Tady jsou data 5.1, jasně označená jako proxy, ne jako výsledek 5.2.

| Benchmark (proxy GLM-5.1) | GLM-5.1 | Srovnání |
|---|---|---|
| SWE-bench Pro | 58,4 % (výrobce tvrdí 1. místo) | GPT-5.4 57,7 %, Opus 4.6 57,3 % |
| SWE-bench Verified | 77,8 % (na základě GLM-5) | Opus 4.6 ~81,4 % |
| Code Arena (Elo) | 1530 (3. na světě) | Opus 4.6 ~1542 (2.) |
| Terminal-Bench 2.0 | 63,5 % (66,5 % se scaffoldem Claude Code) | – |
| Eval Claude Code | 45,3 b. → parita 94,6 % (údaj výrobce) | Opus 4.6 47,9 |
| GPQA-Diamond | 86,2 % | – |
| AIME 2026 | 95,3 % | – |
Jedna rychlá poznámka ke sloupci srovnání: zmínění soupeři (Opus 4.6, GPT-5.4) odrážejí žebříček z éry 5.1, ne dnešní špičku. Aktuální proprietární lídři jsou Claude Opus 4.8 a GPT-5, najdete je v přehledové tabulce níž.
Než těmto číslům uvěříte, potřebujete dvě poznámky. Zaprvé, jsou to čísla GLM-5.1, nejlepší proxy, kterou máme, dokud Z.ai nepublikuje výsledky 5.2. Zadruhé, ty nejvýraznější tvrzení, tedy „jednička“ na SWE-bench Pro a paritní číslo „94,6 % Opus 4.6“, vznikla jako interní čísla hlášená samotným Z.ai. Berte je jako tvrzení výrobce, která čekají na širší nezávislé zopakování, ne jako usazená fakta. Obrázek, který malují, zní „těsně pod špičkou a stahuje ztrátu“. Na model s otevřenými váhami je to působivé, ovšem působivé s hvězdičkou, dokud to nezávislí hodnotitelé nepotvrdí přímo na 5.2.
Jak si GLM 5.2 stojí mezi frontier modely roku 2026
Kde tedy GLM 5.2 vlastně stojí v roce, kdy je na špici opravdu plno? Upřímně: je to silný vyzyvatel s otevřenými váhami, který stahuje ztrátu na proprietární lídry, s férovou poznámkou, že sloupec jeho síly v kódování stojí na proxy datech 5.1, ne na naměřených výsledcích 5.2.
| Model | Otevřené váhy? | Kontext | Síla v kódování (proxy) | Nejlepší pro |
|---|---|---|---|---|
| GLM 5.2 | MIT (přijdou) | 1M | Blízko frontier (proxy 5.1) | Agentní kódování v měřítku repozitáře, týmy na otevřených váhách |
| Claude Opus 4.8 / Fable 5 | Ne | Velký | Frontier | Nejnáročnější reasoning + kódování |
| GPT-5 | Ne | Velký | Frontier | Široký ekosystém, nástroje |
| Gemini 3.x | Ne | Velmi velký | Silná | Multimodalita + stack Google |
| DeepSeek V4 | Otevřené | Velký | Silná | Nákladově výhodná otevřená volba |
| Qwen (nejnovější) | Otevřené | Velký | Silná | Otevřená vícejazyčná volba + čínský stack |
Férové čtení: v nezávisle ověřených výsledcích Claude a GPT stále vedou. Pokud nasazujete nejnáročnější reasoning nebo chcete nejprověřenější model pro kódování, nejnovější počiny Anthropic a OpenAI zůstávají jistější volbou. Jestli zvažujete konkrétně Claude, náš rozbor novinek v Claude Opus 4.8 a řady Claude Fable 5 / Mythos 5 ukazuje, kde tyhle modely získávají náskok.
Co GLM 5.2 přináší a proprietární špička ne, je kombinace kontextového okna 1M, otevřených vah MIT a agresivních cen v jednom balení. Pro týmy, které si cení nezávislosti na dodavateli nebo chtějí model časem provozovat na vlastní infrastruktuře, je to přesvědčivá výměna, i když čistý náskok v benchmarkách zatím patří Claude nebo GPT. Proti ostatním otevřeným hráčům vyhrává DeepSeek V4 nákladovou efektivitou a Qwen jazykovou šíří, ale ani jeden nedosáhne na kontextové okno GLM 5.2. Pokud se některý z těchto modelů snažíte zapojit do automatizované build pipeline, vyplatí se nejdřív porovnat přední frameworky agentů, aby model a orchestrační vrstva skutečně ladily.
Ceny a přístup: GLM Coding Plan + chystaná API
Aktualizováno pro rok 2026: GLM Coding Plan teď běží na GLM-5.2 a tarify se změnily. Pro nyní stojí $72 měsíčně a Max $160 měsíčně, Lite zůstává $18. Úplný rozpis týdenních limitů, mechanismů throttlingu a náš třítýdenní praktický test najdete v samostatném průvodci GLM 5.2 Coding Plan.
Teď část, která zajímá zakladatele: kolik to stojí a jak se k tomu dostat? Dnes je potvrzenou cestou GLM Coding Plan, předplatné, které účtuje prompty za týden místo fakturace po tokenech.
| Tarif | Promptů týdně | Cena (2026) |
|---|---|---|
| Lite | ~400 | ~$18/měs. (některé zdroje: běžně $10/měs., $3 první měsíc) |
| Pro | ~2 000 | ~$30/měs. ($15 první měsíc) |
| Max | ~8 000 | Vyšší tarif |
| Team | podle počtu míst | Ceny pro organizace |
Z pohledu startupu je ta cena agresivní. Tarif Lite za zhruba $18 měsíčně a ~400 promptů týdně je na model ve třídě frontier opravdu levný a slevy na první měsíc dělají vyzkoušení téměř zdarma. Pro většinu vývojářů na volné noze a malé týmy je tarif Pro za ~$30 měsíčně nejlepší poměr ceny a výkonu.
Jedna upřímná mezera: ceny samostatné API GLM 5.2 nebyly při vydání zveřejněny. Dokud Z.ai oficiální sazby 5.2 nevypíše, je nejlepší referencí zděděná základní API GLM-5, tedy $1.00 za 1M vstupních tokenů a $3.20 za 1M výstupních tokenů. Berte to jako orientační pásmo, ne jako nabídku. Pokud je vaše využití měřené a nepředvídatelné, počkejte s modelováním nákladů na skutečná čísla API.
Jak používat GLM 5.2 v Claude Code a Cline
A teď ta opravdu zajímavá část: protože GLM 5.2 nabízí endpoint kompatibilní s Anthropic API, můžete agenta, kterého už používáte (Claude Code nebo Cline), nasměrovat přímo na něj. Žádný nový nástroj se učit nemusíte.
Postup má čtyři kroky:
- Získejte klíč GLM Coding Plan od Z.ai.
- Nasměrujte agenta na základní URL Z.ai.
- Nastavte ID modelu na
glm-5.2[1m]. - Vyberte režim uvažování. Pro složitou práci přes více souborů Max.
Tady je skutečný konfigurační snippet pro zapojení GLM 5.2 do Claude Code přes proměnné prostředí:
# Point Claude Code at the GLM Coding Plan endpoint
# (verify the exact base URL against current Z.ai docs)
export ANTHROPIC_BASE_URL="https://api.z.ai/api/anthropic"
export ANTHROPIC_AUTH_TOKEN="your-glm-coding-plan-key"
export ANTHROPIC_MODEL="glm-5.2[1m]"
# Then run Claude Code as usual — it routes to GLM 5.2
claude
GLM 5.2 funguje hned od začátku s Claude Code, Cline, OpenCode, Roo Code, Goose, Crush, OpenClaw a Kilo Code. Ať váš workflow odpovídá kterémukoli agentovi, pravděpodobně jste pokrytí. Pokud si teprve vybíráte, nejlepší AI coding agenti letošního roku rozebírají jednotlivé kompromisy a pro dlouho běžící úlohy se před rozhodnutím vyplatí podívat se, jak si stojí coding agenti běžící na pozadí. Už pracujete v Claude Code? Náš text o osvědčených workflow pro Claude Code se dá po zapojení GLM 5.2 převzít téměř jedna ku jedné, a pokud chcete setup rozšířit o vlastní nástroje, začněte napojením přes MCP.
Realita vlastního hostingu
„Otevřené váhy pod MIT“ zní, jako byste model mohli spustit na laptopu. Nemůžete, tedy aspoň ne realisticky. Jakmile váhy vyjdou, GLM 5.2 poběží na vLLM a SGLang, standardních stackech pro vysokopropustnostní serving. Jenže checkpoint FP8 potřebuje zhruba 860 GB VRAM. To je rozhodnutí o serveru s více GPU, ne vedlejší projekt. Vlastní hosting je reálný a podporovaný, je to ale investice do infrastruktury. Než týmu slíbíte nasazení on-prem, poctivě si ji rozpočítejte.
Náš pohled: měli byste přejít už dnes?
Převeďme to všechno na rozhodnutí. Upřímný rámec je „vyzkoušet“ versus „zcela migrovat“ a to jsou dvě hodně odlišné úrovně rizika.
| Přepnout / vyzkoušet hned, pokud… | Počkat, pokud… |
|---|---|
| Kódujete v měřítku repozitáře / s dlouhým kontextem a okno 1M chcete už dnes | Před nasazením potřebujete publikované, nezávislé benchmarky |
| Chcete cestu otevřených vah (MIT) a ceníte si nezávislosti na dodavateli | Jste vázaní na proprietární nástroje, které agenti GLM nepodporují |
| Hlídáte náklady a tarify Coding Plan vám sedí do rozpočtu | Potřebujete samostatnou API nebo chatbot (stále „přijde“) |
| Zvládnete vyvíjející se přístup, dokud funkce dorazí | Váš compliance vyžaduje stabilní API ve stavu GA |
Náš závěr: vyzkoušet GLM 5.2 je silné a málo rizikové rozhodnutí. Coding Plan je levný, zapadne do agentů, které už provozujete, a kontextové okno 1M je skutečný přínos dostupný hned. Úplná produkční migrace je rizikovější, dokud nedorazí nezávislé benchmarky a váhy skutečně nevyjdou. Roadmapu nechcete vsadit na čísla hlášená výrobcem. Pokud vaše rozhodnutí závisí i na tom, kterého agenta standardizujete, hodí se jako doprovodné čtení srovnání OpenHands vs. Devin vs. Manus, protože výběr agenta často znamená víc než podkladový model.
Jak k tomu přistupujeme my v Techsy
Rozhodnout, které LLM nasadit do produkce, GLM 5.2, Claude, nebo GPT, není cvičení ve čtení benchmarků. Nasadili jsme AI funkce na všech třech a naše hodnocení vždy skončí u čtyř otázek z praxe: jak velká je mezera mezi benchmarkem a vaším skutečným repozitářem? Jaké jsou skutečné náklady na úlohu při vašem objemu? Integruje se s agenty a CI, které váš tým už provozuje? A jak velký lock-in podepisujete?
U čerstvého vydání, jako je GLM 5.2, to znamená, že model tento týden rádi vyzkoušíme na reálné úloze, ale produkční migraci podržíme, dokud nezávislá čísla nepotvrdí proxy data a váhy nevyjdou. Někdy je proprietární frontier model opravdu lepší volbou, a když to tak je, řekneme to. **Zvažujete, který model patří do vašeho stacku? **Získejte konzultaci zdarma → a my vám pomůžeme zvážit kompromisy proti vaší skutečné zátěži.
Časté dotazy
Co je GLM 5.2 a kdo za ním stojí?
GLM 5.2 je frontier model od Z.ai (Zhipu AI) zaměřený na kódování, vydaný 13. června 2026. Jeho hlavní funkcí je kontextové okno o 1 milionu tokenů a je cílený na agentní vývoj softwaru v měřítku celého repozitáře.
Je GLM 5.2 open source?
Ano, GLM 5.2 je open source pod licencí MIT s otevřenými váhami a pokračuje v povolné tradici rodiny GLM. Háček je v načasování: váhy byly od vydání 13. června 2026 slíbeny „příští týden“ a na Hugging Face zatím nejsou. Jde tedy o open source na roadmapě, první den ještě ke stažení nebyly.
Jak velké je kontextové okno GLM 5.2?
1 000 000 tokenů, zhruba pětinásobný skok proti oknu ~200K u GLM 5.1. Podporuje navíc až 131 072 tokenů výstupu na odpověď, což stačí na velké diffy přes více souborů na jeden zátah.
Čím se GLM 5.2 liší od GLM 5.1?
Velké změny jsou pětinásobné zvětšení kontextového okna, dva zjednodušené režimy uvažování (High a Max, bez Auto/Low) a ostřejší zaměření na kódování a agenty. Všechno ostatní je přírůstkové, skok v kontextu je to pravé vylepšení.
Má GLM 5.2 publikované benchmarky?
Ne. K vydání neexistují žádné oficiální benchmarky GLM 5.2. Čísla, která kolují po internetu, jsou proxy GLM-5.1. Tvrzení o „jedničce na SWE-bench Pro“ a „94,6 % Opus 4.6“ berte jako údaje nahlášené samotným Z.ai, dokud je nezávislí hodnotitelé nezopakují přímo na 5.2.
Je GLM 5.2 lepší než Claude Opus 4.8 nebo GPT-5?
Podle ověřených výsledků ne. Claude Opus 4.8 a GPT-5 stále vedou nezávisle měřenou špičku a důkaz specifický pro GLM 5.2 zatím neexistuje. Podle zděděných proxy dat GLM-5.1 vypadá GLM 5.2 jako model těsně pod špičkou, který stahuje ztrátu, a to je cenné hlavně pro týmy na otevřených váhách. Pro ty nejnáročnější úlohy ale dnes zůstávají bezpečnější volbou proprietární lídři.
Kolik GLM 5.2 stojí?
Ceny běží přes GLM Coding Plan – Lite stojí ~$18/měs. (~400 promptů týdně), Pro ~$30/měs. (~2 000/týden), Max je vyšší tarif (~8 000/týden) a Team se účtuje podle počtu míst. Ceny samostatné API nebyly při vydání zveřejněny, zatím nejlepší referencí je základní sazba GLM-5, tedy $1.00 za 1M vstupních a $3.20 za 1M výstupních tokenů.
Jak GLM 5.2 získám a jak ho používám?
Potvrzená cesta je dnes GLM Coding Plan napojený na Claude Code, Cline, OpenCode, Roo Code, Goose, Crush, OpenClaw nebo Kilo Code. Základní URL nastavíte na endpoint Z.ai a ID modelu na glm-5.2[1m]. Samostatná API a přístup přes chat.z.ai jsou ve stavu „přijde“, ne živé.
Mohu GLM 5.2 provozovat ve vlastní režii?
Jakmile vyjdou váhy pod MIT, ano, přes vLLM nebo SGLang. Jenže checkpoint FP8 potřebuje zhruba 860 GB VRAM, takže jde o seriózní rozhodnutí o infrastruktuře s více GPU, ne o projekt na laptop nebo jednu kartu. Rozpočet na hardware tomu přizpůsobte.
Mám na GLM 5.2 přejít hned teď?
Vyzkoušet ho má nízké riziko. Coding Plan je levný a zapadá do agentů, které už používáte. Úplnou produkční migraci odložte, dokud nedorazí nezávislé benchmarky a nevyjdou váhy, abyste kritickou závislost nestavěli na číslech od výrobce.
Hlavní závěry
- Kontextové okno 1M tokenů je pravé hlavní téma – použitelný pětinásobný skok, který skutečně mění workflow kódování v měřítku repozitáře i agentní práci.
- Benchmarky jsou zděděné proxy GLM-5.1, ne naměřené výsledky 5.2. Čísla „jednička na SWE-bench“ a „94,6 % Opus“ jsou tvrzení nahlášená výrobcem, která čekají na nezávislé zopakování.
- Otevřené váhy MIT a samostatná API jsou ve stavu „přijde“, nikoli vydáno. Potvrzenou cestou je dnes GLM Coding Plan v podporovaném agentovi.
- Vyzkoušení přes Claude Code nebo Cline je levné a s nízkým rizikem; úplná migrace by měla počkat na nezávislá čísla a na váhy.
- Pro týmy na otevřených váhách, které chtějí nezávislost na dodavateli a největší kontextové okno v oboru, je GLM 5.2 jednou z nejzajímavějších sázek roku 2026.
Chcete druhý názor, než zapojíte frontier model do svého stacku? Ozvěte se našemu týmu →. GLM, Claude i GPT máme nasazené v produkci a pomůžeme vám vybrat ten pravý pro vaši zátěž.