
Benchmarky GPT-5.5 Pro: Čísla, která OpenAI zveřejnila (a ta, která ne)
OpenAI vydala GPT-5.5 Pro 23. dubna 2026 a nasadila cenu 30 $ za milion vstupních tokenů a 180 $ za milion výstupních. To je 6× více než základní GPT-5.5 za 5 $/30 $. Za tyto peníze získáte výpočetně náročnější variantu, která v BrowseComp dosahuje 90,1 %. Ale tady je ta část, kterou nikdo nedává do titulku: vlastní evaluační tabulka OpenAI nechává řádek pro kódování u GPT-5.5 Pro prázdný. Stejně tak pro používání počítače. Stejně tak pro dlouhý kontext. Takže když budete hledat skóre tohoto modelu v SWE-Bench Pro, žádné nenajdete. Stáhli jsme zveřejněnou tabulku a každou hodnotu jsme sami ověřili.
Rychlá odpověď:
- GPT-5.5 Pro je výpočetně náročnější varianta GPT-5.5 od OpenAI (vydána 23. dubna 2026), nikoli nový model.
- Vede v prohlížení webu (BrowseComp 90,1 %) a v špičkové matematice, ale OpenAI nechala řádky pro kódování, používání počítače a dlouhý kontext prázdné.
- V existujících řádcích pro kódování zaostává základní GPT-5.5 za Claude Fable 5 (SWE-Bench Pro 58,6 % vs. 80,3 %).
- Claude Fable 5 je momentálně pozastaven (směrnice USA o exportní kontrole, přibližně 12. června 2026), takže jeho vítězství mají hvězdičku „teď ho nekoupíte".
Pár slov k metodě, protože u příspěvku o benchmarkách záleží na přesnosti víc než na rychlosti: níže uvedená čísla jsme zkříženě ověřili se zveřejněnými tabulkami OpenAI a Anthropic a s článkem o SWE-Bench Pro (arXiv 2509.16941). Pokud hodnotu uvádí pouze jeden dodavatel, říkáme to. Pokud OpenAI skóre Pro nikdy nezveřejnila, píšeme „nezveřejněno", místo abychom tiše dosadili číslo základní verze.
Benchmarky GPT-5.5 Pro: Co OpenAI skutečně zveřejnila
Zveřejněné benchmarky GPT-5.5 Pro pokrývají jen úzký výsek: prohlížení webu, špičkovou matematiku, profesionální znalostní práci, genetiku a široké uvažování. OpenAI spustila všechny evaluace s úrovní uvažování xhigh ve výzkumném prostředí, což se liší od výchozího nastavení produkčního ChatGPT. Hlavní číslo je BrowseComp 90,1 %, což je jasně nad 84,4 % základní GPT-5.5.
Zde je hlavní tabulka se sloupcem ukazujícím, zda OpenAI pro každý test zveřejnila samostatné skóre Pro:
| Benchmark | Co testuje | GPT-5.5 Pro | GPT-5.5 základ | Pro zveřejněno? | Poznámky |
|---|---|---|---|---|---|
| BrowseComp | Náročné prohlížení webu / vyhledávání informací | 90,1 % | 84,4 % | Ano | Nejjasnější vítězství Pro nad základem |
| FrontierMath T1-3 | Náročná matematika | 52,4 % | 51,7 % | Ano | Poráží uváděný Opus 4.7 (43,8 %) |
| FrontierMath T4 | Špičková matematika | 39,6 % | 35,4 % | Ano | Nejtěžší matematická úroveň |
| GDPval | Profesionální znalostní práce | 82,3 % (uváděno) | 84,9 % | Ano (připsáno) | Tabulka OpenAI řadí Pro pod základ |
| GeneBench | Vícefázová genetika | 33,2 % (uváděno) | 25,0 % | Ano (připsáno) | „OpenAI uvádí" velký skok |
| HLE (bez nástrojů) | Široké náročné uvažování | 43,1 % | 41,4 % | Ano | Pod uváděným Opus 4.7 (46,9 %) |
| HLE (s nástroji) | Uvažování s nástroji | 57,2 % (uváděno) | 52,2 % | Částečně | Základ 52,2 % potvrzen; Pro 57,2 % uváděno |
| Modelování investičního bankovnictví | Finanční modelování | 88,6 % (interní) | 88,5 % | Interní evaluace | OpenAI toto označila jako INTERNÍ; berte s rezervou |
| SWE-Bench Pro | Agentické kódování | nezveřejněno | 58,6 % | Ne | Hlavní mezera |
| OSWorld-Verified | Používání počítače | nezveřejněno | 78,7 % | Ne | U Pro prázdné |
| Kybernetická bezpečnost | Bezpečnostní úlohy | nezveřejněno | neuvedeno | Ne | U Pro prázdné |
| Dlouhý kontext | Zapamatování dlouhých dokumentů | nezveřejněno | neuvedeno | Ne | U Pro prázdné |
Přečtěte si tento spodní blok pozorně. OpenAI zveřejnila skóre GPT-5.5 Pro pro prohlížení webu a matematiku, ale řádky pro kódování, používání počítače, kybernetickou bezpečnost a dlouhý kontext nechala prázdné. Hodnoty BrowseComp, FrontierMath a základu GDPval jsou potvrzeny sekundárními sledovači; GDPval-Pro 82,3 %, GeneBench 33,2 % a číslo investičního bankovnictví uvádí OpenAI, ale nejsou nezávisle ověřeny, takže je připisujeme, místo abychom je prohlašovali za hotovou věc.
Co „Pro" vlastně znamená: paralelní výpočet v čase testu, nikoli nový model
GPT-5.5 Pro je tentýž model GPT-5.5 běžící s mnohem větším úsilím o uvažování, nikoli jiná architektura. Představte si to méně jako nový motor a více jako tentýž motor, který před odpovědí běží déle a paralelně. OpenAI toto nastavení nazývá reasoning effort a Pro ho drží na nejvyšší úrovni: xhigh.
Je GPT-5.5 Pro jiný model než GPT-5.5?
Ne. Stejné váhy, stejný trénink. Když lidé hledají gpt 5.5 pro vs gpt 5.5 thinking nebo vs xhigh, ve skutečnosti se ptají na jeden ovladač: jak usilovně model přemýšlí, než odpoví. „Paralelní výpočet v čase testu" znamená, že model prozkoumává několik cest uvažování najednou a vybere tu nejlepší, což stojí více tokenů a více reálného času. Právě za tento dodatečný výpočet platíte 6×.
Specifikace jsou jinak sdílené. GPT-5.5 Pro má kontextové okno zhruba 1,1 milionu tokenů na vstupu a 128 tisíc na výstupu. Nekupujete si tedy větší paměť ani chytřejší základní model. Kupujete si více času na přemýšlení u modelu, který už znáte.
GPT-5.5 Pro vs. GPT-5.5 (standard): kde vám 6× cena něco koupí
GPT-5.5 Pro poráží základní GPT-5.5 v nejtěžších úlohách: prohlížení webu, špičková matematika a genetika. Nejméně vám koupí u rutinní práce. Nejčistší zisk je BrowseComp 90,1 % vs. 84,4 %, nárůst o 5,7 bodu v hloubkovém webovém výzkumu. V úrovni 4 FrontierMath stoupá z 35,4 % na 39,6 %.
Ale více výpočtu neznamená vždy vyšší skóre. V GDPval tabulka OpenAI dokonce řadí Pro níže než základní GPT-5.5 (uváděných 82,3 % vs. potvrzených 84,9 %). To je neintuitivní a uvádí se, že Pro vyměňuje některá hrubá vítězství za kalibraci. Pointa platí: vyšší platba není záruka.
Kde Pro vede:
- BrowseComp: 90,1 % vs. 84,4 % (+5,7)
- FrontierMath T4: 39,6 % vs. 35,4 % (+4,2)
- GeneBench: 33,2 % vs. 25,0 % (uvádí OpenAI)
- HLE s nástroji: 57,2 % (uváděno) vs. 52,2 % (potvrzený základ)
Kde je na tom stejně nebo hůř:
- GDPval: 82,3 % (uváděno) vs. 84,9 % základ
- HLE bez nástrojů: 43,1 % vs. 41,4 %, sotva patrný pohyb
Pokud je vaše práce převážně každodenní psaní, revize kódu a shrnutí, 6× příplatek se těžko obhajuje. Matematika se obrátí, jen když je úloha opravdu těžká. Když už jsme u nákladů: pokud je problém váš účet, náš průvodce jak snížit náklady na LLM API pokrývá směrování levnějších modelů na snadných 80 % a rezervaci Pro na těžkých 20 %.
GPT-5.5 Pro vs. Claude Fable 5
V benchmarcích kódování, které uvádějí oba dodavatelé, poráží Claude Fable 5 základní GPT-5.5 přesvědčivě. Ale Fable 5 je momentálně pozastaven, takže vítězství má hvězdičku. A srovnání je nepřehlednější, než vypadá, protože OpenAI skóre kódování GPT-5.5 Pro vůbec nezveřejnila. Poctivé srovnání je tedy vlastně Fable 5 vs. základní GPT-5.5 v kódování, přičemž Pro chybí.
Zde je tabulka pro tři strany. Hodnoty Fable 5 jsou připsány zveřejněné tabulce Anthropic; prázdné buňky Pro jsou přesně tím:
| Test | GPT-5.5 základ | GPT-5.5 Pro | Claude Fable 5 | Vítěz |
|---|---|---|---|---|
| SWE-Bench Pro | 58,6 % | nezveřejněno | 80,3 % | Fable 5 |
| FrontierCode Diamond | 5,7 % | nezveřejněno | 29,3 % | Fable 5 |
| Terminal-Bench | 83,4 % (v2.1) | nezveřejněno | 88,0 % (v2.1) | Fable 5 |
| OSWorld-Verified | 78,7 % | nezveřejněno | 85,0 % | Fable 5 |
| HLE (bez nástrojů) | 41,4 % | 43,1 % | 56,8–59,0 % | Fable 5 |
| HLE (s nástroji) | 52,2 % | 57,2 % (uváděno) | 64,5 % | Fable 5 |
| BrowseComp | 84,4 % | 90,1 % | nezveřejněno | GPT-5.5 Pro |
| FrontierMath T4 | 35,4 % | 39,6 % | neuvedeno | GPT-5.5 Pro |
| GDPval-AA | 1769 | nezveřejněno | 1932 | Fable 5 |
V té tabulce se skrývají dvě upozornění. Zaprvé, Terminal-Bench: základní GPT-5.5 dosahuje 82,7 % ve v2.0 a 83,4 % ve v2.1, zatímco 88,0 % Fable je ve v2.1, takže se ujistěte, že čtete stejnou verzi, než vyhlásíte rozdíl. Zadruhé, GDPval-AA není procento. Je to skóre typu Elo (1932 pro Fable vs. 1769 pro základní GPT-5.5), úplně jiná škála, takže si to v hlavě nesrovnávejte s procentními řádky. Hodnota Fable pro HLE bez nástrojů se navíc liší zdroj od zdroje: CodingFleet uvádí 56,8 %, zatímco jiná shrnutí říkají 59,0 %, takže uvádíme rozmezí.
SWE-Bench Pro je benchmark, o který se opřít pro agentické kódování. Obsahuje 1 865 úloh napříč 41 aktivními repozitáři (podle arXiv 2509.16941), s úkoly, které zkušenému inženýrovi zaberou hodiny nebo dny a vyžadují patche přes více souborů. V tomto testu je 80,3 % Fable 5 proti 58,6 % základní GPT-5.5 široký rozdíl.
Teď ta hvězdička. Claude Fable 5 byl pozastaven v červnu 2026 na základě směrnice USA o exportní kontrole (přibližně 12. června). Takže „Fable vyhrává v kódování" platí podle čísel a momentálně je to u pokladny bezpředmětné. Pokud chcete hlubší pohled ze strany Anthropic, zde je náš úplný rozbor Claude Fable 5. Pro model, s nímž tabulka GPT-5.5 srovnává v matematice, viz Claude Opus 4.8.
Benchmarky, které OpenAI pro Pro NEzveřejnila
OpenAI nikdy nevydala skóre GPT-5.5 Pro pro kódování (SWE-Bench Pro), používání počítače (OSWorld-Verified), kybernetickou bezpečnost, zapamatování dlouhého kontextu ani abstraktní uvažování. Tyto řádky jsou v oficiální tabulce prázdné. Prázdné neznamená, že je v nich model špatný. Znamená to, že neexistuje zveřejněné číslo, a kdokoli nějaké cituje, buď hádá, nebo omylem cituje skóre základu.
Na tom záleží, protože je to nejvyhledávanější mezera. Pokud jste hledali skóre GPT-5.5 Pro v SWE-Bench Pro, žádné neexistuje. OpenAI ho nikdy nezveřejnila. Jediná hodnota, která pro tento benchmark v rodině GPT-5.5 existuje, je 58,6 % základního modelu, a to je hodnota základu, nikoli Pro. Záměrně to tak označujeme.
Co můžeme zodpovědně říct:
- Kódování (SWE-Bench Pro): Pro nezveřejněno. Základ GPT-5.5 = 58,6 % (základ, nikoli Pro).
- Používání počítače (OSWorld-Verified): Pro nezveřejněno. Základ = 78,7 % (základ, nikoli Pro).
- Kybernetická bezpečnost: Pro nezveřejněno, v tabulce žádný použitelný zástupce základu.
- Dlouhý kontext: Pro nezveřejněno, žádný použitelný zástupce základu.
- Abstraktní uvažování: Pro nezveřejněno.
Mohl by paralelní výpočet Pro zvednout tyto hodnoty základu? Pravděpodobně, vzhledem ke vzorci v prohlížení webu a matematice. Ale „pravděpodobně" není benchmark a my nebudeme tisknout číslo, které OpenAI neuvedla. Právě tato zdrženlivost je celým důvodem, proč tato sekce existuje.
Ceny: 5 $/30 $ vs. 30 $/180 $ vs. 10 $/50 $ — stojí Pro za 6×?
GPT-5.5 Pro stojí zhruba 6× více než základní GPT-5.5: 30 $ vstup a 180 $ výstup za milion tokenů, proti základu za 5 $/30 $. Claude Fable 5 sedí mezi nimi za 10 $/50 $. Vyplatí se pro náročný výzkum a špičkovou matematiku, zřídka se vyplatí pro každodenní práci.
| Model | Vstup / 1 mil. | Výstup / 1 mil. | Relativní náklady |
|---|---|---|---|
| GPT-5.5 základ | 5 $ | 30 $ | 1× (základna) |
| Claude Fable 5 | 10 $ | 50 $ | ~2× vstup, ~1,7× výstup |
| GPT-5.5 Pro | 30 $ | 180 $ | ~6× základ |
Tak kdo by vlastně měl platit příplatek? Hrubý verdikt podle práce:
- Náročný výzkum, špičková matematika, hloubkové vícekrokové prohlížení: GPT-5.5 Pro si to zaslouží. Zisky v benchmarcích jsou reálné a hodnota úlohy je vysoká.
- Agentické kódování na velkých repozitářích: Fable 5, pokud ho seženete, jinak základní GPT-5.5 zabalená v lešení pro kódování. Platit ceny Pro za nezveřejněné skóre v kódování je špatná sázka.
- Každodenní psaní, shrnutí, revize kódu, podpora: základní GPT-5.5. 6× výdaj zde nekoupí téměř nic.
Pastí je směrovat vše na Pro „pro jistotu". U výstupně náročných zátěží se těch 180 $ rychle sčítá. Směrujte podle obtížnosti a udržíte většinu kvality za zlomek účtu (více v našem průvodci náklady na LLM API).
Jak jsme tato čísla ověřovali (a kde se zdroje rozcházejí)
Než se některá z těchto hodnot dostala do tohoto příspěvku, udělali jsme tu nevděčnou část: stáhli jsme zveřejněnou evaluační tabulku GPT-5.5 od OpenAI a každý řádek Pro jsme zkontrolovali proti nezávislým sledovačům, místo abychom věřili jednomu snímku obrazovky. Zdroje, které jsme kříženě konfrontovali, byly llm-stats, BenchLM, rozbor Fable 5 od DataCamp, CodingFleet a článek o SWE-Bench Pro na arXiv (2509.16941). Zde je, co obstálo a co ne.
Většina hlavních čísel Pro se čistě sladila. BrowseComp 90,1 %, FrontierMath úroveň 1–3 52,4 % a úroveň 4 39,6 % a ceny 30 $/180 $ se shodovaly napříč všemi zdroji, které jsme kontrolovali. SWE-Bench Pro 80,3 % pro Fable 5 versus 58,6 % pro základní GPT-5.5 a FrontierCode Diamond 29,3 % versus 5,7 % také obstály — a počet úloh SWE-Bench Pro (1 865 úloh napříč 41 repozitáři) pochází přímo z článku, nikoli z blogu dodavatele.
Tři věci se nesladily a měli byste o nich vědět:
- Humanity's Last Exam, s nástroji, pro Fable 5 se objevuje kdekoli od 56,8 % do 59,0 % podle zdroje. Citujeme rozmezí, než abychom si vybrali favorita.
- Čísla Terminal-Bench se v tabulkách OpenAI a Anthropic pohybují mezi verzí 2.0 a 2.1, takže rozdíl GPT-5.5 (83,4 %) vs. Fable (88,0 %) není čistě srovnatelný.
- Skóre modelování investičního bankovnictví (88,6 % Pro) je OpenAI označeno jako „interní", což znamená, že ho žádný nezávislý sledovač nemůže potvrdit. Označujeme ho jako tvrzení dodavatele pokaždé, když se objeví.
To je ta poctivá verze. Čísla, která předkládáme jako fakta, se sladila napříč alespoň dvěma nezávislými zdroji; vše ostatní je připsáno tomu, kdo to uvedl. GPT-5.5 Pro jsme sami nespouštěli — při 30 $/180 $ za milion tokenů není seriózní srovnávací běh něco, co bychom předstírali, takže nebudeme předstírat, že máme laboratorní výsledky, které nemáme.
Reálné výsledky, které dodavatelé uvádějí
Jde o tvrzení dodavatelů, nikoli nezávislé laboratorní výsledky, takže je čtěte jako důkazy hraničící s marketingem. OpenAI i Anthropic zveřejnily případové studie, které vykreslují lichotivý obrázek. Uvádíme je s připsáním, s výhradou, že žádnou z nich jsme neověřili.
Na straně OpenAI společnost říká, že finanční tým použil Codex s GPT-5.5 ke kontrole 24 771 daňových formulářů K-1 (71 637 stran) a dokončil to zhruba o dva týdny rychleji než proces v předchozím roce. OpenAI také uvádí funkční aplikaci algebraické geometrie postavenou z jednoho promptu za 11 minut a analýzu datové sady genové exprese GPT-5.5 Pro zahrnující 62 vzorků a přibližně 28 000 genů.
Na straně Anthropic, Stripe (uváděno přes Anthropic) použil Fable 5 k provedení migrace napříč celou kódovou základnou na 50milionové kódové základně Ruby za jediný den, oproti odhadovaným více než 2 měsícům ručně. Anthropic také říká, že Fable 5 dokončil Pokémon FireRed z hrubých snímků obrazovky, kde dřívější modely Claude potřebovaly dodatečné nástroje lešení, a že s persistentní pamětí založenou na souborech hrál Slay the Spire přibližně 3× lépe než Opus 4.8.
Působivé ukázky, všechny. Jen si pamatujte, že je vybrali dodavatelé a nejsou reprodukovatelné pouze z tiskové zprávy.
Který model byste vlastně měli používat?
Přizpůsobte model práci, ne humbuku. Pro agenty na kódování a velké repozitáře sáhněte po Claude Fable 5, pokud je vám dostupný, a po základní GPT-5.5 zabalené v lešení pro kódování, pokud není. Pro výzkum, špičkovou matematiku a hloubkové prohlížení je volbou GPT-5.5 Pro. Pro každodenní práci a nákladovou efektivitu vyhrává základní GPT-5.5 na hodnotě téměř pokaždé.
Pár tipů, pokud vybíráte spíše stack než jedno volání. Pokud opravdu chcete autonomní systém na kódování, chcete nástroj, nikoli surový model, takže začněte u nejlepších AI agentů na kódování v roce 2026 a přehledu srovnání agentů na kódování na pozadí pro kontext Codex a Devin. Zajímá vás, kam rodina míří dál? Zde je co uniká o GPT-5.6.
V Techsy směrujeme podle úlohy napříč našimi pipeline agentů, špičkové modely uvažování na těžké výzvy a levnější na zbytek, místo abychom platili prémiové sazby za každý požadavek. Pokud chcete druhý názor na vlastní mix modelů, získejte bezplatnou konzultaci.
O autorovi
Mert Batur Gurbuz je spoluzakladatelem Techsy.io, kde tým dodává AI agenty, automatizační systémy a hlasové/SDR pipeline pro klienty B2B. Studuje na University of Birmingham a píše o stacku nástrojů LLM, který tým Techsy skutečně používá v produkci. Spojte se na LinkedIn.
Často kladené otázky
Vyplatí se GPT-5.5 Pro?
Záleží na práci. Pro náročný výzkum, špičkovou matematiku a hloubkové prohlížení ospravedlňují zisky GPT-5.5 Pro nad základem (BrowseComp 90,1 % vs. 84,4 %) zhruba 6× cenu 30 $/180 $ za milion tokenů. Pro každodenní psaní, revize kódu a shrnutí vám základní GPT-5.5 dá téměř stejnou kvalitu za šestinu nákladů.
Je GPT-5.5 Pro lepší než Claude Fable 5?
V zveřejněných benchmarcích kódování ne: Claude Fable 5 poráží základní GPT-5.5 v SWE-Bench Pro (80,3 % vs. 58,6 %) a OpenAI nikdy nezveřejnila skóre kódování Pro pro srovnání. GPT-5.5 Pro vyhrává v prohlížení webu a špičkové matematice. Jeden háček: Fable 5 je momentálně pozastaven na základě směrnice USA o exportní kontrole, takže dostupnost záleží stejně jako benchmark.
Jak dobrý je GPT-5.5 Pro v kódování?
Upřímně, z čísel OpenAI to říct nemůžeme, protože OpenAI skóre kódování GPT-5.5 Pro nezveřejnila. Jediná hodnota kódování pro rodinu je výsledek základní GPT-5.5 v SWE-Bench Pro 58,6 %, což zaostává za 80,3 % Claude Fable 5. Kdokoli cituje „benchmark kódování Pro", pravděpodobně omylem cituje číslo základu.
GPT-5.5 Pro vs. standard GPT-5.5 — který bych měl používat?
Používejte GPT-5.5 Pro pro náročný výzkum, špičkovou matematiku a hloubkové vícekrokové prohlížení, kde jeho dodatečný paralelní výpočet ospravedlňuje 6× cenu. Používejte základní GPT-5.5 pro každodenní práci, revize kódu a shrnutí, kde příplatek koupí málo. V některých testech, jako GDPval, tabulka OpenAI dokonce řadí Pro mírně pod základ.
Kolik stojí GPT-5.5 Pro?
GPT-5.5 Pro stojí 30 $ za milion vstupních tokenů a 180 $ za milion výstupních tokenů, zhruba 6× více než 5 $/30 $ základní GPT-5.5. Pro srovnání, Claude Fable 5 sedí na 10 $/50 $. U výstupně náročných zátěží se příplatek Pro rychle sčítá, takže směrování podle obtížnosti úlohy místo výchozího Pro ušetří reálné peníze.
Co je reasoning effort „xhigh"?
Reasoning effort je ovladač, který řídí, jak usilovně GPT-5.5 přemýšlí, než odpoví. „xhigh" je nejvyšší úroveň, kde model používá paralelní výpočet v čase testu k prozkoumání několika cest uvažování a výběru té nejlepší. OpenAI spustila své zveřejněné evaluace GPT-5.5 Pro na xhigh ve výzkumném prostředí, což se liší od výchozího nastavení produkčního ChatGPT.
Je GPT-5.5 Pro dostupný v Codex?
Ano. GPT-5.5 Pro můžete volat v Codex CLI pomocí řetězce modelu gpt-5.5-pro a nastavit reasoning effort na xhigh pro výpočetně nejnáročnější chování. Čekejte vyšší latenci a znatelně vyšší náklady na tokeny než u základní GPT-5.5, takže si ho rezervujte pro opravdu těžké úlohy, místo abyste ho spouštěli jako výchozí model na kódování.
Je GPT-5.5 Pro nový model?
Ne. GPT-5.5 Pro je tentýž model GPT-5.5 běžící s větším úsilím o uvažování a paralelním výpočtem v čase testu na nastavení xhigh, nikoli samostatná architektura. Sdílí stejné váhy a stejné kontextové okno zhruba 1,1 milionu vstupních a 128 tisíc výstupních tokenů. Platíte za více času na přemýšlení, nikoli za chytřejší základní model.
Jaké je kontextové okno GPT-5.5 Pro?
GPT-5.5 Pro má kontextové okno přibližně 1,1 milionu tokenů na vstupu a 128 tisíc tokenů na výstupu, stejné jako základní GPT-5.5. To stačí na načtení velkých kódových základen nebo dlouhých dokumentů v jednom volání. Rozdíl mezi Pro a základem není velikost paměti; je to, kolik výpočtu na uvažování model utratí, než odpoví.