Techsy
Kontakt
Začít
Zpět na blog
ai-machine-learning

Benchmarky GPT-5.5 Pro: Čísla, která OpenAI zveřejnila (a ta, která ne)

Napsal Mert Batur Gürbüz
Jun 25, 2026
14 minut čtení
Obsah
Benchmarky GPT-5.5 Pro: Čísla, která OpenAI zveřejnila (a ta, která ne)

Benchmarky GPT-5.5 Pro: Čísla, která OpenAI zveřejnila (a ta, která ne)

OpenAI vydala GPT-5.5 Pro 23. dubna 2026 a nasadila cenu 30 $ za milion vstupních tokenů a 180 $ za milion výstupních. To je 6× více než základní GPT-5.5 za 5 $/30 $. Za tyto peníze získáte výpočetně náročnější variantu, která v BrowseComp dosahuje 90,1 %. Ale tady je ta část, kterou nikdo nedává do titulku: vlastní evaluační tabulka OpenAI nechává řádek pro kódování u GPT-5.5 Pro prázdný. Stejně tak pro používání počítače. Stejně tak pro dlouhý kontext. Takže když budete hledat skóre tohoto modelu v SWE-Bench Pro, žádné nenajdete. Stáhli jsme zveřejněnou tabulku a každou hodnotu jsme sami ověřili.

Rychlá odpověď:

  • GPT-5.5 Pro je výpočetně náročnější varianta GPT-5.5 od OpenAI (vydána 23. dubna 2026), nikoli nový model.
  • Vede v prohlížení webu (BrowseComp 90,1 %) a v špičkové matematice, ale OpenAI nechala řádky pro kódování, používání počítače a dlouhý kontext prázdné.
  • V existujících řádcích pro kódování zaostává základní GPT-5.5 za Claude Fable 5 (SWE-Bench Pro 58,6 % vs. 80,3 %).
  • Claude Fable 5 je momentálně pozastaven (směrnice USA o exportní kontrole, přibližně 12. června 2026), takže jeho vítězství mají hvězdičku „teď ho nekoupíte".

Pár slov k metodě, protože u příspěvku o benchmarkách záleží na přesnosti víc než na rychlosti: níže uvedená čísla jsme zkříženě ověřili se zveřejněnými tabulkami OpenAI a Anthropic a s článkem o SWE-Bench Pro (arXiv 2509.16941). Pokud hodnotu uvádí pouze jeden dodavatel, říkáme to. Pokud OpenAI skóre Pro nikdy nezveřejnila, píšeme „nezveřejněno", místo abychom tiše dosadili číslo základní verze.

Benchmarky GPT-5.5 Pro: Co OpenAI skutečně zveřejnila

Zveřejněné benchmarky GPT-5.5 Pro pokrývají jen úzký výsek: prohlížení webu, špičkovou matematiku, profesionální znalostní práci, genetiku a široké uvažování. OpenAI spustila všechny evaluace s úrovní uvažování xhigh ve výzkumném prostředí, což se liší od výchozího nastavení produkčního ChatGPT. Hlavní číslo je BrowseComp 90,1 %, což je jasně nad 84,4 % základní GPT-5.5.

Zde je hlavní tabulka se sloupcem ukazujícím, zda OpenAI pro každý test zveřejnila samostatné skóre Pro:

BenchmarkCo testujeGPT-5.5 ProGPT-5.5 základPro zveřejněno?Poznámky
BrowseCompNáročné prohlížení webu / vyhledávání informací90,1 %84,4 %AnoNejjasnější vítězství Pro nad základem
FrontierMath T1-3Náročná matematika52,4 %51,7 %AnoPoráží uváděný Opus 4.7 (43,8 %)
FrontierMath T4Špičková matematika39,6 %35,4 %AnoNejtěžší matematická úroveň
GDPvalProfesionální znalostní práce82,3 % (uváděno)84,9 %Ano (připsáno)Tabulka OpenAI řadí Pro pod základ
GeneBenchVícefázová genetika33,2 % (uváděno)25,0 %Ano (připsáno)„OpenAI uvádí" velký skok
HLE (bez nástrojů)Široké náročné uvažování43,1 %41,4 %AnoPod uváděným Opus 4.7 (46,9 %)
HLE (s nástroji)Uvažování s nástroji57,2 % (uváděno)52,2 %ČástečněZáklad 52,2 % potvrzen; Pro 57,2 % uváděno
Modelování investičního bankovnictvíFinanční modelování88,6 % (interní)88,5 %Interní evaluaceOpenAI toto označila jako INTERNÍ; berte s rezervou
SWE-Bench ProAgentické kódovánínezveřejněno58,6 %NeHlavní mezera
OSWorld-VerifiedPoužívání počítačenezveřejněno78,7 %NeU Pro prázdné
Kybernetická bezpečnostBezpečnostní úlohynezveřejněnoneuvedenoNeU Pro prázdné
Dlouhý kontextZapamatování dlouhých dokumentůnezveřejněnoneuvedenoNeU Pro prázdné

Přečtěte si tento spodní blok pozorně. OpenAI zveřejnila skóre GPT-5.5 Pro pro prohlížení webu a matematiku, ale řádky pro kódování, používání počítače, kybernetickou bezpečnost a dlouhý kontext nechala prázdné. Hodnoty BrowseComp, FrontierMath a základu GDPval jsou potvrzeny sekundárními sledovači; GDPval-Pro 82,3 %, GeneBench 33,2 % a číslo investičního bankovnictví uvádí OpenAI, ale nejsou nezávisle ověřeny, takže je připisujeme, místo abychom je prohlašovali za hotovou věc.

Co „Pro" vlastně znamená: paralelní výpočet v čase testu, nikoli nový model

GPT-5.5 Pro je tentýž model GPT-5.5 běžící s mnohem větším úsilím o uvažování, nikoli jiná architektura. Představte si to méně jako nový motor a více jako tentýž motor, který před odpovědí běží déle a paralelně. OpenAI toto nastavení nazývá reasoning effort a Pro ho drží na nejvyšší úrovni: xhigh.

Je GPT-5.5 Pro jiný model než GPT-5.5?

Ne. Stejné váhy, stejný trénink. Když lidé hledají gpt 5.5 pro vs gpt 5.5 thinking nebo vs xhigh, ve skutečnosti se ptají na jeden ovladač: jak usilovně model přemýšlí, než odpoví. „Paralelní výpočet v čase testu" znamená, že model prozkoumává několik cest uvažování najednou a vybere tu nejlepší, což stojí více tokenů a více reálného času. Právě za tento dodatečný výpočet platíte 6×.

Specifikace jsou jinak sdílené. GPT-5.5 Pro má kontextové okno zhruba 1,1 milionu tokenů na vstupu a 128 tisíc na výstupu. Nekupujete si tedy větší paměť ani chytřejší základní model. Kupujete si více času na přemýšlení u modelu, který už znáte.

GPT-5.5 Pro vs. GPT-5.5 (standard): kde vám 6× cena něco koupí

GPT-5.5 Pro poráží základní GPT-5.5 v nejtěžších úlohách: prohlížení webu, špičková matematika a genetika. Nejméně vám koupí u rutinní práce. Nejčistší zisk je BrowseComp 90,1 % vs. 84,4 %, nárůst o 5,7 bodu v hloubkovém webovém výzkumu. V úrovni 4 FrontierMath stoupá z 35,4 % na 39,6 %.

Ale více výpočtu neznamená vždy vyšší skóre. V GDPval tabulka OpenAI dokonce řadí Pro níže než základní GPT-5.5 (uváděných 82,3 % vs. potvrzených 84,9 %). To je neintuitivní a uvádí se, že Pro vyměňuje některá hrubá vítězství za kalibraci. Pointa platí: vyšší platba není záruka.

Kde Pro vede:

  • BrowseComp: 90,1 % vs. 84,4 % (+5,7)
  • FrontierMath T4: 39,6 % vs. 35,4 % (+4,2)
  • GeneBench: 33,2 % vs. 25,0 % (uvádí OpenAI)
  • HLE s nástroji: 57,2 % (uváděno) vs. 52,2 % (potvrzený základ)

Kde je na tom stejně nebo hůř:

  • GDPval: 82,3 % (uváděno) vs. 84,9 % základ
  • HLE bez nástrojů: 43,1 % vs. 41,4 %, sotva patrný pohyb

Pokud je vaše práce převážně každodenní psaní, revize kódu a shrnutí, 6× příplatek se těžko obhajuje. Matematika se obrátí, jen když je úloha opravdu těžká. Když už jsme u nákladů: pokud je problém váš účet, náš průvodce jak snížit náklady na LLM API pokrývá směrování levnějších modelů na snadných 80 % a rezervaci Pro na těžkých 20 %.

GPT-5.5 Pro vs. Claude Fable 5

V benchmarcích kódování, které uvádějí oba dodavatelé, poráží Claude Fable 5 základní GPT-5.5 přesvědčivě. Ale Fable 5 je momentálně pozastaven, takže vítězství má hvězdičku. A srovnání je nepřehlednější, než vypadá, protože OpenAI skóre kódování GPT-5.5 Pro vůbec nezveřejnila. Poctivé srovnání je tedy vlastně Fable 5 vs. základní GPT-5.5 v kódování, přičemž Pro chybí.

Zde je tabulka pro tři strany. Hodnoty Fable 5 jsou připsány zveřejněné tabulce Anthropic; prázdné buňky Pro jsou přesně tím:

TestGPT-5.5 základGPT-5.5 ProClaude Fable 5Vítěz
SWE-Bench Pro58,6 %nezveřejněno80,3 %Fable 5
FrontierCode Diamond5,7 %nezveřejněno29,3 %Fable 5
Terminal-Bench83,4 % (v2.1)nezveřejněno88,0 % (v2.1)Fable 5
OSWorld-Verified78,7 %nezveřejněno85,0 %Fable 5
HLE (bez nástrojů)41,4 %43,1 %56,8–59,0 %Fable 5
HLE (s nástroji)52,2 %57,2 % (uváděno)64,5 %Fable 5
BrowseComp84,4 %90,1 %nezveřejněnoGPT-5.5 Pro
FrontierMath T435,4 %39,6 %neuvedenoGPT-5.5 Pro
GDPval-AA1769nezveřejněno1932Fable 5

V té tabulce se skrývají dvě upozornění. Zaprvé, Terminal-Bench: základní GPT-5.5 dosahuje 82,7 % ve v2.0 a 83,4 % ve v2.1, zatímco 88,0 % Fable je ve v2.1, takže se ujistěte, že čtete stejnou verzi, než vyhlásíte rozdíl. Zadruhé, GDPval-AA není procento. Je to skóre typu Elo (1932 pro Fable vs. 1769 pro základní GPT-5.5), úplně jiná škála, takže si to v hlavě nesrovnávejte s procentními řádky. Hodnota Fable pro HLE bez nástrojů se navíc liší zdroj od zdroje: CodingFleet uvádí 56,8 %, zatímco jiná shrnutí říkají 59,0 %, takže uvádíme rozmezí.

SWE-Bench Pro je benchmark, o který se opřít pro agentické kódování. Obsahuje 1 865 úloh napříč 41 aktivními repozitáři (podle arXiv 2509.16941), s úkoly, které zkušenému inženýrovi zaberou hodiny nebo dny a vyžadují patche přes více souborů. V tomto testu je 80,3 % Fable 5 proti 58,6 % základní GPT-5.5 široký rozdíl.

Teď ta hvězdička. Claude Fable 5 byl pozastaven v červnu 2026 na základě směrnice USA o exportní kontrole (přibližně 12. června). Takže „Fable vyhrává v kódování" platí podle čísel a momentálně je to u pokladny bezpředmětné. Pokud chcete hlubší pohled ze strany Anthropic, zde je náš úplný rozbor Claude Fable 5. Pro model, s nímž tabulka GPT-5.5 srovnává v matematice, viz Claude Opus 4.8.

Benchmarky, které OpenAI pro Pro NEzveřejnila

OpenAI nikdy nevydala skóre GPT-5.5 Pro pro kódování (SWE-Bench Pro), používání počítače (OSWorld-Verified), kybernetickou bezpečnost, zapamatování dlouhého kontextu ani abstraktní uvažování. Tyto řádky jsou v oficiální tabulce prázdné. Prázdné neznamená, že je v nich model špatný. Znamená to, že neexistuje zveřejněné číslo, a kdokoli nějaké cituje, buď hádá, nebo omylem cituje skóre základu.

Na tom záleží, protože je to nejvyhledávanější mezera. Pokud jste hledali skóre GPT-5.5 Pro v SWE-Bench Pro, žádné neexistuje. OpenAI ho nikdy nezveřejnila. Jediná hodnota, která pro tento benchmark v rodině GPT-5.5 existuje, je 58,6 % základního modelu, a to je hodnota základu, nikoli Pro. Záměrně to tak označujeme.

Co můžeme zodpovědně říct:

  • Kódování (SWE-Bench Pro): Pro nezveřejněno. Základ GPT-5.5 = 58,6 % (základ, nikoli Pro).
  • Používání počítače (OSWorld-Verified): Pro nezveřejněno. Základ = 78,7 % (základ, nikoli Pro).
  • Kybernetická bezpečnost: Pro nezveřejněno, v tabulce žádný použitelný zástupce základu.
  • Dlouhý kontext: Pro nezveřejněno, žádný použitelný zástupce základu.
  • Abstraktní uvažování: Pro nezveřejněno.

Mohl by paralelní výpočet Pro zvednout tyto hodnoty základu? Pravděpodobně, vzhledem ke vzorci v prohlížení webu a matematice. Ale „pravděpodobně" není benchmark a my nebudeme tisknout číslo, které OpenAI neuvedla. Právě tato zdrženlivost je celým důvodem, proč tato sekce existuje.

Ceny: 5 $/30 $ vs. 30 $/180 $ vs. 10 $/50 $ — stojí Pro za 6×?

GPT-5.5 Pro stojí zhruba 6× více než základní GPT-5.5: 30 $ vstup a 180 $ výstup za milion tokenů, proti základu za 5 $/30 $. Claude Fable 5 sedí mezi nimi za 10 $/50 $. Vyplatí se pro náročný výzkum a špičkovou matematiku, zřídka se vyplatí pro každodenní práci.

ModelVstup / 1 mil.Výstup / 1 mil.Relativní náklady
GPT-5.5 základ5 $30 $1× (základna)
Claude Fable 510 $50 $~2× vstup, ~1,7× výstup
GPT-5.5 Pro30 $180 $~6× základ

Tak kdo by vlastně měl platit příplatek? Hrubý verdikt podle práce:

  • Náročný výzkum, špičková matematika, hloubkové vícekrokové prohlížení: GPT-5.5 Pro si to zaslouží. Zisky v benchmarcích jsou reálné a hodnota úlohy je vysoká.
  • Agentické kódování na velkých repozitářích: Fable 5, pokud ho seženete, jinak základní GPT-5.5 zabalená v lešení pro kódování. Platit ceny Pro za nezveřejněné skóre v kódování je špatná sázka.
  • Každodenní psaní, shrnutí, revize kódu, podpora: základní GPT-5.5. 6× výdaj zde nekoupí téměř nic.

Pastí je směrovat vše na Pro „pro jistotu". U výstupně náročných zátěží se těch 180 $ rychle sčítá. Směrujte podle obtížnosti a udržíte většinu kvality za zlomek účtu (více v našem průvodci náklady na LLM API).

Jak jsme tato čísla ověřovali (a kde se zdroje rozcházejí)

Než se některá z těchto hodnot dostala do tohoto příspěvku, udělali jsme tu nevděčnou část: stáhli jsme zveřejněnou evaluační tabulku GPT-5.5 od OpenAI a každý řádek Pro jsme zkontrolovali proti nezávislým sledovačům, místo abychom věřili jednomu snímku obrazovky. Zdroje, které jsme kříženě konfrontovali, byly llm-stats, BenchLM, rozbor Fable 5 od DataCamp, CodingFleet a článek o SWE-Bench Pro na arXiv (2509.16941). Zde je, co obstálo a co ne.

Většina hlavních čísel Pro se čistě sladila. BrowseComp 90,1 %, FrontierMath úroveň 1–3 52,4 % a úroveň 4 39,6 % a ceny 30 $/180 $ se shodovaly napříč všemi zdroji, které jsme kontrolovali. SWE-Bench Pro 80,3 % pro Fable 5 versus 58,6 % pro základní GPT-5.5 a FrontierCode Diamond 29,3 % versus 5,7 % také obstály — a počet úloh SWE-Bench Pro (1 865 úloh napříč 41 repozitáři) pochází přímo z článku, nikoli z blogu dodavatele.

Tři věci se nesladily a měli byste o nich vědět:

  • Humanity's Last Exam, s nástroji, pro Fable 5 se objevuje kdekoli od 56,8 % do 59,0 % podle zdroje. Citujeme rozmezí, než abychom si vybrali favorita.
  • Čísla Terminal-Bench se v tabulkách OpenAI a Anthropic pohybují mezi verzí 2.0 a 2.1, takže rozdíl GPT-5.5 (83,4 %) vs. Fable (88,0 %) není čistě srovnatelný.
  • Skóre modelování investičního bankovnictví (88,6 % Pro) je OpenAI označeno jako „interní", což znamená, že ho žádný nezávislý sledovač nemůže potvrdit. Označujeme ho jako tvrzení dodavatele pokaždé, když se objeví.

To je ta poctivá verze. Čísla, která předkládáme jako fakta, se sladila napříč alespoň dvěma nezávislými zdroji; vše ostatní je připsáno tomu, kdo to uvedl. GPT-5.5 Pro jsme sami nespouštěli — při 30 $/180 $ za milion tokenů není seriózní srovnávací běh něco, co bychom předstírali, takže nebudeme předstírat, že máme laboratorní výsledky, které nemáme.

Reálné výsledky, které dodavatelé uvádějí

Jde o tvrzení dodavatelů, nikoli nezávislé laboratorní výsledky, takže je čtěte jako důkazy hraničící s marketingem. OpenAI i Anthropic zveřejnily případové studie, které vykreslují lichotivý obrázek. Uvádíme je s připsáním, s výhradou, že žádnou z nich jsme neověřili.

Na straně OpenAI společnost říká, že finanční tým použil Codex s GPT-5.5 ke kontrole 24 771 daňových formulářů K-1 (71 637 stran) a dokončil to zhruba o dva týdny rychleji než proces v předchozím roce. OpenAI také uvádí funkční aplikaci algebraické geometrie postavenou z jednoho promptu za 11 minut a analýzu datové sady genové exprese GPT-5.5 Pro zahrnující 62 vzorků a přibližně 28 000 genů.

Na straně Anthropic, Stripe (uváděno přes Anthropic) použil Fable 5 k provedení migrace napříč celou kódovou základnou na 50milionové kódové základně Ruby za jediný den, oproti odhadovaným více než 2 měsícům ručně. Anthropic také říká, že Fable 5 dokončil Pokémon FireRed z hrubých snímků obrazovky, kde dřívější modely Claude potřebovaly dodatečné nástroje lešení, a že s persistentní pamětí založenou na souborech hrál Slay the Spire přibližně 3× lépe než Opus 4.8.

Působivé ukázky, všechny. Jen si pamatujte, že je vybrali dodavatelé a nejsou reprodukovatelné pouze z tiskové zprávy.

Který model byste vlastně měli používat?

Přizpůsobte model práci, ne humbuku. Pro agenty na kódování a velké repozitáře sáhněte po Claude Fable 5, pokud je vám dostupný, a po základní GPT-5.5 zabalené v lešení pro kódování, pokud není. Pro výzkum, špičkovou matematiku a hloubkové prohlížení je volbou GPT-5.5 Pro. Pro každodenní práci a nákladovou efektivitu vyhrává základní GPT-5.5 na hodnotě téměř pokaždé.

Pár tipů, pokud vybíráte spíše stack než jedno volání. Pokud opravdu chcete autonomní systém na kódování, chcete nástroj, nikoli surový model, takže začněte u nejlepších AI agentů na kódování v roce 2026 a přehledu srovnání agentů na kódování na pozadí pro kontext Codex a Devin. Zajímá vás, kam rodina míří dál? Zde je co uniká o GPT-5.6.

V Techsy směrujeme podle úlohy napříč našimi pipeline agentů, špičkové modely uvažování na těžké výzvy a levnější na zbytek, místo abychom platili prémiové sazby za každý požadavek. Pokud chcete druhý názor na vlastní mix modelů, získejte bezplatnou konzultaci.

O autorovi

Mert Batur Gurbuz je spoluzakladatelem Techsy.io, kde tým dodává AI agenty, automatizační systémy a hlasové/SDR pipeline pro klienty B2B. Studuje na University of Birmingham a píše o stacku nástrojů LLM, který tým Techsy skutečně používá v produkci. Spojte se na LinkedIn.

Často kladené otázky

Vyplatí se GPT-5.5 Pro?

Záleží na práci. Pro náročný výzkum, špičkovou matematiku a hloubkové prohlížení ospravedlňují zisky GPT-5.5 Pro nad základem (BrowseComp 90,1 % vs. 84,4 %) zhruba 6× cenu 30 $/180 $ za milion tokenů. Pro každodenní psaní, revize kódu a shrnutí vám základní GPT-5.5 dá téměř stejnou kvalitu za šestinu nákladů.

Je GPT-5.5 Pro lepší než Claude Fable 5?

V zveřejněných benchmarcích kódování ne: Claude Fable 5 poráží základní GPT-5.5 v SWE-Bench Pro (80,3 % vs. 58,6 %) a OpenAI nikdy nezveřejnila skóre kódování Pro pro srovnání. GPT-5.5 Pro vyhrává v prohlížení webu a špičkové matematice. Jeden háček: Fable 5 je momentálně pozastaven na základě směrnice USA o exportní kontrole, takže dostupnost záleží stejně jako benchmark.

Jak dobrý je GPT-5.5 Pro v kódování?

Upřímně, z čísel OpenAI to říct nemůžeme, protože OpenAI skóre kódování GPT-5.5 Pro nezveřejnila. Jediná hodnota kódování pro rodinu je výsledek základní GPT-5.5 v SWE-Bench Pro 58,6 %, což zaostává za 80,3 % Claude Fable 5. Kdokoli cituje „benchmark kódování Pro", pravděpodobně omylem cituje číslo základu.

GPT-5.5 Pro vs. standard GPT-5.5 — který bych měl používat?

Používejte GPT-5.5 Pro pro náročný výzkum, špičkovou matematiku a hloubkové vícekrokové prohlížení, kde jeho dodatečný paralelní výpočet ospravedlňuje 6× cenu. Používejte základní GPT-5.5 pro každodenní práci, revize kódu a shrnutí, kde příplatek koupí málo. V některých testech, jako GDPval, tabulka OpenAI dokonce řadí Pro mírně pod základ.

Kolik stojí GPT-5.5 Pro?

GPT-5.5 Pro stojí 30 $ za milion vstupních tokenů a 180 $ za milion výstupních tokenů, zhruba 6× více než 5 $/30 $ základní GPT-5.5. Pro srovnání, Claude Fable 5 sedí na 10 $/50 $. U výstupně náročných zátěží se příplatek Pro rychle sčítá, takže směrování podle obtížnosti úlohy místo výchozího Pro ušetří reálné peníze.

Co je reasoning effort „xhigh"?

Reasoning effort je ovladač, který řídí, jak usilovně GPT-5.5 přemýšlí, než odpoví. „xhigh" je nejvyšší úroveň, kde model používá paralelní výpočet v čase testu k prozkoumání několika cest uvažování a výběru té nejlepší. OpenAI spustila své zveřejněné evaluace GPT-5.5 Pro na xhigh ve výzkumném prostředí, což se liší od výchozího nastavení produkčního ChatGPT.

Je GPT-5.5 Pro dostupný v Codex?

Ano. GPT-5.5 Pro můžete volat v Codex CLI pomocí řetězce modelu gpt-5.5-pro a nastavit reasoning effort na xhigh pro výpočetně nejnáročnější chování. Čekejte vyšší latenci a znatelně vyšší náklady na tokeny než u základní GPT-5.5, takže si ho rezervujte pro opravdu těžké úlohy, místo abyste ho spouštěli jako výchozí model na kódování.

Je GPT-5.5 Pro nový model?

Ne. GPT-5.5 Pro je tentýž model GPT-5.5 běžící s větším úsilím o uvažování a paralelním výpočtem v čase testu na nastavení xhigh, nikoli samostatná architektura. Sdílí stejné váhy a stejné kontextové okno zhruba 1,1 milionu vstupních a 128 tisíc výstupních tokenů. Platíte za více času na přemýšlení, nikoli za chytřejší základní model.

Jaké je kontextové okno GPT-5.5 Pro?

GPT-5.5 Pro má kontextové okno přibližně 1,1 milionu tokenů na vstupu a 128 tisíc tokenů na výstupu, stejné jako základní GPT-5.5. To stačí na načtení velkých kódových základen nebo dlouhých dokumentů v jednom volání. Rozdíl mezi Pro a základem není velikost paměti; je to, kolik výpočtu na uvažování model utratí, než odpoví.

Štítky

benchmarky GPT-5.5 ProGPT-5.5 Pro vs FableSWE-Bench ProBrowseCompmodely LLM

Sdílet článek

Související články

Více z kategorie ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 je tady: Inteligence blízká Fable 5 za poloviční cenu

Anthropic vydal Claude Opus 5 24. července 2026. Na Frontier-Bench více než zdvojnásobuje Opus 4.8 a drží cenu Opus, ale v několika testech prohrává s Fable 5 a Mythos 5. Zde je tabulka benchmarků, ceník a doporučení: přepnout / počkat / zůstat.

10 min read minut čtení
Číst
ai-machine-learning
Jul 20, 2026

8 nejlepších API pro AI web scraping v roce 2026 (otestováno na našem vlastním agentním stacku)

Otestovali jsme 8 API pro AI web scraping s reálnými cenami pro rok 2026 staženými přes náš vlastní agentní stack. Firecrawl, Bright Data, ScrapingBee a 5 dalších, seřazené podle výstupu připraveného pro LLM, anti-bot a podpory MCP.

9 min read minut čtení
Číst
ai-machine-learning
Jul 20, 2026

Prompt Engineering pro kódování: 7 vzorů, které denně používáme v Claude Code a Cursor (2026)

Většina článků o „promptech pro AI kódování“ vám nabídne 50 šablon ke kopírování. Tento článek učí 7 vzorů, které každý den používáme k provozu pipeline s 16 agenty v Claude Code, včetně skutečných příkladů před a po úpravě pro každý z nich, a ukazuje, kde se každý vzor nachází v nástrojích Claude Code, Cursor a Copilot v roce 2026.

11 min read minut čtení
Číst
Zobrazit všechny články
Začněte svůj projekt

Pojďme něco postavit nevšedního?

Proměňme vaši vizi ve skutečnost. Náš tým je připraven vám pomoct vytvořit software, který dělá rozdíl.

Rezervovat 30minutový úvodní hovorNaše projekty

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Než z knihovny

Claude dovednosti

Zobrazit vše
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

AI automatizace

Zobrazit vše
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt

Právní informace

  • Zásady ochrany osobních údajů
  • Podmínky poskytování služeb
  • Zásady používání cookies

Služby

  • Podniková řešení
  • Mobilní aplikace
  • Webové aplikace

Řešení

  • CRM systémy
  • Integrace AI
  • ERP systémy
  • Hlasoví agenti
  • Automatizace procesů
  • Kybernetická bezpečnost

Knihovna

  • Blog
  • Reference

Komunita

  • AI automatizace
  • Claude dovednosti

Nástroje

  • Kalkulátor ceny mobilní aplikace
  • Kalkulátor ceny OpenAI / LLM API
  • Kalkulátor ceny MVP
  • Kalkulátor ceny hlasového AI agenta

Společnost

  • O projektu
  • Partneři
  • Kontakt
Právní informaceZásady ochrany osobních údajůPodmínky poskytování služebZásady používání cookies
TECHSY
© 2026 Techsy. Všechna práva vyhrazena.