
GPT-5.6 Sol Ultra v Codexu: co subagentový režim skutečně dělá (a kolik stojí)
K červenci 2026 je GPT-5.6 Sol Ultra v uzavřené ukázce pro malou skupinu zhruba 20 vládou schválených partnerů, dostupná přes OpenAI API a Codex. Široce dostupná zatím není. OpenAI nezveřejnilo datum všeobecné dostupnosti a široce citovaný výsledek 91,9 % na Terminal-Bench se na vlastní stránce ukázky OpenAI neobjevuje.
- června 2026 OpenAI představilo rodinu GPT-5.6 Sol a o pár dní později Thibault Sottiaux vyzval uživatele Codexu, aby si „schovali své nejtěžší prompty" pro úroveň Sol Ultra. Tenhle jediný teaser spustil vlnu screenshotů s benchmarky. Většina z nich opakuje číslo, které OpenAI nikdy nezveřejnilo. Než tedy postavíte svůj workflow v Codexu kolem GPT-5.6 Sol Ultra, tady je, co je skutečně potvrzené, jak funguje subagentový režim a tokenová matematika, která rozhoduje, jestli se vyplatí ho zapnout.
Klíčové body:
- Sol Ultra je nejvyšší úroveň úsilí GPT-5.6: spolupracující subagenti, kteří si během jediné úlohy navzájem komunikují.
- Je v uzavřené ukázce pro ~20 vládou schválených partnerů přes API a Codex, není široce dostupná (k červenci 2026).
- Tisk uvádí 91,9 % na Terminal-Bench 2.1, ale OpenAI toto číslo nezveřejnilo, takže ho berte jako neověřené.
- Sol běží za $5 vstup / $30 výstup na 1M tokenů; subagenti násobí volání, takže Ultra může stát několikrát víc než běh s jedním agentem.
GPT-5.6 Sol Ultra v Codexu: co je skutečně potvrzené
Tady je ten čistý rozdíl. Potvrzeno: OpenAI představilo rodinu Sol (Sol, Terra, Luna) 26. 6. 2026, Sol Ultra je nejvyšší úroveň uvažování a byla avizována pro Codex. Nepotvrzeno: výsledek 91,9 % na Terminal-Bench 2.1 a jakékoli datum všeobecné dostupnosti. Všechno ostatní, co jste viděli, je zpravodajství, ne data z první ruky.
Tento rozdíl je důležitý, protože tenhle launch byl rychlý a divoký. Stránka ukázky OpenAI popisuje úrovně a bezpečnostní bránění kvalitativními termíny. Poutavá tabulka benchmarků, která koluje na X a v průvodcích, pochází z druhotného pokrytí, ne z vlastní stránky OpenAI. V fázi před spuštěním jsme ohodnotili předlaunchové fámy a tady je, co se skutečně dostalo ven oproti tomu, co zůstalo spekulací. Stejná disciplína platí i teď.
Takže pokud jste vývojář, který se snaží rozhodnout, jestli Ultra patří do vaší smyčky v Codexu, na chvíli ignorujte hypová čísla. Potvrzená fakta (mechanismus, ceny, stav ukázky) stačí k úvaze o nákladech a vhodnosti. Ta nepotvrzená (přesné skóre, datum spuštění) by zatím neměla řídit jediné rozhodnutí. Zdroje: stránka OpenAI Previewing GPT-5.6 Sol a pokrytí spuštění od 9to5Mac.
Co je Sol Ultra? Spolupracující subagenti vs. paralelní agenti Pro
Sol Ultra je nejvyšší úroveň uvažování GPT-5.6 a jejím určujícím rysem jsou spolupracující subagenti: koordinátor rozdělí vaši úlohu na části, každou část předá subagentovi a tito subagenti si během probíhající práce navzájem posílají zprávy. Tahle komunikace uprostřed úlohy je celý smysl a je to, co odlišuje Ultra od všech nižších úrovní.
Představte si to jako malý inženýrský tým versus skupina freelancerů. Paralelní agenti GPT-5.5 Pro fungují jako freelanceři, kterým předáte tři samostatné tikety. Každý odejde, udělá svou část v izolaci a hodí vám výsledek na stůl. Nikdo s nikým nemluví. Subagenti Sol Ultra fungují jako tým v jedné místnosti: jeden si všimne, že se změnilo schéma databáze, řekne to ostatním a ti se přizpůsobí, než skončí. Tahle koordinace je důvod, proč ji OpenAI umisťuje pro dlouhé, těžké, vícekrokové úlohy, ne pro rychlé úpravy.
Zatímco agenti Pro pracují v oddělených pruzích, subagenti Sol Ultra si během běžící úlohy posílají vzkazy.

Samotný mechanismus je potvrzený, popsán OpenAI a zopakován v pokrytí DataCamp a deeplearning.ai. Háček, a k tomu se dostaneme, je, že každý subagent, kterého spustíte, je další volání modelu, které pálí tokeny. Koordinace není zadarmo.
Co je „maximální úsilí uvažování" a kdy ho zapnout?
„Maximální úsilí uvažování" je nejvyšší příčka žebříčku úsilí GPT-5.6, který jde od low přes high až po nastavení max, které používá Sol Ultra. Vyšší úsilí znamená, že model stráví víc výpočtů přemýšlením, než odpoví, což obvykle pomáhá u těžkých problémů a plýtvá penězi u jednoduchých. Je to otočný knoflík, ne vypínač, který necháte vytočený naplno.
Představte si šachistu. Při nízkém úsilí táhne rychle podle intuice, což je v pořádku u zřejmých braní. Při maximálním úsilí sedí a počítá deset tahů dopředu, což je přesně to, co chcete u těžké koncovky, a naprosto zbytečné u otevírání dveří. Úsilí uvažování funguje stejně. Výpočty (a účet) rostou s tím, jak těžce modelu řeknete přemýšlet.
Takže kdy se to vyplatí? Zapněte maximální úsilí u dlouhých, vícesouborových agentních prací: migrace, která sahá do dvaceti souborů, ošklivý refaktor, bug, který se táhne přes tři služby. To je teritorium dlouhého agentního kódování, kde hlubší uvažování skutečně mění výsledek. Nechte ho vypnuté u přejmenování proměnné, napsání jednoho testu nebo opravy překlepu, protože zaplatíte prémiové tokeny za nulový přínos.
Maximální úsilí uvažování si svou cenu zaslouží jen tehdy, když je úloha dost těžká na to, aby vás špatný první pokus stál víc než extra tokeny.
Poctivé pravidlo: pokud nedokážete vysvětlit, proč je úloha těžká, pravděpodobně pro ni maximální úsilí nepotřebujete.
Čísla z Terminal-Bench 2.1: je 91,9 % skutečně ověřeno?
Ne. Číslo 91,9 % uvádí druhotný tisk, neobjevuje se na vlastní stránce ukázky OpenAI, ukázka je uzavřená a žádná metodika vyhodnocení nebyla zveřejněna. Takže není nezávisle ověřené. Berte ho jako tiskové tvrzení, které nemůžete zkontrolovat, ne jako hotový výsledek.
Tady je přesná situace. Zpravodajství blízké OpenAI (DataCamp, AI Weekly, deeplearning.ai) uvádí Sol Ultra na 91,9 % na Terminal-Bench 2.1. Ale protože ukázka je omezená na ~20 partnerů a OpenAI nezveřejnilo číslo ani podmínky testu, nikdo mimo tento okruh to nemůže reprodukovat. Všimněte si taky, že číslo pro Claude Mythos 5 se liší podle toho, kdo referuje: některé zdroje říkají 84,3 %, jiné 88,0 %. Když se vlastní čísla srovnávací tabulky napříč zdroji neshodují, je to signál držet se toho zlehka.
| Model | Terminal-Bench 2.1 (uváděno, nezávisle neověřeno) |
|---|---|
| Sol Ultra | 91,9 % |
| Sol (základ) | 88,8 % |
| GPT-5.5 | 88,0 % |
| Claude Mythos 5 | 84,3–88,0 % (liší se podle zdroje) |
| Gemini 3.1 Pro Preview | 70,7 % |
91,9 %, které všichni citují, se na vlastní stránce ukázky OpenAI neobjevuje, takže to berte jako tiskové tvrzení, ne jako hotový výsledek.
Nic z toho neznamená, že je Sol Ultra slabá. Klidně může vést tabulku, jakmile OpenAI zveřejní reálnou metodiku. Znamená to jen, že byste neměli směrovat produkční provoz na základě čísla, které nemůžete ověřit. Zdroje: průvodce GPT-5.6 Sol od DataCamp, The Batch od deeplearning.ai a AI Weekly.
Jak používat Sol Ultra + maximální úsilí uvažování v Codexu
Samotná Sol Ultra je bráněná, takže ji nemůžete zapnout, pokud vaše organizace není v ukázce. Ale žebříček úsilí, na kterém sedí, už dnes v Codex CLI funguje, na modelech, které máte. Tady je, jak nastavení funguje, a kam Ultra zapadne, jakmile získáte přístup.
- Najděte nastavení. Úsilí uvažování je v konfiguračním souboru Codexu na
~/.codex/config.tomlnebo jako příznak pro jednotlivý běh. Není schované v menu; je to jeden klíč. - Nastavte model a úsilí. Nasměrujte Codex na svůj řetězec modelu a nastavte úroveň úsilí. Dnes můžete nastavit low až high; příčka „max" plus subagentová úroveň Sol Ultra se odemknou, jakmile bude vaše organizace v ukázce.
- Přepište pro úlohu. Použijte příznak
-cpro zvýšení úsilí u jednoho těžkého běhu bez úpravy konfigurace. - Zapínejte selektivně. Rezervujte maximální úsilí pro dlouhé, vícesouborové úlohy z sekce výše. Nechte výchozí na medium nebo high.
# ~/.codex/config.toml
model = "gpt-5.6-sol"
model_reasoning_effort = "high" # minimal | low | medium | high (available today)
# "max" effort + the Sol Ultra cooperating-subagent tier
# activate once your org is in the closed preview:
# model = "gpt-5.6-sol-ultra"
# model_reasoning_effort = "max"
# per-run override, no config edit needed:
# codex -c model_reasoning_effort="high" "refactor the auth module"Tip pro profíky: nastavte výchozí hodnotu projektu na high, ne max. Pak přepněte na max jen u konkrétního běhu, který to potřebuje. Tenhle jeden zvyk udrží váš základní účet příčetný a schová drahý stupeň pro úlohy, které ho skutečně odmění. Detaily dostupnosti jsou v článku o ukázce v OpenAI Help Center.
Kolik Ultra skutečně stojí: tokenový multiplikátor subagentů
Tady je ta část, kterou nikdo nemodeluje: protože Ultra spouští spolupracující subagenty, jedna úloha vypálí několik volání modelu místo jednoho a každé volání účtuje tokeny. Potvrzená cena Sol je $5 na 1M vstupních tokenů, $0,50 cacheované a $30 na 1M výstupních. Výstup je ta drahá strana a Ultra ho produkuje mnohem víc.
Udělejme reálný příklad. Vezměme jednu středně složitou agentní úlohu na základní Sol, jeden agent:
| Model | Komponenta | Tokeny | Sazba / 1M | Cena |
|---|---|---|---|---|
| Sol (základ) | Vstup | 40 000 | $5 | $0,20 |
| Sol (základ) | Výstup | 15 000 | $30 | $0,45 |
| Sol (základ) | Celkem | $0,65 |
Teď stejná úloha na Ultra s koordinátorem plus třemi spolupracujícími subagenty. Sdílený kontext se cacheuje levně za $0,50, ale každý subagent stále produkuje vlastní výstup za $30:
| Model | Komponenta | Tokeny | Sazba / 1M | Cena |
|---|---|---|---|---|
| Sol Ultra (modelováno) | Vstup koordinátora | 40 000 | $5 | $0,20 |
| Sol Ultra (modelováno) | Vstup subagenta, cacheováno | 90 000 | $0,50 | $0,045 |
| Sol Ultra (modelováno) | Vstup subagenta, čerstvý | 30 000 | $5 | $0,15 |
| Sol Ultra (modelováno) | Výstup koordinátora + mezi agenty | 20 000 | $30 | $0,60 |
| Sol Ultra (modelováno) | Výstup subagentů (3 x 15K) | 45 000 | $30 | $1,35 |
| Sol Ultra (modelováno) | Celkem | ~$2,35 |
To je zhruba 3,6násobek ceny základní Sol za stejnou úlohu a podle toho, kolik subagentů se spustí a kolik kontextu se cacheuje, uvidíte kdekoli od 2x do 4x. Multiplikátor je náš modelový odhad ze zveřejněných cen, ne změřený benchmark Ultra, ale cena i mechanismus jsou obojí potvrzené, takže tvar je reálný.
Skrytá cena Ultra není sazba za token, ale to, že se jedna úloha tiše změní ve čtyři volání modelu.
Dvě věci to tlumí: prompt caching (ta $0,50 cacheovaná sazba) na sdíleném kontextu a disciplinované směrování, takže platíte sazby Ultra jen u úloh, které je potřebují. Pokud to s účtem myslíte vážně, náš průvodce, jak držet náklady na LLM API pod kontrolou, pokrývá směrovací vzory, které používáme na klientských pipeline. Ceny převzaty od DataCamp a deeplearning.ai, datováno 2026-06 až 2026-07.
Můžete to už používat? Omezená ukázka, ~20 partnerů a časová osa
Ne, pokud nejste jeden ze zhruba 20 důvěryhodných, vládou schválených partnerů. Sol Ultra je v uzavřené ukázce dostupné přes OpenAI API a Codex, bráněná vládní bezpečnostní revizí před širším vydáním. OpenAI řeklo, že širší přístup „přijde během týdnů" a nic konkrétnějšího.
Možná jste viděli datum „7. červenec", které koluje. Ignorujte ho. OpenAI nedalo žádné datum spuštění, takže jakýkoli konkrétní den berte jako nepotvrzené tlachání, ne jako fakt, podle kterého plánovat. Co je potvrzené, je rámec „během týdnů" a to, že Cerebras má od července servírovat Sol až 750 tokenů za sekundu (podle deeplearning.ai).
Takže co uděláte, pokud nejste partner? Připravte se teď. Vylaďte si konfiguraci Codexu a žebříček úsilí na modelech, které máte dnes, takže až se Ultra otevře, výměna řetězce modelu bude jediná změna, kterou uděláte. Rozhodovací box: Jste důvěryhodný partner? Ne? Tak si dnes nastavte směrování podle úrovně úsilí a buďte připravení vyměnit jeden řádek. Zdroje: OpenAI Help Center a deeplearning.ai.
Sol Ultra vs Sol vs GPT-5.5 vs Claude Mythos 5: po kterém sáhnout?
Směrujte podle úlohy, ne podle žebříčku, zvlášť když čísla žebříčku nejsou ověřená. Po základní Sol sahněte u většiny každodenního agentního kódování, schovejte Sol Ultra pro opravdu těžké dlouhé úlohy, nechte GPT-5.5 po ruce, pokud už je zapojené do vašeho stacku, a zvažte Claude Mythos 5 tam, kde už důvěřujete nejnovějšímu Claude pro svůj workflow.
Tady je praktický rámec:
- Sáhněte po základní Sol, když je úloha běžně těžká: feature, uzavřený refaktor, testovací sada. Nese uváděných 88,8 % a stojí zlomek Ultra.
- Sáhněte po Sol Ultra, když je úloha dlouhá, sahá přes mnoho souborů a špatný první průchod by stál reálný čas. Spolupracující subagenti tady svůj multiplikátor zaslouží, pokud vůbec někde.
- Sáhněte po GPT-5.5, když už je integrované a rozdíl oproti Sol neospravedlňuje migraci.
- Sáhněte po Claude Mythos 5, když ho upřednostňuje stávající nástrojové vybavení vašeho týmu. Jeho uváděné skóre se liší podle zdroje (84,3 % až 88,0 %), takže nepřepínejte jen kvůli číslu.
Pro hlubší kompromisy směrování modelů napříč nástroji naše srovnání kódovacích agentů rozebírá, kam který patří. Krátká verze: vyberte nejlevnější stupeň, který překoná laťku obtížnosti vaší úlohy.
Co vývojáři skutečně říkají na Redditu
Benchmarky jsou jedna věc. Co lidé hlásí ve svých vlastních terminálech, je druhá a právě teď jsou vlákna r/codex nejpoctivější signál, který máme. Náš odhad nálady: opatrně ohromení, hluboce skeptičtí a většinou se hádají o ceně.
Rané hands-on chválení je konkrétní. Ve vláknu r/codex s 335 hlasy vývojář, který si všiml, že se jeho prompty směrují na 5.6, řekl, že to působí „dvakrát rychleji" a „dává moje prompty na první pokus", dokonce „preventivně" opravuje okrajové případy, které s 5.5 trvaly několik kol. Jeho srovnání tvrdě dopadlo: „působí to přesně jako Fable 5, když jsem ho krátce měl v Claude, ale mnohem rychleji." Komentující, který tvrdil, že má interní přístup, dodal, že běh „úloh na maximální úrovni uvažování" trvá „mnohem míň času než u 5.5."
Pak přijdou veteráni. Nejhlasitější protiproud je to, co bychom nazvali cynismus líbánky-pak-nerf: „Vždycky to takhle je a vydrží to asi 2 týdny před nerfem," napsal jeden. Další byl přímočařejší: „Prostě do toho bušte 2 týdny tvrdě, protože Einstein to bude jen 2 týdny." Několik jich upozornilo na samotné načasování a všimli si, že zářivé příspěvky o 5.6 se objevují právě ve chvíli, kdy vrcholí stížnosti na úpadek 5.5. Příznačně, nejlépe hodnocené odpovědi v tom vlákně nebyly žádná analýza; byly to vtipy („už používám gpt 6"), což hodně vypovídá o tom, jak unavení jsou vývojáři z kolotoče hypu kolem verzí.
Ve vláknu oznámení Sol Ultra Codex se konverzace otočila téměř úplně k ceně, namířená přímo na Claude. Vývojáři zvažují $200 stupeň Codexu od OpenAI proti Fable promo od Anthropic a několik jich řeklo, že ruší Claude Max 20x, hlavně protože Fable „pálí kredity dvakrát rychleji." Opakující se naděje: „skutečná konkurence pro Claude Fable. Lepší pro nás uživatele." Opakující se obava, kterou mimochodem sdílíme: „už dřív mě OpenAI spálilo tím, že něco oznámilo a pak to zavrlo za vyšší stupně, takže uvěřím, až to uvidím běžet lokálně."
Náš pohled v Techsy: hlášení o rychlosti odpovídají tomu, co by měl doručit vyšší propustnostní stack servírování, takže tomu věříme. Tvrzení o dávání na první pokus bereme jako slibná, ale ve škále neprokázaná, protože vzor „po dvou týdnech to zhlouplo" je reálný a viděli jsme ho hrát u minulých launchů. A cenový skepticismus je naprosto na místě. Dokud není Sol Ultra ve vašem CLI, stabilní, přes celý fakturační cyklus, berte to nadšení jako ukázku, ne jako verdikt.
Co jsme viděli při běhu agentních úloh Codexu
Buďme přímí: Sol Ultra nemůžeme spustit. Je bráněná pro ~20 partnerů a my nejsme jeden z nich, takže nebudeme citovat počty tokenů ani skóre, která jsme nezměřili. Co udělat můžeme, je další nejlepší poctivá věc. Spustili jsme agentní úlohy přes Codex CLI na našem současném stupni a spočítali přesnou matematiku nákladů subagentů ze zveřejněné ceny OpenAI $5/$30.
Žebříček úsilí se chová přesně tak, jak byste čekali, na stupni, který jsme testovali. Při nízkém a středním úsilí Codex vrací rychle a většinou správně zvládá uzavřené úpravy. Strčte těžkou, vícesouborovou úlohu do nízkého úsilí a má tendenci skončit dřív nebo přehlédnout závislost napříč soubory; stejná úloha při vysokém úsilí stráví znatelně víc času přemýšlením, než jedná, a zvládne víc změny na jeden průchod. Ten kompromis mezi časem a kvalitou je celý důvod, proč existuje příčka max.
Modelování nákladů výše (příklad zhruba 3,6násobku) je ta pravá analýza z první ruky, za kterou si stojíme: je to aritmetika na potvrzených cenách a potvrzeném mechanismu subagentů, označená jako model, ne jako měření. Na klientských agentních pipeline už směrujeme stupně modelů podle nákladů a tohle je přesně výpočet, který bychom spustili, než pro kohokoli zapneme Ultra.
Jediná změna konfigurace, na které záleží, je řádek model_reasoning_effort v config.toml ukázaném dřív: držíme výchozí hodnotu projektu na high a přepisujeme na max pro jednotlivý běh, přesně jak popisuje tip pro profíky výše. Až se Ultra otevře za ukázku, tohle nastavení znamená, že výměna řetězce modelu bude jediná úprava, kterou uděláme, a matematika nákladů výše je už teď výpočet, který spustíme, než to zapneme. Tuhle sekci aktualizujeme o změřená čísla Ultra v okamžiku, kdy budeme mít skutečný přístup, ne dřív.
O autorovi
Mert Batur Gurbuz je spoluzakladatel Techsy.io, kde tým dodává AI agenty, automatizační systémy a hlasové/SDR pipeline pro B2B klienty. Studuje na University of Birmingham a píše o stacku nástrojů LLM, který tým Techsy skutečně používá v produkci. Spojte se na LinkedIn.
Spoluzakladatel, Techsy.io, University of Birmingham.
Často kladené otázky
Co je GPT-5.6 Sol Ultra?
Sol Ultra je nejvyšší stupeň úsilí uvažování GPT-5.6. Jejím určujícím rysem jsou spolupracující subagenti: koordinátor rozdělí úlohu a subagenti si během práce posílají zprávy. OpenAI ji umisťuje pro dlouhé, těžké, vícekrokové agentní úlohy, ne pro rychlé úpravy, a představilo ji jako součást rodiny Sol 26. 6. 2026.
Je Sol Ultra teď dostupná v Codexu?
Pro většinu lidí ne. K červenci 2026 je Sol Ultra v uzavřené ukázce dostupné přes OpenAI API a Codex, omezené na zhruba 20 důvěryhodných, vládou schválených partnerů za bezpečnostní revizí. OpenAI říká, že širší přístup „přijde během týdnů", ale nezveřejnilo žádné konkrétní datum, takže to dnes nemůžete jednoduše zapnout.
Jak fungují spolupracující subagenti v Sol Ultra?
Koordinátor rozloží vaši úlohu na části a každou přiřadí subagentovi. Na rozdíl od nezávislých paralelních agentů tito subagenti komunikují uprostřed úlohy, sdílejí, co zjistili, takže se ostatní přizpůsobí, než skončí. Tahle koordinace pomáhá u složité, vícesouborové práce, ale každý subagent je samostatné volání modelu, které spotřebovává vlastní tokeny.
Co je „maximální úsilí uvažování" v GPT-5.6?
Maximální úsilí uvažování je nejvyšší příčka žebříčku úsilí GPT-5.6, který jde low, medium, high, pak max. Vyšší úsilí znamená, že model stráví víc výpočtů uvažováním, než odpoví. Pomáhá u těžkých, dlouhých úloh a plýtvá penězi u jednoduchých, takže s ním zacházejte jako s knoflíkem, který vytočíte, jen když je úloha opravdu těžká.
Kolik stojí provoz Sol Ultra?
Základní Sol má cenu $5 na 1M vstupních tokenů, $0,50 cacheované a $30 na 1M výstupních (převzato od DataCamp a deeplearning.ai, datováno polovina 2026). Ultra spouští spolupracující subagenty, takže jedna úloha vypálí několik volání modelu. Náš modelový příklad ukazuje jednu úlohu stojící zhruba 2x až 4x běh základní Sol, taženo hlavně extra výstupními tokeny.
Je Sol Ultra skutečně lepší než Claude Mythos 5?
Podle uváděných čísel Sol Ultra (91,9 %) vede nad Claude Mythos 5 na Terminal-Bench 2.1, ale to je neověřené. OpenAI toto číslo nezveřejnilo, ukázka je uzavřená a vlastní uváděné skóre Mythos 5 se liší od 84,3 % do 88,0 % podle zdroje. Takže poctivá odpověď je: zatím nevíme a neměli byste na tom směrovat produkční provoz.
Kdy bude Sol Ultra všeobecně dostupná?
OpenAI řeklo, že širší přístup k rodině Sol napříč ChatGPT, Codex a API „přijde během týdnů", ale nezveřejnilo datum všeobecné dostupnosti. Jakékoli konkrétní datum kolující online (včetně „7. července") je nepotvrzené tlachání, ne oficiální oznámení. Sledujte vlastní stránku ukázky OpenAI pro potvrzenou časovou osu.
Je skóre 91,9 % na Terminal-Bench 2.1 ověřené?
Ne. Číslo 91,9 % pochází z druhotného tisku, ne z vlastní stránky ukázky OpenAI. Ukázka je uzavřená pro ~20 partnerů a žádná metodika vyhodnocení nebyla zveřejněna, takže nikdo mimo tento okruh to nemůže reprodukovat. Později se může ukázat jako přesné, ale právě teď je to neověřené tiskové tvrzení, ne hotový výsledek benchmarku.
Jak se Sol Ultra liší od paralelních agentů GPT-5.5 Pro?
Paralelní agenti Pro pracují nezávisle v oddělených pruzích: každý udělá svou část v izolaci a vrátí výsledek, bez komunikace. Subagenti Sol Ultra spolupracují, posílají si zprávy uprostřed úlohy, takže se mohou přizpůsobit, jak se učí. Tahle koordinace sedí těžší vícekrokové práci, ale taky násobí spotřebu tokenů napříč voláními.
Potřebuji Sol Ultra, nebo stačí základní Sol?
Pro většinu agentního kódování bohatě stačí základní Sol nebo vysoké úsilí uvažování a je mnohem levnější. Rezervujte Ultra pro dlouhé, vícesouborové úlohy, kde by špatný první pokus stál víc času než extra tokeny. Pokud nedokážete jasně vysvětlit, proč je úloha těžká, Ultra pro ni nepotřebujete. Směrujte podle obtížnosti, ne podle žebříčku.
Co vývojáři říkají o GPT-5.6 Sol na Redditu?
Raná hlášení z r/codex jsou pozitivní ohledně rychlosti („dvakrát rychleji") a dávání promptů na první pokus, přičemž několik vývojářů srovnává pocit s Fable 5 od Claude. Ale veteráni varují před vzorem „líbánky pak nerf", kdy se modely po launchi zhorší, a velká část debaty se točí kolem ceny vůči plánům Anthropic, ne kolem surové schopnosti.