Techsy
Otetttaa yhteyte
Aloita
Takaisin blogiin
ai-machine-learning

GPT-5.6 Sol Ultra Codexissa: mitä alagenttitila todella tekee (ja maksaa)

Kirjoittanut Mert Batur Gürbüz
Päivitetty Jul 6, 2026
14 lukuaika
Sisällys
GPT-5.6 Sol Ultra Codexissa: mitä alagenttitila todella tekee (ja maksaa)

GPT-5.6 Sol Ultra Codexissa: mitä alagenttitila todella tekee (ja maksaa)

Heinäkuussa 2026 GPT-5.6 Sol Ultra on suljetussa esiversiossa pienelle, noin 20 viranomaishyväksytyn kumppanin joukolle, ja se on tavoitettavissa OpenAI API:n ja Codexin kautta. Se ei ole vielä laajasti saatavilla. OpenAI ei ole julkaissut yleistä saatavuuspäivää, eikä laajasti lainattu 91,9 prosentin Terminal-Bench-tulos näy OpenAI:n omalla ennakkojulkaisusivulla.

26.6.2026 OpenAI esitteli GPT-5.6 Sol -perheen, ja muutamaa päivää myöhemmin Thibault Sottiaux kehotti Codex-käyttäjiä "säästämään kovimmat promptinsa" Sol Ultra -tasoa varten. Tämä yksi vihjaisu synnytti aallon benchmark-ruutukaappauksia. Useimmat niistä toistavat lukua, jota OpenAI ei ole koskaan julkaissut. Joten ennen kuin suunnittelet Codex-työnkulkusi GPT-5.6 Sol Ultran ympärille, tässä mitä todella on vahvistettu, miten alagenttitila toimii ja millä token-laskelmalla ratkeaa, kannattaako se kytkeä päälle.

Keskeiset opit:

  • Sol Ultra on GPT-5.6:n kovin ponnistelutaso: yhteistoiminnalliset alagentit, jotka keskustelevat keskenään yhden tehtävän aikana.
  • Se on suljetussa esiversiossa noin 20 viranomaishyväksytylle kumppanille API:n ja Codexin kautta, ei laajasti saatavilla (heinäkuussa 2026).
  • Lehdistö raportoi 91,9 prosentin tuloksesta Terminal-Bench 2.1:ssä, mutta OpenAI ei ole julkaissut sitä lukua, joten pidä sitä vahvistamattomana.
  • Sol maksaa 5 $ sisään / 30 $ ulos per 1M tokenia; alagentit moninkertaistavat kutsut, joten Ultra voi maksaa useita kertoja yhden agentin ajoon nähden.

GPT-5.6 Sol Ultra Codexissa: mitä todella on vahvistettu

Tässä on selkeä jako. Vahvistettu: OpenAI esitteli Sol-perheen (Sol, Terra, Luna) 26.6.2026, Sol Ultra on ylin päättelytaso ja se on vihjailtu Codexille. Ei vahvistettu: 91,9 prosentin Terminal-Bench 2.1 -tulos tai mikään yleinen saatavuuspäivä. Kaikki muu näkemäsi on raportointia, ei ensimmäisen osapuolen dataa.

Tällä erolla on väliä, koska tämä julkaisu eteni nopeasti ja löyhästi. OpenAI:n ennakkojulkaisusivu kuvaa tasot ja turvallisuusportaat laadullisin termein. Huomiota herättävä benchmark-taulukko, joka kiertää X:ssä ja oppaissa, on peräisin toissijaisesta kattauksesta, ei OpenAI:n omalta sivulta. Ennen julkaisua arvioimme julkaisua edeltäneet huhut, ja tässä mitä todella julkaistiin verrattuna siihen, mikä jäi spekulaatioksi. Sama kuri pätee nyt.

Joten jos olet kehittäjä, joka yrittää päättää, kuuluuko Ultra Codex-silmukkaasi, jätä hypeluvut hetkeksi sivuun. Vahvistetut faktat (mekanismi, hinnoittelu, esiversion tila) riittävät kustannusten ja sopivuuden arviointiin. Vahvistamattomien (tarkka tulos, julkaisupäivä) ei pitäisi ohjata vielä yhtäkään päätöstä. Lähteet: OpenAI:n GPT-5.6 Sol -ennakkojulkaisusivu ja 9to5Macin julkaisukattaus.

Mikä Sol Ultra on? Yhteistoiminnalliset alagentit vs. Pron rinnakkaisagentit

Sol Ultra on GPT-5.6:n ylin päättelytaso, ja sen määrittelevä ominaisuus ovat yhteistoiminnalliset alagentit: koordinaattori pilkkoo tehtäväsi osiin, antaa jokaisen osan alagentille, ja nuo alagentit välittävät viestejä toisilleen työn ollessa vielä käynnissä. Tämä tehtävän aikainen viestintä on koko idea, ja se erottaa Ultran kaikista alemmista tasoista.

Ajattele sitä pienenä tiiminä verrattuna freelancereiden joukkoon. GPT-5.5 Pron rinnakkaisagentit toimivat kuin freelancerit, joille ojennat kolme erillistä lippua. Jokainen lähtee tekemään omaa osuuttaan eristyksissä ja pudottaa tuloksen pöydällesi. Kukaan ei puhu. Sol Ultran alagentit toimivat kuin samassa huoneessa oleva tiimi: yksi huomaa tietokantaskeeman muuttuneen, kertoo muille, ja he mukautuvat ennen valmistumista. Tämä koordinaatio on syy siihen, miksi OpenAI asemoi sen pitkiin, vaikeisiin, monivaiheisiin tehtäviin pikamuokkausten sijaan.

Kun Pron agentit työskentelevät erillisillä kaistoilla, Sol Ultran alagentit lähettävät toisilleen viestejä tehtävän ollessa yhä käynnissä.

Jaettu kaavio: Sol Ultran yhteistoiminnalliset alagentit välittävät viestejä vasemmalla; Pron itsenäiset rinnakkaisagentit oikealla
Sol Ultran yhteistoiminnalliset alagentit viestivät tehtävän aikana; Pron rinnakkaisagentit toimivat eristetyillä, itsenäisillä kaistoilla.

Mekanismi itsessään on vahvistettu, OpenAI on kuvannut sen ja DataCamp sekä deeplearning.ai toistavat sen kattauksissaan. Koukku, johon palaamme, on se, että jokainen luomasi alagentti on uusi mallikutsu, joka polttaa tokeneita. Koordinaatio ei ole ilmaista.

Mitä "maksimipäättelypanos" tarkoittaa ja milloin se kannattaa kytkeä päälle?

"Maksimipäättelypanos" on GPT-5.6:n ponnistusportaiden ylin porras, joka kulkee matalasta korkeaan ja aina maksimiasetukseen, jota Sol Ultra käyttää. Kovempi ponnistus tarkoittaa, että malli käyttää enemmän laskentaa ajatteluun ennen vastaamista, mikä yleensä auttaa vaikeissa ongelmissa ja hukkaa rahaa helppoissa. Se on säädin, ei kytkin, jonka jättää kaakkoon.

Kuvittele shakinpelaaja. Matalalla ponnistuksella hän siirtää nopeasti vaistonvaraisesti, mikä sopii ilmeisiin lyönteihin. Maksimiponnistuksella hän istuu ja laskee kymmenen siirtoa eteenpäin, mikä on juuri sitä mitä haluat vaikeassa loppupelissä ja täysin turhaa oven avaamisessa. Päättelypanos toimii samoin. Laskenta (ja lasku) skaalautuu sen mukaan, kuinka kovaa käskeät mallin ajatella.

Milloin se siis kannattaa? Kytke maksimiponnistus päälle pitkäjänteisessä, monta tiedostoa koskevassa agenttisessa työssä: migraatio, joka koskee kahtakymmentä tiedostoa, kinkkinen refaktorointi, bugi, joka ulottuu kolmeen palveluun. Se on pitkäjänteisen agenttisen koodauksen aluetta, jossa syvempi päättely todella muuttaa lopputulosta. Pidä se pois päältä muuttujan nimeämisestä, yksittäisen testin kirjoittamisesta tai kirjoitusvirheen korjaamisesta, koska maksat preemiotokeneista nollahyödyn.

Maksimipäättelypanos ansaitsee hintansa vain, kun tehtävä on riittävän vaikea, jotta väärä ensimmäinen yritys maksaisi enemmän kuin ylimääräiset tokenit.

Rehellinen sääntö: jos et osaa selittää, miksi tehtävä on vaikea, et todennäköisesti tarvitse siihen maksimiponnistusta.

Terminal-Bench 2.1 -luvut: onko 91,9 % todella vahvistettu?

Ei. 91,9 prosentin luku on toissijaisen lehdistön raportoima, se ei näy OpenAI:n omalla ennakkojulkaisusivulla, esiversio on suljettu eikä arviointimenetelmää ole paljastettu. Joten sitä ei ole vahvistettu itsenäisesti. Käsittele sitä lehdistön väitteenä, jota et voi tarkistaa, ei varmistuneena tuloksena.

Tässä on tarkka tilanne. OpenAI-läheinen raportointi (DataCamp, AI Weekly, deeplearning.ai) asettaa Sol Ultran 91,9 prosenttiin Terminal-Bench 2.1:ssä. Mutta koska esiversio on rajattu noin 20 kumppanille eikä OpenAI ole julkaissut lukua tai testiolosuhteita, kukaan tuon piirin ulkopuolella ei voi toistaa sitä. Huomaa myös, että Claude Mythos 5:n luku vaihtelee raportoijasta riippuen: jotkut lähteet sanovat 84,3 %, toiset 88,0 %. Kun vertailutaulukon omat luvut ovat ristiriidassa lähteiden välillä, se on merkki pitää siitä löyhästi kiinni.

MalliTerminal-Bench 2.1 (raportoitu, ei itsenäisesti vahvistettu)
Sol Ultra91,9 %
Sol (perus)88,8 %
GPT-5.588,0 %
Claude Mythos 584,3–88,0 % (vaihtelee lähteen mukaan)
Gemini 3.1 Pro Preview70,7 %

Kaikkien lainaama 91,9 % ei näy OpenAI:n omalla ennakkojulkaisusivulla, joten pidä sitä lehdistön väitteenä, ei varmistuneena tuloksena.

Mikään tästä ei tarkoita, että Sol Ultra olisi heikko. Se voi hyvinkin nousta kärkeen, kun OpenAI julkaisee todellisen menetelmän. Se tarkoittaa vain, ettei tuotantoliikennettä pidä reitittää luvun perusteella, jota et voi vahvistaa. Lähteet: DataCampin GPT-5.6 Sol -opas, deeplearning.ain The Batch ja AI Weekly.

Näin käytät Sol Ultraa + maksimipäättelypanosta Codexissa

Sol Ultra itsessään on rajattu, joten et voi kytkeä sitä päälle ellet organisaatiosi kuulu esiversioon. Mutta ponnistusportaat, joilla se seisoo, toimivat jo Codex CLI:ssä tänään, käytössäsi olevilla malleilla. Näin asetus toimii, ja mihin Ultra asettuu, kun saat pääsyn.

  1. Etsi asetus. Päättelypanos sijaitsee Codex-asetustiedostossasi ~/.codex/config.toml tai ajokohtaisena lippuna. Se ei ole hautautunut valikkoon; se on yksi avain.
  2. Aseta malli ja ponnistus. Osoita Codex mallimerkkijonoosi ja aseta ponnistustaso. Tänään voit asettaa matalasta korkeaan; "maksimi"-porras ja Sol Ultran alagenttitaso avautuvat, kun organisaatiosi on esiversiossa.
  3. Ohita tehtäväkohtaisesti. Käytä -c-lippua nostaaksesi ponnistusta yksittäistä vaikeaa ajoa varten muokkaamatta asetuksiasi.
  4. Kytke se valikoivasti. Varaa maksimiponnistus yllä olevan osion pitkiin, monta tiedostoa koskeviin tehtäviin. Pidä oletuksesi keskitasolla tai korkealla.
toml
# ~/.codex/config.toml
model = "gpt-5.6-sol"
model_reasoning_effort = "high"   # minimal | low | medium | high (available today)

# "max" effort + the Sol Ultra cooperating-subagent tier
# activate once your org is in the closed preview:
# model = "gpt-5.6-sol-ultra"
# model_reasoning_effort = "max"

# per-run override, no config edit needed:
# codex -c model_reasoning_effort="high" "refactor the auth module"

Pro-vinkki: aseta projektisi oletukseksi high, ei max. Ohita sitten maksimiin vain tietyn ajon kohdalla, joka sitä tarvitsee. Tämä yksi tapa pitää peruslaskusi järkevänä ja säästää kalliin tason tehtäville, jotka todella palkitsevat sen. Saatavuustiedot ovat OpenAI:n Help Centerin esiversioartikkelissa.

Mitä Ultra todella maksaa: alagenttien token-kerroin

Tässä on osa, jota kukaan ei mallinna: koska Ultra synnyttää yhteistoiminnallisia alagentteja, yksi tehtävä laukaisee useita mallikutsuja yhden sijaan, ja jokainen kutsu laskuttaa tokeneita. Solin vahvistettu hinnoittelu on 5 $ per 1M input-tokenia, 0,50 $ välimuistitettuna ja 30 $ per 1M output-tokenia. Output on kallis puoli, ja Ultra tuottaa sitä paljon enemmän.

Käydään läpi todellinen esimerkki. Otetaan yksi kohtalaisen monimutkainen agenttinen tehtävä perus-Solilla, yksittäinen agentti:

MalliKomponenttiTokenitHinta / 1MKustannus
Sol (perus)Input40 000$5$0.20
Sol (perus)Output15 000$30$0.45
Sol (perus)Yhteensä$0.65

Nyt sama tehtävä Ultralla, koordinaattori plus kolme yhteistoiminnallista alagenttia. Jaettu konteksti välimuistittuu halvalla 0,50 $:lla, mutta jokainen alagentti tuottaa silti oman outputinsa 30 $:lla:

MalliKomponenttiTokenitHinta / 1MKustannus
Sol Ultra (mallinnettu)Koordinaattorin input40 000$5$0.20
Sol Ultra (mallinnettu)Alagentin input, välimuistissa90 000$0.50$0.045
Sol Ultra (mallinnettu)Alagentin input, tuore30 000$5$0.15
Sol Ultra (mallinnettu)Koordinaattorin + agenttien välinen output20 000$30$0.60
Sol Ultra (mallinnettu)Alagentin output (3 x 15K)45 000$30$1.35
Sol Ultra (mallinnettu)Yhteensä~$2.35

Tämä on suunnilleen 3,6-kertainen perus-Solin kustannus samasta tehtävästä, ja riippuen siitä kuinka monta alagenttia syntyy ja kuinka paljon kontekstia välimuistittuu, näet 2–4-kertaisen kertoimen. Kerroin on mallinnettu arviomme julkaistuista hinnoista, ei mitattu Ultra-benchmark, mutta sekä hinnoittelu että mekanismi ovat vahvistettuja, joten muoto on todellinen.

Ultran piilokustannus ei ole tokenikohtainen hinta, vaan se, että yhdestä tehtävästä tulee hiljaisesti neljä mallikutsua.

Kaksi asiaa pehmentävät tätä: promptien välimuistitus (tuo 0,50 $:n välimuistihinta) jaetussa kontekstissa ja kurinalainen reititys, jotta maksat Ultra-hinnat vain tehtävistä, jotka niitä tarvitsevat. Jos otat laskun vakavasti, oppaamme siitä, miten pitää LLM API -kustannuksesi kurissa, kattaa reititysmallit, joita käytämme asiakasputkissamme. Hinnoittelu DataCampilta ja deeplearning.ailta, ajoitettu 2026-06–2026-07.

Voitko käyttää sitä jo? Rajattu esiversio, noin 20 kumppania ja aikataulu

Et, ellet ole yksi noin 20 luotetusta, viranomaishyväksytystä kumppanista. Sol Ultra on suljetussa esiversiossa, joka on tavoitettavissa OpenAI API:n ja Codexin kautta, viranomaisten turvallisuustarkastuksen takana ennen laajempaa julkaisua. OpenAI on sanonut laajemman pääsyn olevan "tulossa viikoissa", eikä mitään tarkempaa.

Olet ehkä nähnyt "7. heinäkuuta" -päivämäärän kiertävän. Jätä se huomiotta. OpenAI ei antanut julkaisupäivää, joten pidä mitä tahansa tiettyä päivää vahvistamattomana puheena, ei faktana, jonka ympärille suunnitella. Vahvistettua on "tulossa viikoissa" -kehys ja se, että Cerebras on tarjoamassa Solia jopa 750 tokenilla sekunnissa heinäkuusta alkaen (deeplearning.ain mukaan).

Mitä siis teet, jos et ole kumppani? Valmistaudu nyt. Viritä Codex-asetuksesi ja ponnistusportaasi käytössäsi oleville malleille tänään, jotta kun Ultra avautuu, mallimerkkijonon vaihtaminen on ainoa muutoksesi. Päätöslaatikko: Oletko luotettu kumppani? Et? Aseta sitten ponnistelutason reitityksesi tänään ja ole valmis vaihtamaan yksi rivi. Lähteet: OpenAI Help Center ja deeplearning.ai.

Sol Ultra vs. Sol vs. GPT-5.5 vs. Claude Mythos 5: mihin kannattaa tarttua?

Reititä tehtävän, älä tuloslistan mukaan, etenkin kun tuloslistan luvut eivät ole vahvistettuja. Tartu perus-Soliin useimmissa päivittäisissä agenttisissa koodaustehtävissä, säästä Sol Ultra aidosti vaikeisiin pitkäjänteisiin tehtäviin, pidä GPT-5.5 käytössä jos se on jo kytketty pinoosi, ja harkitse Claude Mythos 5:tä silloin kun jo luotat Clauden uusimpaan työkulussasi.

Tässä on käytännöllinen kehys:

  • Tartu perus-Soliin, kun tehtävä on normaalin vaikea: ominaisuus, rajattu refaktorointi, testisarja. Sillä on raportoitu 88,8 % ja se maksaa murto-osan Ultrasta.
  • Tartu Sol Ultraan, kun tehtävä on pitkä, koskee montaa tiedostoa ja väärä ensimmäinen veto maksaisi todellista aikaa. Yhteistoiminnalliset alagentit ansaitsevat kertoimensa täällä, jos missään.
  • Tartu GPT-5.5:een, kun se on jo integroitu eikä ero Soliin oikeuta migraatiota.
  • Tartu Claude Mythos 5:een, kun tiimisi olemassa olevat työkalut suosivat sitä. Sen raportoitu tulos vaihtelee lähteen mukaan (84,3–88,0 %), joten älä vaihda pelkän luvun perusteella.

Syvempiä mallireitityksen kompromisseja työkalujen välillä varten koodausagenttivertailumme erittelee, mihin kukin sopii. Lyhyt versio: valitse halvin taso, joka ylittää tehtäväsi vaikeusrajan.

Mitä kehittäjät todella sanovat Redditissä

Benchmarkit ovat yksi asia. Se, mitä ihmiset raportoivat omissa terminaaleissaan, on toinen, ja juuri nyt r/codex-ketjut ovat rehellisin signaali, mikä meillä on. Lukemamme tunnelmasta: varovaisen vaikuttunut, syvän skeptinen ja enimmäkseen hintaa väittelevä.

Varhainen käytännön kehu on tarkkaa. 335 äänen r/codex-ketjussa kehittäjä, joka huomasi promptiensa reitittyvän 5.6:lle, sanoi sen tuntuvan "kaksi kertaa nopeammalta" ja "hoitavan promptini kerralla", jopa "ennakoivasti" korjaavan reunatapauksia, joihin 5.5:n kanssa meni useita kierroksia. Hänen vertauksensa osui kovaa: se "tuntuu täsmälleen Fable 5:ltä, kun minulla oli se hetken Claudessa, mutta paljon nopeammalta." Sisäistä pääsyä väittänyt kommentoija lisäsi, että "tehtävien ajaminen maksimipäättelytasolla" vie "paljon vähemmän aikaa kuin 5.5:llä."

Sitten konkarit saapuvat. Voimakkain vastavirta on mitä kutsumme hunajakuukausi-sitten-nerf-synismiksi: "Näin on aina ja se kestää noin 2 viikkoa ennen nerfiä", yksi kirjoitti. Toinen oli suorempi: "Takoa vain 2 viikkoa kovaa, koska se on Einstein vain 2 viikkoa." Muutama nosti esiin ajoituksen itsessään, huomauttaen hehkuttavien 5.6-viestien ilmestyvän juuri kun 5.5:n heikkenemisvalitukset huipentuvat. Kertovaa on, että ketjun äänistetyimmät vastaukset eivät olleet analyysiä lainkaan; ne olivat vitsejä ("käytän jo gpt 6:ta"), mikä kertoo paljon siitä kuinka kyllästyneitä kehittäjät ovat versiohypen pyöritykseen.

Sol Ultra Codex -julkistusketjussa keskustelu kääntyi lähes kokonaan hintaan, suunnattuna suoraan Claudeen. Kehittäjät punnitsevat OpenAI:n 200 $:n Codex-tasoa Anthropicin Fable-promoa vastaan, ja useat sanoivat irtisanovansa Claude Max 20x:n, enimmäkseen koska Fable "polttaa krediittejä kaksi kertaa nopeammin." Toistuva toive: "todellista kilpailua Claude Fablelle. Parempi meille käyttäjille." Toistuva pelko, jonka jaamme: "OpenAI on aiemmin polttanut meidät julkistamalla asioita ja rajaamalla ne korkeampien tasojen taakse, joten uskon sen vasta kun näen sen ajettavan lokaalisti."

Meidän näkemyksemme Techsyssä: nopeusraportit sopivat yhteen sen kanssa, mitä korkeamman läpimenon tarjoilupinon pitäisi tuottaa, joten uskomme niitä. Kerralla hoitaminen -väitteitä pidämme lupaavina mutta skaalassa todistamattomina, koska "se tyhmeni kahden viikon jälkeen" -kuvio on todellinen ja olemme nähneet sen toistuvan aiemmissa julkaisuissa. Ja hintaskeptisyys on täysin oikeassa. Kunnes Sol Ultra on CLI:ssäsi, vakaa, täyden laskutusjakson läpi, pidä innostusta esiversiona, ei tuomiona.

Mitä näimme ajaessamme Codexin agenttisia tehtäviä

Sanotaan suoraan: emme voi ajaa Sol Ultraa. Se on rajattu noin 20 kumppanille emmekä ole yksi heistä, joten emme lainaa tokenmääriä tai tuloksia, joita emme ole mitanneet. Mitä voimme tehdä, on seuraavaksi paras rehellinen asia. Ajoimme agenttisia tehtäviä Codex CLI:n läpi nykyisellä tasollamme ja laskimme tarkan alagenttien kustannusmatematiikan OpenAI:n julkaisemista 5 $/30 $ -hinnoista.

Ponnistusportaat käyttäytyvät täsmälleen odotetusti testaamallamme tasolla. Matalalla ja keskitason ponnistuksella Codex palauttaa nopeasti ja saa rajatut muokkaukset enimmäkseen oikein. Työnnä vaikea, monta tiedostoa koskeva tehtävä matalalla ponnistuksella ja se taipuu jäämään vajaaksi tai missaamaan tiedostojen välisen riippuvuuden; sama tehtävä korkealla ponnistuksella ajattelee huomattavasti pidempään ennen toimintaa ja saa enemmän muutoksesta kerralla maaliin. Tämä kellonaika-laatu-kompromissi on koko syy siihen, miksi maksimiporras on olemassa.

Yllä oleva kustannusmallinnus (suunnilleen 3,6-kertainen esimerkki) on aito ensikäden analyysi, jonka takana voimme seistä: se on laskutoimitusta vahvistetuilla hinnoilla ja vahvistetulla alagenttimekanismilla, merkitty malliksi, ei mittaukseksi. Asiakkaiden agenttisissa putkissa reititämme jo mallitasot kustannuksen mukaan, ja tämä on täsmälleen se laskelma, jonka ajaisimme ennen Ultran kytkemistä kenellekään.

Ainoa merkityksellinen asetusten muutos on aiemmin näytetyn config.toml-tiedoston model_reasoning_effort-rivi: pidämme projektimme oletuksena high ja ohitamme max-tasoon ajokohtaisesti, täsmälleen kuten yllä oleva pro-vinkki kuvaa. Kun Ultra avautuu esiversion ohi, tuo asetus tarkoittaa, että mallimerkkijonon vaihtaminen on ainoa muokkaus, jonka teemme, ja yllä oleva kustannusmatematiikka on jo laskelma, jonka ajamme ennen sen kytkemistä. Päivitämme tämän osion mitatuilla Ultra-luvuilla heti kun saamme aitoa pääsyä, emme ennen sitä.

Tietoa kirjoittajasta

Mert Batur Gurbuz on Techsy.io:n perustajaosakas, missä tiimi toimittaa AI-agentteja, automaatiojärjestelmiä ja ääni-/SDR-putkia B2B-asiakkaille. Hän opiskelee Birminghamin yliopistossa ja kirjoittaa LLM-työkalupinosta, jota Techsyn tiimi todella käyttää tuotannossa. Yhdistä LinkedInissä.

Perustajaosakas, Techsy.io, Birminghamin yliopisto.

Usein kysytyt kysymykset

Mikä on GPT-5.6 Sol Ultra?

Sol Ultra on GPT-5.6:n korkeimman päättelypanoksen taso. Sen määrittelevä ominaisuus ovat yhteistoiminnalliset alagentit: koordinaattori pilkkoo tehtävän ja alagentit välittävät viestejä toisilleen työskennellessään. OpenAI asemoi sen pitkiin, vaikeisiin, monivaiheisiin agenttisiin tehtäviin pikamuokkausten sijaan ja esitteli sen osana Sol-perhettä 26.6.2026.

Onko Sol Ultra saatavilla Codexissa juuri nyt?

Ei useimmille. Heinäkuussa 2026 Sol Ultra on suljetussa esiversiossa, joka on tavoitettavissa OpenAI API:n ja Codexin kautta, rajattuna noin 20 luotetulle, viranomaishyväksytylle kumppanille turvallisuustarkastuksen takana. OpenAI sanoo laajemman pääsyn olevan "tulossa viikoissa", mutta ei ole julkaissut tarkkaa päivää, joten et voi vain kytkeä sitä päälle tänään.

Miten yhteistoiminnalliset alagentit toimivat Sol Ultrassa?

Koordinaattori pilkkoo tehtäväsi osiin ja osoittaa jokaisen alagentille. Toisin kuin itsenäiset rinnakkaisagentit, nämä alagentit viestivät tehtävän aikana, jakaen oppimaansa niin, että muut mukautuvat ennen valmistumista. Tämä koordinaatio auttaa monimutkaisessa, monta tiedostoa koskevassa työssä, mutta jokainen alagentti on erillinen mallikutsu, joka kuluttaa omat tokeninsa.

Mitä on "maksimipäättelypanos" GPT-5.6:ssa?

Maksimipäättelypanos on GPT-5.6:n ponnistusportaiden ylin porras, joka kulkee matala, keskitaso, korkea ja sitten maksimi. Kovempi ponnistus tarkoittaa, että malli käyttää enemmän laskentaa päättelyyn ennen vastaamista. Se auttaa vaikeissa, pitkäjänteisissä tehtävissä ja hukkaa rahaa yksinkertaisissa, joten pidä sitä säätimenä, jonka nostat kaakkoon vain kun tehtävä on aidosti vaikea.

Paljonko Sol Ultran ajaminen maksaa?

Perus-Solin hinta on 5 $ per 1M input-tokenia, 0,50 $ välimuistitettuna ja 30 $ per 1M output-tokenia (DataCampilta ja deeplearning.ailta, ajoitettu vuoden 2026 puoliväliin). Ultra synnyttää yhteistoiminnallisia alagentteja, joten yksi tehtävä laukaisee useita mallikutsuja. Mallinnettu esimerkkimme näyttää yksittäisen tehtävän maksavan suunnilleen 2–4-kertaisesti perus-Solin ajoon nähden, enimmäkseen ylimääräisten output-tokenien vuoksi.

Onko Sol Ultra todella parempi kuin Claude Mythos 5?

Raportoituja lukuja katsoen Sol Ultra (91,9 %) johtaa Claude Mythos 5:tä Terminal-Bench 2.1:ssä, mutta se on vahvistamatonta. OpenAI ei ole julkaissut lukua, esiversio on suljettu, ja Mythos 5:n oma raportoitu tulos vaihtelee 84,3–88,0 prosentin välillä lähteestä riippuen. Joten rehellinen vastaus on: emme vielä tiedä, eikä tuotantoliikennettä pidä reitittää sen perusteella.

Milloin Sol Ultra on yleisesti saatavilla?

OpenAI on sanonut laajemman pääsyn Sol-perheeseen ChatGPT:ssä, Codexissa ja API:ssa olevan "tulossa viikoissa", mutta ei ole julkaissut yleistä saatavuuspäivää. Mikään verkossa kiertävä tietty päivämäärä (mukaan lukien "7. heinäkuuta") ei ole vahvistettua puhetta, ei virallinen julkistus. Seuraa OpenAI:n omaa ennakkojulkaisusivua vahvistetun aikataulun osalta.

Onko 91,9 prosentin Terminal-Bench 2.1 -tulos vahvistettu?

Ei. 91,9 prosentin luku on peräisin toissijaiselta lehdistöltä, ei OpenAI:n omalta ennakkojulkaisusivulta. Esiversio on suljettu noin 20 kumppanille eikä arviointimenetelmää ole paljastettu, joten kukaan tuon piirin ulkopuolella ei voi toistaa sitä. Se voi osoittautua tarkaksi myöhemmin, mutta juuri nyt se on vahvistamaton lehdistön väite, ei varmistunut benchmark-tulos.

Miten Sol Ultra eroaa GPT-5.5 Pron rinnakkaisagenteista?

Pron rinnakkaisagentit toimivat itsenäisesti erillisillä kaistoilla: jokainen tekee osuutensa eristyksissä ja palauttaa tuloksen, ilman viestintää. Sol Ultran alagentit tekevät yhteistyötä, välittäen viestejä toisilleen tehtävän aikana, jotta he voivat mukautua oppiessaan. Tämä koordinaatio sopii vaikeampaan monivaiheiseen työhön, mutta se myös moninkertaistaa tokenkäytön kutsujen välillä.

Tarvitsenko Sol Ultraa, vai riittääkö perus-Sol?

Useimpiin agenttisiin koodaustehtäviin perus-Sol tai korkea päättelypanos riittää ja on paljon halvempi. Varaa Ultra pitkiin, monta tiedostoa koskeviin tehtäviin, joissa väärä ensimmäinen yritys maksaisi enemmän aikaa kuin ylimääräiset tokenit. Jos et osaa selittää selkeästi, miksi tehtävä on vaikea, et tarvitse Ultraa siihen. Reititä vaikeuden, älä tuloslistan mukaan.

Mitä kehittäjät sanovat GPT-5.6 Solista Redditissä?

Varhaiset r/codex-raportit ovat positiivisia nopeudesta ("kaksi kertaa nopeampi") ja promptien kerralla hoitamisesta, useiden kehittäjien verrattua tuntumaa Clauden Fable 5:een. Mutta konkarit varoittavat "hunajakuukausi sitten nerf" -kuviosta, jossa mallit heikkenevät julkaisun jälkeen, ja suuri osa väittelystä pyörii kustannusten ympärillä Anthropicin suunnitelmia vastaan, ei raakaa kyvykkyyttä.

Aihepiirit

GPT-5.6 Sol Ultra CodexissaSol Ultra CodexmaksimipäättelypanosalagentitTerminal-Bench 2.1

Jaa tämä artikkeli

Aiheeseen liittyvät julkaisut

Lisää aiheesta ai-machine-learning

ai-machine-learning
Jul 24, 2026

Claude Opus 5 on täällä: Lähes Fable 5:n älykkyys puoleen hintaan

Anthropic julkaisi Claude Opus 5:n 24. heinäkuuta 2026. Se yli kaksinkertaistaa Opus 4.8:n tuloksen Frontier-Benchissä ja pitää Opus-hinnoittelun, mutta häviää muutamia testejä Fable 5:lle ja Mythos 5:lle. Tässä benchmark-taulukko, hinnoittelu ja vaihda/odota/pysy-suositus.

10 min read lukuaika
Lue
ai-machine-learning
Jul 20, 2026

8 parasta tekoälypohjaista web scraping -APIa vuonna 2026 (testattu omalla agenttipinollamme)

Testasimme 8 tekoälypohjaista web scraping -APIa todellisilla vuoden 2026 hinnoilla, jotka haimme oman agenttipinomme kautta. Firecrawl, Bright Data, ScrapingBee ja 5 muuta – sijoitettuna LLM-valmiin tulosteen, bottitorjunnan ja MCP-tuen mukaan.

9 min read lukuaika
Lue
ai-machine-learning
Jul 20, 2026

Kehitystyön prompt-suunnittelu: 7 mallia, joita käytämme päivittäin Claude Codessa ja Cursorissa (2026)

Useimmat 'tekoälyn koodausprompteja' käsittelevät artikkelit tarjoavat 50 valmista mallia kopioitavaksi. Tämä opettaa 7 mallia, joita käytämme joka päivä 16 agentin Claude Code -putkiston ajamiseen, mukana todelliset ennen-jälkeen-esimerkit kustakin sekä tieto siitä, missä kukin malli sijaitsee Claude Codessa, Cursorissa ja Copilotissa vuonna 2026.

11 min read lukuaika
Lue
Katso kaikki julkaisut
Aloita projekti

Valmiina rakentamaan jotain erinomainen?

Muutetaan visiosi todellisuudeksi. Tiimimme on valmis auttamaan sinua luomaan ohjelmistoja, joilla on todellinen vaikutus.

Varaa lyhyt suunnittelukeskusteluKatso töitämme

Suosittuja kirjastosta

Claude-taidot

Katso kaikki
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tekoäly automatisoinnit

Katso kaikki
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Suosittuja kirjastosta

Claude-taidot

Katso kaikki
  • New Post

    Full SEO blog pipeline: research, brief, write, validate, image, translate, publish to Sanity. Autonomous from start to finish.

  • Content Refresh

    Audit a stale post, find decay drivers, and ship a SERP-aligned refresh without losing existing rankings.

  • SEO Audit

    Site-wide SEO audit with prioritized fix list: technical, on-page, and EEAT signals.

Tekoäly automatisoinnit

Katso kaikki
  • Security Auditor

    Weekly SCA + IaC scan with prioritized fix PRs.

  • Cold Email Writer

    Generates first-touch emails grounded in one specific public detail.

  • Lead Research Agent

    Enrich an email into a profile, score fit, alert in Slack.

Palvelut

  • Yritysratkaisut
  • Mobiilisovellukset
  • Verkkosovellukset

Ratkaisut

  • CRM-järjestelmät
  • Tekoälyintegraatio
  • ERP-ratkaisut
  • Ääniapurarit
  • Prosessien automatisointi
  • Kyberturvallisuus

Kirjasto

  • Blogi
  • Portfolio

Yhteisö

  • Tekoäly automatisoinnit
  • Claude-taidot

Työkalut

  • Mobile sovelluksen hintalaskuri
  • OpenAI / LLM API -hintalaskuri
  • MVP-hintalaskuri
  • Puhe-tekoälyasiamies-hintalaskuri

Yritys

  • Tietoja
  • Kumppanit
  • Ota yhteyttä

Juridiset asiat

  • Tietosuopolitiiikka
  • Käyttöehdot
  • Evästekäytäntö

Palvelut

  • Yritysratkaisut
  • Mobiilisovellukset
  • Verkkosovellukset

Ratkaisut

  • CRM-järjestelmät
  • Tekoälyintegraatio
  • ERP-ratkaisut
  • Ääniapurarit
  • Prosessien automatisointi
  • Kyberturvallisuus

Kirjasto

  • Blogi
  • Portfolio

Yhteisö

  • Tekoäly automatisoinnit
  • Claude-taidot

Työkalut

  • Mobile sovelluksen hintalaskuri
  • OpenAI / LLM API -hintalaskuri
  • MVP-hintalaskuri
  • Puhe-tekoälyasiamies-hintalaskuri

Yritys

  • Tietoja
  • Kumppanit
  • Ota yhteyttä
Juridiset asiatTietosuopolitiiikkaKäyttöehdotEvästekäytäntö
TECHSY
© 2026 Techsy. Kaikki oikeudet pidätetään.