ai-machine-learning

Codex'te GPT-5.6 Sol Ultra: Subagent Modu Gerçekte Ne Yapıyor (ve Ne Kadara Mal Oluyor)

Yazan Mert Batur
Güncellendi Jul 6, 2026
15 okuma
Codex'te GPT-5.6 Sol Ultra: Subagent Modu Gerçekte Ne Yapıyor (ve Ne Kadara Mal Oluyor)

Codex'te GPT-5.6 Sol Ultra: Subagent Modu Gerçekte Ne Yapıyor (ve Ne Kadara Mal Oluyor)

Temmuz 2026 itibarıyla GPT-5.6 Sol Ultra, hükümet onaylı yaklaşık 20 ortaktan oluşan küçük bir grup için kapalı önizlemede ve OpenAI API'si ile Codex üzerinden erişilebiliyor. Henüz geniş erişime açılmadı. OpenAI genel kullanıma açılış tarihi paylaşmadı ve her yerde alıntılanan %91,9 Terminal-Bench skoru, OpenAI'nin kendi önizleme sayfasında yer almıyor.

26.06.2026'da OpenAI, GPT-5.6 Sol ailesini önizlemeye açtı ve günler sonra Thibault Sottiaux, Codex kullanıcılarına en zorlu istemlerini Sol Ultra katmanı için "saklamalarını" söyledi. O tek teaser, bir benchmark ekran görüntüsü dalgası başlattı. Bunların çoğu OpenAI'nin hiç yayınlamadığı bir sayıyı tekrarlıyor. O yüzden Codex iş akışınızı GPT-5.6 Sol Ultra etrafında kurmadan önce, gerçekte doğrulanan neyin ne olduğuna, subagent modunun nasıl çalıştığına ve Ultra'yı açmanın gerçekten değip değmediğine karar veren token matematiğine bakalım.

Önemli çıkarımlar:

  • Sol Ultra, GPT-5.6'nın en yüksek çaba katmanı: bir görev sırasında birbiriyle konuşan iş birlikçi subagent'lar.
  • Hükümet onaylı ~20 ortak için API ve Codex üzerinden kapalı önizlemede, henüz geniş erişimde değil (Temmuz 2026 itibarıyla).
  • Basın Terminal-Bench 2.1'de %91,9 bildiriyor, ama OpenAI bu rakamı yayınlamadı; bu yüzden doğrulanmamış kabul edin.
  • Sol, 1M token için 5$ girdi / 30$ çıktı fiyatlandırmasıyla çalışıyor; subagent'lar çağrı sayısını çarpıyor, dolayısıyla Ultra tek agent'lı bir çalıştırmanın birkaç katına mal olabilir.

Codex'te GPT-5.6 Sol Ultra: Gerçekte Doğrulanan Ne?

İşte net ayrım. Doğrulanan: OpenAI, Sol ailesini (Sol, Terra, Luna) 26.06.2026'da önizlemeye açtı, Sol Ultra en yüksek akıl yürütme katmanı ve Codex için teaser olarak duyuruldu. Doğrulanmayan: %91,9 Terminal-Bench 2.1 skoru ve herhangi bir genel kullanıma açılış tarihi. Gördüğünüz her şeyin gerisi haberdir, birinci taraf veri değil.

Bu ayrım önemli, çünkü bu lansman hızlı ve gevşek ilerledi. OpenAI'nin önizleme sayfası, katmanları ve güvenlik kontrollerini niteliksel terimlerle anlatıyor. X'te ve rehberlerde dolaşan göz alıcı benchmark tablosu, OpenAI'nin kendi sayfasından değil, ikincil haberlerden geliyor. Lansman öncesi aşamada lansman öncesi söylentileri değerlendirmiştik, işte gerçekte piyasaya çıkanla spekülasyon olarak kalan arasındaki fark. Aynı disiplin şimdi de geçerli.

Yani Ultra'nın Codex döngünüzde yer alıp almayacağına karar vermeye çalışan bir geliştiriciyseniz, hype sayılarını bir kenara bırakın. Doğrulanan gerçekler (mekanizma, fiyatlandırma, önizleme durumu) maliyet ve uyumu değerlendirmek için yeterli. Doğrulanmayanlar (kesin skor, lansman tarihi) henüz hiçbir kararı yönlendirmemeli. Kaynaklar: OpenAI'nin Previewing GPT-5.6 Sol sayfası ve 9to5Mac'in lansman haberi.

Sol Ultra Nedir? İş Birlikçi Subagent'lar vs Pro'nun Paralel Agent'ları

Sol Ultra, GPT-5.6'nın en yüksek akıl yürütme katmanı ve tanımlayıcı özelliği iş birlikçi subagent'lar: bir koordinatör görevinizi parçalara bölüyor, her parçayı bir subagent'a veriyor ve bu subagent'lar iş devam ederken birbirlerine mesaj gönderiyor. Bu görev-içi iletişim tam olarak konunun özü ve Ultra'yı altındaki her katmandan ayıran şey de bu.

Bunu küçük bir mühendislik ekibi ile bir grup serbest çalışan arasındaki fark gibi düşünün. GPT-5.5 Pro'nun paralel agent'ları, üç ayrı bilet verdiğiniz serbest çalışanlar gibi çalışır. Her biri kendi işine gider, kendi parçasını izole şekilde yapar ve sonucu masanıza bırakır. Kimse konuşmaz. Sol Ultra'nın subagent'ları ise tek bir odadaki bir ekip gibi çalışır: biri veritabanı şemasının değiştiğini fark eder, diğerlerine söyler ve işi bitirmeden önce ayarlarını buna göre yaparlar. Bu koordinasyon, OpenAI'nin bunu hızlı düzenlemeler yerine uzun, zor, çok adımlı görevler için konumlandırmasının nedeni.

Pro'nun agent'ları ayrı şeritlerde çalışırken, Sol Ultra'nın subagent'ları görev henüz sürerken birbirine not geçiyor.

Bölünmüş diyagram: solda Sol Ultra'nın iş birlikçi subagent'ları, sağda GPT-5.5 Pro'nun bağımsız paralel agent'ları
Sol Ultra'nın iş birlikçi subagent'ları görev sırasında iletişim kurar; Pro'nun paralel agent'ları izole, bağımsız şeritlerde çalışır.

Mekanizmanın kendisi doğrulanmış durumda; OpenAI tarafından tanımlanmış ve DataCamp ile deeplearning.ai'nin haberlerinde de tekrarlanmış. Asıl mesele, ve buna geleceğiz, oluşturduğunuz her subagent'ın token yakan başka bir model çağrısı olması. Koordinasyon bedava değil.

"Maksimum Akıl Yürütme Çabası" Nedir ve Ne Zaman Açmalısınız?

"Maksimum akıl yürütme çabası", GPT-5.6'nın düşükten yükseğe ve Sol Ultra'nın kullandığı maksimum ayara kadar uzanan çaba merdiveninin en üst basamağı. Daha yüksek çaba, modelin cevap vermeden önce daha fazla işlem gücü harcaması demek; bu genelde zor problemlerde yardımcı oluyor, kolay problemlerde ise para çöpe gidiyor. Bu, açık bırakılan bir düğme değil, ayarlanan bir kadran.

Bir satranç oyuncusunu düşünün. Düşük çabada içgüdüyle hızlı hamle yapar, bu bariz alışlarda sorun değildir. Maksimum çabada oturup on hamle ilerisini hesaplar; bu, zor bir oyun sonu için tam istediğiniz şey ama bir kapıyı açmak için tamamen anlamsız. Akıl yürütme çabası aynı şekilde çalışır. İşlem gücü (ve fatura) modele düşünmesini söylediğiniz zorluk düzeyiyle ölçeklenir.

Peki ne zaman değer? Uzun ufuklu, çok dosyalı agentic işler için maksimum çabayı açın: yirmi dosyaya dokunan bir migration, çirkin bir refactor, üç servise yayılan bir bug. Bu, daha derin akıl yürütmenin gerçekten sonucu değiştirdiği uzun ufuklu agentic kodlama alanı. Bir değişkeni yeniden adlandırmak, tek bir test yazmak veya bir yazım hatasını düzeltmek için kapalı tutun, çünkü sıfır fayda için premium token ödersiniz.

Maksimum akıl yürütme çabası, sadece görev yeterince zor olduğunda ve yanlış bir ilk deneme size ekstra tokenlerden daha fazlaya mal olacaksa maliyetini karşılar.

Dürüst kural: görevin neden zor olduğunu net şekilde ifade edemiyorsanız, büyük olasılıkla maksimum çabaya ihtiyacınız yok.

Terminal-Bench 2.1 Sayıları: %91,9 Gerçekten Doğrulandı mı?

Hayır. %91,9 rakamı ikincil basın tarafından bildiriliyor, OpenAI'nin kendi önizleme sayfasında görünmüyor, önizleme kapalı ve hiçbir değerlendirme metodolojisi açıklanmadı. Yani bu bağımsız olarak doğrulanmamış. Kontrol edemediğiniz bir basın iddiası olarak ele alın, kesinleşmiş bir sonuç değil.

İşte tam durum. OpenAI'ye yakın haber kaynakları (DataCamp, AI Weekly, deeplearning.ai) Sol Ultra'yı Terminal-Bench 2.1'de %91,9'a koyuyor. Ama önizleme ~20 ortakla sınırlı olduğundan ve OpenAI ne rakamı ne de test koşullarını yayınladığından, o çevrenin dışındaki kimse bunu tekrar üretemez. Şunu da not edin: Claude Mythos 5 rakamı kim bildirdiğine göre değişiyor; bazı kaynaklar %84,3, bazıları %88,0 diyor. Bir karşılaştırma tablosunun kendi sayıları kaynaklar arasında çelişiyorsa, bu sizin için gevşek tutma sinyalidir.

ModelTerminal-Bench 2.1 (bildirilen, bağımsız olarak doğrulanmamış)
Sol Ultra%91,9
Sol (temel)%88,8
GPT-5.5%88,0
Claude Mythos 5%84,3-88,0 (kaynağa göre değişir)
Gemini 3.1 Pro Preview%70,7

Herkesin alıntıladığı %91,9, OpenAI'nin kendi önizleme sayfasında görünmüyor; bu yüzden bir basın iddiası olarak ele alın, kesinleşmiş bir sonuç değil.

Bunların hiçbiri Sol Ultra'nın zayıf olduğu anlamına gelmiyor. OpenAI gerçek metodolojiyi yayınladığında tabloda en üste bile çıkabilir. Sadece doğrulayamadığınız bir sayıya dayanarak üretim trafiğinizi yönlendirmemeniz gerektiği anlamına geliyor. Kaynaklar: DataCamp'in GPT-5.6 Sol rehberi, deeplearning.ai'nin The Batch'i ve AI Weekly.

Codex'te Sol Ultra + Maksimum Akıl Yürütme Çabası Nasıl Kullanılır

Sol Ultra'nın kendisi kapalı, yani kuruluşunuz önizlemede değilse açamazsınız. Ama üzerinde bulunduğu çaba merdiveni, elinizdeki modellerle Codex CLI'da bugün zaten çalışıyor. İşte ayarın nasıl çalıştığı ve erişiminiz olduğunda Ultra'nın nereye oturduğu.

  1. Ayarı bulun. Akıl yürütme çabası, ~/.codex/config.toml yapılandırma dosyanızda veya çalıştırma başına bir bayrak olarak bulunur. Bir menüde gizli değil; tek bir anahtar.
  2. Modeli ve çabayı ayarlayın. Codex'i model dizinize yönlendirin ve çaba seviyesini belirleyin. Bugün düşükten yükseğe ayarlayabilirsiniz; "maksimum" basamak ve Sol Ultra subagent katmanı, kuruluşunuz önizlemeye girdiğinde açılır.
  3. Görev bazında geçersiz kılın. Yapılandırmanızı düzenlemeden tek bir zor çalıştırma için çabayı yükseltmek için -c bayrağını kullanın.
  4. Seçici şekilde açın. Maksimum çabayı yukarıdaki bölümde geçen uzun, çok dosyalı görevler için ayırın. Varsayılanınızı orta veya yüksekte bırakın.
toml
# ~/.codex/config.toml
model = "gpt-5.6-sol"
model_reasoning_effort = "high"   # minimal | low | medium | high (bugün mevcut)

# "max" çaba + Sol Ultra iş birlikçi subagent katmanı
# kuruluşunuz kapalı önizlemeye girdiğinde etkinleştirin:
# model = "gpt-5.6-sol-ultra"
# model_reasoning_effort = "max"

# çalıştırma başına geçersiz kılma, yapılandırma düzenlemeye gerek yok:
# codex -c model_reasoning_effort="high" "refactor the auth module"

Pratik ipucu: proje varsayılanınızı max değil high yapın. Sonra sadece ihtiyacı olan çalıştırmada maksimuma geçin. Bu tek alışkanlık, temel faturanızı akıllıca tutar ve pahalı katmanı gerçekten karşılığını verecek görevlere ayırır. Erişilebilirlik detayları OpenAI'nin Help Center önizleme makalesinde.

Ultra Gerçekte Neye Mal Olur: Subagent Token Çarpanı

Kimsenin modellemediği kısım şu: Ultra iş birlikçi subagent'lar oluşturduğundan, bir görev tek çağrı yerine birden fazla model çağrısı tetikliyor ve her çağrı token faturalandırıyor. Sol'un doğrulanmış fiyatlandırması 1M girdi tokeni için 5$, önbelleklenmiş için 0,50$ ve 1M çıktı tokeni için 30$. Çıktı taraf pahalı olan ve Ultra çok daha fazlasını üretiyor.

Gerçek bir örnek üzerinden gidelim. Temel Sol'da, tek agent'la, orta düzeyde karmaşık bir agentic görev alalım:

ModelBileşenTokenOran / 1MMaliyet
Sol (temel)Girdi40.0005$0,20$
Sol (temel)Çıktı15.00030$0,45$
Sol (temel)Toplam0,65$

Şimdi aynı görevi bir koordinatör ve üç iş birlikçi subagent'la Ultra'da çalıştıralım. Paylaşılan bağlam ucuza 0,50$'dan önbelleklenir, ama her subagent kendi çıktısını 30$'dan üretmeye devam eder:

ModelBileşenTokenOran / 1MMaliyet
Sol Ultra (modellenmiş)Koordinatör girdisi40.0005$0,20$
Sol Ultra (modellenmiş)Subagent girdisi, önbellekli90.0000,50$0,045$
Sol Ultra (modellenmiş)Subagent girdisi, taze30.0005$0,15$
Sol Ultra (modellenmiş)Koordinatör + agent-arası çıktı20.00030$0,60$
Sol Ultra (modellenmiş)Subagent çıktısı (3 x 15K)45.00030$1,35$
Sol Ultra (modellenmiş)Toplam~2,35$

Bu, aynı görev için temel Sol maliyetinin kabaca 3,6 katı ve kaç subagent oluştuğuna ve ne kadar bağlamın önbelleklendiğine bağlı olarak 2 kat ile 4 kat arasında herhangi bir yerde görebilirsiniz. Bu çarpan, ölçülmüş bir Ultra benchmark'ı değil, yayınlanmış fiyatlandırmadan yaptığımız modellenmiş tahminimiz; ama fiyatlandırma ve mekanizma ikisi de doğrulanmış olduğundan, şeklin kendisi gerçek.

Ultra'nın gizli maliyeti token başına oran değil; tek bir görevin sessizce dört model çağrısına dönüşmesi.

Bunu yumuşatan iki şey var: paylaşılan bağlam üzerinde prompt önbellekleme (o 0,50$'lık önbellekli oran) ve Ultra fiyatlarını sadece gerçekten ihtiyacı olan görevlerde ödemenizi sağlayan disiplinli yönlendirme. Faturayı gerçekten kontrol etmek istiyorsanız, LLM API maliyetlerinizi kontrol altında tutma rehberimiz, müşteri hatlarımızda kullandığımız yönlendirme desenlerini kapsıyor. Fiyatlandırma, DataCamp ve deeplearning.ai'den, Haziran-Temmuz 2026 tarihli.

Şu Anda Kullanabilir misiniz? Sınırlı Önizleme, ~20 Ortak ve Zaman Çizelgesi

Hükümet onaylı yaklaşık 20 güvenilir ortaktan biri değilseniz, hayır. Sol Ultra, OpenAI API'si ve Codex üzerinden erişilebilen, genel çıkıştan önce bir hükümet güvenlik incelemesinin ardında tutulan kapalı bir önizlemede. OpenAI daha geniş erişimin "gelecek haftalarda" olacağını söyledi, başka bir ayrıntı vermedi.

Dolaşan bir "7 Temmuz" tarihi görmüş olabilirsiniz. Görmezden gelin. OpenAI hiçbir lansman tarihi vermedi; bu yüzden herhangi bir kesin günü, plan yapılacak bir gerçek değil, doğrulanmamış dedikodu olarak ele alın. Doğrulanan şey "gelecek haftalar" çerçevesi ve Cerebras'ın Temmuz'da başlayarak Sol'u saniyede 750 tokene kadar sunacak olması (deeplearning.ai'ye göre).

Peki ortak değilseniz ne yaparsınız? Şimdiden hazırlanın. Codex yapılandırmanızı ve çaba merdiveninizi bugün elinizdeki modellerle ayarlayın; Ultra açıldığında yapacağınız tek değişiklik model dizisini değiştirmek olsun. Karar kutusu: Güvenilir bir ortak mısınız? Değilseniz, çaba-seviyesi yönlendirmenizi bugün kurun ve tek satırla geçiş yapmaya hazır olun. Kaynaklar: OpenAI Help Center ve deeplearning.ai.

Sol Ultra vs Sol vs GPT-5.5 vs Claude Mythos 5: Hangisine Yönelmelisiniz?

Göreve göre yönlenin, liderlik tablosuna göre değil, özellikle de tablo sayıları doğrulanmamışken. Günlük agentic kodlamanın çoğu için temel Sol'a yönelin, gerçekten zor uzun ufuklu görevler için Sol Ultra'yı saklayın, zaten yığınınıza kablolanmışsa GPT-5.5'i elinizde tutun ve iş akışınız için zaten Claude'un en güncel modeline güveniyorsanız Claude Mythos 5'i düşünün.

İşte pratik çerçeve:

  • Temel Sol'a yönelin görev normal-zor olduğunda: bir özellik, sınırlı bir refactor, bir test paketi. Bildirilen %88,8 skoru taşıyor ve Ultra'nın bir kesrine mal oluyor.
  • Sol Ultra'ya yönelin görev uzun olduğunda, çok dosyaya yayıldığında ve yanlış bir ilk denemenin gerçek zaman kaybettireceği durumlarda. İş birlikçi subagent'lar, varsa, karşılığını burada verir.
  • GPT-5.5'e yönelin zaten entegre edilmişse ve Sol'a geçişin farkı bir migration'ı haklı çıkarmıyorsa.
  • Claude Mythos 5'e yönelin ekibinizin mevcut araçları onu tercih ediyorsa. Bildirilen skoru kaynağa göre değişiyor (%84,3'ten %88,0'a), o yüzden sadece sayıya bakarak geçiş yapmayın.

Araçlar arasında daha derin model yönlendirme dengeleri için, kodlama-agent karşılaştırmamız her birinin nereye uyduğunu ayrıntılandırıyor. Kısa versiyon: görevinizin zorluk çubuğunu geçen en ucuz katmanı seçin.

Geliştiriciler Reddit'te Gerçekte Ne Diyor

Benchmark'lar bir şey. İnsanların kendi terminallerinde bildirdiği şey ise başka bir şey; şu anda r/codex başlıkları elimizdeki en dürüst sinyal. Genel havaya bakışımız: temkinli hayranlık, derin şüphecilik ve büyük ölçüde fiyat üzerine tartışma.

Erken elden geçirme övgüleri spesifik. 335 upvote'lu bir r/codex başlığında, isteklerinin 5.6'ya yönlendirildiğini fark eden bir geliştirici bunun "iki kat daha hızlı" hissettirdiğini ve isteklerini "tek atışta çözdüğünü", 5.5 ile birkaç tur alan kenar durumlarını bile "önceden" düzelttiğini söyledi. Karşılaştırması sert oturdu: "Claude'da kısa süreliğine Fable 5'i denediğimdeki hisse tam olarak benziyor, ama çok daha hızlı." İç erişimi olduğunu iddia eden bir yorumcu, "maksimum akıl yürütme seviyesinde görevleri" çalıştırmanın "5.5'in aldığından çok daha az zaman aldığını" ekledi.

Sonra kıdemliler devreye giriyor. En yüksek sesli karşı akım, bal ayı sonra kısıtlama diyebileceğimiz sinizm: "Bu hep böyle oluyor ve kısıtlanmadan önce yaklaşık 2 hafta sürüyor" diye yazdı biri. Bir diğeri daha net oldu: "Sadece 2 hafta sıkı çalıştır, çünkü sadece 2 hafta Einstein olacak." Birkaçı zamanlamanın kendisini işaret etti; parlak 5.6 gönderilerinin, 5.5'in düşüşüne dair şikayetlerin tam zirveye çıktığı anda ortaya çıktığını fark ettiler. Dikkat çekici bir şekilde, o başlıktaki en çok oy alan yanıtlar hiç analiz değildi; şakalardı ("ben zaten gpt 6 kullanıyorum"), bu da geliştiricilerin versiyon-hype döngüsünden ne kadar bıktığını çok şey anlatıyor.

Sol Ultra Codex duyuru başlığında, konuşma neredeyse tamamen maliyete döndü, doğrudan Claude'a nişan alarak. Geliştiriciler OpenAI'nin 200$'lık Codex katmanını Anthropic'in Fable promosyonuna karşı tartıyor ve birçoğu Claude Max 20x'i iptal ettiklerini söyledi, çoğunlukla Fable'ın "kredileri iki kat daha hızlı yakması" nedeniyle. Tekrarlanan umut: "Claude Fable'a gerçek rekabet. Bizim gibi kullanıcılar için daha iyi." Tekrarlanan korku, bizim de paylaştığımız bir korku: "OpenAI'nin bir şeyleri duyurup sonra daha yüksek katmanların ardına gizlemesiyle önceden yandım, o yüzden yerel olarak çalıştığını görünce inanacağım."

Techsy olarak görüşümüz: hız raporları, daha yüksek verimli bir sunum altyapısının teslim etmesi gerekenle örtüşüyor, bu yüzden onlara inanıyoruz. Tek atışta çözme iddialarını umut verici ama ölçek düzeyinde henüz kanıtlanmamış olarak ele alıyoruz, çünkü "iki hafta sonra kalınlaştı" deseni gerçek ve geçmiş lansmanlarda gerçekleştiğini izledik. Ve maliyet şüpheciliği tam olarak yerinde. Sol Ultra CLI'nizde durana, tam bir fatura döngüsü boyunca stabil çalışana kadar heyecanı bir önizleme olarak ele alın, bir hüküm olarak değil.

Codex Agentic Görevleri Çalıştırırken Ne Gördük

Dürüst olalım: Sol Ultra'yı çalıştıramıyoruz. ~20 ortakla sınırlı ve biz onlardan biri değiliz, o yüzden ölçmediğimiz token sayılarını veya skorları alıntılamayacağız. Yapabileceğimiz en dürüst ikinci en iyi şey bu. Mevcut katmanımızda Codex CLI üzerinden agentic görevler çalıştırdık ve OpenAI'nin yayınlanmış 5$/30$ fiyatlandırmasından tam subagent maliyet matematiğini çıkardık.

Çaba merdiveni, test ettiğimiz katmanda tam beklendiği gibi davranıyor. Düşük ve orta çabada, Codex hızlı dönüyor ve genelde sınırlı düzenlemeleri doğru yapıyor. Zor, çok dosyalı bir görevi düşük çabada zorlarsanız, erken duruyor veya dosyalar arası bir bağımlılığı kaçırıyor; aynı görev yüksek çabada belirgin şekilde daha uzun düşünüyor ve değişikliğin daha büyük bir kısmını bir seferde tamamlıyor. Bu saat-süresi-karşı-kalite dengesi, maksimum basamağın var olmasının tüm nedeni.

Yukarıdaki maliyet modellemesi (kabaca 3,6 katlık örnek), arkasında durabileceğimiz gerçek ilk el analizi: doğrulanmış fiyatlandırma ve doğrulanmış subagent mekanizması üzerine aritmetik, bir model olarak etiketlenmiş, bir ölçüm olarak değil. Müşteri agentic hatlarında model katmanlarını maliyete göre zaten yönlendiriyoruz ve bu, Ultra'yı herkes için açmadan önce çalıştıracağımız tam hesaplama.

Önemli olan tek yapılandırma değişikliği, daha önce gösterilen config.toml'daki model_reasoning_effort satırı: proje varsayılanımızı high'da tutuyor ve çalıştırma başına max'a geçiyoruz, yukarıdaki pratik ipucunun tam olarak anlattığı gibi. Ultra önizlemenin ötesine açıldığında, bu kurulum sadece model dizisini değiştirmemiz gerektiği anlamına gelir ve yukarıdaki maliyet matematiği, açmadan önce zaten çalıştıracağımız hesaplamadır. Gerçek erişimimiz olduğu anda bu bölümü ölçülmüş Ultra sayılarıyla güncelleyeceğiz, öncesinde değil.

Yazar Hakkında

Mert Batur, Techsy.io'nun Kurucu Ortağı; ekip B2B müşteriler için AI agent'ları, otomasyon sistemleri ve ses/SDR hatları geliştiriyor. Techsy ekibinin üretimde gerçekten kullandığı LLM araç yığını hakkında yazıyor. LinkedIn üzerinden bağlantı kurabilirsiniz.

Kurucu Ortak, Techsy.io.

Sıkça Sorulan Sorular

GPT-5.6 Sol Ultra nedir?

Sol Ultra, GPT-5.6'nın en yüksek akıl yürütme çabalı katmanı. Tanımlayıcı özelliği iş birlikçi subagent'lar: bir koordinatör görevi böler ve subagent'lar çalışırken birbirlerine mesaj gönderir. OpenAI bunu hızlı düzenlemeler yerine uzun, zor, çok adımlı agentic görevler için konumlandırıyor ve 26.06.2026'da Sol ailesinin bir parçası olarak önizlemeye açtı.

Sol Ultra şu anda Codex'te kullanılabilir mi?

Çoğu kişi için hayır. Temmuz 2026 itibarıyla Sol Ultra, OpenAI API'si ve Codex üzerinden erişilebilen, bir güvenlik incelemesinin ardında yaklaşık 20 güvenilir, hükümet onaylı ortakla sınırlı kapalı bir önizlemede. OpenAI daha geniş erişimin "gelecek haftalarda" olacağını söylüyor ama kesin bir tarih yayınlamadı, yani bugün basitçe açamazsınız.

Sol Ultra'da iş birlikçi subagent'lar nasıl çalışır?

Bir koordinatör görevinizi parçalara böler ve her birini bir subagent'a atar. Bağımsız paralel agent'lardan farklı olarak, bu subagent'lar görev sırasında iletişim kurar; öğrendiklerini paylaşırlar, böylece diğerleri bitirmeden önce ayar yapabilir. Bu koordinasyon, karmaşık, çok dosyalı işlerde yardımcı olur, ama her subagent kendi tokenlerini tüketen ayrı bir model çağrısıdır.

GPT-5.6'da "maksimum akıl yürütme çabası" nedir?

Maksimum akıl yürütme çabası, GPT-5.6'nın düşük, orta, yüksek, sonra maksimum şeklinde giden çaba merdiveninin en üst basamağıdır. Daha yüksek çaba, modelin cevap vermeden önce daha fazla işlem gücü harcaması demek. Zor, uzun ufuklu görevlerde yardımcı olur, basit olanlarda para kaybettirir; o yüzden bunu sadece bir görev gerçekten zor olduğunda açtığınız bir kadran olarak ele alın.

Sol Ultra'yı çalıştırmak ne kadara mal olur?

Temel Sol, 1M girdi tokeni için 5$, önbelleklenmiş için 0,50$ ve 1M çıktı için 30$ olarak fiyatlandırılmış (DataCamp ve deeplearning.ai'den, 2026 yılı ortası tarihli). Ultra iş birlikçi subagent'lar oluşturuyor, yani bir görev birden fazla model çağrısı tetikliyor. Modellenmiş örneğimiz, tek bir görevin temel Sol çalıştırmasının kabaca 2 ile 4 katına mal olduğunu, bunun da büyük ölçüde ekstra çıktı tokenlerinden kaynaklandığını gösteriyor.

Sol Ultra gerçekten Claude Mythos 5'ten daha iyi mi?

Bildirilen sayılara göre Sol Ultra (%91,9), Terminal-Bench 2.1'de Claude Mythos 5'in önünde, ama bu doğrulanmamış. OpenAI rakamı yayınlamadı, önizleme kapalı ve Mythos 5'in kendi bildirilen skoru kaynağa göre %84,3'ten %88,0'a değişiyor. Yani dürüst cevap: henüz bilmiyoruz ve üretim trafiğinizi bunun üzerine yönlendirmemelisiniz.

Sol Ultra ne zaman genel kullanıma açılacak?

OpenAI, ChatGPT, Codex ve API üzerinden Sol ailesine daha geniş erişimin "gelecek haftalarda" olacağını söyledi, ama genel kullanıma açılış tarihi yayınlamadı. İnternette dolaşan herhangi bir kesin tarih (7 Temmuz dahil) resmi bir duyuru değil, doğrulanmamış dedikodudur. Doğrulanmış zaman çizelgesi için OpenAI'nin kendi önizleme sayfasını takip edin.

%91,9 Terminal-Bench 2.1 skoru doğrulanmış mı?

Hayır. %91,9 rakamı ikincil basından geliyor, OpenAI'nin kendi önizleme sayfasından değil. Önizleme ~20 ortakla sınırlı ve hiçbir değerlendirme metodolojisi açıklanmadı; bu yüzden o çevrenin dışındaki kimse bunu tekrar üretemez. İleride doğru çıkabilir, ama şu anda bu doğrulanmamış bir basın iddiası, kesinleşmiş bir benchmark sonucu değil.

Sol Ultra, GPT-5.5 Pro'nun paralel agent'larından nasıl farklı?

Pro'nun paralel agent'ları ayrı şeritlerde bağımsız çalışır: her biri kendi parçasını izole şekilde yapar ve bir sonuç döndürür, iletişim olmadan. Sol Ultra'nın subagent'ları iş birliği yapar, öğrendiklerine göre ayar yapabilmeleri için görev sırasında birbirlerine mesaj geçer. Bu koordinasyon daha zor çok adımlı işlere uygun, ama çağrılar arasında token kullanımını da çarpıyor.

Sol Ultra'ya mı ihtiyacım var, yoksa temel Sol yeterli mi?

Çoğu agentic kodlama için temel Sol veya yüksek akıl yürütme çabası fazlasıyla yeterli ve çok daha ucuz. Ultra'yı, yanlış bir ilk denemenin ekstra tokenlerden daha fazla zamana mal olacağı uzun, çok dosyalı görevler için saklayın. Bir görevin neden zor olduğunu net şekilde açıklayamıyorsanız, Ultra'ya ihtiyacınız yok. Liderlik tablosuna göre değil, zorluğa göre yönlenin.

Geliştiriciler Reddit'te GPT-5.6 Sol hakkında ne söylüyor?

Erken r/codex raporları hız konusunda ("iki kat daha hızlı") ve isteklerin tek atışta çözülmesi konusunda pozitif; birçok geliştirici bu hissi Claude'un Fable 5'ine benzetiyor. Ama kıdemliler, lansman sonrası modellerin kötüleştiği bir "bal ayı sonra kısıtlama" deseninden uyarıyor ve tartışmanın büyük kısmı ham yetenek yerine maliyet ile Anthropic'in planları etrafında dönüyor.

Etiketler

Codex'te GPT-5.6 Sol Ultra, Sol Ultra Codex, maksimum akıl yürütme çabası, subagent'larTerminal-Bench 2.1

Bu makaleyi paylaş

Projenize Başlayın

Harika bir şey inşa etmeye hazır mısınız?

Vizyonunuzu hayata geçirelim. Fark yaratan yazılımlar için ekibimiz hazır.