
GPT-6 Astra vs Claude Opus 5.5 vs Grok 4.7: fatura, GDPval ve altı çağrılık ölçer
GPT-6 Astra, Claude Opus 5.5 ve Grok 4.7, 22 Eylül 2026'da saat 22:34 UTC'de OpenRouter'da çağrılabiliyordu. Altı puanlanmış çağrı, iki görev, her birinde tek deneme. Hepsi geçti. Gateway faturası $0.01626.
Lansman grafikleri aynı hizaya gelmiyor.
Anthropic'in tablosunda Astra var, Grok yok. xAI'nin tablosunda Fable 5.1 ve Sol var. Astra bir Elo grafiğinde de duruyor. Bu sayfa ortak dayanakları tutuyor. Cetveller ayrılınca duruyor.
Opus 5.5 ile Opus 5 arasındaki fiyat kesimi Opus 5.5 yazısında kalıyor. 4.7'nin 4.6'ya yükseltmesi Grok 4.7 yazısında kalıyor. Astra'nın Fable karşısındaki hesabı GPT-6 Astra yazısında kalıyor.
Üç kart: prompt boyutu GPT-6 Astra'yı ve Grok'u yeniden fiyatlıyor
Astra'nın token fiyatı girdi ve çıktıda Opus 5.5'in 2,5 katı, cache okumada 5 katı. Grok'un xAI kartı, prompt 200.000 token'ı geçene kadar, girdide Opus 5.5'in yarısı ve çıktıda 0,3 katı.
Opus 5.5 kat olarak 1,0. Milyon başına $4, $20 ve $0.20.
Astra'nın model kartı $10, $50 ve $1.00. Grok'un 21 Eylül kartı, 200.000 prompt token'ının altında $2, $6 ve $0.50.
| Uçurumun altı, 1 milyon token başına | Opus 5.5 | GPT-6 Astra | Grok 4.7, xAI kartı |
|---|---|---|---|
| Girdi | $4 | $10 | $2 |
| Çıktı | $20 | $50 | $6 |
| Cache okuma | $0.20 | $1.00 | $0.50 |
| Bağlam | 1.000.000 | 1.050.000 | 500.000 |
| Uçurum | bu kartta yok | 272.000 prompt token'ı: girdi ve cache 2 kat, çıktı 1,5 kat | 200.000 prompt token'ı: isteğin tamamı $4 / $12 / $1 |

OpenRouter, 22:34 UTC'de Opus'ta ve Astra'da laboratuvar kartıyla aynı fiyatı gösteriyordu. Grok'ta göstermiyordu.
Liste $1.60, $4.80 ve $0.40 idi. 200.000 prompt token'ında $3.20, $9.60 ve $0.80 oluyordu. Bu, xAI kartının 0,8 katı. Bizim usage.cost rakamlarımız o kataloğu kullanıyor. Grok 4.7 yazısı xAI'nin kendi kartını hâlâ $2 ve $6 diye fiyatlıyor.
500.000 token'lık bir cache yeniden okuması, düz çarpım: Opus $0.10, Astra $0.25, Grok'un xAI cache satırı $0.25. Astra'nın pahalı olduğu yer çıktı değil, cache. Çıktıda Grok'un $6'sı, Astra'nın $50'sine karşı 8,3 kat, Opus'un $20'sine karşı 3,3 kat açık.
Altı puanlanmış çağrı ve her modelin döndürdüğü fatura
Altısı da geçti. İki çağrının faturası Grok'ta $0.0038784, Opus 5.5'te $0.005292, Astra'da $0.00709 tuttu.
Invoice cevabı 1.96 olmak zorundaydı. merge_intervals, temas eden aralıklar dahil, gizli testleri geçmek zorundaydı.
Cache'lenen token sayısı Opus ve Astra'da 0'dı. Grok iki çağrıda da 1.152 cache'lenmiş token bildirdi. Bu sayı, 1.310'lık ve 1.336'lık prompt sayımlarının içindeydi. 298 invoice token'ının 295'i reasoning token'ıydı.
# 22 Sep 2026, 22:34 UTC, OpenRouter, one trial, max_tokens 1800
MODELS = [
"anthropic/claude-opus-5.5",
"openai/gpt-6-astra",
"x-ai/grok-4.7",
]| Görev | Opus 5.5 | GPT-6 Astra | Grok 4.7 |
|---|---|---|---|
| Invoice, 1.96 olmak zorunda | geçti, $0.001336, 46 çıktı, 4,277 sn | geçti, $0.00263, 38 çıktı, 2,116 sn | geçti, $0.002144, 298 çıktı, 5,292 sn |
| merge_intervals | geçti, $0.003956, 168 çıktı, 3,307 sn | geçti, $0.00446, 69 çıktı, 2,588 sn | geçti, $0.0017344, 204 çıktı, 4,217 sn |
| İki görev toplamı | $0.005292 | $0.00709 | $0.0038784 |

Astra en az token'ı yazdı, en büyük faturayı kesti.
38 ve 69 completion token. Opus 46 ve 168 yazdı. $10/$50 kartı, az token'dan gelen tasarrufu yedi. O iki usage.cost rakamı $10 ve $50 ile tam tutuyor. Opus $4 ve $20 ile tutuyor.
Grok invoice görevini kaybetti, fonksiyonu kazandı. 204 token, $4.80 üzerinden $0.0017344 tuttu.
Astra iki görevde de en hızlıydı: 2,116 sn ve 2,588 sn. Tek deneme bir hız sıralaması değil.
4 Eylül'deki Astra yazısı, openai/gpt-6-astra için HTTP 400 demişti. O gün 14:40 UTC'de doğruydu. Bu koşu için değil. Model id'si çözüldü, çağrı 1.96 döndü, testler geçti.
GDPval, iki laboratuvarın paylaştığı satır
Opus 5.5 o paylaşılan satırda 1.846 ile önde. Grok 4.7 xhigh 1.695. Astra max 1.542.
Fable 5.1, 1.735 ile dayanak. Dördüncü aday değil.
Anthropic 1.735, Astra için 1.542 ve Opus 5.5 için 1.846 basıyor. xAI aynı 1.735 ve 1.542'yi basıyor, Grok 4.7 xhigh için 1.695. İki sayı kopya. Çubuklar bu yüzden aynı ekseni paylaşıyor.

| Hücre | Skor | Kim bastı |
|---|---|---|
| Claude Opus 5.5 | 1.846 | Anthropic, 22 Eylül 2026, GDPval-AA v2.1 |
| Grok 4.7 xhigh | 1.695 | xAI lansman grafiği, 21 Eylül 2026, GDPval |
| GPT-6 Astra max | 1.542 | Her iki grafik |
| Fable 5.1 max, yalnız dayanak | 1.735 | Her iki grafik |
Opus, Grok'un 151 Elo ve Astra'nın 304 Elo önünde. Grok, Astra'nın 153 Elo önünde, Fable dayağının 40 Elo gerisinde. Bunun hiçbiri bizim ölçümümüz değil. Altı çağrımız 1.96'lık bir invoice ile bir merge fonksiyonuydu. Ofis işini puanlamıyorlar.
Artificial Analysis, Opus 5.5'i max effort'ta Intelligence Index'te 58'e koydu. Görev başı maliyetin Opus 5 ile aynı kaldığını söyledi, çünkü çıktı token'ları yaklaşık 1,6 kat artmış. Grok 4.7 notu aynı indekste bu modeli 46'ya koyuyor. Cetvel başka. Yön aynı: Opus, Grok'un önünde. Token faturasını yok saymak için gerekçe değil.
Terminal-Bench ve CursorBench tek cetvel değil
Anthropic'in %66,4'ü ile xAI'nin %38,0'ını ortalamaya kalkma. Aynı Terminal-Bench hücresi değiller.
- Anthropic, Opus 5.5 xhigh'da, Astra OpenAI'nin bildirdiği gibi high'da: Terminal-Bench 4.0, Opus 5.5 için %66,4, Astra için %57,9. Fable 5.1 o sayfada %55,8. CursorBench 4.0, Opus 5.5 için %57,8, Fable için %51,8. Astra'nın CursorBench hücresi boş.
- xAI skor tablosu: Terminal-Bench 4.0, Grok 4.7 xhigh için %38,0, Fable 5.1 Max için %57,9. CursorBench, Grok için %46,3, Fable için %51,8. Astra o tabloda yok. Fable'ın CursorBench hücresi %51,8 ve Anthropic ile tutuyor. Terminal-Bench hücresi tutmuyor: orada %57,9, Anthropic sayfasında %55,8.
- Artificial Analysis, üçüncü kurulum: Opus 5.5 Terminal-Bench 4.0'da %59,6, xhigh'daki Astra ile aynı seviyede. Grok'un o laboratuvarın ajan koşusundaki hareketi %18'den %33'e. %38,0 değil.
CursorBench kendi yanına konabilir, çünkü %51,8 iki kez çıkıyor. Opus 5.5, Anthropic'in daha yüksek effort rakamında %57,8 ile Fable'ın 6,0 puan önünde. Grok %46,3 ile o Fable hücresinin 5,5 puan gerisinde. Astra'nın hücresi yok. Yüzdenin yanına laboratuvarın adını yaz. Yoksa sıralama kolaj olur.
EEBench, Harvey ve HealthBench xAI satırları. Opus 5.5 ve Astra yok. Grok yazısında kalıyorlar. AutomationBench ve Terminal-Bench-Science, Anthropic ile OpenAI satırları. Grok yok. Opus ve Astra yazılarında kalıyorlar.
Mevcut üç yazı hangi hesabı tutuyor
Bu sayfa, bağladığı üç yazının yerine geçmiyor. Üç modeli birbirine karşı sıralıyor. O kadar.
- Opus 5.5 yazısı $4/$20 kesimini, $0.02719 ölçeri, beş saatlik limiti ve siber görevlerde Opus 4.8'e düşüşü tutuyor. Kapak Anthropic grafiği olarak kalıyor. Astra sütunları bu sayfada okunuyor.
- Grok 4.7 yazısı 4.7'yi 4.6'ya karşı tutuyor: on iki çağrı, 12/12 ve $2/$6 uçurumu. 1.695 çubuğu onların. Opus 5.5 değil.
- Astra yazısı, Astra'yı Fable 5.1 karşısında tutuyor. 4 Eylül HTTP 400'ü ve %99,9 ile %62,7 ayrımı da orada. Çağrılabilirlik 22 Eylül'de değişti. Fable kararı değişmedi.
GPT-6 Astra, Opus 5.5, Grok 4.7: hangisini sabitlemelisin
Çıktı faturası kararın kendisiyse ve iş 500.000 token'a sığıyorsa Grok 4.7'yi sabitle. Paylaşılan GDPval satırı kararın kendisiyse Opus 5.5'i sabitle. Öbür iki yazının belgelediği bir bilgisayar kullanımı ya da matematik işini ölçtüysen ve $10/$50 ödeyebiliyorsan Astra'yı sabitle.
- Bu altı çağrı gibi kısa, cache'lenmemiş çağrılar: Grok toplamda en ucuzdu. $0.0038784, karşısında $0.005292 ve $0.00709. Invoice görevinde pahalı olan oydu, çünkü reasoning 295 token'a çıktı. Kısa çağrıların
merge_intervalsgibi duruyorsa kopyalayacağın satır fonksiyon satırı. Tek satırlık bir sayıya benziyorlarsa Opus 46 token harcadı ve o satırı kazandı. - 200.000 prompt token'ının altında, cache'i ağır ajanlar: Opus, milyon cache'lenmiş token başına $0.20 ile ikisini de geçiyor. Astra'nın $1.00 satırı bunun 5 katı. Grok'un xAI cache satırı $0.50, Opus'un 2,5 katı.
- 200.000 token'ı geçen prompt'lar: Grok isteğin tamamını yeniden fiyatlıyor. xAI kartında 250.000 token'lık bir prompt $4 ve $12 tutuyor, $2 ve $6 değil. Astra'nın uçurumu daha geç, 272.000'de başlıyor. Eşiğin altındaki token'lar Astra'da eski tarifede kalır. Grok belgelerinde bu koruma yok.
- GDPval'e bırakmaya razı olduğun ofis işi: Opus 1.846, sonra Grok 1.695, sonra Astra 1.542. Fable'ın 1.735'i Opus ile Grok'un arasında duruyor. Sıra laboratuvarların sırası. Altı çağrıdan çıkan bir skor değil.
- Terminal işini bu sıralamaya alma. Yayına aldığın runner hangi laboratuvarınsa, o laboratuvarın sayısını kullan. %66,4 ile %38,0'ı karıştırmak hangi binary'yi çağıracağını söylemez.
Sık sorulan sorular
GPT-6 Astra'yı OpenRouter'da şimdi çağırabiliyor musun?
Evet, 22 Eylül 2026 saat 22:34 UTC itibarıyla. openai/gpt-6-astra invoice görevinde 1.96 döndürdü. Yazdığı merge_intervals gizli testleri geçti. 4 Eylül'de aynı id HTTP 400 döndürmüştü. Önceki yazı o 400'ü kaydediyor. Bu yazı çalışan çağrıyı kaydediyor. Listedeki bağlam 1.050.000 token idi.
xAI, Grok 4.7'yi $2 ve $6'dan indirdi mi?
Bu sayfanın dayandığı lansman kartında hayır. xAI tablosu, 200.000 prompt token'ının altında hâlâ $2 ve $6. Sonrası $4 ve $12. Bu koşudaki OpenRouter kataloğu $1.60 ve $4.80, sonra $3.20 ve $9.60 idi. Bu, o satırların 0,8 katı. Altı çağrının faturası OpenRouter rakamını kullanıyor. xAI'ye doğrudan ödediğin fatura ise, xAI kartı değişene kadar o kartı izliyor.
Grok, Anthropic'in kıyas grafiğinde neden yok?
Anthropic'in 22 Eylül grafiği Opus 5.5'i Fable 5.1, Opus 5, GPT-6 Astra ve GPT-5.6 Sol ile kıyaslıyor. Grok sütun değil. xAI grafiği Grok 4.7'yi Grok 4.6, Sol ve Fable ile kıyaslıyor. Opus 5.5 sütun değil. Örtüşen satır GDPval. İki sayfa da Fable'ı 1.735, Astra'yı 1.542 basıyor.
Altı çağrılık ölçer Opus 5.5'in daha zeki olduğunu mu söylüyor?
Hayır. Üç model de iki görevi geçti. Ölçer bir fatura ve bir token sayımı. GDPval laboratuvar skoru. Bu üçlüde Opus 5.5'i 1.846 ile birinciye koyuyor. Karşısında 1.695 ve 1.542 var. Geçen bir merge fonksiyonu 1.846'yı doğrulamaz. 1.846 da $0.005292 faturasını öngörmez.
Hangi modelin bağlam penceresi daha kısa?
Grok 4.7. OpenRouter listesinde 500.000 token. Opus 5.5 1.000.000. Astra 1.050.000. Grok 200.000 prompt token'ında da yeniden fiyatlıyor, o yüzden ucuz pencere 500.000'den dar. Astra'nın yüksek tarifesi 272.000'de başlıyor. Çizginin üstündeki token'lara uygulanıyor. Çıktıya ayrıca 1,5 kat biniyor.