Frontier modellerde gerçek görev maliyeti
Güncellendi September 22, 2026 · ilk yayın September 22, 2026
Liste fiyatları bir tokenın ne kadara mal olduğunu söyler. Bitmiş bir görevin ne kadara mal olduğunu söylemezler; çünkü modeller aynı işi bitirmek için çok farklı sayıda token harcar. Bu sayfa, Claude Opus 5.5, Claude Opus 5, Claude Fable 5.1, GPT-6 Astra ve GPT-6 Sol için her efor seviyesinde ölçülen görev maliyetini ve bir kalite puanını yan yana koyar. Her rakamın bir kaynağı var ve hiçbiri tahmin değildir.
Kısa cevap: GPT-6 Sol, 47.5 puana kadar herhangi bir puana ulaşmanın en ucuz yoludur. 47.5 üzerinde Opus 5.5 her seviyede en ucuzdur. low dışındaki GPT-6 Astra, Opus 5 ya da Fable 5.1 hiçbir ayarıyla maliyet açısından verimli değildir: her biri, Sol ya da Opus 5.5'in bir ayarı tarafından hem puanda hem fiyatta geride bırakılır.
Yöntem
Tüm puanlar ve maliyetler, 22 Eylül 2026'da okunan Artificial Analysis Intelligence Index v4.3.2 kaynağından gelir. Index on değerlendirme çalıştırır: AA-Briefcase, GDPval-AA, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience ve AA-LCR. Artificial Analysis her modeli her efor ayarında sağlayıcı API'si üzerinden çalıştırır ve liste fiyatlarıyla ödediği tutarı kaydeder. Görev başına maliyet, bu harcamanın görev başına girdi ve çıktı olarak ayrılmış hâlidir. Her satır için aynı test seti çalışır, bu yüzden satırlar doğrudan karşılaştırılabilir.
Rakamları okumadan önce iki sınır var. Birincisi, index tek bir görev karışımıdır. Sizin karışımınız maliyetleri değiştirecektir; bu yüzden son bölüm kendi maliyetinizi nasıl ölçeceğinizi anlatır. İkincisi, farklı index sürümlerinden gelen puanlar karşılaştırılamaz; bu yüzden bu rakamları daha eski yayımlanmış sayılarla karıştırmayın.
Tam merdiven: 26 ayar
Görev başına çıktı tokenları, modelin yazdığı tokenlardır; akıl yürütme dahil. Artificial Analysis, dört orta GPT-6 Sol ayarı için girdi ve çıktı dağılımını yayımlamaz, bu yüzden o hücreler n/a yazar.
| Model | Efor | Intelligence Index | Görev başına maliyet | Girdi maliyeti | Çıktı maliyeti | Görev başına çıktı tokenı | Frontier üzerinde |
|---|---|---|---|---|---|---|---|
| GPT-6 Sol | none | 28.1 | $0.33 | $0.28 | $0.05 | 4,900 | Hayır |
| GPT-6 Sol | low | 33.9 | $0.13 | n/a | n/a | 3,400 | Evet |
| GPT-6 Sol | medium (varsayılan) | 39.8 | $0.25 | n/a | n/a | 6,500 | Evet |
| GPT-6 Sol | high | 42.8 | $0.37 | n/a | n/a | 10,200 | Evet |
| GPT-6 Sol | xhigh | 44.1 | $0.53 | n/a | n/a | 16,000 | Evet |
| GPT-6 Sol | max | 47.5 | $1.06 | $0.74 | $0.31 | 31,200 | Evet |
| GPT-6 Astra | low | 45.8 | $0.82 | $0.60 | $0.22 | 4,400 | Evet |
| GPT-6 Astra | medium | 49.6 | $1.54 | $1.06 | $0.48 | 9,600 | Hayır |
| GPT-6 Astra | high | 50.9 | $1.73 | $1.13 | $0.59 | 11,800 | Hayır |
| GPT-6 Astra | xhigh | 52.4 | $2.31 | $1.46 | $0.85 | 16,900 | Hayır |
| GPT-6 Astra | max | 52.7 | $3.26 | $1.90 | $1.36 | 27,200 | Hayır |
| Claude Opus 5 | low | 39.4 | $1.10 | $0.73 | $0.37 | 14,700 | Hayır |
| Claude Opus 5 | medium | 44.8 | $2.19 | $1.47 | $0.72 | 29,000 | Hayır |
| Claude Opus 5 | high (varsayılan) | 48.1 | $3.61 | $2.46 | $1.16 | 46,200 | Hayır |
| Claude Opus 5 | xhigh | 49.7 | $4.88 | $3.36 | $1.52 | 60,700 | Hayır |
| Claude Opus 5 | max | 50.8 | $5.86 | $4.05 | $1.81 | 72,500 | Hayır |
| Claude Opus 5.5 | low | 42.3 | $0.55 | $0.35 | $0.20 | 10,200 | Hayır |
| Claude Opus 5.5 | medium (varsayılan) | 51.2 | $1.34 | $0.82 | $0.51 | 25,700 | Evet |
| Claude Opus 5.5 | high | 53.6 | $1.82 | $1.11 | $0.71 | 35,600 | Evet |
| Claude Opus 5.5 | xhigh | 56.0 | $3.46 | $2.15 | $1.31 | 65,700 | Evet |
| Claude Opus 5.5 | max | 57.6 | $5.98 | $3.60 | $2.38 | 119,200 | Evet |
| Claude Fable 5.1 | low | 46.8 | $2.37 | $1.30 | $1.08 | 21,600 | Hayır |
| Claude Fable 5.1 | medium | 48.9 | $2.98 | $1.59 | $1.39 | 27,900 | Hayır |
| Claude Fable 5.1 | high | 51.2 | $3.91 | $2.01 | $1.90 | 38,100 | Hayır |
| Claude Fable 5.1 | xhigh | 53.2 | $5.98 | $2.96 | $3.02 | 60,500 | Hayır |
| Claude Fable 5.1 | max | 53.4 | $7.63 | $3.73 | $3.90 | 78,100 | Hayır |
Frontier üzerinde olmak, bu tablodaki hiçbir başka ayarın daha yüksek puanı daha az parayla vermediği anlamına gelir.
Maliyet frontier'ı
26 ayarın on tanesi frontier üzerindedir. Maliyete göre sıralandığında, yalnızca fiyata bakarak düşünmeye değer tek ayarlar bunlardır. Geri kalan her ayar, aynı puan için daha fazla öder ya da daha az puan için aynı parayı öder.
| Ayar | Intelligence Index | Görev başına maliyet | Her 10,000 görev için |
|---|---|---|---|
| GPT-6 Sol · low | 33.9 | $0.13 | $1,300 |
| GPT-6 Sol · medium | 39.8 | $0.25 | $2,500 |
| GPT-6 Sol · high | 42.8 | $0.37 | $3,700 |
| GPT-6 Sol · xhigh | 44.1 | $0.53 | $5,300 |
| GPT-6 Astra · low | 45.8 | $0.82 | $8,200 |
| GPT-6 Sol · max | 47.5 | $1.06 | $10,600 |
| Claude Opus 5.5 · medium | 51.2 | $1.34 | $13,400 |
| Claude Opus 5.5 · high | 53.6 | $1.82 | $18,200 |
| Claude Opus 5.5 · xhigh | 56.0 | $3.46 | $34,600 |
| Claude Opus 5.5 · max | 57.6 | $5.98 | $59,800 |
Frontier'ın iki bölgesi var. 0.13 $ ile 1.06 $ arasında neredeyse tamamı GPT-6 Sol'dur; tek istisna 0.82 $ ile GPT-6 Astra low'dur. 1.34 $'dan yukarısı yalnızca Opus 5.5'tir. İki bölge arasındaki geçiş küçüktür: Opus 5.5 medium, Sol max'ten 3.7 puan fazla puan alır ve görev başına 0.28 $ fazla öder.
Eşit ya da daha iyi puanda birebir karşılaştırma
Bu çiftler, daha ucuz bir ayarı, aynı puanı ya da daha düşük puanı veren daha pahalı bir ayarla karşılaştırır.
| Daha ucuz ayar | Daha pahalı ayar | Puan farkı | Tasarruf |
|---|---|---|---|
| Opus 5.5 medium: 51.2, $1.34 | Opus 5 high: 48.1, $3.61 | +3.1, Opus 5.5 lehine | 63% |
| Opus 5.5 medium: 51.2, $1.34 | Opus 5 max: 50.8, $5.86 | +0.4, Opus 5.5 lehine | 77% |
| Opus 5.5 medium: 51.2, $1.34 | Fable 5.1 high: 51.2, $3.91 | eşit | 66% |
| Opus 5.5 high: 53.6, $1.82 | GPT-6 Astra max: 52.7, $3.26 | +0.9, Opus 5.5 lehine | 44% |
| Opus 5.5 high: 53.6, $1.82 | Fable 5.1 max: 53.4, $7.63 | +0.2, Opus 5.5 lehine | 76% |
| GPT-6 Sol max: 47.5, $1.06 | Opus 5 high: 48.1, $3.61 | +0.6, Opus 5 lehine | 71% |
Opus 5 satırı, henüz geçiş yapmamış ekipler için önemlidir. Opus 5 varsayılan olarak high efor ile çalışıyordu. Opus 5.5 varsayılan olarak medium ile çalışır ve bu varsayılanda 3.1 puan daha fazla puanı görev başına %63 daha az maliyetle verir. Anthropic, Opus 5.5'in Opus 5'ten 40% daha ucuz olduğunu söylüyor; bu index üzerinde ölçülen fark, iddia edilenden daha geniştir.
Para nereye gidiyor: çıktıya değil, girdiye
Tüm modellerde girdi, görev başına maliyetin yaklaşık yarısı ile dörtte üçü arasındadır. Opus 5.5 medium için 1.34 $'ın 0.82 $'ı girdidir, yani %61. GPT-6 Astra max için bu oran %58, GPT-6 Sol max için %70 ve Fable 5.1 max için %49'dur. Ajan görevleri, büyüyen bağlamlarını her adımda yeniden gönderir; bu yüzden girdi harcaması yalnızca cevabın uzunluğuyla değil, adım sayısıyla da büyür.
Bu yüzden GPT-6 Sol'un akıl yürütmesiz çalışması low'dan daha pahalıdır: 0.33 $'a karşı 0.13 $, üstelik yalnızca 4,900 çıktı tokenı yazmasına rağmen. 0.33 $'ın 0.28 $'ı girdidir. Muhtemel neden daha fazla adım ve her adımda yeniden gönderilen bağlamdır. Akıl yürütmeyi kapatmak, ajanın daha fazla tura ihtiyaç duyması durumunda onu ucuzlatmaz.
Faturanız için bu, önbelleğin model seçimi kadar önemli olduğu anlamına gelir. Opus 5.5 ve GPT-6 Sol, milyon önbelleğe alınmış girdi tokenı başına 0.20 $ alır. GPT-6 Astra 1.00 $, Opus 5 ise 0.50 $ alır.
Token hacmi ile liste fiyatı
GPT-6 Astra, buradaki en token verimli modeldir. Max efor ile görev başına 27,200 çıktı tokenı yazar; Opus 5.5 max ise 119,200 yazar. Ancak Astra milyonda 10 $ ve 50 $ alır; bu, Opus 5.5 fiyatının 2.5× katıdır. Liste fiyatı kazanır: Opus 5.5 high görev başına 1.82 $ tutar ve 53.6 puan alır, Astra max ise 3.26 $ tutar ve 52.7 puan alır.
Opus 5.5 max, verbosity'nin zarar verdiği tek yerdir. 119,200 çıktı tokenı, girdi eklenmeden önce 2.38 $ tutar ve tam görev 5.98 $'a mal olur. Bu, tablodaki en yüksek puanı, 57.6'yı satın alır; ama bu, medium'un 4.5× maliyetidir.
Efor ile azalan getiri
Her satır, efor bir seviye yükseldiğinde ne kazanıldığını gösterir: ek görev maliyetine karşılık index puanı.
| Model | medium → high | xhigh → max |
|---|---|---|
| GPT-6 Sol | +3.0 puan, +48% | +3.4 puan, +100% |
| GPT-6 Astra | +1.3 puan, +12% | +0.3 puan, +41% |
| Claude Opus 5 | +3.3 puan, +65% | +1.1 puan, +20% |
| Claude Opus 5.5 | +2.4 puan, +36% | +1.6 puan, +73% |
| Claude Fable 5.1 | +2.3 puan, +31% | +0.2 puan, +28% |
Fable 5.1 ve GPT-6 Astra için max efor neredeyse hiçbir şey kazandırmaz: %28 ve %41 daha fazla maliyete karşılık 0.2 ve 0.3 puan. Opus 5.5 için max'e çıkmak yine 1.6 puan kazandırır, ama %73 daha fazla maliyetle. Max'i yalnızca ekstra puanın sonucu değiştirdiğini ölçtüğünüz görevlerde kullanın.
GPT-6 Sol max ne zaman yeterlidir
Index bir ortalamadır ve Sol max ile Opus 5.5 medium arasındaki fark tüm değerlendirmelerde eşit değildir. Artificial Analysis'in değerlendirme bazında puanları:
| Değerlendirme | Opus 5.5 medium (1.34 $) | GPT-6 Sol max (1.06 $) |
|---|---|---|
| Terminal-Bench 4.0 | 52.5 | 43.9 |
| AutomationBench-AA | 61.2 | 61.6 |
| GDPval-AA (Elo) | 1576 | 1487 |
| AA-Briefcase (Elo) | 1642 | 1483 |
| Humanity's Last Exam | 54.7 | 47.9 |
| SciCode | 59.3 | 57.6 |
| CritPt | 27.7 | 30.9 |
| AA-LCR | 84.3 | 83.7 |
AutomationBench ve CritPt'te GPT-6 Sol, görev başına 1.34 $ yerine 1.06 $ ödeyerek Opus 5.5 medium ile eşit ya da ondan iyidir. Terminal-Bench, bilgi işi değerlendirmeleri ve Humanity's Last Exam'de Opus 5.5 büyük farkla önde gider. İş akışı otomasyonu Sol'da çalışabilir. Terminal ve kod ajanları ile belge yoğun bilgi işi, Opus 5.5'in fiyatını hak ettiği yerlerdir.
Satıcı iddiaları ile bağımsız rakamlar
Satıcı rakamları ile bağımsız rakamlar sıklıkla farklılaşır, çünkü farklı test ortamları ve ayarlar kullanırlar. Anthropic, Opus 5.5 için xhigh'da Terminal-Bench 4.0'da %66.4 bildiriyor. Artificial Analysis aynı efor ile %59.6 ölçüyor.
| Efor | Opus 5.5 | Fable 5.1 |
|---|---|---|
| low | 31.3% | 40.4% |
| medium | 52.5% | 44.9% |
| high | 56.6% | 52.0% |
| xhigh | 59.6% | 55.1% |
| max | 59.6% | 52.0% |
Sıralama index'e göre de değişebilir. Vals AI Index'te Fable 5.1 %68.83 ile birinci, GPT-6 Astra %66.61 ile üçüncü ve Opus 5.5 %66.16 ile dördüncüdür. Orada görev başına maliyet aynı temelde yayımlanmadığı için yukarıdaki frontier'ı değiştirmez. Bu, tek bir index'in tek bir bakış açısı olduğunu hatırlatır.
Liste fiyatları ve önbellek ağırlıklı bir görev
Digital Applied, her modelde önbellek ağırlıklı bir ajan görevinin fiyatını hesapladı: 8M önbellek okuma tokenı, 400K önbelleksiz girdi, 600K önbellek yazma tokenı ve 300K çıktı tokenı. Sonuç frontier'ı takip eder; yalnızca GPT-6 Astra için ek bir ceza vardır.
| Model | Girdi $/MTok | Çıktı $/MTok | Önbellek okuma $/MTok | Önbellek ağırlıklı görev (Digital Applied) |
|---|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | $0.20 | $6.90 |
| Claude Opus 5.5 | $4.00 | $20.00 | $0.20 | $12.20 |
| Claude Opus 5 | $5.00 | $25.00 | $0.50 | $17.25 |
| Claude Fable 5.1 | $10.00 | $50.00 | $0.25 | $28.50 |
| GPT-6 Astra (≤272K) | $10.00 | $50.00 | $1.00 | $34.50 |
| GPT-6 Astra (>272K) | $20.00 | $75.00 | n/a | $61.50 |
GPT-6 Astra, girdi 272K tokeni geçtiğinde tüm isteği milyonda 20 $ ve 75 $ üzerinden faturalandırır. Opus 5.5, 1M tokenlık penceresi boyunca tek fiyat uygular. Opus 5.5'te önbelleğe yazma, 5 dakikalık önbellek için milyonda 5 $, 1 saatlik önbellek için 8 $ tutar; toplu işler %50 üzerinden faturalandırılır ve hızlı mod fiyatı ikiye katlar. Ayrıntılar için bkz. Claude Opus 5.5 maliyet modeli ve Opus 5.5 hızlı mod ekonomisi.
Kendi görev başına maliyetinizi nasıl ölçersiniz
- Tokenları istek başına değil, görev başına kaydedin: önbelleksiz girdi, önbellekli girdi, önbellek yazmaları ve çıktı; görevin her adımında toplanmış hâlde.
- Birkaç yüz gerçek görevden oluşan bir örneklem alın ve bunu iki ya da üç aday ayarda yeniden çalıştırın; örneğin Sol max, Opus 5.5 medium ve Opus 5.5 high.
- Her sonucu üretimde kullandığınız aynı kontrolle değerlendirin ve geçen görevleri sayın.
- Toplam harcamayı geçen görev sayısına bölün. Karşılaştırılacak sayı başarılı görev başına maliyettir, çünkü daha sık başarısız olan ucuz bir ayar ucuz değildir.
- Kalite çıtanızı geçen en ucuz ayarı seçin ve yalnızca başarısız olan görevleri daha yüksek bir ayara yönlendirin.
- Bir fiyat ya da varsayılan efor değiştiğinde yeniden çalıştırın.
Tek bir modelde efor ayarlarının faturayı nasıl değiştirdiğini görmek için bkz. Opus 5.5 efor seviyeleri gerçek fiyattır.
Çekinceler
- Tüm maliyetler, Artificial Analysis görev karışımı üzerinde liste API fiyatlarıyla hesaplanmıştır. İndirimler, toplu fiyatlandırma ve kendi önbelleğiniz bunları değiştirir.
- Artificial Analysis, Opus 5.5 ve Fable 5.1 girdilerini Default Fallback olarak etiketler. Her satırı aynı API yapılandırması gibi ele almadan önce yöntem notlarını kontrol edin.
- Puanlar yalnızca index v4.3.2 sürümüne aittir. Önceki sürümler farklı değerlendirmeler kullandı ve karşılaştırılamaz.
- Digital Applied'ın önbellek ağırlıklı görevi, bir ölçüm değil, örnekleyici bir iş yüküdür.
- Sağlayıcılar fiyat ya da varsayılanları değiştirdiğinde rakamlar değişir. Okuma tarihi 22 Eylül 2026'dır.
Kaynaklar
- Artificial Analysis Intelligence Index
- Artificial Analysis: Claude Opus 5.5
- Artificial Analysis: Claude Opus 5
- Artificial Analysis: Claude Fable 5.1
- Artificial Analysis: GPT-6 Astra
- Artificial Analysis: GPT-6 Sol
- Digital Applied: GPT-6 Sol vs Claude Opus 5.5 cost benchmarks
- Digital Applied: Claude Opus 5.5 vs GPT-6 Astra
- Digital Applied: Is Claude Fable 5.1 still worth it?
- Digital Applied: Claude Opus 5.5 launch pricing and benchmarks
- Digital Applied: Opus 5.5 vs Grok 4.7 vs Muse Spark 1.3 cost per task
İlgili
Bunu kendi altyapınıza uygulamak mı istiyorsunuz? Sağlayıcı faturalarını, ağ geçidi kayıtlarını ve ana iş akışlarını getirin; maliyet etkenlerini ve tasarruf yolunu çıkaralım. Ücretsiz denetim planlayın →