İçeriğe geç

Frontier modellerde gerçek görev maliyeti

Güncellendi September 22, 2026 · ilk yayın September 22, 2026

Liste fiyatları bir tokenın ne kadara mal olduğunu söyler. Bitmiş bir görevin ne kadara mal olduğunu söylemezler; çünkü modeller aynı işi bitirmek için çok farklı sayıda token harcar. Bu sayfa, Claude Opus 5.5, Claude Opus 5, Claude Fable 5.1, GPT-6 Astra ve GPT-6 Sol için her efor seviyesinde ölçülen görev maliyetini ve bir kalite puanını yan yana koyar. Her rakamın bir kaynağı var ve hiçbiri tahmin değildir.

Kısa cevap: GPT-6 Sol, 47.5 puana kadar herhangi bir puana ulaşmanın en ucuz yoludur. 47.5 üzerinde Opus 5.5 her seviyede en ucuzdur. low dışındaki GPT-6 Astra, Opus 5 ya da Fable 5.1 hiçbir ayarıyla maliyet açısından verimli değildir: her biri, Sol ya da Opus 5.5'in bir ayarı tarafından hem puanda hem fiyatta geride bırakılır.

Yöntem

Tüm puanlar ve maliyetler, 22 Eylül 2026'da okunan Artificial Analysis Intelligence Index v4.3.2 kaynağından gelir. Index on değerlendirme çalıştırır: AA-Briefcase, GDPval-AA, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience ve AA-LCR. Artificial Analysis her modeli her efor ayarında sağlayıcı API'si üzerinden çalıştırır ve liste fiyatlarıyla ödediği tutarı kaydeder. Görev başına maliyet, bu harcamanın görev başına girdi ve çıktı olarak ayrılmış hâlidir. Her satır için aynı test seti çalışır, bu yüzden satırlar doğrudan karşılaştırılabilir.

Rakamları okumadan önce iki sınır var. Birincisi, index tek bir görev karışımıdır. Sizin karışımınız maliyetleri değiştirecektir; bu yüzden son bölüm kendi maliyetinizi nasıl ölçeceğinizi anlatır. İkincisi, farklı index sürümlerinden gelen puanlar karşılaştırılamaz; bu yüzden bu rakamları daha eski yayımlanmış sayılarla karıştırmayın.

Tam merdiven: 26 ayar

Görev başına çıktı tokenları, modelin yazdığı tokenlardır; akıl yürütme dahil. Artificial Analysis, dört orta GPT-6 Sol ayarı için girdi ve çıktı dağılımını yayımlamaz, bu yüzden o hücreler n/a yazar.

ModelEforIntelligence IndexGörev başına maliyetGirdi maliyetiÇıktı maliyetiGörev başına çıktı tokenıFrontier üzerinde
GPT-6 Solnone28.1$0.33$0.28$0.054,900Hayır
GPT-6 Sollow33.9$0.13n/an/a3,400Evet
GPT-6 Solmedium (varsayılan)39.8$0.25n/an/a6,500Evet
GPT-6 Solhigh42.8$0.37n/an/a10,200Evet
GPT-6 Solxhigh44.1$0.53n/an/a16,000Evet
GPT-6 Solmax47.5$1.06$0.74$0.3131,200Evet
GPT-6 Astralow45.8$0.82$0.60$0.224,400Evet
GPT-6 Astramedium49.6$1.54$1.06$0.489,600Hayır
GPT-6 Astrahigh50.9$1.73$1.13$0.5911,800Hayır
GPT-6 Astraxhigh52.4$2.31$1.46$0.8516,900Hayır
GPT-6 Astramax52.7$3.26$1.90$1.3627,200Hayır
Claude Opus 5low39.4$1.10$0.73$0.3714,700Hayır
Claude Opus 5medium44.8$2.19$1.47$0.7229,000Hayır
Claude Opus 5high (varsayılan)48.1$3.61$2.46$1.1646,200Hayır
Claude Opus 5xhigh49.7$4.88$3.36$1.5260,700Hayır
Claude Opus 5max50.8$5.86$4.05$1.8172,500Hayır
Claude Opus 5.5low42.3$0.55$0.35$0.2010,200Hayır
Claude Opus 5.5medium (varsayılan)51.2$1.34$0.82$0.5125,700Evet
Claude Opus 5.5high53.6$1.82$1.11$0.7135,600Evet
Claude Opus 5.5xhigh56.0$3.46$2.15$1.3165,700Evet
Claude Opus 5.5max57.6$5.98$3.60$2.38119,200Evet
Claude Fable 5.1low46.8$2.37$1.30$1.0821,600Hayır
Claude Fable 5.1medium48.9$2.98$1.59$1.3927,900Hayır
Claude Fable 5.1high51.2$3.91$2.01$1.9038,100Hayır
Claude Fable 5.1xhigh53.2$5.98$2.96$3.0260,500Hayır
Claude Fable 5.1max53.4$7.63$3.73$3.9078,100Hayır

Frontier üzerinde olmak, bu tablodaki hiçbir başka ayarın daha yüksek puanı daha az parayla vermediği anlamına gelir.

Maliyet frontier'ı

26 ayarın on tanesi frontier üzerindedir. Maliyete göre sıralandığında, yalnızca fiyata bakarak düşünmeye değer tek ayarlar bunlardır. Geri kalan her ayar, aynı puan için daha fazla öder ya da daha az puan için aynı parayı öder.

AyarIntelligence IndexGörev başına maliyetHer 10,000 görev için
GPT-6 Sol · low33.9$0.13$1,300
GPT-6 Sol · medium39.8$0.25$2,500
GPT-6 Sol · high42.8$0.37$3,700
GPT-6 Sol · xhigh44.1$0.53$5,300
GPT-6 Astra · low45.8$0.82$8,200
GPT-6 Sol · max47.5$1.06$10,600
Claude Opus 5.5 · medium51.2$1.34$13,400
Claude Opus 5.5 · high53.6$1.82$18,200
Claude Opus 5.5 · xhigh56.0$3.46$34,600
Claude Opus 5.5 · max57.6$5.98$59,800

Frontier'ın iki bölgesi var. 0.13 $ ile 1.06 $ arasında neredeyse tamamı GPT-6 Sol'dur; tek istisna 0.82 $ ile GPT-6 Astra low'dur. 1.34 $'dan yukarısı yalnızca Opus 5.5'tir. İki bölge arasındaki geçiş küçüktür: Opus 5.5 medium, Sol max'ten 3.7 puan fazla puan alır ve görev başına 0.28 $ fazla öder.

Eşit ya da daha iyi puanda birebir karşılaştırma

Bu çiftler, daha ucuz bir ayarı, aynı puanı ya da daha düşük puanı veren daha pahalı bir ayarla karşılaştırır.

Daha ucuz ayarDaha pahalı ayarPuan farkıTasarruf
Opus 5.5 medium: 51.2, $1.34Opus 5 high: 48.1, $3.61+3.1, Opus 5.5 lehine63%
Opus 5.5 medium: 51.2, $1.34Opus 5 max: 50.8, $5.86+0.4, Opus 5.5 lehine77%
Opus 5.5 medium: 51.2, $1.34Fable 5.1 high: 51.2, $3.91eşit66%
Opus 5.5 high: 53.6, $1.82GPT-6 Astra max: 52.7, $3.26+0.9, Opus 5.5 lehine44%
Opus 5.5 high: 53.6, $1.82Fable 5.1 max: 53.4, $7.63+0.2, Opus 5.5 lehine76%
GPT-6 Sol max: 47.5, $1.06Opus 5 high: 48.1, $3.61+0.6, Opus 5 lehine71%

Opus 5 satırı, henüz geçiş yapmamış ekipler için önemlidir. Opus 5 varsayılan olarak high efor ile çalışıyordu. Opus 5.5 varsayılan olarak medium ile çalışır ve bu varsayılanda 3.1 puan daha fazla puanı görev başına %63 daha az maliyetle verir. Anthropic, Opus 5.5'in Opus 5'ten 40% daha ucuz olduğunu söylüyor; bu index üzerinde ölçülen fark, iddia edilenden daha geniştir.

Para nereye gidiyor: çıktıya değil, girdiye

Tüm modellerde girdi, görev başına maliyetin yaklaşık yarısı ile dörtte üçü arasındadır. Opus 5.5 medium için 1.34 $'ın 0.82 $'ı girdidir, yani %61. GPT-6 Astra max için bu oran %58, GPT-6 Sol max için %70 ve Fable 5.1 max için %49'dur. Ajan görevleri, büyüyen bağlamlarını her adımda yeniden gönderir; bu yüzden girdi harcaması yalnızca cevabın uzunluğuyla değil, adım sayısıyla da büyür.

Bu yüzden GPT-6 Sol'un akıl yürütmesiz çalışması low'dan daha pahalıdır: 0.33 $'a karşı 0.13 $, üstelik yalnızca 4,900 çıktı tokenı yazmasına rağmen. 0.33 $'ın 0.28 $'ı girdidir. Muhtemel neden daha fazla adım ve her adımda yeniden gönderilen bağlamdır. Akıl yürütmeyi kapatmak, ajanın daha fazla tura ihtiyaç duyması durumunda onu ucuzlatmaz.

Faturanız için bu, önbelleğin model seçimi kadar önemli olduğu anlamına gelir. Opus 5.5 ve GPT-6 Sol, milyon önbelleğe alınmış girdi tokenı başına 0.20 $ alır. GPT-6 Astra 1.00 $, Opus 5 ise 0.50 $ alır.

Token hacmi ile liste fiyatı

GPT-6 Astra, buradaki en token verimli modeldir. Max efor ile görev başına 27,200 çıktı tokenı yazar; Opus 5.5 max ise 119,200 yazar. Ancak Astra milyonda 10 $ ve 50 $ alır; bu, Opus 5.5 fiyatının 2.5× katıdır. Liste fiyatı kazanır: Opus 5.5 high görev başına 1.82 $ tutar ve 53.6 puan alır, Astra max ise 3.26 $ tutar ve 52.7 puan alır.

Opus 5.5 max, verbosity'nin zarar verdiği tek yerdir. 119,200 çıktı tokenı, girdi eklenmeden önce 2.38 $ tutar ve tam görev 5.98 $'a mal olur. Bu, tablodaki en yüksek puanı, 57.6'yı satın alır; ama bu, medium'un 4.5× maliyetidir.

Efor ile azalan getiri

Her satır, efor bir seviye yükseldiğinde ne kazanıldığını gösterir: ek görev maliyetine karşılık index puanı.

Modelmedium → highxhigh → max
GPT-6 Sol+3.0 puan, +48%+3.4 puan, +100%
GPT-6 Astra+1.3 puan, +12%+0.3 puan, +41%
Claude Opus 5+3.3 puan, +65%+1.1 puan, +20%
Claude Opus 5.5+2.4 puan, +36%+1.6 puan, +73%
Claude Fable 5.1+2.3 puan, +31%+0.2 puan, +28%

Fable 5.1 ve GPT-6 Astra için max efor neredeyse hiçbir şey kazandırmaz: %28 ve %41 daha fazla maliyete karşılık 0.2 ve 0.3 puan. Opus 5.5 için max'e çıkmak yine 1.6 puan kazandırır, ama %73 daha fazla maliyetle. Max'i yalnızca ekstra puanın sonucu değiştirdiğini ölçtüğünüz görevlerde kullanın.

GPT-6 Sol max ne zaman yeterlidir

Index bir ortalamadır ve Sol max ile Opus 5.5 medium arasındaki fark tüm değerlendirmelerde eşit değildir. Artificial Analysis'in değerlendirme bazında puanları:

DeğerlendirmeOpus 5.5 medium (1.34 $)GPT-6 Sol max (1.06 $)
Terminal-Bench 4.052.543.9
AutomationBench-AA61.261.6
GDPval-AA (Elo)15761487
AA-Briefcase (Elo)16421483
Humanity's Last Exam54.747.9
SciCode59.357.6
CritPt27.730.9
AA-LCR84.383.7

AutomationBench ve CritPt'te GPT-6 Sol, görev başına 1.34 $ yerine 1.06 $ ödeyerek Opus 5.5 medium ile eşit ya da ondan iyidir. Terminal-Bench, bilgi işi değerlendirmeleri ve Humanity's Last Exam'de Opus 5.5 büyük farkla önde gider. İş akışı otomasyonu Sol'da çalışabilir. Terminal ve kod ajanları ile belge yoğun bilgi işi, Opus 5.5'in fiyatını hak ettiği yerlerdir.

Satıcı iddiaları ile bağımsız rakamlar

Satıcı rakamları ile bağımsız rakamlar sıklıkla farklılaşır, çünkü farklı test ortamları ve ayarlar kullanırlar. Anthropic, Opus 5.5 için xhigh'da Terminal-Bench 4.0'da %66.4 bildiriyor. Artificial Analysis aynı efor ile %59.6 ölçüyor.

EforOpus 5.5Fable 5.1
low31.3%40.4%
medium52.5%44.9%
high56.6%52.0%
xhigh59.6%55.1%
max59.6%52.0%

Sıralama index'e göre de değişebilir. Vals AI Index'te Fable 5.1 %68.83 ile birinci, GPT-6 Astra %66.61 ile üçüncü ve Opus 5.5 %66.16 ile dördüncüdür. Orada görev başına maliyet aynı temelde yayımlanmadığı için yukarıdaki frontier'ı değiştirmez. Bu, tek bir index'in tek bir bakış açısı olduğunu hatırlatır.

Liste fiyatları ve önbellek ağırlıklı bir görev

Digital Applied, her modelde önbellek ağırlıklı bir ajan görevinin fiyatını hesapladı: 8M önbellek okuma tokenı, 400K önbelleksiz girdi, 600K önbellek yazma tokenı ve 300K çıktı tokenı. Sonuç frontier'ı takip eder; yalnızca GPT-6 Astra için ek bir ceza vardır.

ModelGirdi $/MTokÇıktı $/MTokÖnbellek okuma $/MTokÖnbellek ağırlıklı görev (Digital Applied)
GPT-6 Sol$2.00$10.00$0.20$6.90
Claude Opus 5.5$4.00$20.00$0.20$12.20
Claude Opus 5$5.00$25.00$0.50$17.25
Claude Fable 5.1$10.00$50.00$0.25$28.50
GPT-6 Astra (≤272K)$10.00$50.00$1.00$34.50
GPT-6 Astra (>272K)$20.00$75.00n/a$61.50

GPT-6 Astra, girdi 272K tokeni geçtiğinde tüm isteği milyonda 20 $ ve 75 $ üzerinden faturalandırır. Opus 5.5, 1M tokenlık penceresi boyunca tek fiyat uygular. Opus 5.5'te önbelleğe yazma, 5 dakikalık önbellek için milyonda 5 $, 1 saatlik önbellek için 8 $ tutar; toplu işler %50 üzerinden faturalandırılır ve hızlı mod fiyatı ikiye katlar. Ayrıntılar için bkz. Claude Opus 5.5 maliyet modeli ve Opus 5.5 hızlı mod ekonomisi.

Kendi görev başına maliyetinizi nasıl ölçersiniz

  1. Tokenları istek başına değil, görev başına kaydedin: önbelleksiz girdi, önbellekli girdi, önbellek yazmaları ve çıktı; görevin her adımında toplanmış hâlde.
  2. Birkaç yüz gerçek görevden oluşan bir örneklem alın ve bunu iki ya da üç aday ayarda yeniden çalıştırın; örneğin Sol max, Opus 5.5 medium ve Opus 5.5 high.
  3. Her sonucu üretimde kullandığınız aynı kontrolle değerlendirin ve geçen görevleri sayın.
  4. Toplam harcamayı geçen görev sayısına bölün. Karşılaştırılacak sayı başarılı görev başına maliyettir, çünkü daha sık başarısız olan ucuz bir ayar ucuz değildir.
  5. Kalite çıtanızı geçen en ucuz ayarı seçin ve yalnızca başarısız olan görevleri daha yüksek bir ayara yönlendirin.
  6. Bir fiyat ya da varsayılan efor değiştiğinde yeniden çalıştırın.

Tek bir modelde efor ayarlarının faturayı nasıl değiştirdiğini görmek için bkz. Opus 5.5 efor seviyeleri gerçek fiyattır.

Çekinceler

Kaynaklar

İlgili


Bunu kendi altyapınıza uygulamak mı istiyorsunuz? Sağlayıcı faturalarını, ağ geçidi kayıtlarını ve ana iş akışlarını getirin; maliyet etkenlerini ve tasarruf yolunu çıkaralım. Ücretsiz denetim planlayın →

finopsllm.com'a dön