Claude Fable 5.1 maliyet modeli
Güncellendi September 1, 2026 · ilk yayın September 1, 2026
Claude Fable 5.1 (claude-fable-5-1) milyon giriş tokenı başına $10, milyon çıkış tokenı başına $50 fiyatla sunulur. Opus 5 için bu rakamlar $5 ve $25'tir. Yalnızca bu dört rakama bakarsanız Fable sabit bir 2× prim gibi görünür. Ama bu yanlış bir modeldir. Önbellekli giriş oranı ters yönde hareket eder ve üretim iş yüklerinde tokenların çoğu genellikle önbellekte yer alır.
Önemli olan dört oran
Bir modelin tek bir fiyatı yoktur. Fable 5.1 beş farklı token türünü faturalandırır ve bunların yalnızca ikisi ana fiyatta görünür.
| Token türü | Fable 5.1 | Opus 5 |
|---|---|---|
| Giriş (önbelleksiz) | $10.00 / MTok | $5.00 / MTok |
| Çıkış | $50.00 / MTok | $25.00 / MTok |
| Önbellek yazma (5 dakika) | $12.50 / MTok | $6.25 / MTok |
| Önbellek yazma (1 saat) | $20.00 / MTok | $10.00 / MTok |
| Önbellek okuma | $0.25 / MTok | $0.50 / MTok |
Önbellek okuma istisnadır. Fable'ın kendi liste giriş fiyatının 2.5%'si kadardır ve aynı önbellekli tokenın Opus 5'te maliyetinin yarısıdır. Diğer her satır 2×; yalnızca bu satır 0.5×.
Gerçek bir iş yükünü nasıl etkiler
Bir oturum boyunca yeniden kullanılan, 100.000 tokenlık bir sistem istemi, araç şeması ve alınmış bağlamı olan bir ajanı düşünün. Soğuk bir çağrıda bu önek Fable'da $1.00, Opus 5'te $0.50 tutar. Sıcak bir çağrıda Fable'da $0.025, Opus 5'te $0.05 tutar. Aynı istemde iki kat pahalı olan sağlayıcı artık yarı fiyatta kalır, çünkü değişen tek şey önekin önbellekten gelip gelmediğidir.
Dolayısıyla başa baş noktası bir model tercihi değil, bir önbellek isabet oranıdır. Giriş tokenlarının yaklaşık %50'sinden azı önbellekten sunulduğunda Fable'ın giriş primi baskındır ve önek başına Opus 5 daha ucuzdur. Bu eşiğin üzerinde Fable'ın önbellekli oranı öne geçer ve fark açılmaya devam eder. Çıkış tokenları her iki durumda da 2× kalır; bu yüzden ikinci kaldıraç model seçimi değil, çıkış uzunluğudur.
Çıkış tarafı sınırsızdır
Fable 5.1, 1M tokenlık bir bağlam penceresini kabul eder ve tek bir yanıtta 128K'ya kadar çıkış tokenı üretebilir. Milyon başına $50 fiyatla tek bir 128K yanıt $6.40 çıkış maliyeti demektir. Genişletilmiş düşünme bu modelde her zaman açıktır — kapatmanın bir yolu yoktur ve eski budget_tokens denetimi 400 hatasıyla reddedilir. Bunun yerine low'dan max'e kadar bir effort ayarı vardır. Bu artık bir maliyet kadranıdır ve model seçimi yanında yönlendirme politikanıza girmelidir; kimsenin yeniden bakmadığı uygulama varsayılanlarında değil.
Ham akıl yürütme hiçbir zaman döndürülmez, bu yüzden telemetriniz düşünme maliyetini yanıt metninden yeniden oluşturamaz. Bunu her çağrıdaki usage bloğundan okuyup saklamalısınız. Bu modelde Priority Tier de yoktur, dolayısıyla gecikme satın alınamaz; kapasite planlaması sizin tarafınızda eşzamanlılık ve kuyruklama ile yapılmalıdır.
Trafiği yönlendirmeden önce neyi ölçmelisiniz
Fable 5.1'in sizin için ucuz mu pahalı mı olduğuna üç alan karar verir ve hiçbiri fiyat listesinde görünmez.
- Özellik başına önbellek isabet oranı. Hesap düzeyinde bir ortalama değil; %90'da çalışan bir sohbet yüzeyi ile %0'da çalışan bir toplu iş birbirini götürüp anlamsız bir %45'e indirger.
- Önbellek yazma yükseltmesi. 1 saatlik bir yazma, liste girişinin 2× maliyetindedir. Okunduğundan daha sık yeniden yazılan bir önek, hangi TTL olursa olsun net zarardır.
- Başarılı görev başına çıkış tokenı. 2× çıkış primi, yalnızca daha az deneme gerektiğinde haklı çıkar. Çağrı başına değil, başarılı görev başına maliyeti ölçün.
Ardından karşılaştırmayı mevcut modelinize karşı bir sapma köprüsü olarak çalıştırın; oranı, hacmi ve karışımı ayırarak. Liste fiyatının iki katı ama önbellek fiyatının yarısı olan bir model, iki büyük ve birbirini dengeleyen hareket olarak görünür; bir ortalama ikisini de gizler.
İlgili
İlgili
Bunu kendi altyapınıza uygulamak mı istiyorsunuz? Sağlayıcı faturalarını, ağ geçidi kayıtlarını ve ana iş akışlarını getirin; maliyet etkenlerini ve tasarruf yolunu çıkaralım. Ücretsiz denetim planlayın →