Claude Haiku 5.5 ve 100k token fiyat eşiği
Güncellendi October 8, 2026 · ilk yayın October 8, 2026
Claude Haiku 5.5'in öne çıkan fiyatı prompt uzunluğuna bağlıdır. Anthropic modeli October 7, 2026 tarihinde yayımladı; sınıflandırma, özetler ve alt ajan görevleri gibi yüksek hacimli işler için. 1 milyon tokenlık bağlam penceresi, bu tokenların hepsinin kısa prompt tarifesinden ücretlendirileceği anlamına gelmez: 100,000 tokenın üzerindeki bir prompt daha yüksek bir fiyat katmanı kullanır. Bu da istek boyutunu bir bütçe kararına dönüştürür; özellikle belge ve araç sonuçlarını biriktiren ajanlar için.
Fiyat tablosunun iki yüzü var
Aşağıdakiler, Anthropic'in yayımladığı Claude API standart fiyatları; milyon token başına ABD doları cinsinden, October 8 itibarıyla kontrol edildi. Sınır, 100,000 prompt tokenına kadar ile 100,000 üzeri arasındadır; yalnızca eşiği aşan tokenlara uygulanan bir fiyat değildir. Tahminde kullanmadan önce güncel fiyatlandırma belgelerini kontrol edin.
| Token kategorisi | Prompt 100k'ya kadar | Prompt 100k üzeri |
|---|---|---|
| Önbelleğe alınmamış girdi | $0.10 | $0.50 |
| Çıktı | $0.50 | $2.50 |
| 5 dakikalık önbellek yazımı | $0.125 | $0.625 |
| 1 saatlik önbellek yazımı | $0.20 | $1.00 |
| Önbellek okuma | $0.01 | $0.05 |
Listelenen her token fiyatı, sınırın üzerinde beş kat daha yüksektir. Bu, her uygulama faturasının beş kat artacağı anlamına gelmez: çoğu çağrı kısa kalabilir; çıktı hacmi, önbellekleme, araçlar, toplu işleme, yeniden denemeler ve görev başarısı toplam harcamayı etkiler. Önbelleğe alınmış bağlam yine prompt'u kaplar; önbellek isabeti, 120k tokenlık bir isteği kısa prompta çevirmez.
Sınır tek bir istekte nasıl görünür
Önbellek ve ayrıca faturalanan araç olmadan, her biri 1,000 çıktı tokenı üreten iki örnek çağrıya bakın. 99,000 tokenlık bir prompt, kısa prompt tarifeleriyle girdi artı çıktı için yaklaşık $0.0104 tutar. 101,000 tokenlık bir prompt ise uzun prompt tarifeleriyle yaklaşık $0.0530 tutar. Yalnızca 2,000 girdi tokenı daha uzun olan bir istek için yaklaşık beş kat fazla. Örnek, fiyat sınırını izole etmek için çıktıyı sabit tutar; ölçülmüş bir üretim tasarrufu değildir. Gerçek promptlar ayrıca sistem talimatlarını, konuşma geçmişini, araç şemalarını ve araç sonuçlarını da içerir.
Geçişten önce yeniden sayın
Anthropic'in geçiş notları, aynı metnin Haiku 4.5'e göre Haiku 5.5'te yaklaşık %30 daha fazla token ürettiğini, içeriğe göre değiştiğini söylüyor. Eski token sayılarıyla 100k'nın rahatça altında görünen bir prompt, yeni sınırı aşabilir. Her eski sayıyı 1.3 ile çarpıp bunu fatura tahmini olarak kullanmayın; temsili istekleri claude-haiku-5-5 ile yeniden sayın.
Anthropic'in token sayma uç noktası, üretim isteği gönderilmeden önce yapılandırılmış mesajı, sistem promptunu ve desteklenen istemci araçlarını kabul eder. Hedef modelle sayın, ardından yanıttan sonra gerçek kullanımı kaydedin. Ön sayım bir tahmindir ve faturalanan girdiden hafifçe farklı olabilir; sayaç bazı sunucu araçlarını ve URL/dosya bloklarını desteklemez. Bu yollarda gözlenen istek kullanımına güvenin ve eşiğin yakınında bir güvenlik payı bırakın.
Alt ajanlar için bir prompt bütçe kuralı
- Dağılımı ölçün. Haiku 5.5 prompt token sayılarını iş yüküne, model kimliğine ve görev sonucuna göre kaydedin. Yalnızca ortalamaya bakmak yerine, kaç çağrının 100k civarında ya da üzerinde yoğunlaştığını izleyin.
- Sınırdan önce uyarın. Ajan orkestratöründe eşiğe yakın istekleri işaretleyin. Uyarı seviyesini Anthropic'in bir fiyat kuralı değil, kendi operasyonel payınız olarak görün.
- Nedeni kısaltın. Kalite testlerinin izin verdiği yerlerde yinelenen geri getirme parçalarını kaldırın, araç sonuçlarının boyutunu sınırlayın ya da eski geçmişi sıkıştırın. Yalnızca token tasarrufu için bir ajanın ihtiyaç duyduğu kanıtı atmayın.
- Uzun kuyruğu karşılaştırın. Kaçınılmaz uzun promptlar için, Haiku'yu daha yüksek katmanda aynı görevlerde başka bir rotayla test edin. Yalnızca liste fiyatlarına değil, kabul edilen sonuç başına maliyete, gecikmeye ve yedek kullanım sıklığına bakın.
- Faturayla uzlaştırın. Gerçek girdi, çıktı, önbellek okuma ve yazmalarını geçerli katmanda fiyatlandırın; ardından araçları ve yeniden denemeleri ekleyin. Sağlayıcı ya da bulut platformu fiyatlarını ve varsa sözleşme indirimlerini yeniden kontrol edin.
Haiku 5.5, 100k üzerinde hâlâ en iyi seçenek olabilir; ama bu ölçülmüş bir yönlendirme kararı olmalı. Önemli kontrol, hangi isteklerin sınırı geçtiğini ve nedenini bilmektir.
Ekiplerin sorduğu sorular
Daha yüksek fiyat yalnızca 100k üzerindeki tokenlar için mi geçerli?
Hayır. Anthropic, Haiku 5.5'i prompt uzunluğuna göre fiyatlandırıyor: 100,000'den fazla prompt tokenı olan bir istek, o istek için yayımlanmış daha yüksek tarifeleri öder.
Prompt önbellekleme uzun bir isteği daha ucuz katmanda tutabilir mi?
Hayır. Yeniden kullanılan tokenlar önbellek okuma tarifesi alabilir, ama önbelleğe alınmış bağlam yine prompt uzunluğunu kaplar. Eşiği kontrol ederken tüm promptu sayın.
Tokenizer'da %30 artış garanti mi?
Hayır. Anthropic, içeriğe bağlı olarak aynı metin için Haiku 4.5'e göre yaklaşık %30 daha fazla token olduğunu söylüyor. Kendi promptlarınızı hedef modelde sayın.
İlgili
Bunu kendi altyapınıza uygulamak mı istiyorsunuz? Sağlayıcı faturalarını, ağ geçidi kayıtlarını ve ana iş akışlarını getirin; maliyet etkenlerini ve tasarruf yolunu çıkaralım. Ücretsiz denetim planlayın →