Langsung ke konten

Harga dan model biaya Claude Opus 5.5

Diperbarui October 10, 2026 · pertama terbit September 22, 2026

Anthropic merilis Claude Opus 5.5 (claude-opus-5-5) pada 22 September 2026. Harga utamanya adalah $4 per juta token input dan $20 per juta token output, turun dari $5 dan $25 pada Opus 5. Itu pemotongan 20%. Untuk sebagian besar beban kerja produksi, pemotongan sebenarnya lebih besar, karena tarif yang paling banyak berubah adalah tarif yang tidak tercantum di harga utama.

Harga Opus 5.5: tarif yang penting

Jenis tokenOpus 5.5Opus 5Fable 5.1
Input (tanpa cache)$4.00 / MTok$5.00 / MTok$10.00 / MTok
Output$20.00 / MTok$25.00 / MTok$50.00 / MTok
Cache write (5 menit)$5.00 / MTok$6.25 / MTok$12.50 / MTok
Cache read$0.20 / MTok$0.50 / MTok$0.25 / MTok
Fast mode (input / output)$8 / $40——

Setiap baris 20% lebih rendah kecuali cache read, yang 60% lebih rendah. Di $0.20, tarif ini kini lebih murah daripada $0.25 milik Fable 5.1. Itu membalik satu-satunya baris yang sebelumnya dimenangkan Fable. Dalam model biaya Fable 5.1 kami, beban kerja dengan cache tinggi bisa lebih murah di Fable dibanding Opus 5. Terhadap Opus 5.5, hal itu tidak lagi terjadi. Fable lebih mahal di setiap jenis token.

Mengapa satu tugas tipikal berbiaya sekitar 40% lebih sedikit

Klaim Anthropic adalah penurunan biaya 40% untuk satu tugas tipikal, bukan 20%. Selisih tambahannya berasal dari efisiensi token. Anthropic menyatakan Opus 5.5 mencapai hasil yang sama dengan sekitar 20% lebih sedikit token input dan output, dan menulis output sekitar 40% lebih ringkas. Tarif yang lebih rendah dikali jumlah token yang lebih sedikit saling menguatkan: 0.8 × 0.8 = 0.64, yaitu sekitar 36–40% lebih murah tergantung campurannya.

Berikut satu langkah agen: 200.000 token input, 90% dilayani dari cache, dan 20.000 token output.

BarisOpus 5Opus 5.5 (token sama)Fable 5.1
20K input tanpa cache$0.100$0.080$0.200
180K input dari cache$0.090$0.036$0.045
20K output$0.500$0.400$1.000
Total$0.690$0.516$1.245

Dengan token yang sama, Opus 5.5 25% lebih murah dibanding Opus 5, bukan 20%, karena diskon cache. Jika pengurangan token 20% berlaku untuk beban kerja Anda, langkah ini turun menjadi sekitar $0.41, yaitu 40% di bawah Opus 5 dan sepertiga biaya Fable. Output tetap sekitar 80% dari tagihan dalam contoh ini. Di situlah pengurangan verbositas memberi keuntungan.

Biaya per tugas dibandingkan GPT-6 Sol, GPT-6 Astra dan Fable 5.1

Harga daftar per juta token, dan langkah agen yang sama seperti di atas (200K input, 90% cache, 20K output) dihitung untuk setiap model.

ModelInput $/MTokOutput $/MTokCache read $/MTokLangkah agen yang sama
GPT-6 Sol$2.00$10.00$0.20$0.276
Claude Opus 5.5$4.00$20.00$0.20$0.516
Claude Opus 5$5.00$25.00$0.50$0.690
Claude Fable 5.1$10.00$50.00$0.25$1.245
GPT-6 Astra$10.00$50.00$1.00$1.380

Biaya per tugas yang diukur pada Artificial Analysis Intelligence Index v4.3.2, dibaca 22 September 2026, diurutkan berdasarkan skor. GPT-6 Sol adalah cara termurah untuk mencapai skor hingga 47.5. Di atas itu, Opus 5.5 adalah yang termurah di setiap level: Opus 5.5 high mencetak 53.6 seharga $1.82, sedangkan GPT-6 Astra max mencetak 52.7 seharga $3.26 dan Fable 5.1 max mencetak 53.4 seharga $7.63.

ModelIntelligence IndexBiaya per tugasToken output per tugas
GPT-6 Sol · medium39.8$0.256,500
GPT-6 Sol · xhigh44.1$0.5316,000
GPT-6 Astra · low45.8$0.824,400
GPT-6 Sol · max47.5$1.0631,200
Claude Opus 5 · high48.1$3.6146,200
Claude Opus 5 · max50.8$5.8672,500
Claude Opus 5.5 · medium51.2$1.3425,700
Claude Fable 5.1 · high51.2$3.9138,100
GPT-6 Astra · max52.7$3.2627,200
Claude Fable 5.1 · max53.4$7.6378,100
Claude Opus 5.5 · high53.6$1.8235,600
Claude Opus 5.5 · max57.6$5.98119,200

Setiap pengaturan GPT-6 Astra di atas low, setiap pengaturan Opus 5, dan setiap pengaturan Fable 5.1 lebih mahal daripada pengaturan Sol atau Opus 5.5 yang skornya sama atau lebih tinggi. Biaya per tugas bergantung pada campuran tugas benchmark. Uji ulang lalu lintas Anda sendiri sebelum berpindah model.

Apakah cukup baik untuk menggantikan Fable?

Anthropic memposisikan Opus 5.5 setara dengan Fable 5.1 pada sebagian besar tugas. Angka yang dipublikasikan mendukung hal itu untuk pekerjaan coding dan agentik:

Artificial Analysis menempatkannya di urutan pertama pada Intelligence Index-nya di hari peluncuran. Anthropic juga menyatakan bahwa pada effort default (medium) ia mengungguli GPT-6 Astra pada effort max untuk pekerjaan pengetahuan, dengan biaya per tugas sekitar seperlima. Itu perbandingan dari vendor, jadi anggap sebagai hipotesis yang perlu diuji. Bagian perhitungan biaya di atas adalah bagian yang bisa Anda verifikasi sendiri.

Fast mode berbiaya 2×

Fast mode berbiaya $8 input dan $40 output, tepat dua kali tarif standar, untuk kecepatan hingga 2.5×. Model standar juga sekitar 30% lebih cepat dari Opus 5. Gunakan fast mode untuk jalur interaktif yang sensitif terhadap latensi, tempat pengguna sedang menunggu. Matikan untuk batch job, agen latar belakang, dan evaluasi. Saat fast mode diaktifkan secara default, biaya per unit berlipat dua dan dasbor tidak menunjukkan apa pun yang janggal sampai tagihan datang.

Yang perlu dilakukan minggu ini

  1. Kunci ID model. Arahkan produksi ke claude-opus-5-5 secara eksplisit dan catat ID itu di setiap permintaan, agar biaya per permintaan bisa dipisah per model setelah migrasi.
  2. Ukur ulang dengan lalu lintas Anda sendiri. Putar ulang sampel permintaan nyata pada kedua model dan bandingkan token per tugas yang selesai, bukan per panggilan. Klaim efisiensi token 20% adalah bagian yang paling mungkin berbeda antarbeban kerja.
  3. Periksa ulang pengaturan effort. Jika sebuah beban kerja pindah ke Fable atau ke effort max demi kualitas, uji Opus 5.5 pada medium terlebih dahulu. Itu pengaturan yang dijadikan patokan oleh Anthropic.
  4. Tinjau ulang keputusan routing Fable. Rute apa pun yang mengirim lalu lintas berat cache ke Fable demi cache read yang lebih murah perlu dievaluasi ulang. Keunggulan biaya itu sudah hilang.
  5. Pantau rasio cache hit. Di $0.20 dibanding $4.00, cache miss kini berharga 20× cache hit. Perubahan template prompt yang merusak prefiks kini lebih mahal daripada di Opus 5.

Anthropic menyatakan Sonnet 5.5 dan Haiku 5.5 akan menyusul dalam beberapa minggu ke depan. Simpan harness replay dari langkah 2 agar setiap rilis bisa diukur ulang dalam satu sore.

Terkait


Ingin menerapkannya pada stack Anda? Bawa tagihan penyedia, log gateway, dan alur kerja utama; kami akan memetakan pendorong biaya dan jalur penghematan. Pesan audit gratis →

Kembali ke finopsllm.com