Anthropic meluncurkan Claude Opus 5.5 pada 22 September. Anthropic mengklaim kinerjanya mendekati Fable 5.1 untuk sebagian besar pekerjaan, dengan harga lebih rendah daripada Opus 5.

Bagi tim yang sudah menggunakan Opus 5, pembaruan ini lebih dari sekadar ID model yang lebih murah. Opus 5.5 selalu menggunakan thinking adaptif, secara bawaan menggunakan tingkat upaya medium, dan menolak beberapa bentuk permintaan yang diterima Opus 5. Anthropic juga menempatkannya di bawah Fable 5.1 sebagai model harian yang direkomendasikan untuk pekerjaan yang diawasi; Fable ditujukan untuk pekerjaan otonom paling sulit dan berdurasi paling panjang.

Perubahan besar

  • Yang berubah: Opus 5.5 menurunkan tarif masukan dan keluaran sebesar 20% serta tarif pembacaan cache sebesar 60%. Thinking adaptif yang selalu aktif juga mengubah cara klien API yang sudah ada harus meminta dan menganggarkan pekerjaan.
  • Mengapa ini penting: Pekerjaan agen yang panjang berulang kali membaca instruksi dan hasil alat sebelumnya. Potongan harga terbesar berlaku untuk konteks yang digunakan ulang, sehingga penggunaan cache menjadi penting untuk memahami tagihan seluruh pekerjaan.
  • Yang perlu dipantau: Sonnet 5.5 dan Haiku 5.5 diumumkan akan hadir dalam beberapa minggu mendatang; Opus tersedia lebih dulu. Memilih model bawaan berarti membandingkan biaya tugas yang telah selesai dan tingkat peninjauan yang dibutuhkan tiap tingkatan.

Opus 5.5 ditujukan untuk pekerjaan produksi di bawah tingkatan Fable

Dalam panduan bagi mitra, Anthropic merekomendasikan Opus 5.5 sebagai pilihan bawaan perusahaan untuk pekerjaan produksi di bidang pemrograman, keuangan, dan pengetahuan hukum, serta untuk agen. Panduan pemilihan model publik menyebutkan bahwa sebagian besar beban kerja dimulai dengan Opus 5.5 dan mengaitkannya dengan pemrograman agentik yang kompleks serta pekerjaan perusahaan. Panduan biaya yang terpisah menyebutnya “model harian” untuk pekerjaan fitur, debugging, dan tinjauan kode yang diawasi. Kedua panduan menempatkan Fable 5.1 di atasnya ketika kemampuan tertinggi atau pekerjaan sulit yang panjang lebih penting daripada harga token.

Panduan prompting Anthropic mendukung cakupan tersebut dengan pengujian perusahaan dalam analisis akar masalah, pemeriksaan kode, subagen paralel, riset, spreadsheet, laporan, dan presentasi. Panduan itu juga menjelaskan pesan kemajuan dan ringkasan akhir yang lebih jelas, serta peningkatan visi dan penggunaan komputer. Semua ini merupakan evaluasi Anthropic, bukan pengujian yang dilakukan BIG CHANGE.

Pembedaan Opus dan Fable penting karena harga Fable 5.1 tercantum sebesar $10 per sejuta token masukan dan $50 per sejuta token keluaran, dibandingkan dengan $4 dan $20 untuk Opus 5.5. Harga pembacaan cache lebih berdekatan, yaitu $0.25 dan $0.20. Karena itu, untuk sesi panjang yang banyak menggunakan cache, selisih harga dapat lebih kecil daripada yang tersirat dari tarif utama masukan dan keluaran.

Harga Claude Opus 5.5 mengubah empat tarif API

Harga API standar di bawah ini adalah per sejuta token. Referensi model Anthropic mencantumkan jendela konteks 1 juta token dan keluaran maksimum 128.000 token untuk Opus 5.5. Dokumentasi harga menyebutkan bahwa seluruh jendela konteks menggunakan tarif standar.

Biaya API

Opus 5.5

Opus 5

Perubahan

Masukan

$4

$5

20% lebih rendah

Keluaran

$20

$25

20% lebih rendah

Penulisan cache 5 menit

$5

$6.25

20% lebih rendah

Pembacaan cache

$0.20

$0.50

60% lebih rendah

Anthropic melaporkan bahwa biaya untuk beban kerja umum turun 40% pada pengaturan bawaan, dengan menggabungkan tarif dan efisiensi penggunaan token. Penjelasan biaya tugas menunjukkan mengapa komposisinya penting: sesi agen yang panjang berulang kali membaca konteks yang terus bertambah, keluaran mencakup token thinking, dan satu tugas dapat terdiri atas banyak giliran. Penurunan 60% pada pembacaan cache dapat mendominasi sesi yang banyak menggunakan cache, sementara permintaan singkat tanpa cache dengan jawaban panjang lebih mendekati penurunan tarif keluaran sebesar 20%.

Menurut panduan prompting, peningkatan lebih dari 30% yang dilaporkan adalah kecepatan pembuatan keluaran. Angka itu tidak mengukur waktu menunggu alat, pengujian, layanan eksternal, atau peninjau. Anthropic juga menawarkan mode API yang lebih cepat dengan tarif $8 untuk masukan dan $40 untuk keluaran per sejuta token; mode tersebut masih dalam pratinjau riset di Claude API, bukan pada platform cloud mitra.

Anthropic juga meningkatkan batas penggunaan lima jam pada paket Pro, Max, Team, dan Enterprise berbasis kursi, serta menyediakan reset yang dapat dibawa ke periode berikutnya. Kapasitas langganan terpisah dari penagihan API.

Tolok ukur perusahaan menunjukkan kekuatan dan batasan

Anthropic melaporkan skor Terminal-Bench 4.0 sebesar 66,4% untuk Opus 5.5 pada xhigh, 52,3% untuk Opus 5, dan 55,8% untuk Fable 5.1. Sebagian besar hasil utama lainnya menggunakan tingkat upaya Max.

GPT-6 Astra memimpin baris AutomationBench dan Terminal-Bench-Science yang ditampilkan. Tugas siber dengan perlindungan khusus menggunakan Opus 4.8; tugas biologi dan pengembangan model frontier menggunakan Opus 5. AutomationBench tidak menggunakan fallback.

Anthropic melaporkan lebih sedikit tindakan yang tidak dapat dipulihkan atau melampaui batas dalam audit perilakunya. Panduan prompting-nya juga melaporkan ketahanan yang lebih tinggi terhadap injeksi prompt tidak langsung dibandingkan model Opus sebelumnya. Keduanya merupakan hasil pengujian yang dilakukan perusahaan, bukan sertifikasi keselamatan umum.

Klien API yang sudah ada perlu menjalani migrasi secara eksplisit

Pelanggan API harus meminta claude-opus-5-5; pemanggilan Opus 5 yang sudah ada tidak otomatis beralih model. Referensi migrasi mencantumkan beberapa perubahan permintaan yang dapat menyebabkan galat atau mengubah aliran keluaran aplikasi jika tidak ditangani.

Hal migrasi

Perilaku Opus 5.5

Pemilihan model

Gunakan claude-opus-5-5 secara eksplisit.

Thinking

Thinking adaptif selalu aktif. Thinking yang dinonaktifkan dan anggaran token manual mengembalikan HTTP 400.

Upaya

Gunakan low, medium, high, xhigh atau max; nilai bawaannya adalah medium.

Alat paksa

tool_choice nilai any dan tool mengembalikan HTTP 400; auto dan none tetap didukung.

Penggunaan komputer

Alat computer_20251124 yang lebih lama ditolak pada Claude API dan Google Cloud; Amazon Bedrock masih mendukungnya.

Teks kemajuan

Teks di antara pemanggilan alat muncul dalam blok thinking, sehingga klien yang menggunakan tampilan bawaan yang mengabaikannya dapat tampak senyap di antara pemanggilan.

Thinking yang dipertahankan menambah batasan lain bagi klien yang berjalan lama. Blok thinking terikat pada model dan awalan percakapan. Pada akun API dan platform cloud yang dibuat pada atau setelah 31 Agustus 2026, mengubah instruksi, alat, atau pesan sebelumnya sebelum memutar ulang blok akan menghasilkan galat 400 secara bawaan. Dokumentasi thinking yang dipertahankan dari Anthropic menjelaskan jalur yang hanya menambahkan konten serta opsi terkendali untuk membuang blok yang tidak kompatibel.

Perutean keselamatan dapat mengubah model yang memberikan jawaban

Panduan prompting menjelaskan perlindungan biologi setingkat Fable 5.1 serta pengklasifikasi untuk keamanan siber dan ekstraksi penalaran. Pencarian kerentanan dalam kode sumber tetap diizinkan, dan organisasi dapat mengajukan verifikasi ilmu hayati. Perluasan verifikasi siber diumumkan akan hadir dalam beberapa minggu mendatang.

Penolakan tetap dapat muncul bersama HTTP 200 dan stop_reason: "refusal". Dokumentasi fallback menjelaskan fallback sisi server, middleware SDK, dan percobaan ulang yang dikelola klien. Fallback hanya terjadi jika salah satu jalur yang didukung tersebut dikonfigurasi; fallback bukan jaminan otomatis yang melekat pada setiap permintaan Opus 5.5. Kategori tanpa fallback yang direkomendasikan tetap dapat ditolak.

Artinya, model yang benar-benar melayani permintaan menjadi bagian dari hasil. Aplikasi yang beralih ke Opus 5.5 perlu mencatat penolakan dan respons yang dilayani melalui fallback secara terpisah, terutama jika pekerjaannya menyentuh bidang dengan perlindungan khusus. Tarif lebih rendah dan klaim kemampuan yang lebih luas berlaku untuk Opus 5.5; permintaan yang dialihkan mengikuti perilaku dan batasan model yang benar-benar menjawab.