Anthropic merilis Claude Haiku 5.5 pada 7 Oktober untuk pekerjaan singkat dan sering yang dapat mendominasi jumlah panggilan dalam sistem agen. Tarif daftar Claude API mulai dari $0,10 per satu juta token input dan $0,50 per satu juta token output, sepersepuluh tarif Haiku 4.5. Namun, Anthropic menyatakan bahwa teks yang sama memakai sekitar 30% lebih banyak token pada model baru, dan prompt di atas 100.000 token masuk ke tingkat harga yang lebih tinggi. Tim pengguna Haiku 4.5 perlu menghitung ulang permintaan mereka sebelum memperkirakan tagihan atau memindahkan trafik produksi.

Rilis ini juga mengubah jalur Messages API. Anggaran thinking manual tidak berfungsi pada Haiku 5.5, adaptive thinking aktif secara default, dan blok respons pertama dapat berupa thinking alih-alih teks. Ini adalah pemeriksaan kompatibilitas konkret bagi layanan yang berulang kali memanggil model kecil untuk mengklasifikasikan, mengekstrak, merutekan, atau merangkum pekerjaan.

Perubahan utama

  • Apa yang berubah: Anthropic menghadirkan jendela konteks baru satu juta token dan adaptive thinking ke tingkat Claude dengan harga terendah. Haiku 5.5 menurunkan tarif untuk prompt pendek sekaligus mengubah cara teks dihitung dan bagaimana respons dapat dimulai.
  • Mengapa penting: Tim kini dapat mempertimbangkan Claude untuk lebih banyak langkah agen yang sering dilakukan dan cakupannya sempit dengan tarif tercantum lebih rendah. Manfaatnya bergantung pada campuran panjang prompt, token output dan thinking, penggunaan cache, serta apakah model baru memenuhi sasaran kualitas untuk langkah tersebut.
  • Yang perlu diperhatikan: Integrasi Haiku 4.5 perlu dimigrasikan dengan pengukuran. Setelah dihitung ulang, permintaan yang mendekati batas 100.000 token dapat masuk ke tingkat harga lebih tinggi; kode yang menganggap blok konten pertama selalu berupa teks dapat salah menangani balasan yang sebenarnya berhasil.

Harga bergantung pada panjang prompt

Di Claude API, Haiku 5.5 dikenai biaya $0,10 per satu juta token input dan $0,50 per satu juta token output untuk prompt hingga 100.000 token. Di atas ambang itu, tarif masing-masing menjadi $0,50 dan $2,50. Haiku 4.5 tercantum dengan tarif $1 dan $5 di seluruh jendela konteks 200.000 token. Haiku 5.5 memiliki jendela konteks satu juta token dan output maksimum 128.000 token, dibandingkan 200.000 dan 64.000 pada Haiku 4.5. Anthropic mencantumkan ketersediaan melalui Claude API, Amazon Bedrock, Claude Platform di AWS, Google Cloud, dan Microsoft Foundry. ID model Amazon Bedrock adalah anthropic.claude-haiku-5-5; Claude API menggunakan claude-haiku-5-5. Halaman model Anthropic mencantumkan ID platform, batas, dan tarif saat ini.

Anthropic menyebut biaya penggunaan Haiku 5.5 sekitar 75% lebih rendah daripada Haiku 4.5 secara rata-rata. Catatan kakinya menggabungkan tarif daftar 90% lebih rendah untuk prompt hingga 100.000 token, tarif 50% lebih rendah di atas ambang tersebut, pengamatannya bahwa 90% permintaan Haiku 4.5 berada dalam kategori pendek, serta jumlah token lebih tinggi dari tokenizer baru untuk pekerjaan yang sama. Perhitungan itu menggambarkan campuran permintaan Anthropic, bukan diskon seragam untuk setiap permintaan. Kenaikan token sekitar 30% juga merupakan perkiraan vendor untuk teks input yang sama; perubahan tepatnya bergantung pada isi teks. Pengumuman peluncuran Anthropic menjelaskan klaim dan metodenya.

Untuk permintaan Claude API tanpa cache, ambil jumlah token input dan output Haiku 5.5, kalikan masing-masing dengan tarif pada tingkat harga berdasarkan panjang prompt permintaan tersebut, lalu bagi satu juta. Sebagai perhitungan, 80.000 token input dan 10.000 token output pada tarif prompt pendek berbiaya $0,013. Untuk 120.000 token input dan 10.000 token output, tarif prompt panjang menghasilkan $0,085. Ini adalah perhitungan harga, bukan pekerjaan yang diamati atau prakiraan. Pembacaan dan penulisan cache memiliki tarif masing-masing, sementara pemrosesan batch mencantumkan diskon 50% untuk input dan output. Karena itu, perkiraan yang berguna mengelompokkan panggilan nyata menurut panjang prompt dan perilaku cache sebelum menjumlahkannya. Halaman model Haiku 5.5 mencantumkan kategori ini.

Hitung ulang prompt representatif yang tersimpan menggunakan endpoint penghitungan token Message, dengan menetapkan claude-haiku-5-5. Total token model lama tidak menunjukkan tingkat harga Haiku 5.5 yang akan dikenakan pada prompt. Untuk sampel langsung, catat usage respons, panjang output, kolom cache, effort, dan biaya aktual bersama hasil tugas. Sertakan permintaan pendek, percakapan berulang terpanjang, dan kasus yang mendekati 100.000 token. BIG CHANGE telah meninjau dokumentasi; BIG CHANGE belum menjalankan Haiku 5.5 atau mengukur beban kerja produksi.

Pengaturan yang perlu ditinjau saat migrasi

Anthropic panduan migrasi Haiku 5.5 memberikan daftar periksa yang sangat spesifik bagi klien yang beralih dari Haiku 4.5:

  1. Ubah ID model untuk platform dan hitung ulang prompt. claude-haiku-5-5adalah ID Claude API tetap tanpa akhiran tanggal atau alias terpisah. Tinjau max_tokens karena thinking memakai batas itu dan teks yang setara mungkin membutuhkan lebih banyak token.
  2. Ganti thinking: {"type":"enabled","budget_tokens":N} dengan adaptive thinking atau biarkan thinking tidak disetel. Atur output_config.effort untuk mengkalibrasi kedalaman; nilai default yang didokumentasikan adalah medium. Nilai max_tokens yang rendah dapat mengakhiri respons setelah blok thinking dan sebelum teks apa pun muncul.
  3. Baca blok konten berdasarkan type, bukan posisinya. Kirim kembali blok thinking tanpa perubahan bersama hasil alat. Uji penyimpanan percakapan yang memutar ulang suatu blok melalui akun lain atau mengubah pesan, instruksi sistem, maupun alat sebelumnya.
  4. Hapus pengaturan khusus temperature, top_p, dan top_k. Ganti awalan assistant terakhir dengan giliran user; untuk format terbatas, gunakan pendekatan keluaran terstruktur atau alat yang didokumentasikan Anthropic. Tangani stop_reason bernilai refusal di klien.
  5. Jika integrasi menggunakan computer use pada Claude API atau Google Cloud, ganti alat lama computer_20250124 dengan computer_toolset_20260801 dan perbarui siklus alat sesuai panduan. Organisasi yang memakai kapasitas Priority Tier untuk Haiku 4.5 juga memerlukan rencana terpisah: panduan menyatakan Priority Tier tidak tersedia pada Haiku 5.5.

Perubahan ini tidak menentukan satu pengaturan effort untuk setiap tugas. Perbandingan perlu mempertahankan tugas aplikasi dan kriteria penerimaan, lalu mencatat kualitas jawaban, penolakan, pemotongan, latensi, dan token tertagih pada pengaturan yang dipertimbangkan. Anthropic melaporkan hasil Haiku 5.5 yang lebih baik daripada 4.5 pada beberapa benchmark, termasuk 39,2% dibanding 0,0% pada tabel Terminal-Bench 4.0 miliknya. Itu adalah hasil yang dilaporkan Anthropic dengan kondisi evaluasinya, bukan pengukuran agen milik pembaca. Anthropic juga menyebut Sonnet 5.5 dan Opus 5.5 lebih sesuai untuk pemrograman agen yang kompleks dalam benchmark tersebut. Keputusan terdekat bagi pengguna Haiku 4.5 adalah apakah model yang lebih kecil tetap memenuhi persyaratan setiap langkah yang cakupannya sempit setelah perubahan API dan jumlah token baru diperhitungkan.

Sumber dan bacaan lanjutan