AI-translated from English; not yet reviewed by a fluent editor.

# Claude Haiku 5.5 menurunkan harga token, tetapi mengubah perhitungan migrasi

> Model Haiku baru dari Anthropic memiliki tarif token lebih rendah, tokenizer yang berbeda, serta perubahan migrasi Messages API. Pengguna Haiku 4.5 sebaiknya menghitung ulang token permintaan dan menguji penanganan respons sebelum beralih.

By BIG CHANGE Editorial

Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

![Conceptual charcoal illustration of a mechanical adding machine with a long blank paper tape and one orange band.](https://bigchange.ai/api/media/file/claude-haiku-55-recount-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.

Anthropic merilis Claude Haiku 5.5 pada 7 Oktober untuk pekerjaan singkat dan sering yang dapat mendominasi jumlah panggilan dalam sistem agen. Tarif daftar Claude API mulai dari $0,10 per satu juta token input dan $0,50 per satu juta token output, sepersepuluh tarif Haiku 4.5. Namun, Anthropic menyatakan bahwa teks yang sama memakai sekitar 30% lebih banyak token pada model baru, dan prompt di atas 100.000 token masuk ke tingkat harga yang lebih tinggi. Tim pengguna Haiku 4.5 perlu menghitung ulang permintaan mereka sebelum memperkirakan tagihan atau memindahkan trafik produksi.

Rilis ini juga mengubah jalur Messages API. Anggaran thinking manual tidak berfungsi pada Haiku 5.5, adaptive thinking aktif secara default, dan blok respons pertama dapat berupa `thinking` alih-alih teks. Ini adalah pemeriksaan kompatibilitas konkret bagi layanan yang berulang kali memanggil model kecil untuk mengklasifikasikan, mengekstrak, merutekan, atau merangkum pekerjaan.

## Perubahan utama

- **Apa yang berubah:** Anthropic menghadirkan jendela konteks baru satu juta token dan adaptive thinking ke tingkat Claude dengan harga terendah. Haiku 5.5 menurunkan tarif untuk prompt pendek sekaligus mengubah cara teks dihitung dan bagaimana respons dapat dimulai.
- **Mengapa penting:** Tim kini dapat mempertimbangkan Claude untuk lebih banyak langkah agen yang sering dilakukan dan cakupannya sempit dengan tarif tercantum lebih rendah. Manfaatnya bergantung pada campuran panjang prompt, token output dan thinking, penggunaan cache, serta apakah model baru memenuhi sasaran kualitas untuk langkah tersebut.
- **Yang perlu diperhatikan:** Integrasi Haiku 4.5 perlu dimigrasikan dengan pengukuran. Setelah dihitung ulang, permintaan yang mendekati batas 100.000 token dapat masuk ke tingkat harga lebih tinggi; kode yang menganggap blok konten pertama selalu berupa teks dapat salah menangani balasan yang sebenarnya berhasil.

## Harga bergantung pada panjang prompt

Di Claude API, Haiku 5.5 dikenai biaya $0,10 per satu juta token input dan $0,50 per satu juta token output untuk prompt hingga 100.000 token. Di atas ambang itu, tarif masing-masing menjadi $0,50 dan $2,50. Haiku 4.5 tercantum dengan tarif $1 dan $5 di seluruh jendela konteks 200.000 token. Haiku 5.5 memiliki jendela konteks satu juta token dan output maksimum 128.000 token, dibandingkan 200.000 dan 64.000 pada Haiku 4.5. Anthropic mencantumkan ketersediaan melalui Claude API, Amazon Bedrock, Claude Platform di AWS, Google Cloud, dan Microsoft Foundry. ID model Amazon Bedrock adalah `anthropic.claude-haiku-5-5`; Claude API menggunakan `claude-haiku-5-5`. [Halaman model Anthropic](https://platform.claude.com/docs/en/models/haiku-5-5/overview) mencantumkan ID platform, batas, dan tarif saat ini.

Anthropic menyebut biaya penggunaan Haiku 5.5 sekitar 75% lebih rendah daripada Haiku 4.5 *secara rata-rata*. Catatan kakinya menggabungkan tarif daftar 90% lebih rendah untuk prompt hingga 100.000 token, tarif 50% lebih rendah di atas ambang tersebut, pengamatannya bahwa 90% permintaan Haiku 4.5 berada dalam kategori pendek, serta jumlah token lebih tinggi dari tokenizer baru untuk pekerjaan yang sama. Perhitungan itu menggambarkan campuran permintaan Anthropic, bukan diskon seragam untuk setiap permintaan. Kenaikan token sekitar 30% juga merupakan perkiraan vendor untuk teks input yang sama; perubahan tepatnya bergantung pada isi teks. [Pengumuman peluncuran Anthropic](https://www.anthropic.com/claude-haiku-5-5) menjelaskan klaim dan metodenya.

Untuk permintaan Claude API tanpa cache, ambil jumlah token input dan output Haiku 5.5, kalikan masing-masing dengan tarif pada *tingkat harga berdasarkan panjang prompt permintaan* tersebut, lalu bagi satu juta. Sebagai perhitungan, 80.000 token input dan 10.000 token output pada tarif prompt pendek berbiaya $0,013. Untuk 120.000 token input dan 10.000 token output, tarif prompt panjang menghasilkan $0,085. Ini adalah perhitungan harga, bukan pekerjaan yang diamati atau prakiraan. Pembacaan dan penulisan cache memiliki tarif masing-masing, sementara pemrosesan batch mencantumkan diskon 50% untuk input dan output. Karena itu, perkiraan yang berguna mengelompokkan panggilan nyata menurut panjang prompt dan perilaku cache sebelum menjumlahkannya. [Halaman model Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) mencantumkan kategori ini.

Hitung ulang prompt representatif yang tersimpan menggunakan [endpoint penghitungan token Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens), dengan menetapkan `claude-haiku-5-5`. Total token model lama tidak menunjukkan tingkat harga Haiku 5.5 yang akan dikenakan pada prompt. Untuk sampel langsung, catat `usage` respons, panjang output, kolom cache, effort, dan biaya aktual bersama hasil tugas. Sertakan permintaan pendek, percakapan berulang terpanjang, dan kasus yang mendekati 100.000 token. BIG CHANGE telah meninjau dokumentasi; BIG CHANGE belum menjalankan Haiku 5.5 atau mengukur beban kerja produksi.

## Pengaturan yang perlu ditinjau saat migrasi

Anthropic [panduan migrasi Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) memberikan daftar periksa yang sangat spesifik bagi klien yang beralih dari Haiku 4.5:

1. Ubah ID model untuk platform dan hitung ulang prompt. `claude-haiku-5-5`adalah ID Claude API tetap tanpa akhiran tanggal atau alias terpisah. Tinjau `max_tokens` karena thinking memakai batas itu dan teks yang setara mungkin membutuhkan lebih banyak token.
2. Ganti `thinking: {"type":"enabled","budget_tokens":N}` dengan adaptive thinking atau biarkan `thinking` tidak disetel. Atur `output_config.effort` untuk mengkalibrasi kedalaman; nilai default yang didokumentasikan adalah `medium`. Nilai `max_tokens` yang rendah dapat mengakhiri respons setelah blok thinking dan sebelum teks apa pun muncul.
3. Baca blok konten berdasarkan `type`, bukan posisinya. Kirim kembali blok thinking tanpa perubahan bersama hasil alat. Uji penyimpanan percakapan yang memutar ulang suatu blok melalui akun lain atau mengubah pesan, instruksi sistem, maupun alat sebelumnya.
4. Hapus pengaturan khusus `temperature`, `top_p`, dan `top_k`. Ganti awalan assistant terakhir dengan giliran user; untuk format terbatas, gunakan pendekatan keluaran terstruktur atau alat yang didokumentasikan Anthropic. Tangani `stop_reason` bernilai `refusal` di klien.
5. Jika integrasi menggunakan computer use pada Claude API atau Google Cloud, ganti alat lama `computer_20250124` dengan `computer_toolset_20260801` dan perbarui siklus alat sesuai panduan. Organisasi yang memakai kapasitas Priority Tier untuk Haiku 4.5 juga memerlukan rencana terpisah: panduan menyatakan Priority Tier tidak tersedia pada Haiku 5.5.

Perubahan ini tidak menentukan satu pengaturan effort untuk setiap tugas. Perbandingan perlu mempertahankan tugas aplikasi dan kriteria penerimaan, lalu mencatat kualitas jawaban, penolakan, pemotongan, latensi, dan token tertagih pada pengaturan yang dipertimbangkan. Anthropic melaporkan hasil Haiku 5.5 yang lebih baik daripada 4.5 pada beberapa benchmark, termasuk 39,2% dibanding 0,0% pada tabel Terminal-Bench 4.0 miliknya. Itu adalah hasil yang dilaporkan Anthropic dengan kondisi evaluasinya, bukan pengukuran agen milik pembaca. Anthropic juga menyebut Sonnet 5.5 dan Opus 5.5 lebih sesuai untuk pemrograman agen yang kompleks dalam benchmark tersebut. Keputusan terdekat bagi pengguna Haiku 4.5 adalah apakah model yang lebih kecil tetap memenuhi persyaratan setiap langkah yang cakupannya sempit setelah perubahan API dan jumlah token baru diperhitungkan.

## Sumber dan bacaan lanjutan

- [Pengumuman Anthropic tentang Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5)Mencantumkan tanggal rilis, pekerjaan yang dituju, dan ketersediaan, serta menjelaskan perhitungan biaya tugas rata-rata perusahaan. Tabel benchmark-nya melaporkan hasil evaluasi Anthropic.
- [Halaman model Haiku 5.5 di Claude Platform](https://platform.claude.com/docs/en/models/haiku-5-5/overview)Mencantumkan ID, batas konteks dan output, tingkat panjang prompt, harga cache, serta dukungan platform. [Halaman Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview)menyediakan tarif dan batas model pendahulunya.
- [Panduan migrasi Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)Menentukan perubahan Messages API dan kesalahan yang perlu diperiksa sebelum memindahkan integrasi yang ada. [Referensi API penghitungan token](https://platform.claude.com/docs/en/api/go/messages/count_tokens)mendokumentasikan penghitungan permintaan dengan model pilihan.
- [Laporan peluncuran Reuters tanggal 7 Oktober](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)secara independen menguatkan tanggal rilis. Pengaturan teknis dan tarif di atas berasal dari dokumentasi Anthropic saat ini.

## Sources

- [Peluncuran Claude Haiku 5.5 oleh Anthropic](https://www.anthropic.com/claude-haiku-5-5) — Tanggal rilis, tugas yang dituju, benchmark vendor dan klaim biaya rata-rata, catatan perhitungan, serta ketersediaan cloud.
- [Ikhtisar model Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — ID model saat ini, harga API menurut panjang prompt, tarif cache dan batch, konteks, output, dan ketersediaan.
- [Ikhtisar model Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — Status lama model pendahulu saat ini, tarif daftar, dan batasnya.
- [Panduan migrasi Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Daftar periksa perubahan utama Messages API dan panduan tokenizer.
- [Menghitung token dalam sebuah Message](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — Endpoint penghitungan token dan jumlah token permintaan khusus model.
- [Reuters, Anthropic meluncurkan model Claude 5.5 ketiga](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — Hanya sebagai konfirmasi rilis independen.
