পৃথিবী স্থির নেই।RSS
BIG CHANGE.

Markdown সংস্করণ

AI-translated from English; not yet reviewed by a fluent editor.

# Claude Haiku 5.5 টোকেনের দাম কমায়, তবে মাইগ্রেশনের হিসাব বদলে দেয়

> Anthropic-এর নতুন Haiku মডেলে টোকেনের হার কম, tokenizer আলাদা, আর Messages API মাইগ্রেশনেও পরিবর্তন আছে। Haiku 4.5-এর বর্তমান ব্যবহারকারীদের বদলানোর আগে অনুরোধের টোকেন আবার গুনে response handling পরীক্ষা করা উচিত।

By BIG CHANGE Editorial

Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

![Conceptual charcoal illustration of a mechanical adding machine with a long blank paper tape and one orange band.](https://bigchange.ai/api/media/file/claude-haiku-55-recount-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.

এজেন্ট সিস্টেমে কলের পরিমাণের বড় অংশ জুড়ে থাকতে পারে এমন ছোট ও ঘনঘন কাজের জন্য Anthropic ৭ অক্টোবর Claude Haiku 5.5 প্রকাশ করেছে। Claude API-এর তালিকাভুক্ত হার প্রতি দশ লক্ষ ইনপুট টোকেনে $0.10 এবং প্রতি দশ লক্ষ আউটপুট টোকেনে $0.50 থেকে শুরু—Haiku 4.5-এর হারের দশ ভাগের এক ভাগ। তবে Anthropic বলছে, একই লেখায় নতুন মডেলে প্রায় ৩০% বেশি টোকেন লাগে এবং 100,000 টোকেনের বেশি prompt উচ্চতর মূল্যস্তরে পড়ে। বিল অনুমান বা production traffic সরানোর আগে Haiku 4.5 ব্যবহারকারী দলগুলোর নিজেদের অনুরোধ আবার গুনে দেখা দরকার।

এই রিলিজে Messages API ব্যবহারের পথও বদলেছে। Haiku 5.5-এ হাতে নির্ধারিত thinking budget কাজ করে না, adaptive thinking ডিফল্টভাবে চালু থাকে, আর প্রথম response block-টি লেখার বদলে `thinking` হতে পারে। ছোট মডেলকে বারবার ডেকে শ্রেণিবিন্যাস, তথ্য বের করা, রুট করা বা সারসংক্ষেপ তৈরির পরিষেবাগুলোর জন্য এগুলো নির্দিষ্ট compatibility check।

## মূল পরিবর্তন

- **কী বদলেছে:** Anthropic নতুন এক মিলিয়ন-টোকেন context window এবং adaptive thinking-কে Claude-এর সবচেয়ে কমদামি স্তরে এনেছে। Haiku 5.5 ছোট prompt-এর হার কমায়, পাশাপাশি কীভাবে লেখা গোনা হয় এবং response কীভাবে শুরু হতে পারে তা বদলায়।
- **কেন এটি গুরুত্বপূর্ণ:** কম প্রকাশিত হারে আরও ঘনঘন ও নির্দিষ্ট পরিসরের এজেন্ট ধাপে Claude ব্যবহার করা যায় কি না, দলগুলো এখন তা বিবেচনা করতে পারে। লাভ নির্ভর করে prompt-এর দৈর্ঘ্যের মিশ্রণ, output ও thinking token, cache ব্যবহার এবং নতুন মডেলটি ওই ধাপের মানের লক্ষ্য পূরণ করে কি না তার ওপর।
- **যা নজরে রাখবেন:** Haiku 4.5 integration মেপে মেপে migrate করতে হবে। 100,000-টোকেন সীমার কাছাকাছি অনুরোধ আবার গুনলে উচ্চতর স্তরে যেতে পারে; প্রথম content block-কে লেখা ধরে নেওয়া code অন্যভাবে সফল হওয়া response-ও ভুলভাবে সামলাতে পারে।

## prompt-এর দৈর্ঘ্য অনুযায়ী দাম

Claude API-তে 100,000 টোকেন পর্যন্ত prompt-এর জন্য Haiku 5.5-এর দাম প্রতি দশ লক্ষ ইনপুট টোকেনে $0.10 এবং প্রতি দশ লক্ষ আউটপুট টোকেনে $0.50। সীমা পেরোলে সংশ্লিষ্ট হার $0.50 ও $2.50। Haiku 4.5-এর 200,000-টোকেন context window জুড়ে তালিকাভুক্ত হার $1 ও $5। Haiku 5.5-এর context window এক মিলিয়ন টোকেন এবং সর্বোচ্চ output 128,000 টোকেন; Haiku 4.5-এ তা 200,000 ও 64,000। Anthropic Claude API, Amazon Bedrock, AWS-এর Claude Platform, Google Cloud এবং Microsoft Foundry-তে প্রাপ্যতার কথা জানিয়েছে। Amazon Bedrock-এর মডেল ID হলো `anthropic.claude-haiku-5-5`; Claude API ব্যবহার করে `claude-haiku-5-5`। [Anthropic-এর মডেল পেজগুলো](https://platform.claude.com/docs/en/models/haiku-5-5/overview) বর্তমান platform ID, সীমা ও হার জানায়।

Anthropic-এর মতে, Haiku 5.5 চালাতে Haiku 4.5-এর তুলনায় প্রায় 75% কম খরচ হয় *গড়ে* চালানোর খরচ। ফুটনোটে 100,000 টোকেন পর্যন্ত prompt-এর 90% কম তালিকাভুক্ত হার, তার বেশি হলে 50% কম হার, Haiku 4.5-এর 90% অনুরোধ ছোট শ্রেণিতে ছিল—এই পর্যবেক্ষণ, এবং একই কাজের জন্য নতুন tokenizer-এর বেশি টোকেন গণনা একসঙ্গে ধরা হয়েছে। এই হিসাব Anthropic-এর অনুরোধের মিশ্রণ বোঝায়, প্রতিটি অনুরোধে সমান ছাড় নয়। একই ইনপুট লেখায় প্রায় 30% টোকেন বৃদ্ধিও বিক্রেতার অনুমান; সঠিক পরিবর্তন বিষয়বস্তুর ওপর নির্ভর করে। [Anthropic-এর প্রকাশনা-ঘোষণা](https://www.anthropic.com/claude-haiku-5-5) দাবি এবং হিসাবের পদ্ধতি—দুটিই জানায়।

cache-বিহীন Claude API অনুরোধের জন্য Haiku 5.5-এর ইনপুট ও আউটপুট টোকেন সংখ্যা নিন, প্রতিটিকে *ওই অনুরোধের prompt-দৈর্ঘ্য মূল্যস্তর*এর হারে গুণ করে এক মিলিয়ন দিয়ে ভাগ করুন। হিসাবের উদাহরণ: ছোট-prompt হারে 80,000 ইনপুট ও 10,000 আউটপুট টোকেনের খরচ $0.013। 120,000 ইনপুট ও 10,000 আউটপুট টোকেনে দীর্ঘ-prompt হারে খরচ $0.085। এগুলো দামের হিসাব, দেখা কাজ বা পূর্বাভাস নয়। Cache পড়া ও লেখার আলাদা হার আছে; batch processing-এ ইনপুট ও আউটপুট উভয়ের ওপর 50% ছাড় তালিকাভুক্ত। তাই কার্যকর অনুমানের জন্য বাস্তব call-গুলো prompt-এর দৈর্ঘ্য ও cache আচরণ অনুযায়ী ভাগ করে তারপর যোগ করা উচিত। [Haiku 5.5 মডেল পেজে](https://platform.claude.com/docs/en/models/haiku-5-5/overview) এই বিভাগগুলো তালিকাভুক্ত আছে।

সংরক্ষিত প্রতিনিধিত্বমূলক prompt আবার গুনুন [Message token-count endpoint](https://platform.claude.com/docs/en/api/go/messages/count_tokens)দিয়ে, এবং উল্লেখ করুন `claude-haiku-5-5`। পুরোনো মডেলের মোট token সংখ্যা থেকে 5.5-এ prompt কোন স্তরে পড়বে তা বোঝা যায় না। বাস্তব নমুনায় কাজের ফলের সঙ্গে response-এর `usage`, output-এর দৈর্ঘ্য, cache field, effort এবং প্রকৃত চার্জ নথিভুক্ত করুন। ছোট অনুরোধ, সবচেয়ে দীর্ঘ পুনরাবৃত্ত কথোপকথন এবং 100,000 টোকেনের কাছাকাছি উদাহরণ রাখুন। BIG CHANGE নথি পর্যালোচনা করেছে; Haiku 5.5 চালায়নি বা production workload মাপেনি।

## মাইগ্রেশনের সময় যে সেটিংসগুলো আবার দেখতে হবে

Anthropic-এর [Haiku 5.5 মাইগ্রেশন গাইড](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) Haiku 4.5 থেকে বদলানো client-দের জন্য বেশ নির্দিষ্ট একটি checklist দিয়েছে:

1. platform অনুযায়ী মডেল ID বদলান এবং prompt আবার গুনুন। `claude-haiku-5-5`তারিখের suffix বা আলাদা alias ছাড়া স্থির Claude API ID। `max_tokens`পর্যালোচনা করুন, কারণ thinking ওই সীমা ব্যবহার করে এবং একই লেখায় বেশি টোকেন লাগতে পারে।
2. বদলান `thinking: {"type":"enabled","budget_tokens":N}`adaptive thinking দিয়ে, অথবা `thinking`অনির্ধারিত রাখুন। গভীরতা ঠিক করতে `output_config.effort`সেট করুন; নথিভুক্ত default হলো `medium`। কম `max_tokens`থাকলে thinking block-এর পর, কোনো লেখা আসার আগেই response শেষ হতে পারে।
3. content block অবস্থান দিয়ে নয়, `type`দিয়ে পড়ুন। tool result-এর সঙ্গে thinking block অপরিবর্তিত রেখে ফেরত দিন। অন্য account দিয়ে block replay করে, অথবা আগের message, system instruction বা tool বদলে দেয়—এমন যেকোনো conversation store পরীক্ষা করুন।
4. নিজস্ব `temperature`, `top_p` ও `top_k`সেটিংস সরান। শেষ assistant prefill-কে user turn দিয়ে বদলান; সীমাবদ্ধ format-এ Anthropic-এর নথিভুক্ত structured-output বা tool পদ্ধতি ব্যবহার করুন। client-এ `stop_reason`মানের `refusal`সামলান।
5. integration Claude API বা Google Cloud-এ computer use ব্যবহার করলে পুরোনো `computer_20250124`tool-টি `computer_toolset_20260801`দিয়ে বদলান এবং guide অনুযায়ী tool loop হালনাগাদ করুন। Haiku 4.5-এর Priority Tier capacity ব্যবহার করা সংস্থারও আলাদা পরিকল্পনা দরকার: guide বলছে Haiku 5.5-এ Priority Tier নেই।

এই পরিবর্তনগুলো সব কাজের জন্য এক effort setting নির্ধারণ করে না। তুলনায় application task এবং acceptance criteria একই রাখতে হবে; তারপর বিবেচিত setting-এ উত্তরের মান, প্রত্যাখ্যান, truncation, latency এবং বিল করা token নথিভুক্ত করতে হবে। Anthropic একাধিক benchmark-এ Haiku 5.5-এর ফল 4.5-এর চেয়ে ভালো বলে জানিয়েছে; তাদের Terminal-Bench 4.0 টেবিলে 39.2% বনাম 0.0% রয়েছে। এগুলো Anthropic-এর নিজস্ব মূল্যায়ন-শর্তে পাওয়া ফল, পাঠকের agent-এর মাপ নয়। ওই benchmark-এ জটিল agentic coding-এর জন্য Sonnet 5.5 এবং Opus 5.5 বেশি উপযোগী বলেও Anthropic জানায়। Haiku 4.5 ব্যবহারকারীর নিকটবর্তী সিদ্ধান্ত হলো API পরিবর্তন ও নতুন token সংখ্যা ধরার পরও ছোট মডেলটি প্রতিটি নির্দিষ্ট ধাপের প্রয়োজন পূরণ করে কি না।

## সূত্র ও আরও পড়ুন

- [Haiku 5.5 নিয়ে Anthropic-এর ঘোষণা](https://www.anthropic.com/claude-haiku-5-5)প্রকাশের তারিখ, লক্ষ্যকৃত কাজ ও প্রাপ্যতা জানায় এবং কোম্পানির গড় task cost হিসাব ব্যাখ্যা করে। এর benchmark table-এ Anthropic-এর মূল্যায়নের ফল রয়েছে।
- [Claude Platform-এর Haiku 5.5 মডেল পেজ](https://platform.claude.com/docs/en/models/haiku-5-5/overview)ID, context ও output সীমা, prompt-দৈর্ঘ্য মূল্যস্তর, cache-এর দাম এবং platform support তালিকাভুক্ত করে। [Haiku 4.5 পেজ](https://platform.claude.com/docs/en/models/haiku-4-5/overview)আগের মডেলের হার ও সীমা দেয়।
- [Haiku 5.5 মাইগ্রেশন গাইড](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)বিদ্যমান integration বদলানোর আগে Messages API-এর যেসব পরিবর্তন ও error যাচাই করতে হবে তা জানায়। [token-count API রেফারেন্স](https://platform.claude.com/docs/en/api/go/messages/count_tokens)নির্বাচিত মডেল দিয়ে request গণনার পদ্ধতি নথিভুক্ত করে।
- [৭ অক্টোবরের প্রকাশনা নিয়ে Reuters-এর প্রতিবেদন](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)স্বাধীনভাবে প্রকাশের তারিখ সমর্থন করে। ওপরের কারিগরি সেটিংস ও হার Anthropic-এর বর্তমান নথি থেকে নেওয়া।

## Sources

- [Anthropic, Claude Haiku 5.5 প্রকাশ](https://www.anthropic.com/claude-haiku-5-5) — প্রকাশের তারিখ, লক্ষ্যকৃত কাজ, বিক্রেতার benchmark ও গড় খরচের দাবি, হিসাবের ফুটনোট এবং cloud-এ প্রাপ্যতা।
- [Claude Haiku 5.5 মডেলের পরিচিতি](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — বর্তমান মডেল ID, prompt দৈর্ঘ্য অনুযায়ী API দাম, cache ও batch হার, context, output এবং প্রাপ্যতা।
- [Claude Haiku 4.5 মডেলের পরিচিতি](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — আগের মডেলের বর্তমান legacy অবস্থা, তালিকাভুক্ত হার ও সীমা।
- [Claude Haiku 5.5 মাইগ্রেশন গাইড](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Messages API-এর প্রধান পরিবর্তনের checklist এবং tokenizer নির্দেশনা।
- [একটি Message-এ token গোনা](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — token-count endpoint ও মডেলভিত্তিক request গণনা।
- [Reuters: Anthropic তৃতীয় Claude 5.5 মডেল চালু করেছে](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — শুধু স্বাধীনভাবে প্রকাশনা নিশ্চিত করার জন্য।