এজেন্ট সিস্টেমে কলের পরিমাণের বড় অংশ জুড়ে থাকতে পারে এমন ছোট ও ঘনঘন কাজের জন্য Anthropic ৭ অক্টোবর Claude Haiku 5.5 প্রকাশ করেছে। Claude API-এর তালিকাভুক্ত হার প্রতি দশ লক্ষ ইনপুট টোকেনে $0.10 এবং প্রতি দশ লক্ষ আউটপুট টোকেনে $0.50 থেকে শুরু—Haiku 4.5-এর হারের দশ ভাগের এক ভাগ। তবে Anthropic বলছে, একই লেখায় নতুন মডেলে প্রায় ৩০% বেশি টোকেন লাগে এবং 100,000 টোকেনের বেশি prompt উচ্চতর মূল্যস্তরে পড়ে। বিল অনুমান বা production traffic সরানোর আগে Haiku 4.5 ব্যবহারকারী দলগুলোর নিজেদের অনুরোধ আবার গুনে দেখা দরকার।
এই রিলিজে Messages API ব্যবহারের পথও বদলেছে। Haiku 5.5-এ হাতে নির্ধারিত thinking budget কাজ করে না, adaptive thinking ডিফল্টভাবে চালু থাকে, আর প্রথম response block-টি লেখার বদলে thinking হতে পারে। ছোট মডেলকে বারবার ডেকে শ্রেণিবিন্যাস, তথ্য বের করা, রুট করা বা সারসংক্ষেপ তৈরির পরিষেবাগুলোর জন্য এগুলো নির্দিষ্ট compatibility check।
মূল পরিবর্তন
- কী বদলেছে: Anthropic নতুন এক মিলিয়ন-টোকেন context window এবং adaptive thinking-কে Claude-এর সবচেয়ে কমদামি স্তরে এনেছে। Haiku 5.5 ছোট prompt-এর হার কমায়, পাশাপাশি কীভাবে লেখা গোনা হয় এবং response কীভাবে শুরু হতে পারে তা বদলায়।
- কেন এটি গুরুত্বপূর্ণ: কম প্রকাশিত হারে আরও ঘনঘন ও নির্দিষ্ট পরিসরের এজেন্ট ধাপে Claude ব্যবহার করা যায় কি না, দলগুলো এখন তা বিবেচনা করতে পারে। লাভ নির্ভর করে prompt-এর দৈর্ঘ্যের মিশ্রণ, output ও thinking token, cache ব্যবহার এবং নতুন মডেলটি ওই ধাপের মানের লক্ষ্য পূরণ করে কি না তার ওপর।
- যা নজরে রাখবেন: Haiku 4.5 integration মেপে মেপে migrate করতে হবে। 100,000-টোকেন সীমার কাছাকাছি অনুরোধ আবার গুনলে উচ্চতর স্তরে যেতে পারে; প্রথম content block-কে লেখা ধরে নেওয়া code অন্যভাবে সফল হওয়া response-ও ভুলভাবে সামলাতে পারে।
prompt-এর দৈর্ঘ্য অনুযায়ী দাম
Claude API-তে 100,000 টোকেন পর্যন্ত prompt-এর জন্য Haiku 5.5-এর দাম প্রতি দশ লক্ষ ইনপুট টোকেনে $0.10 এবং প্রতি দশ লক্ষ আউটপুট টোকেনে $0.50। সীমা পেরোলে সংশ্লিষ্ট হার $0.50 ও $2.50। Haiku 4.5-এর 200,000-টোকেন context window জুড়ে তালিকাভুক্ত হার $1 ও $5। Haiku 5.5-এর context window এক মিলিয়ন টোকেন এবং সর্বোচ্চ output 128,000 টোকেন; Haiku 4.5-এ তা 200,000 ও 64,000। Anthropic Claude API, Amazon Bedrock, AWS-এর Claude Platform, Google Cloud এবং Microsoft Foundry-তে প্রাপ্যতার কথা জানিয়েছে। Amazon Bedrock-এর মডেল ID হলো anthropic.claude-haiku-5-5; Claude API ব্যবহার করে claude-haiku-5-5। Anthropic-এর মডেল পেজগুলো বর্তমান platform ID, সীমা ও হার জানায়।
Anthropic-এর মতে, Haiku 5.5 চালাতে Haiku 4.5-এর তুলনায় প্রায় 75% কম খরচ হয় গড়ে চালানোর খরচ। ফুটনোটে 100,000 টোকেন পর্যন্ত prompt-এর 90% কম তালিকাভুক্ত হার, তার বেশি হলে 50% কম হার, Haiku 4.5-এর 90% অনুরোধ ছোট শ্রেণিতে ছিল—এই পর্যবেক্ষণ, এবং একই কাজের জন্য নতুন tokenizer-এর বেশি টোকেন গণনা একসঙ্গে ধরা হয়েছে। এই হিসাব Anthropic-এর অনুরোধের মিশ্রণ বোঝায়, প্রতিটি অনুরোধে সমান ছাড় নয়। একই ইনপুট লেখায় প্রায় 30% টোকেন বৃদ্ধিও বিক্রেতার অনুমান; সঠিক পরিবর্তন বিষয়বস্তুর ওপর নির্ভর করে। Anthropic-এর প্রকাশনা-ঘোষণা দাবি এবং হিসাবের পদ্ধতি—দুটিই জানায়।
cache-বিহীন Claude API অনুরোধের জন্য Haiku 5.5-এর ইনপুট ও আউটপুট টোকেন সংখ্যা নিন, প্রতিটিকে ওই অনুরোধের prompt-দৈর্ঘ্য মূল্যস্তরএর হারে গুণ করে এক মিলিয়ন দিয়ে ভাগ করুন। হিসাবের উদাহরণ: ছোট-prompt হারে 80,000 ইনপুট ও 10,000 আউটপুট টোকেনের খরচ $0.013। 120,000 ইনপুট ও 10,000 আউটপুট টোকেনে দীর্ঘ-prompt হারে খরচ $0.085। এগুলো দামের হিসাব, দেখা কাজ বা পূর্বাভাস নয়। Cache পড়া ও লেখার আলাদা হার আছে; batch processing-এ ইনপুট ও আউটপুট উভয়ের ওপর 50% ছাড় তালিকাভুক্ত। তাই কার্যকর অনুমানের জন্য বাস্তব call-গুলো prompt-এর দৈর্ঘ্য ও cache আচরণ অনুযায়ী ভাগ করে তারপর যোগ করা উচিত। Haiku 5.5 মডেল পেজে এই বিভাগগুলো তালিকাভুক্ত আছে।
সংরক্ষিত প্রতিনিধিত্বমূলক prompt আবার গুনুন Message token-count endpointদিয়ে, এবং উল্লেখ করুন claude-haiku-5-5। পুরোনো মডেলের মোট token সংখ্যা থেকে 5.5-এ prompt কোন স্তরে পড়বে তা বোঝা যায় না। বাস্তব নমুনায় কাজের ফলের সঙ্গে response-এর usage, output-এর দৈর্ঘ্য, cache field, effort এবং প্রকৃত চার্জ নথিভুক্ত করুন। ছোট অনুরোধ, সবচেয়ে দীর্ঘ পুনরাবৃত্ত কথোপকথন এবং 100,000 টোকেনের কাছাকাছি উদাহরণ রাখুন। BIG CHANGE নথি পর্যালোচনা করেছে; Haiku 5.5 চালায়নি বা production workload মাপেনি।
মাইগ্রেশনের সময় যে সেটিংসগুলো আবার দেখতে হবে
Anthropic-এর Haiku 5.5 মাইগ্রেশন গাইড Haiku 4.5 থেকে বদলানো client-দের জন্য বেশ নির্দিষ্ট একটি checklist দিয়েছে:
- platform অনুযায়ী মডেল ID বদলান এবং prompt আবার গুনুন।
claude-haiku-5-5তারিখের suffix বা আলাদা alias ছাড়া স্থির Claude API ID।max_tokensপর্যালোচনা করুন, কারণ thinking ওই সীমা ব্যবহার করে এবং একই লেখায় বেশি টোকেন লাগতে পারে। - বদলান
thinking: {"type":"enabled","budget_tokens":N}adaptive thinking দিয়ে, অথবাthinkingঅনির্ধারিত রাখুন। গভীরতা ঠিক করতেoutput_config.effortসেট করুন; নথিভুক্ত default হলোmedium। কমmax_tokensথাকলে thinking block-এর পর, কোনো লেখা আসার আগেই response শেষ হতে পারে। - content block অবস্থান দিয়ে নয়,
typeদিয়ে পড়ুন। tool result-এর সঙ্গে thinking block অপরিবর্তিত রেখে ফেরত দিন। অন্য account দিয়ে block replay করে, অথবা আগের message, system instruction বা tool বদলে দেয়—এমন যেকোনো conversation store পরীক্ষা করুন। - নিজস্ব
temperature,top_pওtop_kসেটিংস সরান। শেষ assistant prefill-কে user turn দিয়ে বদলান; সীমাবদ্ধ format-এ Anthropic-এর নথিভুক্ত structured-output বা tool পদ্ধতি ব্যবহার করুন। client-এstop_reasonমানেরrefusalসামলান। - integration Claude API বা Google Cloud-এ computer use ব্যবহার করলে পুরোনো
computer_20250124tool-টিcomputer_toolset_20260801দিয়ে বদলান এবং guide অনুযায়ী tool loop হালনাগাদ করুন। Haiku 4.5-এর Priority Tier capacity ব্যবহার করা সংস্থারও আলাদা পরিকল্পনা দরকার: guide বলছে Haiku 5.5-এ Priority Tier নেই।
এই পরিবর্তনগুলো সব কাজের জন্য এক effort setting নির্ধারণ করে না। তুলনায় application task এবং acceptance criteria একই রাখতে হবে; তারপর বিবেচিত setting-এ উত্তরের মান, প্রত্যাখ্যান, truncation, latency এবং বিল করা token নথিভুক্ত করতে হবে। Anthropic একাধিক benchmark-এ Haiku 5.5-এর ফল 4.5-এর চেয়ে ভালো বলে জানিয়েছে; তাদের Terminal-Bench 4.0 টেবিলে 39.2% বনাম 0.0% রয়েছে। এগুলো Anthropic-এর নিজস্ব মূল্যায়ন-শর্তে পাওয়া ফল, পাঠকের agent-এর মাপ নয়। ওই benchmark-এ জটিল agentic coding-এর জন্য Sonnet 5.5 এবং Opus 5.5 বেশি উপযোগী বলেও Anthropic জানায়। Haiku 4.5 ব্যবহারকারীর নিকটবর্তী সিদ্ধান্ত হলো API পরিবর্তন ও নতুন token সংখ্যা ধরার পরও ছোট মডেলটি প্রতিটি নির্দিষ্ট ধাপের প্রয়োজন পূরণ করে কি না।
সূত্র ও আরও পড়ুন
- Haiku 5.5 নিয়ে Anthropic-এর ঘোষণাপ্রকাশের তারিখ, লক্ষ্যকৃত কাজ ও প্রাপ্যতা জানায় এবং কোম্পানির গড় task cost হিসাব ব্যাখ্যা করে। এর benchmark table-এ Anthropic-এর মূল্যায়নের ফল রয়েছে।
- Claude Platform-এর Haiku 5.5 মডেল পেজID, context ও output সীমা, prompt-দৈর্ঘ্য মূল্যস্তর, cache-এর দাম এবং platform support তালিকাভুক্ত করে। Haiku 4.5 পেজআগের মডেলের হার ও সীমা দেয়।
- Haiku 5.5 মাইগ্রেশন গাইডবিদ্যমান integration বদলানোর আগে Messages API-এর যেসব পরিবর্তন ও error যাচাই করতে হবে তা জানায়। token-count API রেফারেন্সনির্বাচিত মডেল দিয়ে request গণনার পদ্ধতি নথিভুক্ত করে।
- ৭ অক্টোবরের প্রকাশনা নিয়ে Reuters-এর প্রতিবেদনস্বাধীনভাবে প্রকাশের তারিখ সমর্থন করে। ওপরের কারিগরি সেটিংস ও হার Anthropic-এর বর্তমান নথি থেকে নেওয়া।



