Anthropic Claude Opus 5.5 চালু করেছে ২২ সেপ্টেম্বর। কোম্পানির দাবি, অধিকাংশ কাজে এর কর্মদক্ষতা Fable 5.1-এর কাছাকাছি এবং Opus 5-এর চেয়ে দাম কম।

আগে থেকেই Opus 5 ব্যবহার করা দলের জন্য এটি শুধু সস্তা model ID নয়। Opus 5.5-এ adaptive thinking সব সময় চালু, default effort level medium, আর Opus 5 যে কিছু request মেনে নিত সেগুলোর কয়েকটি এখন প্রত্যাখ্যাত হয়। তত্ত্বাবধানযুক্ত কাজের জন্য Anthropic একে Fable 5.1-এর নিচের tier-এ দৈনন্দিন প্রস্তাবিত model হিসেবে রেখেছে; Fable রেখেছে সবচেয়ে কঠিন ও দীর্ঘ autonomous কাজের জন্য।

বড় পরিবর্তন

  • কী বদলেছে: Opus 5.5 input ও output rate ২০% এবং cache read rate ৬০% কমায়। সব সময় চালু adaptive thinking-এর কারণে বিদ্যমান API client-কে কাজের request ও budget কীভাবে নির্ধারণ করতে হবে, সেটিও বদলে যায়।
  • কেন গুরুত্বপূর্ণ: Agent-এর দীর্ঘ কাজের সময় পুরোনো নির্দেশনা ও tool-এর ফল বারবার পড়া হয়। সবচেয়ে বড় দাম-কমানো হয়েছে এই পুনর্ব্যবহৃত context-এ, তাই পুরো কাজের খরচ বুঝতে cache ব্যবহার গুরুত্বপূর্ণ।
  • কী লক্ষ করবেন: Sonnet 5.5 ও Haiku 5.5 আগামী কয়েক সপ্তাহে আসবে বলে ঘোষণা হয়েছে; আপাতত Opus-ই পাওয়া যাচ্ছে। default বেছে নিতে সম্পন্ন কাজের খরচ এবং প্রতিটি tier-এ কী ধরনের পর্যালোচনা লাগে, তা তুলনা করুন।

Opus 5.5-এর লক্ষ্য Fable tier-এর নিচের production কাজ

Anthropic অংশীদারদের জন্য Opus 5.5-কে production coding, আর্থিক ও আইনি তথ্য-সংক্রান্ত কাজ এবং agent-এর default option বলেছে। তাদের model বেছে নেওয়ার প্রকাশ্য নির্দেশিকায় অধিকাংশ কাজ Opus 5.5 দিয়ে শুরু হয় এবং জটিল agent-ভিত্তিক coding ও enterprise কাজের জন্য একে রাখা হয়েছে। আলাদা cost guide-এ একে তত্ত্বাবধানযুক্ত feature কাজ, debugging ও code review-এর “দৈনন্দিন model” বলা হয়েছে। দুই guide-ই Fable 5.1-কে এর ওপরে রাখে, যখন token-এর দামের চেয়ে সর্বোচ্চ সক্ষমতা বা দীর্ঘ ও কঠিন কাজ বেশি গুরুত্বপূর্ণ।

Anthropic-এর prompting guide এই বিস্তৃত দাবির পক্ষে root-cause analysis, code checking, parallel subagent, research, spreadsheet, report ও presentation নিয়ে কোম্পানির পরীক্ষা তুলে ধরে। এতে অগ্রগতির স্পষ্ট বার্তা এবং vision ও computer use-এ উন্নতির কথাও আছে। এগুলো Anthropic-এর মূল্যায়ন, BIG CHANGE-এর পরীক্ষা নয়।

Opus ও Fable-এর পার্থক্য গুরুত্বপূর্ণ, কারণ Fable 5.1-এর rate প্রতি million input token-এ $10 এবং output token-এ $50; Opus 5.5-এর rate যথাক্রমে $4 ও $20। Cache read rate কাছাকাছি: $0.25 এবং $0.20। তাই দীর্ঘ cache-করা session-এ মূল input ও output rate-এর তুলনায় দামের ব্যবধান ছোট হতে পারে।

Claude Opus 5.5-এর API-তে চারটি rate বদলেছে

নিচের standard API দাম প্রতি million token-এ। Anthropic-এর model reference-এ Opus 5.5-এর context window 1 million token এবং সর্বোচ্চ output 128,000 token বলা হয়েছে। তাদের pricing documentation বলছে, সম্পূর্ণ context window-তেই standard rate প্রযোজ্য।

API charge

Opus 5.5

Opus 5

পরিবর্তন

Input

$4

$5

২০% কম

Output

$20

$25

২০% কম

৫ মিনিটের cache write

$5

$6.25

২০% কম

Cache read

$0.20

$0.50

৬০% কম

Anthropic-এর হিসাবে default setting-এ অধিকাংশ কাজের খরচ ৪০% কম; এতে rate এবং token ব্যবহারের দক্ষতা—দুটিই ভূমিকা রাখে। তাদের work-cost ব্যাখ্যায় দেখানো হয়েছে কেন কাজভেদে পার্থক্য হয়: agent-এর দীর্ঘ session-এ বাড়তে থাকা context বারবার পড়া হয়, output-এ thinking token থাকে এবং একটি কাজের জন্য একাধিক ধাপ লাগতে পারে। Cache read-এ ৬০% ছাড় cache-নির্ভর session-এ বড় প্রভাব ফেলতে পারে; অন্যদিকে ছোট uncached request ও দীর্ঘ উত্তর output rate-এর ২০% কমার কাছাকাছি সুবিধা পাবে।

prompting guide অনুযায়ী, output লেখার গতি ৩০%-এর বেশি উন্নত হয়েছে। এতে tool, test, বাহ্যিক service বা reviewer-এর অপেক্ষার সময় মাপা হয়নি। Anthropic আরও একটি faster API mode দেয়, যার rate প্রতি million input token-এ $8 এবং output token-এ $40। এটি Claude API-তে research preview হিসেবে আছে, partner cloud platform-এ নয়।

Anthropic Pro, Max, Team এবং seat-ভিত্তিক Enterprise plan-এ পাঁচ ঘণ্টার usage limit-ও বাড়িয়েছে, সঙ্গে rollover reset দিয়েছে। Subscription-এর capacity API billing থেকে আলাদা।

কোম্পানির benchmark-এ সক্ষমতা ও সীমা দুটোই দেখা যায়

Anthropic-এর হিসাবে, Terminal-Bench 4.0-এ Opus 5.5-এর xhigh score 66.4%, Opus 5-এর 52.3% এবং Fable 5.1-এর 55.8%। অন্যান্য অধিকাংশ শীর্ষ ফল max effort-এ মাপা হয়েছে।

দেখানো AutomationBench ও Terminal-Bench-Science ফলাফলে GPT-6 Astra এগিয়ে। নিরাপত্তা-নিয়ন্ত্রিত cyber কাজের জন্য Opus 4.8 এবং biology ও frontier-model development কাজের জন্য Opus 5 ব্যবহৃত হয়েছে। AutomationBench-এ fallback ছিল না।

Anthropic-এর প্রতিবেদন অনুযায়ী, তাদের আচরণগত audit-এ এমন কাজের সংখ্যা কমেছে, যা ফেরানো যায় না বা নির্ধারিত সীমা ছাড়িয়ে যায়। তাদের prompting guide-এ আগের Opus model-এর তুলনায় indirect prompt injection ঠেকানোর উন্নতির কথাও বলা হয়েছে। দুটোই কোম্পানির পরিচালিত পরীক্ষা; সাধারণ নিরাপত্তা সনদ নয়।

বিদ্যমান API client-কে স্পষ্টভাবে migration করতে হবে

API গ্রাহকদের স্পষ্টভাবে claude-opus-5-5 model হিসেবে request করতে হবে; Opus 5-এর বর্তমান call নিজে থেকে model বদলায় না। Anthropic-এর migration reference-এ বেশ কিছু request পরিবর্তন তালিকাভুক্ত, যা না করলে error হতে পারে বা app-এর output stream বদলে যেতে পারে।

Migration-এর বিষয়

Opus 5.5-এর আচরণ

Model নির্বাচন

স্পষ্টভাবে claude-opus-5-5 ব্যবহার করুন।

Thinking

Adaptive thinking সব সময় চালু। এটি বন্ধ করা বা token-এর manual budget দিলে HTTP 400 error আসে।

Effort

ব্যবহার করুন: low, medium, high, xhigh অথবা max; default হলো medium।

জোর করে নির্ধারিত tool

tool_choice value any এবং tool-এ HTTP 400 error হয়; auto এবং none সমর্থিত থাকে।

Computer use

পুরোনো computer_20251124 tool Claude API ও Google Cloud-এ প্রত্যাখ্যাত হয়; Amazon Bedrock-এ এখনো সমর্থিত।

অগ্রগতির বার্তা

Tool call-এর মাঝখানে আসা text thinking block-এ থাকে; যেসব client default-এ তা দেখায় না, সেগুলো call-এর মধ্যে নীরব মনে হতে পারে।

দীর্ঘসময় চলা client-এর জন্য সংরক্ষিত thinking আরও একটি সীমা তৈরি করে। Thinking block নির্দিষ্ট model ও কথোপকথনের prefix-এর সঙ্গে বাঁধা। ৩১ আগস্ট ২০২৬ বা তার পরে তৈরি API ও cloud-platform account-এ block আবার পাঠানোর আগে আগের instruction, tool বা message বদলালে default-এ HTTP 400 error আসে। Anthropic-এর সংরক্ষিত thinking-এর documentation শুধু শেষে যোগ করার নিয়ম এবং অসামঞ্জস্যপূর্ণ block বাদ দেওয়ার নিয়ন্ত্রিত বিকল্প ব্যাখ্যা করে।

Safety routing উত্তরদাতা model বদলে দিতে পারে

Anthropic-এর prompting guide Fable 5.1-স্তরের biology safeguard এবং cybersecurity ও reasoning তথ্য বের করার জন্য classifier-এর বর্ণনা দেয়। Source-code-এর দুর্বলতা খুঁজে বের করা অনুমোদিতই থাকে, এবং প্রতিষ্ঠানগুলো life-sciences verification-এর আবেদন করতে পারে। উন্নত cyber verification আগামী কয়েক সপ্তাহে আসবে বলে জানানো হয়েছে।

প্রত্যাখ্যাত উত্তরেও HTTP 200 ও stop_reason: "refusal" ফিরে আসতে পারে। Anthropic-এর fallback documentation-এ server-side fallback, SDK middleware এবং client-নিয়ন্ত্রিত retry-এর বর্ণনা রয়েছে। সমর্থিত পথগুলোর একটি configure করা থাকলেই fallback চলে; প্রতিটি Opus 5.5 request-এর সঙ্গে এটি স্বয়ংক্রিয়ভাবে পাওয়ার নিশ্চয়তা নেই। যেসব শ্রেণির জন্য প্রস্তাবিত fallback নেই, সেগুলোর request তবুও প্রত্যাখ্যাত হতে পারে।

তাই কোন model উত্তর দিচ্ছে, সেটিও ফলাফলের অংশ। Opus 5.5-এ যাওয়া app-কে refusal এবং fallback দিয়ে দেওয়া response আলাদা করে নথিভুক্ত করতে হবে, বিশেষত সুরক্ষিত domain-এর কাজের ক্ষেত্রে। কম rate ও বিস্তৃত সক্ষমতার দাবিগুলো Opus 5.5-এর জন্য; অন্য model-এ route করা request আসলে উত্তর দেওয়া model-এর আচরণ ও সীমা অনুসরণ করে।