Anthropic Claude Opus 5.5 চালু করেছে ২২ সেপ্টেম্বর। কোম্পানির দাবি, অধিকাংশ কাজে এর কর্মদক্ষতা Fable 5.1-এর কাছাকাছি এবং Opus 5-এর চেয়ে দাম কম।
আগে থেকেই Opus 5 ব্যবহার করা দলের জন্য এটি শুধু সস্তা model ID নয়। Opus 5.5-এ adaptive thinking সব সময় চালু, default effort level medium, আর Opus 5 যে কিছু request মেনে নিত সেগুলোর কয়েকটি এখন প্রত্যাখ্যাত হয়। তত্ত্বাবধানযুক্ত কাজের জন্য Anthropic একে Fable 5.1-এর নিচের tier-এ দৈনন্দিন প্রস্তাবিত model হিসেবে রেখেছে; Fable রেখেছে সবচেয়ে কঠিন ও দীর্ঘ autonomous কাজের জন্য।
বড় পরিবর্তন
- কী বদলেছে: Opus 5.5 input ও output rate ২০% এবং cache read rate ৬০% কমায়। সব সময় চালু adaptive thinking-এর কারণে বিদ্যমান API client-কে কাজের request ও budget কীভাবে নির্ধারণ করতে হবে, সেটিও বদলে যায়।
- কেন গুরুত্বপূর্ণ: Agent-এর দীর্ঘ কাজের সময় পুরোনো নির্দেশনা ও tool-এর ফল বারবার পড়া হয়। সবচেয়ে বড় দাম-কমানো হয়েছে এই পুনর্ব্যবহৃত context-এ, তাই পুরো কাজের খরচ বুঝতে cache ব্যবহার গুরুত্বপূর্ণ।
- কী লক্ষ করবেন: Sonnet 5.5 ও Haiku 5.5 আগামী কয়েক সপ্তাহে আসবে বলে ঘোষণা হয়েছে; আপাতত Opus-ই পাওয়া যাচ্ছে। default বেছে নিতে সম্পন্ন কাজের খরচ এবং প্রতিটি tier-এ কী ধরনের পর্যালোচনা লাগে, তা তুলনা করুন।
Opus 5.5-এর লক্ষ্য Fable tier-এর নিচের production কাজ
Anthropic অংশীদারদের জন্য Opus 5.5-কে production coding, আর্থিক ও আইনি তথ্য-সংক্রান্ত কাজ এবং agent-এর default option বলেছে। তাদের model বেছে নেওয়ার প্রকাশ্য নির্দেশিকায় অধিকাংশ কাজ Opus 5.5 দিয়ে শুরু হয় এবং জটিল agent-ভিত্তিক coding ও enterprise কাজের জন্য একে রাখা হয়েছে। আলাদা cost guide-এ একে তত্ত্বাবধানযুক্ত feature কাজ, debugging ও code review-এর “দৈনন্দিন model” বলা হয়েছে। দুই guide-ই Fable 5.1-কে এর ওপরে রাখে, যখন token-এর দামের চেয়ে সর্বোচ্চ সক্ষমতা বা দীর্ঘ ও কঠিন কাজ বেশি গুরুত্বপূর্ণ।
Anthropic-এর prompting guide এই বিস্তৃত দাবির পক্ষে root-cause analysis, code checking, parallel subagent, research, spreadsheet, report ও presentation নিয়ে কোম্পানির পরীক্ষা তুলে ধরে। এতে অগ্রগতির স্পষ্ট বার্তা এবং vision ও computer use-এ উন্নতির কথাও আছে। এগুলো Anthropic-এর মূল্যায়ন, BIG CHANGE-এর পরীক্ষা নয়।
Opus ও Fable-এর পার্থক্য গুরুত্বপূর্ণ, কারণ Fable 5.1-এর rate প্রতি million input token-এ $10 এবং output token-এ $50; Opus 5.5-এর rate যথাক্রমে $4 ও $20। Cache read rate কাছাকাছি: $0.25 এবং $0.20। তাই দীর্ঘ cache-করা session-এ মূল input ও output rate-এর তুলনায় দামের ব্যবধান ছোট হতে পারে।
Claude Opus 5.5-এর API-তে চারটি rate বদলেছে
নিচের standard API দাম প্রতি million token-এ। Anthropic-এর model reference-এ Opus 5.5-এর context window 1 million token এবং সর্বোচ্চ output 128,000 token বলা হয়েছে। তাদের pricing documentation বলছে, সম্পূর্ণ context window-তেই standard rate প্রযোজ্য।
API charge | Opus 5.5 | Opus 5 | পরিবর্তন |
|---|---|---|---|
Input | $4 | $5 | ২০% কম |
Output | $20 | $25 | ২০% কম |
৫ মিনিটের cache write | $5 | $6.25 | ২০% কম |
Cache read | $0.20 | $0.50 | ৬০% কম |
Anthropic-এর হিসাবে default setting-এ অধিকাংশ কাজের খরচ ৪০% কম; এতে rate এবং token ব্যবহারের দক্ষতা—দুটিই ভূমিকা রাখে। তাদের work-cost ব্যাখ্যায় দেখানো হয়েছে কেন কাজভেদে পার্থক্য হয়: agent-এর দীর্ঘ session-এ বাড়তে থাকা context বারবার পড়া হয়, output-এ thinking token থাকে এবং একটি কাজের জন্য একাধিক ধাপ লাগতে পারে। Cache read-এ ৬০% ছাড় cache-নির্ভর session-এ বড় প্রভাব ফেলতে পারে; অন্যদিকে ছোট uncached request ও দীর্ঘ উত্তর output rate-এর ২০% কমার কাছাকাছি সুবিধা পাবে।
prompting guide অনুযায়ী, output লেখার গতি ৩০%-এর বেশি উন্নত হয়েছে। এতে tool, test, বাহ্যিক service বা reviewer-এর অপেক্ষার সময় মাপা হয়নি। Anthropic আরও একটি faster API mode দেয়, যার rate প্রতি million input token-এ $8 এবং output token-এ $40। এটি Claude API-তে research preview হিসেবে আছে, partner cloud platform-এ নয়।
Anthropic Pro, Max, Team এবং seat-ভিত্তিক Enterprise plan-এ পাঁচ ঘণ্টার usage limit-ও বাড়িয়েছে, সঙ্গে rollover reset দিয়েছে। Subscription-এর capacity API billing থেকে আলাদা।
কোম্পানির benchmark-এ সক্ষমতা ও সীমা দুটোই দেখা যায়
Anthropic-এর হিসাবে, Terminal-Bench 4.0-এ Opus 5.5-এর xhigh score 66.4%, Opus 5-এর 52.3% এবং Fable 5.1-এর 55.8%। অন্যান্য অধিকাংশ শীর্ষ ফল max effort-এ মাপা হয়েছে।
দেখানো AutomationBench ও Terminal-Bench-Science ফলাফলে GPT-6 Astra এগিয়ে। নিরাপত্তা-নিয়ন্ত্রিত cyber কাজের জন্য Opus 4.8 এবং biology ও frontier-model development কাজের জন্য Opus 5 ব্যবহৃত হয়েছে। AutomationBench-এ fallback ছিল না।
Anthropic-এর প্রতিবেদন অনুযায়ী, তাদের আচরণগত audit-এ এমন কাজের সংখ্যা কমেছে, যা ফেরানো যায় না বা নির্ধারিত সীমা ছাড়িয়ে যায়। তাদের prompting guide-এ আগের Opus model-এর তুলনায় indirect prompt injection ঠেকানোর উন্নতির কথাও বলা হয়েছে। দুটোই কোম্পানির পরিচালিত পরীক্ষা; সাধারণ নিরাপত্তা সনদ নয়।
বিদ্যমান API client-কে স্পষ্টভাবে migration করতে হবে
API গ্রাহকদের স্পষ্টভাবে claude-opus-5-5 model হিসেবে request করতে হবে; Opus 5-এর বর্তমান call নিজে থেকে model বদলায় না। Anthropic-এর migration reference-এ বেশ কিছু request পরিবর্তন তালিকাভুক্ত, যা না করলে error হতে পারে বা app-এর output stream বদলে যেতে পারে।
Migration-এর বিষয় | Opus 5.5-এর আচরণ |
|---|---|
Model নির্বাচন | স্পষ্টভাবে |
Thinking | Adaptive thinking সব সময় চালু। এটি বন্ধ করা বা token-এর manual budget দিলে HTTP 400 error আসে। |
Effort | ব্যবহার করুন: |
জোর করে নির্ধারিত tool | |
Computer use | পুরোনো |
অগ্রগতির বার্তা | Tool call-এর মাঝখানে আসা text thinking block-এ থাকে; যেসব client default-এ তা দেখায় না, সেগুলো call-এর মধ্যে নীরব মনে হতে পারে। |
দীর্ঘসময় চলা client-এর জন্য সংরক্ষিত thinking আরও একটি সীমা তৈরি করে। Thinking block নির্দিষ্ট model ও কথোপকথনের prefix-এর সঙ্গে বাঁধা। ৩১ আগস্ট ২০২৬ বা তার পরে তৈরি API ও cloud-platform account-এ block আবার পাঠানোর আগে আগের instruction, tool বা message বদলালে default-এ HTTP 400 error আসে। Anthropic-এর সংরক্ষিত thinking-এর documentation শুধু শেষে যোগ করার নিয়ম এবং অসামঞ্জস্যপূর্ণ block বাদ দেওয়ার নিয়ন্ত্রিত বিকল্প ব্যাখ্যা করে।
Safety routing উত্তরদাতা model বদলে দিতে পারে
Anthropic-এর prompting guide Fable 5.1-স্তরের biology safeguard এবং cybersecurity ও reasoning তথ্য বের করার জন্য classifier-এর বর্ণনা দেয়। Source-code-এর দুর্বলতা খুঁজে বের করা অনুমোদিতই থাকে, এবং প্রতিষ্ঠানগুলো life-sciences verification-এর আবেদন করতে পারে। উন্নত cyber verification আগামী কয়েক সপ্তাহে আসবে বলে জানানো হয়েছে।
প্রত্যাখ্যাত উত্তরেও HTTP 200 ও stop_reason: "refusal" ফিরে আসতে পারে। Anthropic-এর fallback documentation-এ server-side fallback, SDK middleware এবং client-নিয়ন্ত্রিত retry-এর বর্ণনা রয়েছে। সমর্থিত পথগুলোর একটি configure করা থাকলেই fallback চলে; প্রতিটি Opus 5.5 request-এর সঙ্গে এটি স্বয়ংক্রিয়ভাবে পাওয়ার নিশ্চয়তা নেই। যেসব শ্রেণির জন্য প্রস্তাবিত fallback নেই, সেগুলোর request তবুও প্রত্যাখ্যাত হতে পারে।
তাই কোন model উত্তর দিচ্ছে, সেটিও ফলাফলের অংশ। Opus 5.5-এ যাওয়া app-কে refusal এবং fallback দিয়ে দেওয়া response আলাদা করে নথিভুক্ত করতে হবে, বিশেষত সুরক্ষিত domain-এর কাজের ক্ষেত্রে। কম rate ও বিস্তৃত সক্ষমতার দাবিগুলো Opus 5.5-এর জন্য; অন্য model-এ route করা request আসলে উত্তর দেওয়া model-এর আচরণ ও সীমা অনুসরণ করে।



