Anthropic ने Claude Opus 5.5 लॉन्च किया 22 सितंबर को। कंपनी का दावा है कि अधिकांश काम में इसका प्रदर्शन Fable 5.1 के करीब है और कीमत Opus 5 से कम है।

पहले से Opus 5 इस्तेमाल कर रही टीमों के लिए यह बदलाव सिर्फ़ सस्ता मॉडल ID नहीं है। Opus 5.5 में adaptive thinking हमेशा चालू रहती है, डिफ़ॉल्ट प्रयास स्तर medium है और अनुरोध के कई ऐसे रूप अस्वीकार होते हैं जिन्हें Opus 5 स्वीकार करता था। निगरानी वाले काम के लिए Anthropic इसे Fable 5.1 से नीचे रोज़मर्रा के सुझाए गए मॉडल के रूप में रखता है; Fable को सबसे कठिन और लंबे स्वायत्त कार्यों के लिए रखता है।

बड़ा बदलाव

  • क्या बदला: Opus 5.5 इनपुट और आउटपुट दरें 20% तथा कैश-पठन दरें 60% घटाता है। हमेशा चालू रहने वाली adaptive thinking से यह भी बदलता है कि मौजूदा API क्लाइंट को काम का अनुरोध और बजट कैसे तय करना चाहिए।
  • यह क्यों मायने रखता है: एजेंट के लंबे काम में पुराने निर्देश और टूल के नतीजे बार-बार पढ़े जाते हैं। सबसे बड़ी कीमत-कटौती इसी दोबारा इस्तेमाल होने वाले संदर्भ पर है, इसलिए पूरे काम का बिल समझने के लिए कैश उपयोग अहम है।
  • क्या देखना है: आने वाले हफ्तों के लिए Sonnet 5.5 और Haiku 5.5 की घोषणा हुई है; फिलहाल Opus उपलब्ध है। डिफ़ॉल्ट चुनने के लिए पूरे किए गए काम की लागत और हर टियर को मिलने वाली समीक्षा की तुलना करें।

Opus 5.5 का लक्ष्य Fable टियर से नीचे के उत्पादन कार्य हैं

Anthropic अपने भागीदारों के लिए Opus 5.5 को उत्पादन कोडिंग, वित्तीय और कानूनी जानकारी वाले काम तथा एजेंटों का डिफ़ॉल्ट विकल्प बताता है। उसकी मॉडल चुनने की सार्वजनिक गाइड कहती है कि अधिकांश काम Opus 5.5 से शुरू होते हैं और उसे जटिल एजेंट-आधारित कोडिंग तथा एंटरप्राइज़ कामों के लिए रखती है। अलग लागत गाइड इसे निगरानी वाले फ़ीचर कार्य, डीबगिंग और कोड समीक्षा का “दैनिक मॉडल” कहती है। दोनों गाइड Fable 5.1 को उससे ऊपर रखती हैं, जब टोकन कीमत से अधिक अहम उच्चतम क्षमता या लंबा कठिन कार्य हो।

Anthropic की प्रॉम्प्टिंग गाइड इस व्यापकता के समर्थन में मूल-कारण विश्लेषण, कोड जांच, समानांतर सबएजेंट, शोध, स्प्रेडशीट, रिपोर्ट और प्रस्तुतियों पर कंपनी के परीक्षण देती है। इसमें प्रगति के स्पष्ट संदेश और अंतिम सारांश तथा विज़न और कंप्यूटर उपयोग में सुधार भी बताए गए हैं। ये Anthropic के मूल्यांकन हैं, BIG CHANGE के परीक्षण नहीं।

Opus और Fable का फर्क इसलिए मायने रखता है कि Fable 5.1 की दर प्रति दस लाख इनपुट टोकन $10 और आउटपुट टोकन $50 है, जबकि Opus 5.5 की दरें $4 और $20 हैं। कैश-पठन की दरें कहीं नज़दीक हैं: $0.25 और $0.20। इसलिए लंबे, कैश किए सत्रों में कीमत का अंतर इनपुट और आउटपुट की मुख्य दरों से छोटा हो सकता है।

Claude Opus 5.5 की API कीमतें चार दरें बदलती हैं

नीचे की मानक API कीमतें प्रति दस लाख टोकन हैं। Anthropic का मॉडल संदर्भ Opus 5.5 के लिए 1 मिलियन टोकन की कॉन्टेक्स्ट विंडो और अधिकतम 128,000 टोकन का आउटपुट बताता है। उसका कीमतों का दस्तावेज़ कहता है कि पूरी कॉन्टेक्स्ट विंडो पर मानक दरें लगती हैं।

API शुल्क

Opus 5.5

Opus 5

बदलाव

इनपुट

$4

$5

20% कम

आउटपुट

$20

$25

20% कम

5-मिनट कैश लेखन

$5

$6.25

20% कम

कैश पठन

$0.20

$0.50

60% कम

Anthropic का कहना है कि डिफ़ॉल्ट सेटिंग में सामान्य काम की लागत 40% कम होती है; इसमें दरें और टोकन दक्षता दोनों शामिल हैं। उसकी काम की लागत की व्याख्या दिखाती है कि अलग-अलग उपयोग क्यों मायने रखते हैं: एजेंट के लंबे सत्र बढ़ते संदर्भ को बार-बार पढ़ते हैं, आउटपुट में सोचने के टोकन शामिल होते हैं और एक काम में कई दौर लग सकते हैं। कैश-पठन में 60% की कटौती कैश पर निर्भर सत्र पर बड़ा असर डाल सकती है, जबकि छोटा बिना कैश अनुरोध और लंबा जवाब आउटपुट दर में 20% कटौती के करीब होगा।

प्रॉम्प्टिंग गाइड के अनुसार, 30% से अधिक सुधार आउटपुट लिखने की गति में है। यह टूल, परीक्षण, बाहरी सेवाओं या समीक्षक की प्रतीक्षा का समय नहीं मापता। Anthropic तेज़ API मोड भी देता है जिसकी दर प्रति दस लाख इनपुट टोकन $8 और आउटपुट टोकन $40 है। यह Claude API पर शोध-पूर्वावलोकन में है, साझेदार क्लाउड प्लेटफ़ॉर्म पर नहीं।

Anthropic ने Pro, Max, Team और सीट-आधारित Enterprise योजनाओं में पांच-घंटे की सीमाएं भी बढ़ाईं और जमा किए जा सकने वाला रीसेट दिया। सदस्यता क्षमता API बिलिंग से अलग है।

कंपनी के बेंचमार्क क्षमताएं और सीमाएं दिखाते हैं

Anthropic के अनुसार, Terminal-Bench 4.0 में Opus 5.5 का xhigh स्कोर 66.4%, Opus 5 का 52.3% और Fable 5.1 का 55.8% है। अधिकतर अन्य प्रमुख नतीजे max प्रयास पर हैं।

दिखाई गई AutomationBench और Terminal-Bench-Science पंक्तियों में GPT-6 Astra आगे है। सुरक्षा-नियंत्रित साइबर कामों में Opus 4.8, जबकि जीव-विज्ञान और फ्रंटियर-मॉडल-विकास कार्यों में Opus 5 इस्तेमाल हुआ। AutomationBench में फॉलबैक नहीं था।

Anthropic की रिपोर्ट के अनुसार, उसके व्यवहार-संबंधी ऑडिट में ऐसे काम कम हुए जिन्हें वापस लेना संभव नहीं था या जो तय दायरे से बाहर थे। उसकी प्रॉम्प्टिंग गाइड पहले के Opus मॉडलों की तुलना में अप्रत्यक्ष प्रॉम्प्ट इंजेक्शन का बेहतर प्रतिरोध भी बताती है। दोनों कंपनी द्वारा किए गए परीक्षण हैं, सामान्य सुरक्षा प्रमाणन नहीं।

मौजूदा API क्लाइंट को स्पष्ट माइग्रेशन करना होगा

API ग्राहकों को स्पष्ट रूप से claude-opus-5-5 का अनुरोध करना होगा; Opus 5 की मौजूदा कॉल अपने-आप मॉडल नहीं बदलतीं। Anthropic का माइग्रेशन संदर्भ कई अनुरोध बदलाव सूचीबद्ध करता है जिनसे अन्यथा त्रुटि आ सकती है या ऐप का आउटपुट बदल सकता है।

माइग्रेशन पहलू

Opus 5.5 का व्यवहार

मॉडल चयन

स्पष्ट रूप से claude-opus-5-5 इस्तेमाल करें।

सोचने की प्रक्रिया

Adaptive thinking हमेशा चालू है। इसे बंद करना और सोचने के टोकन का मैन्युअल बजट देना HTTP 400 त्रुटि लौटाता है।

प्रयास स्तर

इस्तेमाल करें: low, medium, high, xhigh या max; डिफ़ॉल्ट है medium।

मजबूर टूल

tool_choice मान any और tool पर HTTP 400 त्रुटि आती है; auto और none समर्थित हैं।

कंप्यूटर उपयोग

पुराना computer_20251124 टूल Claude API और Google Cloud पर अस्वीकृत है; Amazon Bedrock में अब भी समर्थित है।

प्रगति संदेश

टूल कॉल के बीच आने वाला पाठ thinking ब्लॉक में होता है; डिफ़ॉल्ट रूप से छोड़े गए ऐसे पाठ को छिपाने वाला क्लाइंट कॉल के बीच चुप दिखाई दे सकता है।

लंबे समय चलने वाले क्लाइंट के लिए सुरक्षित रखी गई thinking एक और सीमा है। Thinking ब्लॉक मॉडल और बातचीत के प्रीफ़िक्स से जुड़े होते हैं। 31 अगस्त 2026 या उसके बाद बने API और क्लाउड-प्लेटफ़ॉर्म खातों में, ब्लॉक को दोबारा चलाने से पहले पुराने निर्देशों, टूल या संदेशों को बदलने पर डिफ़ॉल्ट रूप से 400 त्रुटि आती है। Anthropic का सुरक्षित रखी गई thinking का दस्तावेज़ केवल आगे जोड़ने का रास्ता और मेल न खाने वाले ब्लॉक को हटाने का नियंत्रित विकल्प समझाता है।

सुरक्षा रूटिंग जवाब देने वाला मॉडल बदल सकती है

Anthropic की प्रॉम्प्टिंग गाइड Fable 5.1 स्तर के जीव-विज्ञान सुरक्षा उपाय और साइबर सुरक्षा तथा रीजनिंग जानकारी निकालने के लिए वर्गीकारकों का वर्णन करती है। स्रोत कोड की कमज़ोरियां ढूंढना अब भी अनुमत है और संगठन जीवन-विज्ञान सत्यापन के लिए आवेदन कर सकते हैं। विस्तारित साइबर सत्यापन आने वाले हफ्तों के लिए घोषित है।

अस्वीकार किया गया जवाब HTTP 200 और stop_reason: "refusal" लौटाकर भी आ सकता है। Anthropic का फॉलबैक दस्तावेज़ सर्वर-साइड फॉलबैक, SDK मिडलवेयर और क्लाइंट-प्रबंधित दोबारा कोशिश का वर्णन करता है। फॉलबैक तभी होता है जब इन समर्थित रास्तों में से कोई सेट किया गया हो; यह हर Opus 5.5 अनुरोध के साथ अपने-आप मिलने वाला वादा नहीं है। जिन श्रेणियों के लिए सुझाया गया फॉलबैक नहीं है, उनमें अनुरोध फिर भी ठुकराया जा सकता है।

इसलिए जवाब देने वाला मॉडल भी नतीजे का हिस्सा है। Opus 5.5 पर जाने वाले ऐप को अस्वीकार किए गए और फॉलबैक से दिए गए जवाब अलग-अलग दर्ज करने चाहिए, खासकर सुरक्षित श्रेणियों वाले काम में। कम दरें और व्यापक क्षमता के दावे Opus 5.5 पर लागू हैं; रूट किया गया अनुरोध उस मॉडल के व्यवहार और सीमाओं के अनुसार चलता है जिसने वास्तव में जवाब दिया।