Anthropic ने Claude Opus 5.5 लाँच केले २२ सप्टेंबर रोजी. बहुतेक कामांत Fable 5.1 जवळची कामगिरी आणि Opus 5 पेक्षा कमी दर असल्याचा कंपनीचा दावा आहे.

आधीपासून Opus 5 वापरणाऱ्या टीम्ससाठी हा बदल केवळ स्वस्त मॉडेल ID इतकाच नाही. Opus 5.5 मध्ये adaptive thinking नेहमी सुरू असते, डीफॉल्ट effort मध्यम असतो आणि Opus 5 ने स्वीकारलेले काही विनंती-स्वरूप ते नाकारते. देखरेखीखालील कामासाठी Anthropic चा दैनंदिन शिफारसीचा मॉडेल म्हणूनही ते Fable 5.1 च्या खाली आहे; सर्वात कठीण आणि दीर्घकाळ स्वायत्तपणे चालणाऱ्या कामांसाठी Fable राखले आहे.

मोठा बदल

  • काय बदलले: Opus 5.5 ने इनपुट व आउटपुट दर २०% आणि कॅश-वाचन दर ६०% कमी केले आहेत. नेहमी सुरू असलेले adaptive thinking यामुळे विद्यमान API क्लायंटना कामाची विनंती आणि बजेट आखण्याची पद्धतही बदलावी लागते.
  • हे का महत्त्वाचे: दीर्घकाळ चालणारे एजंट काम आधीच्या सूचना व टूल निकाल पुन्हा पुन्हा वाचते. पुन्हा वापरल्या जाणाऱ्या या संदर्भावर सर्वात मोठी दरकपात लागू होते; त्यामुळे संपूर्ण कामाचे बिल समजण्यासाठी कॅशचा वापर महत्त्वाचा ठरतो.
  • कशाकडे लक्ष द्यावे: Sonnet 5.5 आणि Haiku 5.5 पुढील काही आठवड्यांत येतील; सध्या प्रथम Opus उपलब्ध आहे. डीफॉल्ट मॉडेल ठरवताना पूर्ण झालेल्या कामाचा खर्च आणि प्रत्येक tier ला किती पुनरावलोकन आवश्यक आहे, यांची तुलना करा.

Opus 5.5 हे Fable tier च्या खालील उत्पादन-कामांसाठी आहे

Anthropic च्या भागीदारांसाठीच्या मांडणीत उत्पादनातील कोडिंग, वित्तीय व कायदेशीर ज्ञान-काम आणि एजंट्ससाठी Opus 5.5 हे एंटरप्राइझचे डीफॉल्ट मॉडेल सुचवले आहे. तिचे सार्वजनिक मॉडेल-निवड मार्गदर्शक बहुतेक कामांची सुरुवात Opus 5.5 पासून होते आणि गुंतागुंतीचे एजंट-आधारित कोडिंग व एंटरप्राइझ काम त्यासोबत जोडले आहे. स्वतंत्र खर्च मार्गदर्शक देखरेखीखालील feature-काम, debugging आणि code review साठी त्याला “दैनंदिन कामाचा साथीदार” म्हणतो. टोकन-दरापेक्षा सर्वोच्च क्षमता किंवा दीर्घ व कठीण रन महत्त्वाचा असेल तेव्हा दोन्ही मार्गदर्शक Fable 5.1 ला त्यापुढे ठेवतात.

Anthropic चे prompting मार्गदर्शक मूळ कारणांचे विश्लेषण, कोड तपासणी, समांतर subagent, संशोधन, स्प्रेडशीट, अहवाल आणि सादरीकरण यांवरील कंपनीच्या चाचण्यांतून या व्यापक उपयोगाला आधार देतो. अधिक स्पष्ट प्रगती-संदेश व अंतिम सारांश, तसेच vision आणि computer-use मधील सुधारणा यांचेही वर्णन आहे. ही Anthropic ची मूल्यमापने आहेत; BIG CHANGE ने केलेल्या चाचण्या नाहीत.

Opus आणि Fable मधील फरक महत्त्वाचा आहे: Fable 5.1 चे दर दहा लाख इनपुट टोकन्समागे $10 आणि आउटपुटमागे $50 आहेत; Opus 5.5 साठी ते $4 आणि $20 आहेत. कॅश-वाचनाचे दर मात्र $0.25 आणि $0.20 असे जवळचे आहेत. त्यामुळे कॅशचा भरपूर पुनर्वापर असलेल्या दीर्घ सत्रांत दरातील फरक, मथळ्यातील इनपुट व आउटपुट दरांइतका मोठा नसेल.

Claude Opus 5.5 मध्ये API चे चार दर बदलले

खालील सामान्य API दर प्रति दहा लाख टोकन्समागे आहेत. Anthropic च्या मॉडेल संदर्भात Opus 5.5 साठी 1 दशलक्ष टोकन्सची संदर्भ-खिडकी आणि 128,000 टोकन्सचे कमाल आउटपुट दिले आहे. तिच्या किंमत-दस्तऐवजीकरणानुसार पूर्ण संदर्भ-खिडकीला सामान्य दर लागू होतात.

API शुल्क

Opus 5.5

Opus 5

बदल

इनपुट

$4

$5

20% कमी

आउटपुट

$20

$25

20% कमी

५ मिनिटांची कॅश-लेखन नोंद

$5

$6.25

20% कमी

कॅश-वाचन

$0.20

$0.50

60% कमी

डीफॉल्ट सेटिंग्जमध्ये दर आणि टोकन-कार्यक्षमता एकत्र धरून नेहमीच्या कामाचा खर्च ४०% कमी असल्याचे Anthropic सांगते. तिचे कामाच्या खर्चाचे स्पष्टीकरण मिश्रण का महत्त्वाचे आहे ते दाखवते: दीर्घ एजंट सत्रांत वाढता संदर्भ वारंवार वाचला जातो, आउटपुटमध्ये thinking टोकन्स असतात आणि एका कामात अनेक फेऱ्या होऊ शकतात. कॅश-वाचनातील ६०% कपात कॅशवर अवलंबून सत्राचा मोठा खर्च कमी करू शकते; तर दीर्घ उत्तर असलेली, कॅश न केलेली छोटी विनंती आउटपुट-दरातील २०% कपातीच्या जवळ राहते.

prompting मार्गदर्शकानुसार, नोंदवलेली ३०% पेक्षा अधिक सुधारणा ही आउटपुट तयार होण्याच्या वेगाची आहे. टूल्स, चाचण्या, बाह्य सेवा किंवा समीक्षकाची वाट पाहण्यात गेलेला वेळ ती मोजत नाही. Anthropic API चे अधिक वेगवान modeही देते: प्रति दहा लाख टोकन्समागे $8 इनपुट आणि $40 आउटपुट. ते Claude API वर संशोधन-पूर्वावलोकनात आहे; भागीदारांच्या क्लाउड प्लॅटफॉर्मवर नाही.

Anthropic ने Pro, Max, Team आणि आसन-आधारित Enterprise योजनांवरील पाच तासांच्या मर्यादाही वाढवल्या आणि पुढे वापरता येईल अशी reset सुविधा दिली. सदस्यत्वाची क्षमता API बिलिंगपासून वेगळी आहे.

कंपनीच्या बेंचमार्कमध्ये ताकद आणि मर्यादा दिसतात

Anthropic च्या मते Terminal-Bench 4.0 वर xhigh effort मध्ये Opus 5.5 ला 66.4%, Opus 5 ला 52.3% आणि Fable 5.1 ला 55.8% मिळाले. इतर बहुतेक ठळक निकालांसाठी max effort वापरले आहे.

दाखवलेल्या AutomationBench आणि Terminal-Bench-Science ओळींमध्ये GPT-6 Astra आघाडीवर आहे. सुरक्षा उपाय असलेल्या cyber कामांत Opus 4.8; जीवशास्त्र आणि अत्याधुनिक मॉडेल-विकासाच्या कामांत Opus 5 वापरले. AutomationBench मध्ये fallback नव्हता.

वर्तनविषयक तपासणीत परत न बदलता येणाऱ्या किंवा मर्यादेबाहेरील कृती कमी झाल्याचे Anthropic सांगते. तिचे prompting मार्गदर्शक आधीच्या Opus मॉडेल्सच्या तुलनेत अप्रत्यक्ष prompt injection ला अधिक प्रतिकार असल्याचेही सांगते. दोन्ही कंपनीने केलेल्या चाचण्या आहेत; सर्वसाधारण सुरक्षितता प्रमाणपत्र नाही.

विद्यमान API क्लायंटसाठी स्पष्ट स्थलांतर आवश्यक आहे

API ग्राहकांनी claude-opus-5-5 स्पष्टपणे मागितले पाहिजे; Opus 5 च्या विद्यमान विनंत्या आपोआप नव्या मॉडेलवर जात नाहीत. स्थलांतर संदर्भात अनेक विनंती-बदल दिले आहेत; ते न केल्यास त्रुटी येऊ शकतात किंवा अनुप्रयोगाच्या आउटपुट-स्ट्रीममध्ये बदल होऊ शकतो.

स्थलांतराचा मुद्दा

Opus 5.5 चे वर्तन

मॉडेल निवड

वापरा claude-opus-5-5 स्पष्टपणे.

विचार प्रक्रिया

Adaptive thinking नेहमी सुरू असते. Thinking बंद करणे किंवा टोकन्सचा manual budget देणे HTTP 400 त्रुटी देते.

Effort

वापरा low, medium, high, xhigh किंवा max; डीफॉल्ट आहे medium.

जबरदस्तीची tools

tool_choice मूल्ये any आणि tool HTTP 400 देतात; auto आणि none समर्थित राहतात.

Computer use

जुने computer_20251124 टूल Claude API आणि Google Cloud वर नाकारले जाते; Amazon Bedrock वर मात्र त्याचे समर्थन कायम आहे.

प्रगतीचा मजकूर

टूल कॉलमधील मजकूर thinking blocks मध्ये येतो; त्यामुळे defaultनुसार ते लपवणारा क्लायंट कॉल्सदरम्यान शांत दिसू शकतो.

दीर्घकाळ चालणाऱ्या क्लायंटसाठी जतन केलेले thinking ही आणखी एक मर्यादा ठरते. Thinking blocks मॉडेल आणि संभाषणाच्या prefix शी जोडलेले असतात. ३१ ऑगस्ट २०२६ रोजी किंवा त्यानंतर तयार झालेल्या API व cloud-platform खात्यांत block पुन्हा पाठवण्याआधी त्यापूर्वीच्या सूचना, tools किंवा संदेश बदलल्यास डीफॉल्टने 400 त्रुटी येते. Anthropic च्या जतन केलेल्या thinking विषयीच्या दस्तऐवजांत फक्त शेवटी मजकूर जोडण्याचा मार्ग आणि विसंगत block वगळण्याचा नियंत्रित पर्याय स्पष्ट केला आहे.

सुरक्षा-रूटिंगमुळे उत्तर देणारे मॉडेल बदलू शकते

Anthropic चा prompting मार्गदर्शक जीवशास्त्रासाठी Fable 5.1-स्तरीय सुरक्षा उपाय आणि सायबरसुरक्षा तसेच reasoning extraction साठी classifiers यांचे वर्णन करतो. स्रोत-कोडमधील असुरक्षा शोधण्यास परवानगी आहे आणि जीवशास्त्र वापरासाठी संस्था पडताळणीकरिता अर्ज करू शकतात. विस्तारित cyber पडताळणी पुढील काही आठवड्यांत येणार असल्याचे जाहीर केले आहे.

HTTP 200 स्थितीसहही नकार मिळू शकतो आणि त्यात stop_reason: "refusal" असू शकते. fallback दस्तऐवजीकरणात सर्व्हरवरील fallback, SDK middleware आणि क्लायंट-व्यवस्थापित retries स्पष्ट केले आहेत. या समर्थित मार्गांपैकी एखादा कॉन्फिगर केल्यावरच fallback होतो; प्रत्येक Opus 5.5 विनंतीसोबत तो आपोआप मिळेल, अशी हमी नाही. शिफारस केलेला fallback नसलेल्या श्रेणींमध्ये नकार मिळू शकतो.

त्यामुळे सेवा देणारे मॉडेलही निकालाचा भाग ठरते. Opus 5.5 कडे जाणाऱ्या अनुप्रयोगाने नकार आणि fallback ने दिलेली उत्तरे स्वतंत्रपणे नोंदावीत—विशेषतः त्याचे काम संरक्षित क्षेत्रांना स्पर्श करत असेल. कमी दर व अधिक व्यापक क्षमतांचे दावे Opus 5.5 साठी आहेत; रूट केलेल्या विनंतीचे वर्तन आणि मर्यादा प्रत्यक्ष उत्तर देणाऱ्या मॉडेलवर अवलंबून असतात.