Anthropic је представио Claude Opus 5.5 22. септембра. Компанија тврди да је његов учинак у већини послова близак моделу Fable 5.1, уз ниже цене од Opus-а 5.
За тимове који већ користе Opus 5, ово ажурирање доноси више од јефтиније ознаке модела. Opus 5.5 увек користи прилагодљиво размишљање, подразумевано поставља средњи ниво напора и одбија неколико облика захтева које је Opus 5 прихватао. Такође је испод Fable 5.1 као Anthropic-ов препоручени свакодневни модел за надгледан рад, док је Fable намењен најтежим и најдужим аутономним задацима.
Суштинска промена
- Шта се променило: Opus 5.5 снижава цене улазних и излазних токена за 20%, а читања из кеша за 60%. Обавезно прилагодљиво размишљање мења и начин на који постојећи API клијенти морају да задају и планирају трошкове рада.
- Зашто је важно: Дуготрајни задаци агената више пута читају ранија упутства и резултате алата. Највеће снижење цене односи се на тај поново коришћени контекст, па је употреба кеша кључна за разумевање целог рачуна за задатак.
- На шта обратити пажњу: Sonnet 5.5 и Haiku 5.5 најављени су за наредне недеље; Opus је први доступан модел. При избору подразумеваног модела упоредите трошкове довршених задатака и ниво провере који је потребан за сваки ниво.
Opus 5.5 је намењен продукционом раду испод нивоа Fable-а
У препорукама за партнере Anthropic препоручује Opus 5.5 као подразумевани избор за пословне кориснике у продукционом програмирању и финансијском и правном раду са знањем, као и за агенте. Његов јавни водич за избор модела наводи да већина оптерећења почиње са Opus-ом 5.5 и повезује га са сложеним агентским програмирањем и пословним радом. Засебан водич о трошковима назива га „свакодневним моделом“ за надгледан рад на функционалностима, отклањање грешака и преглед кода. Оба водича препоручују Fable 5.1 уместо њега када су највеће могућности или дуго и тешко покретање важнији од цене токена.
Anthropic-ов водич за писање упита поткрепљује такав широки опсег интерним тестовима компаније за анализу основног узрока, проверу кода, паралелне подагенте, истраживање, табеле, извештаје и презентације. Описује и јасније поруке о напретку и завршне сажетке, као и побољшања вида и коришћења рачунара. То су процене Anthropic-а, а не тестови које је спровео BIG CHANGE.
Разлика између Opus-а и Fable-а је важна: цена Fable-а 5.1 износи 10 долара за милион улазних токена и 50 долара за милион излазних, док Opus 5.5 кошта 4 и 20 долара. Цене читања из кеша су много ближе: 0,25 и 0,20 долара. Зато разлика може бити мања од очекиване на основу насловних цена улаза и излаза када се ради о дугим сесијама са кешом.
Claude Opus 5.5 мења четири API цене
Стандардне API цене у наставку су по милиону токена. Anthropic-ова референца модела наводи контекстни прозор од милион токена и максимални излаз од 128.000 токена за Opus 5.5. Њена документација о ценама наводи да се на цео контекстни прозор примењују стандардне цене.
API трошак | Opus 5.5 | Opus 5 | Промена |
|---|---|---|---|
Улаз | $4 | $5 | 20% ниже |
Излаз | $20 | $25 | 20% ниже |
Упис у кеш на 5 минута | $5 | $6,25 | 20% ниже |
Читање из кеша | $0,20 | $0,50 | 60% ниже |
Anthropic наводи да су трошкови типичног оптерећења 40% нижи уз подразумеване поставке, што обједињује цене и ефикасност токена. У објашњењу трошкова задатака показује се зашто је састав потрошње важан: дуге сесије агената више пута читају све већи контекст, излаз обухвата токене размишљања, а задатак може имати много корака. Снижење читања из кеша од 60% може да има највећи утицај у сесији која интензивно користи кеш, док је кратак захтев без кеша са дугим одговором ближи снижењу цене излазних токена од 20%.
Према водичу за писање упита, пријављено побољшање од преко 30% односи се на брзину генерисања излаза. Оно не мери време чекања на алате, тестове, спољне услуге или рецензента. Anthropic нуди и бржи режим API-ја по цени од 8 долара за улаз и 40 долара за излаз на милион токена; он је у истраживачком прегледу на Claude API-ју, али не и на партнерским платформама у облаку.
Anthropic је такође повећао ограничења за петочасовну употребу на претплатама Pro, Max, Team и Enterprise по корисничком месту и омогућио пренос неискоришћеног времена ресетовања. Капацитет претплате је одвојен од API наплате.
Мерила компаније показују предности и границе
Anthropic наводи резултате Terminal-Bench 4.0 од 66,4% за Opus 5.5 при xhigh напору, 52,3% за Opus 5 и 55,8% за Fable 5.1. За већину осталих насловних резултата коришћен је максимални ниво напора.
GPT-6 Astra има најбоље резултате у приказаним категоријама AutomationBench и Terminal-Bench-Science. За заштићене кибернетичке задатке коришћен је Opus 4.8; за биологију и развој најнапреднијих модела — Opus 5. AutomationBench није користио резервно усмеравање.
Anthropic у извештају о понашању наводи мање неповратних поступака или поступака ван дозвољених граница. Његов водич за писање упита такође наводи већу отпорност на посредно убризгавање упита него код ранијих модела Opus. Оба резултата потичу из тестирања компаније, а не представљају општу безбедносну потврду.
Постојећи API клијенти морају да обаве изричиту миграцију
Корисници API-ја морају да затраже claude-opus-5-5; постојећи позиви Opus-а 5 не прелазе неприметно на нови модел. У референтном водичу за миграцију наведене су измене захтева које иначе могу да изазову грешке или промене ток излаза апликације.
Тачка миграције | Понашање Opus-а 5.5 |
|---|---|
Избор модела | Изричито користите |
Размишљање | Прилагодљиво размишљање је увек укључено. Искључено размишљање и ручни буџети токена враћају HTTP 400. |
Ниво напора | Користите |
Принудно коришћење алата | |
Коришћење рачунара | Старији алат |
Текст о напретку | Текст између позива алата стиже у блоковима размишљања, па клијент који подразумевано не приказује те блокове кориснику може деловати неактивно између позива. |
Очувано размишљање доноси још једно ограничење за дуготрајне клијентске сесије. Блокови размишљања везани су за модел и префикс разговора. На налозима за API и платформе у облаку отвореним 31. августа 2026. или касније, измена ранијих упутстава, алата или порука пре поновног слања блока подразумевано враћа грешку 400. Документација Anthropic-а о очуваном размишљању објашњава поступак који дозвољава само додавање и контролисану могућност одбацивања некомпатибилног блока.
Безбедносно усмеравање може да промени модел који одговара
У водичу за писање упита описују се заштитне мере у биологији на нивоу Fable 5.1 и класификатори за кибернетичку безбедност и извлачење података о резоновању. Проналажење рањивости у изворном коду и даље је дозвољено, а организације могу да затраже проверу у области биолошких наука. Проширена провера сајбер-безбедности најављена је за наредне недеље.
Одбијање и даље може да стигне уз HTTP 200 и stop_reason: "refusal". У документацији о резервном усмеравању описани су резервно усмеравање на страни сервера, посреднички софтвер SDK-а и поновни покушаји којима управља клијент. Резервно усмеравање се дешава само ако је подешен један од тих подржаних начина; оно није аутоматски обећано за сваки захтев Opus-а 5.5. Захтеви у категоријама без препорученог резервног модела и даље могу бити одбијени.
Зато модел који одговара постаје део резултата. Апликација која прелази на Opus 5.5 треба засебно да бележи одбијања и одговоре послате резервним моделом, посебно ако се користи у областима са заштитним ограничењима. Тврдње о нижим ценама и ширим могућностима односе се на Opus 5.5; преусмерени захтев прати понашање и ограничења модела који је стварно одговорио.



