Anthropic je lansirao Claude Opus 5.5 22. septembra. Kompanija tvrdi da za većinu zadataka postiže rezultate bliske modelu Fable 5.1, po nižoj ceni od Opus-a 5.

Za timove koji već koriste Opus 5, ovo ažuriranje donosi više od jeftinijeg ID-ja modela. Opus 5.5 uvek koristi adaptivno rezonovanje, podrazumevano podešava napor na srednji nivo i odbija više oblika zahteva koje je Opus 5 prihvatao. Anthropic ga preporučuje kao svakodnevni model za rad pod nadzorom, ispod Fable-a 5.1; Fable je namenjen najtežim i najdužim autonomnim zadacima.

Šta se suštinski menja

  • Šta se promenilo: Opus 5.5 snižava cenu ulaza i izlaza za 20%, a čitanja keša za 60%. Stalno uključeno adaptivno rezonovanje menja i način na koji postojeći API klijenti moraju da podnose zahteve i planiraju troškove.
  • Zašto je važno: Dugi agentski zadaci više puta čitaju ranija uputstva i rezultate alata. Najveće sniženje cene odnosi se na ponovo korišćen kontekst, pa je upotreba keša ključna za razumevanje ukupnog računa za zadatak.
  • Na šta treba obratiti pažnju: Sonnet 5.5 i Haiku 5.5 najavljeni su za naredne nedelje; Opus je prvi dostupan. Pri izboru podrazumevanog modela treba uporediti cenu završenih zadataka i potreban nivo provere u svakom rangu.

Opus 5.5 namenjen je radu u produkciji ispod ranga Fable-a

U predstavljanju proizvoda partnerima Anthropic preporučuje Opus 5.5 kao podrazumevani izbor za poslovnu upotrebu u produkciji, uključujući programiranje, finansije i pravne poslove, kao i rad agenata. Njegov javni vodič za izbor modela navodi da većina opterećenja počinje modelom Opus 5.5, koji se preporučuje za složeno agentsko programiranje i poslovne zadatke. Zaseban vodič za troškove opisuje ga kao „svakodnevni model” za razvoj funkcija, otklanjanje grešaka i pregled koda pod nadzorom. Oba vodiča Fable 5.1 svrstavaju više, kada su najvažniji najveće mogućnosti ili dug i težak zadatak, a ne cena tokena.

Anthropic-ov vodič za promptove potkrepljuje tu širinu internim testovima kompanije u analizi osnovnog uzroka, proveri koda, paralelnom radu podagenata, istraživanju, tabelama, izveštajima i prezentacijama. Opisuje i jasnije poruke o napretku i završne sažetke, kao i poboljšanja u obradi slika i upravljanju računarom. To su procene kompanije Anthropic, a ne testovi koje je sproveo BIG CHANGE.

Razlika između modela Opus i Fable je važna jer je cena modela Fable 5.1 navedena kao 10 dolara po milionu ulaznih tokena i 50 dolara po milionu izlaznih tokena, u poređenju sa 4 i 20 dolara za Opus 5.5. Cene čitanja keša su mnogo bliže: 0,25 i 0,20 dolara. Zato kod dugih sesija koje se oslanjaju na keš razlika može biti manja nego što sugerišu istaknute cene ulaza i izlaza.

Claude Opus 5.5 menja četiri API cene

Standardne API cene ispod iskazane su po milionu tokena. Anthropic-ov referentni priručnik za model navodi kontekstni prozor od milion tokena i maksimalni izlaz od 128.000 tokena za Opus 5.5. Njegova dokumentacija o cenama kaže da se za ceo kontekstni prozor primenjuju standardne cene.

API stavka

Opus 5.5

Opus 5

Promena

Ulaz

$4

$5

20% manje

Izlaz

$20

$25

20% manje

Upis u keš na 5 minuta

$5

$6.25

20% manje

Čitanje keša

$0.20

$0.50

60% manje

Anthropic navodi da su tipični troškovi rada uz podrazumevana podešavanja niži za 40%; u obračun ulaze cene i efikasnije korišćenje tokena. Njegovo objašnjenje cene zadatka pokazuje zašto je važan odnos ovih stavki: duge agentske sesije iznova čitaju kontekst koji raste, izlaz uključuje tokene rezonovanja, a zadatak može imati mnogo koraka. Sniženje cene čitanja keša za 60% može presudno da utiče na sesiju koja se mnogo oslanja na keš, dok je kratak zahtev bez keširanja i dugog odgovora bliži sniženju cene izlaza od 20%.

Prema vodiču za promptove, prijavljeno poboljšanje od više od 30% odnosi se na brzinu generisanja izlaza. Ono ne meri vreme čekanja na alate, testove, spoljne usluge ili recenzenta. Anthropic nudi i brži režim rada API-ja po ceni od 8 dolara za ulaz i 40 dolara za izlaz na milion tokena; dostupan je kao istraživački pregled u Claude API-ju, ali ne i na partnerskim platformama u oblaku.

Anthropic je takođe povećao ograničenja u periodu od pet sati za pretplate Pro, Max, Team i Enterprise po korisničkom mestu, uz mogućnost prenosa preostale kvote pri resetovanju. Kapacitet pretplate obračunava se odvojeno od API-ja.

Poslovni testovi pokazuju prednosti i ograničenja

Anthropic navodi rezultate na testu Terminal-Bench 4.0 od 66,4% za Opus 5.5 sa podešavanjem Xhigh, 52,3% za Opus 5 i 55,8% za Fable 5.1. Za većinu drugih istaknutih rezultata korišćeno je podešavanje Max.

GPT-6 Astra predvodi prikazane rezultate u redovima AutomationBench i Terminal-Bench-Science. Za kontrolisane sajber-bezbednosne zadatke korišćen je Opus 4.8, a za biologiju i razvoj vodećih modela Opus 5. U AutomationBench-u nije korišćen rezervni model.

Anthropic navodi da je njegova bihevioralna revizija zabeležila manje nepovratnih radnji i radnji izvan dozvoljenog obima. Njegov vodič za promptove takođe navodi bolju otpornost na indirektno ubacivanje promptova u poređenju sa ranijim modelima Opus. Oboje su rezultati testova koje je sprovela kompanija, a ne opšta potvrda bezbednosti.

Postojeći API klijenti zahtevaju izričit prelazak

Korisnici API-ja moraju eksplicitno da zatraže claude-opus-5-5; pozivi modelu Opus 5 ne prelaze neprimetno na novu verziju. Referentni vodič za migraciju navodi više izmena zahteva koje u suprotnom mogu da dovedu do grešaka ili promene toka izlaznih podataka aplikacije.

Stavka migracije

Ponašanje modela Opus 5.5

Izbor modela

Koristite claude-opus-5-5 eksplicitno.

Rezonovanje

Adaptivno rezonovanje je uvek uključeno. Isključeno rezonovanje i ručni budžeti tokena vraćaju HTTP 400.

Napor

Koristite low, medium, high, xhigh ili max; podrazumevana vrednost je medium.

Prinudni izbor alata

tool_choice vrednosti any i tool vraćaju HTTP 400; auto i none su i dalje podržani.

Upravljanje računarom

Stariji alat computer_20251124 odbacuje se u Claude API-ju i Google Cloud-u; Amazon Bedrock ga i dalje podržava.

Tekst o napretku

Tekst između poziva alata stiže u blokovima rezonovanja, pa klijent koji podrazumevano izostavlja njihov prikaz može delovati neaktivan između poziva.

Sačuvani blokovi rezonovanja predstavljaju dodatno ograničenje za klijente koji rade duže vreme. Ti blokovi vezani su za model i prefiks razgovora. Ako je nalog na API-ju ili platformi u oblaku napravljen 31. avgusta 2026. ili kasnije, izmena ranijih uputstava, alata ili poruka pre ponovnog slanja bloka podrazumevano vraća grešku 400. Anthropic-ova dokumentacija o sačuvanom rezonovanju objašnjava postupak dodavanja sadržaja bez izmena ranijeg teksta i kontrolisanu opciju odbacivanja nekompatibilnog bloka.

Bezbednosno usmeravanje može da promeni model koji odgovara

U vodiču za promptove opisuju se biološke zaštitne mere na nivou modela Fable 5.1 i klasifikatori za sajber-bezbednost i izvlačenje podataka iz rezonovanja. Pronalaženje ranjivosti u izvornom kodu ostaje dozvoljeno, a organizacije mogu da podnesu zahtev za proveru za oblast prirodnih nauka. Proširena provera za sajber-bezbednost najavljena je za naredne nedelje.

Odbijanje zahteva i dalje može da stigne uz HTTP 200 i stop_reason: "refusal". Dokumentacija o rezervnim modelima opisuje rezervni model na strani servera, posrednički softver SDK-ja i ponovljene pokušaje kojima upravlja klijent. Rezervni model se koristi samo ako je podešen jedan od tih podržanih načina; to nije automatsko obećanje koje važi za svaki zahtev modelu Opus 5.5. Kategorije bez preporučenog rezervnog modela i dalje mogu biti odbijene.

Zbog toga je model koji je zaista pružio odgovor deo rezultata. Aplikacija koja prelazi na Opus 5.5 treba zasebno da beleži odbijene zahteve i odgovore dobijene od rezervnog modela, naročito za rad u oblastima sa zaštitnim merama. Niže cene i šire tvrdnje o mogućnostima odnose se na Opus 5.5; zahtev koji je usmeren na drugi model prati ponašanje i ograničenja modela koji je zaista odgovorio.