Anthropic je lansirao Claude Opus 5.5 22. septembra. Kompanija tvrdi da za većinu zadataka postiže rezultate bliske modelu Fable 5.1, po nižoj ceni od Opus-a 5.
Za timove koji već koriste Opus 5, ovo ažuriranje donosi više od jeftinijeg ID-ja modela. Opus 5.5 uvek koristi adaptivno rezonovanje, podrazumevano podešava napor na srednji nivo i odbija više oblika zahteva koje je Opus 5 prihvatao. Anthropic ga preporučuje kao svakodnevni model za rad pod nadzorom, ispod Fable-a 5.1; Fable je namenjen najtežim i najdužim autonomnim zadacima.
Šta se suštinski menja
- Šta se promenilo: Opus 5.5 snižava cenu ulaza i izlaza za 20%, a čitanja keša za 60%. Stalno uključeno adaptivno rezonovanje menja i način na koji postojeći API klijenti moraju da podnose zahteve i planiraju troškove.
- Zašto je važno: Dugi agentski zadaci više puta čitaju ranija uputstva i rezultate alata. Najveće sniženje cene odnosi se na ponovo korišćen kontekst, pa je upotreba keša ključna za razumevanje ukupnog računa za zadatak.
- Na šta treba obratiti pažnju: Sonnet 5.5 i Haiku 5.5 najavljeni su za naredne nedelje; Opus je prvi dostupan. Pri izboru podrazumevanog modela treba uporediti cenu završenih zadataka i potreban nivo provere u svakom rangu.
Opus 5.5 namenjen je radu u produkciji ispod ranga Fable-a
U predstavljanju proizvoda partnerima Anthropic preporučuje Opus 5.5 kao podrazumevani izbor za poslovnu upotrebu u produkciji, uključujući programiranje, finansije i pravne poslove, kao i rad agenata. Njegov javni vodič za izbor modela navodi da većina opterećenja počinje modelom Opus 5.5, koji se preporučuje za složeno agentsko programiranje i poslovne zadatke. Zaseban vodič za troškove opisuje ga kao „svakodnevni model” za razvoj funkcija, otklanjanje grešaka i pregled koda pod nadzorom. Oba vodiča Fable 5.1 svrstavaju više, kada su najvažniji najveće mogućnosti ili dug i težak zadatak, a ne cena tokena.
Anthropic-ov vodič za promptove potkrepljuje tu širinu internim testovima kompanije u analizi osnovnog uzroka, proveri koda, paralelnom radu podagenata, istraživanju, tabelama, izveštajima i prezentacijama. Opisuje i jasnije poruke o napretku i završne sažetke, kao i poboljšanja u obradi slika i upravljanju računarom. To su procene kompanije Anthropic, a ne testovi koje je sproveo BIG CHANGE.
Razlika između modela Opus i Fable je važna jer je cena modela Fable 5.1 navedena kao 10 dolara po milionu ulaznih tokena i 50 dolara po milionu izlaznih tokena, u poređenju sa 4 i 20 dolara za Opus 5.5. Cene čitanja keša su mnogo bliže: 0,25 i 0,20 dolara. Zato kod dugih sesija koje se oslanjaju na keš razlika može biti manja nego što sugerišu istaknute cene ulaza i izlaza.
Claude Opus 5.5 menja četiri API cene
Standardne API cene ispod iskazane su po milionu tokena. Anthropic-ov referentni priručnik za model navodi kontekstni prozor od milion tokena i maksimalni izlaz od 128.000 tokena za Opus 5.5. Njegova dokumentacija o cenama kaže da se za ceo kontekstni prozor primenjuju standardne cene.
API stavka | Opus 5.5 | Opus 5 | Promena |
|---|---|---|---|
Ulaz | $4 | $5 | 20% manje |
Izlaz | $20 | $25 | 20% manje |
Upis u keš na 5 minuta | $5 | $6.25 | 20% manje |
Čitanje keša | $0.20 | $0.50 | 60% manje |
Anthropic navodi da su tipični troškovi rada uz podrazumevana podešavanja niži za 40%; u obračun ulaze cene i efikasnije korišćenje tokena. Njegovo objašnjenje cene zadatka pokazuje zašto je važan odnos ovih stavki: duge agentske sesije iznova čitaju kontekst koji raste, izlaz uključuje tokene rezonovanja, a zadatak može imati mnogo koraka. Sniženje cene čitanja keša za 60% može presudno da utiče na sesiju koja se mnogo oslanja na keš, dok je kratak zahtev bez keširanja i dugog odgovora bliži sniženju cene izlaza od 20%.
Prema vodiču za promptove, prijavljeno poboljšanje od više od 30% odnosi se na brzinu generisanja izlaza. Ono ne meri vreme čekanja na alate, testove, spoljne usluge ili recenzenta. Anthropic nudi i brži režim rada API-ja po ceni od 8 dolara za ulaz i 40 dolara za izlaz na milion tokena; dostupan je kao istraživački pregled u Claude API-ju, ali ne i na partnerskim platformama u oblaku.
Anthropic je takođe povećao ograničenja u periodu od pet sati za pretplate Pro, Max, Team i Enterprise po korisničkom mestu, uz mogućnost prenosa preostale kvote pri resetovanju. Kapacitet pretplate obračunava se odvojeno od API-ja.
Poslovni testovi pokazuju prednosti i ograničenja
Anthropic navodi rezultate na testu Terminal-Bench 4.0 od 66,4% za Opus 5.5 sa podešavanjem Xhigh, 52,3% za Opus 5 i 55,8% za Fable 5.1. Za većinu drugih istaknutih rezultata korišćeno je podešavanje Max.
GPT-6 Astra predvodi prikazane rezultate u redovima AutomationBench i Terminal-Bench-Science. Za kontrolisane sajber-bezbednosne zadatke korišćen je Opus 4.8, a za biologiju i razvoj vodećih modela Opus 5. U AutomationBench-u nije korišćen rezervni model.
Anthropic navodi da je njegova bihevioralna revizija zabeležila manje nepovratnih radnji i radnji izvan dozvoljenog obima. Njegov vodič za promptove takođe navodi bolju otpornost na indirektno ubacivanje promptova u poređenju sa ranijim modelima Opus. Oboje su rezultati testova koje je sprovela kompanija, a ne opšta potvrda bezbednosti.
Postojeći API klijenti zahtevaju izričit prelazak
Korisnici API-ja moraju eksplicitno da zatraže claude-opus-5-5; pozivi modelu Opus 5 ne prelaze neprimetno na novu verziju. Referentni vodič za migraciju navodi više izmena zahteva koje u suprotnom mogu da dovedu do grešaka ili promene toka izlaznih podataka aplikacije.
Stavka migracije | Ponašanje modela Opus 5.5 |
|---|---|
Izbor modela | Koristite |
Rezonovanje | Adaptivno rezonovanje je uvek uključeno. Isključeno rezonovanje i ručni budžeti tokena vraćaju HTTP 400. |
Napor | Koristite |
Prinudni izbor alata | |
Upravljanje računarom | Stariji alat |
Tekst o napretku | Tekst između poziva alata stiže u blokovima rezonovanja, pa klijent koji podrazumevano izostavlja njihov prikaz može delovati neaktivan između poziva. |
Sačuvani blokovi rezonovanja predstavljaju dodatno ograničenje za klijente koji rade duže vreme. Ti blokovi vezani su za model i prefiks razgovora. Ako je nalog na API-ju ili platformi u oblaku napravljen 31. avgusta 2026. ili kasnije, izmena ranijih uputstava, alata ili poruka pre ponovnog slanja bloka podrazumevano vraća grešku 400. Anthropic-ova dokumentacija o sačuvanom rezonovanju objašnjava postupak dodavanja sadržaja bez izmena ranijeg teksta i kontrolisanu opciju odbacivanja nekompatibilnog bloka.
Bezbednosno usmeravanje može da promeni model koji odgovara
U vodiču za promptove opisuju se biološke zaštitne mere na nivou modela Fable 5.1 i klasifikatori za sajber-bezbednost i izvlačenje podataka iz rezonovanja. Pronalaženje ranjivosti u izvornom kodu ostaje dozvoljeno, a organizacije mogu da podnesu zahtev za proveru za oblast prirodnih nauka. Proširena provera za sajber-bezbednost najavljena je za naredne nedelje.
Odbijanje zahteva i dalje može da stigne uz HTTP 200 i stop_reason: "refusal". Dokumentacija o rezervnim modelima opisuje rezervni model na strani servera, posrednički softver SDK-ja i ponovljene pokušaje kojima upravlja klijent. Rezervni model se koristi samo ako je podešen jedan od tih podržanih načina; to nije automatsko obećanje koje važi za svaki zahtev modelu Opus 5.5. Kategorije bez preporučenog rezervnog modela i dalje mogu biti odbijene.
Zbog toga je model koji je zaista pružio odgovor deo rezultata. Aplikacija koja prelazi na Opus 5.5 treba zasebno da beleži odbijene zahteve i odgovore dobijene od rezervnog modela, naročito za rad u oblastima sa zaštitnim merama. Niže cene i šire tvrdnje o mogućnostima odnose se na Opus 5.5; zahtev koji je usmeren na drugi model prati ponašanje i ograničenja modela koji je zaista odgovorio.



