Anthropic je 28. septembra objavio Claude Sonnet 5.5 po istim cenama API tokena kao Sonnet 5. Kompanija navodi da model generiše izlaz više od 30% brže i da po zadatku može da košta do 30% manje zato što koristi manje tokena. To su odvojene tvrdnje: objavljena cena nije snižena, a račun za zadatak i dalje zavisi od upita, izlaza, alata i podešavanja napora.
Za programere, izdanje donosi potencijalno korisno povećanje efikasnosti, ali i izmene koje mogu da pokvare integracije sa Sonnet-om 5. Anthropic-ova dokumentacija navodi model pod oznakom claude-sonnet-5-5 na Claude API-ju, Google Cloud-u i Microsoft Foundry-ju, a anthropic.claude-sonnet-5-5 na Amazon Bedrock-u. Na stranici modela navode se kontekst od milion tokena i maksimalni izlaz od 128.000 tokena. Pristup je dostupan i preko Claude Platform-a na AWS-u. Naplata i regionalna podešavanja cloud provajdera mogu da se razlikuju od objavljenih cena Claude API-ja.
Šta pokazuju evaluacije
U Anthropic-ovom testu Terminal-Bench 4.0, Sonnet 5.5 je rešio 70,6% od 66 terminalskih zadataka, u poređenju sa 10,3% za Sonnet 5 prema tabeli uz objavu. U kartici sistema skup je opisan kao zahtevni naučni i inženjerski zadaci u komandnim okruženjima pokrenutim u kontejnerima. Anthropic je pokrenuo Claude Code u osnovnom režimu uz najveći napor rezonovanja, blokirao pristup internetu i keširao resurse potrebne za zadatke. Zaštitne mere preusmerile su 1,2% zahteva za Sonnet 5.5 na rezervni model, što je uticalo na 1,5% pokušaja. Anthropic navodi standardnu grešku od 2,5 procentnih poena za rezultat Sonnet-a 5.5. Rezultat meri te uslove; ne potvrđuje isto poboljšanje u repozitorijumima programera.
Prema kartici sistema Anthropic-a, Cognition je u Claude Code-u pokrenuo FrontierCode na 150 zadataka iz repozitorijuma i prijavio 52,1% za Sonnet 5.5 na glavnom skupu pri veoma visokom nivou napora (xhigh). Rezultat je pao na 46,2% pri maksimalnom naporu, delom zato što su dodatni pregled i izmene agenta u slučajevima koje je Cognition ispitao prekoračili obim ili vremensko ograničenje benchmarka. Cursor je pokrenuo CursorBench 4.0 u svom produkcionom agentskom okruženju na zadacima zasnovanim na Cursor sesijama. Rezultat Sonnet-a 5.5 od 55,5% pri maksimalnom naporu nalazi se u tabeli rezultata poslatoj Anthropic-u; kompanija je procenila cenu po zadatku na osnovu broja tokena koji je dostavio Cursor. Ove spoljne evaluacije koristile su različite zadatke i okruženja, a ovde prikazane brojke za Sonnet 5.5 prenete su kroz karticu sistema Anthropic-a.
Artificial Analysis je takođe testirao verziju pre izdanja na GDPval-AA, koji poredi rezultate rada u 220 zadataka iz 44 zanimanja, i na AA-Briefcase-u, skupu povezanih projekata kancelarijskog rada. Kartica navodi Elo rezultate od 1844 i 1811 pri maksimalnom naporu, redom, bliske modelu Opus 5.5 u tim testovima. Anthropic navodi da je verzija pre izdanja imala grešku u strukturisanom izlazu koja je možda uticala na rezultate i koja je u međuvremenu ispravljena. Poređenje procenjuje rezultate benchmarka u tim uslovima; ne pokazuje da će se Sonnet 5.5 izjednačiti sa Opus-om u otvorenom zadatku čitaoca. Sam Anthropic navodi da je Opus i dalje snažniji u složenom radu koji zahteva dugotrajno prosuđivanje.
Citati ranih korisnika u objavi Anthropic-a opisuju brže tokove rada i manju potrošnju tokena u njihovim testovima. Korisnici su koristili sopstvene zadatke i metode, pa njihovi iskazi ne utvrđuju jedinstvenu meru produktivnosti. BIG CHANGE nije pokrenuo Sonnet 5.5 niti proverio dobavljačeve tvrdnje o brzini i ceni zadatka u radnom toku uživo.
Cena i migracija
Cena Claude API-ja iznosi 2 dolara za milion ulaznih tokena i 10 dolara za milion izlaznih tokena, nepromenjeno u odnosu na Sonnet 5. Upis u petominutnu keš memoriju košta 2,50 dolara za milion tokena, a čitanje iz keša 0,20 dolara. Grafikoni Anthropic-a o trošku po zadatku kombinuju objavljene cene sa brojem tokena potrošenih pri određenom nivou napora. Njima se ne može potvrditi univerzalna ušteda od 30%. Tim koji poredi modele treba da pokrene reprezentativne zadatke i zabeleži potrošnju tokena i proteklo vreme, kao i uspešnost pri potrebnom nivou kvaliteta.
Sama promena ID-ja modela možda neće biti dovoljna za postojeći kod koji koristi Messages API. Sonnet 5 thinking: {"type": "disabled"} izaziva grešku u verziji 5.5; dokumentovana zamena za izbegavanje rezonovanja na početku je thinking: {"type": "between_tools"}, koja prihvata nizak, srednji i visok nivo napora. Adaptivno rezonovanje je uključeno kada se polje izostavi, a Claude API podrazumevano bira visok nivo napora. Prinudne vrednosti tool_choice imaju vrednosti any i tool takođe vraćaju greške; Anthropic upućuje programere na auto i stroge šeme alata tamo gde su podržane. Na Sonnet-u 5.5 u Amazon Bedrock-u stroga upotreba alata nije dostupna: koristite auto bez strict i proveravajte ulazne podatke alata u kodu aplikacije. Kôd koji prikazuje tekst između poziva alata možda mora da obradi ažuriranja o napretku vraćena u blokovima rezonovanja. Integracije za upravljanje računarom na Claude API-ju i Google Cloud-u zahtevaju noviji skup alata computer_toolset_20260801, dok Bedrock zadržava raniju verziju computer_20251124. U vodiču za migraciju opisane su i druge izmene kompatibilnosti.
Suštinska promena
Sonnet 5.5 timovima osetljivim na troškove pruža novi model po ceni tokena Sonnet-a 5, uz bolje rezultate u nekoliko precizno navedenih evaluacija i Anthropic-ovu tvrdnju o bržem izlazu. Praktična vrednost zavisi od vrste zadataka i podešavanja napora. Potrebno je proveriti i postavke postojećih integracija. Najjasnije poređenje koje sledi jeste merenje sopstvenog radnog opterećenja organizacije prema tačnosti rezultata, potrošnji tokena i proteklom vremenu.
Izvori i dodatna literatura
- Anthropic-ova objava o Sonnet-u 5.5 navodi datum izdanja, tvrdnje kompanije o brzini i ceni zadatka, sažetak benchmark rezultata i iskustva ranih korisnika. Tvrdnje o rezultatima treba proveriti za konkretno radno opterećenje.
- Kartica sistema Anthropic-a za Sonnet 5.5 dokumentuje zadatke na benchmarku, okruženja, podešavanja napora, ponašanje rezervnog modela i poreklo spoljnih evaluacija. To je primarna objava dobavljača modela koja obuhvata i rezultate spoljašnjih testova dostavljene kompaniji.
- Stranica modela Claude Platform-a navodi ID-jeve API-ja, dostupnost, ograničenja i cene tokena. Kompletna stranica sa cenama potvrđuje da su osnovne cene Sonnet-a 5 i 5.5 jednake i objašnjava razlike u cenama cloud provajdera.
- Vodič za migraciju na Sonnet 5.5 beleži podešavanja zahteva koja su promenjena ili vraćaju greške. Koristite ga za potpunu kontrolnu listu postojeće integracije.



