Anthropic je 7. oktobra objavio Claude Haiku 5.5 za kratke, česte zadatke koji mogu činiti veliki deo poziva u agentskom sistemu. Javne cene Claude API-ja počinju od 0,10 dolara po milionu ulaznih tokena i 0,50 dolara po milionu izlaznih tokena, što je desetina cena za Haiku 4.5. Ipak, Anthropic kaže da isti tekst na novom modelu koristi oko 30% više tokena, a promptovi duži od 100.000 tokena prelaze u skuplji cenovni nivo. Tim koji koristi Haiku 4.5 treba ponovo da prebroji sopstvene zahteve pre procene računa ili preusmeravanja produkcionog saobraćaja.

Izdanje menja i putanju Messages API-ja. Ručno podešeni budžeti za thinking ne rade na Haiku 5.5, adaptivni thinking je podrazumevano uključen, a prvi blok odgovora može biti thinking umesto teksta. To su konkretne provere kompatibilnosti za servise koji više puta pozivaju manji model da klasifikuje, izdvoji, usmeri ili sažme sadržaj.

Šta se menja

  • Šta je promenjeno: Anthropic je doneo novi kontekstni prozor od milion tokena i adaptivni thinking u najjeftiniji Claude paket. Haiku 5.5 snižava cenu za kratke promptove, ali menja način brojanja teksta i način na koji odgovor može da počne.
  • Zašto je važno: Tim sada može da razmotri Claude za više čestih, usko definisanih agentskih koraka po nižoj objavljenoj ceni. Dobit zavisi od kombinacije dužina promptova, izlaznih i thinking tokena, korišćenja keša i toga da li novi model ispunjava cilj kvaliteta za taj korak.
  • Na šta obratiti pažnju: Integracije sa Haiku 4.5 zahtevaju odmerenu migraciju. Zahtevi blizu granice od 100.000 tokena mogu, nakon ponovnog brojanja, preći u skuplji nivo, a kod koji pretpostavlja da je prvi blok sadržaja tekst može pogrešno obraditi inače uspešan odgovor.

Cena zavisi od dužine prompta

Na Claude API-ju, Haiku 5.5 košta 0,10 dolara po milionu ulaznih tokena i 0,50 dolara po milionu izlaznih tokena za promptove do 100.000 tokena. Iznad tog praga, odgovarajuće cene su 0,50 i 2,50 dolara. Haiku 4.5 je naveden po ceni od 1 i 5 dolara u okviru kontekstnog prozora od 200.000 tokena. Haiku 5.5 ima kontekstni prozor od milion tokena i maksimalni izlaz od 128.000 tokena, u poređenju sa 200.000 i 64.000 kod Haiku 4.5. Anthropic navodi dostupnost preko Claude API-ja, Amazon Bedrocka, Claude Platforma na AWS-u, Google Clouda i Microsoft Foundryja. ID modela na Amazon Bedrocku je anthropic.claude-haiku-5-5; Claude API koristi claude-haiku-5-5. Anthropicove stranice modela navode aktuelne ID-jeve platformi, ograničenja i cene.

Anthropic kaže da je prosečan trošak rada Haiku 5.5 oko 75% niži nego kod Haiku 4.5 u proseku. Fusnota kombinuje 90% nižu objavljenu cenu za promptove do 100.000 tokena, 50% nižu cenu iznad tog praga, njihovo zapažanje da je 90% zahteva za Haiku 4.5 bilo u kraćoj kategoriji i veći broj tokena koji novi tokenizer obračunava za isti posao. Taj račun opisuje Anthropicovu strukturu zahteva, a ne jedinstven popust za svaki zahtev. Približno 30% više tokena takođe je procena dobavljača za isti ulazni tekst; tačna razlika zavisi od sadržaja. Anthropicovo saopštenje o lansiranju navodi i tvrdnju i metodologiju.

Za Claude API zahtev bez keširanja uzmite broj ulaznih i izlaznih tokena za Haiku 5.5, pomnožite svaki odgovarajućom cenom za cenovni nivo prema dužini prompta tog zahteva i podelite sa milion. Računski primer: 80.000 ulaznih i 10.000 izlaznih tokena po ceni za kratke promptove koštaju 0,013 dolara. Sa 120.000 ulaznih i 10.000 izlaznih tokena, cena za duge promptove daje 0,085 dolara. To su računski primeri cena, a ne zabeleženi poslovi ili prognoze. Čitanje i upis keša imaju zasebne cene, a za grupnu obradu navedeni su popusti od 50% na ulaz i izlaz. Korisna procena zato prvo grupiše stvarne pozive prema dužini prompta i ponašanju keša, pa ih sabira. Stranica modela Haiku 5.5 navodi ove kategorije.

Ponovo prebrojte sačuvane reprezentativne promptove pomoću Messages endpointa za brojanje tokena, uz model claude-haiku-5-5. Ukupan broj tokena starog modela ne pokazuje u koji nivo na 5.5 spada prompt. Za uzorak iz produkcije zabeležite odgovor usage, dužinu izlaza, polja keša, nivo napora i stvarni trošak, zajedno sa ishodima zadatka. Uključite kratke zahteve, najduže ponovljene razgovore i slučajeve blizu 100.000 tokena. BIG CHANGE je pregledao dokumentaciju; nije pokretao Haiku 5.5 niti merio produkciono opterećenje.

Podešavanja koja treba obuhvatiti migracijom

Anthropicov vodič za migraciju na Haiku 5.5 daje neuobičajeno konkretnu kontrolnu listu za klijente koji prelaze sa Haiku 4.5:

  1. Promenite ID modela za platformu i ponovo prebrojte promptove. claude-haiku-5-5je fiksni ID Claude API-ja, bez datuma ili zasebnog aliasa. Proverite max_tokens, jer thinking troši taj limit, a isti tekst može zahtevati više tokena.
  2. Zamenite thinking: {"type":"enabled","budget_tokens":N} adaptivnim thinkingom ili ostavite thinking nepodešenim. Podesite output_config.effort da biste kalibrisali dubinu; dokumentovana podrazumevana vrednost je medium. Niska vrednost za max_tokens može da završi odgovor posle thinking bloka, pre nego što se pojavi tekst.
  3. Čitajte blokove sadržaja prema polju type, a ne prema njihovom redosledu. Vraćajte thinking blokove neizmenjene zajedno sa rezultatima alata. Testirajte svako skladište razgovora koje reprodukuje blok preko drugog naloga ili menja ranije poruke, sistemska uputstva ili alate.
  4. Uklonite prilagođena podešavanja temperature, top_p i top_k. Završno unapred popunjavanje assistant poruke zamenite user porukom, a za ograničene formate upotrebite strukturisani izlaz ili pristup pomoću alata koji Anthropic dokumentuje. U klijentu obradite stop_reason sa vrednošću refusal.
  5. Ako integracija koristi computer use na Claude API-ju ili Google Cloudu, zamenite stariji alat computer_20250124 sa computer_toolset_20260801 i ažurirajte ciklus alata prema vodiču. Organizacijama koje koriste Priority Tier kapacitet za Haiku 4.5 potreban je i zaseban plan: vodič kaže da Priority Tier nije dostupan na Haiku 5.5.

Ove promene ne propisuju jednu vrednost napora za svaki zadatak. Poređenje treba da zadrži isti zadatak aplikacije i kriterijume prihvatanja, a zatim da beleži kvalitet odgovora, odbijanja, skraćivanje, kašnjenje i naplaćene tokene za razmatrana podešavanja. Anthropic navodi bolje rezultate Haiku 5.5 nego 4.5 na više testova, uključujući odnos 39,2% prema 0,0% u tabeli Terminal-Bench 4.0. To su rezultati koje je prijavio Anthropic u svojim uslovima testiranja, a ne merenje agentovog sistema kod čitaoca. Anthropic takođe navodi da su Sonnet 5.5 i Opus 5.5 pogodniji za složeno agentsko programiranje u tom testu. Neposredna odluka za korisnika Haiku 4.5 jeste da li manji model i dalje ispunjava zahteve svakog usko definisanog koraka kada se uračunaju izmene API-ja i novi broj tokena.

Izvori i dodatno čitanje