Anthropic hat Claude Haiku 5.5 am 7. Oktober für kurze, häufige Aufgaben veröffentlicht, die einen großen Teil der Aufrufe in einem Agentensystem ausmachen können. Die Listenpreise der Claude API beginnen bei 0,10 US-Dollar pro Million Eingabetoken und 0,50 US-Dollar pro Million Ausgabetoken – ein Zehntel der Preise von Haiku 4.5. Laut Anthropic benötigt derselbe Text beim neuen Modell jedoch rund 30 % mehr Token, und Prompts mit mehr als 100.000 Token fallen in eine höhere Preisstufe. Teams mit Haiku 4.5 müssen ihre eigenen Anfragen neu zählen, bevor sie die Kosten schätzen oder Produktionsverkehr verlagern.
Mit der Veröffentlichung ändert sich auch der Ablauf der Messages API. Manuelle Thinking-Budgets funktionieren bei Haiku 5.5 nicht, adaptives Thinking ist standardmäßig aktiviert, und der erste Antwortblock kann thinking statt Text sein. Das sind konkrete Kompatibilitätsprüfungen für Dienste, die ein kleines Modell wiederholt zum Klassifizieren, Extrahieren, Weiterleiten oder Zusammenfassen aufrufen.
Die entscheidende Änderung
- Was sich geändert hat: Anthropic bringt sein neues Kontextfenster mit einer Million Token und adaptives Thinking in die günstigste Claude-Stufe. Haiku 5.5 senkt den Preis für kurze Prompts und ändert zugleich, wie Text gezählt wird und womit eine Antwort beginnen kann.
- Warum das wichtig ist: Teams können Claude jetzt für mehr häufige, klar abgegrenzte Agentenschritte zu einem niedrigeren Listenpreis in Betracht ziehen. Der Vorteil hängt von der Mischung aus Promptlängen, Ausgabe- und Thinking-Token, Cache-Nutzung und der Frage ab, ob das neue Modell das Qualitätsziel des jeweiligen Schritts erreicht.
- Worauf zu achten ist: Integrationen mit Haiku 4.5 müssen kontrolliert migriert werden. Nach der Neuzählung können Anfragen nahe der Grenze von 100.000 Token in die höhere Preisstufe wechseln. Code, der den ersten Inhaltsblock als Text voraussetzt, kann außerdem eine ansonsten erfolgreiche Antwort falsch verarbeiten.
Der Preis hängt von der Promptlänge ab
In der Claude API kostet Haiku 5.5 bei Prompts mit bis zu 100.000 Token 0,10 US-Dollar pro Million Eingabetoken und 0,50 US-Dollar pro Million Ausgabetoken. Oberhalb dieser Grenze gelten 0,50 beziehungsweise 2,50 US-Dollar. Für Haiku 4.5 sind über das gesamte Kontextfenster von 200.000 Token Preise von 1 und 5 US-Dollar angegeben. Haiku 5.5 bietet ein Kontextfenster mit einer Million Token und eine maximale Ausgabe von 128.000 Token; bei Haiku 4.5 sind es 200.000 und 64.000. Anthropic nennt die Claude API, Amazon Bedrock, Claude Platform auf AWS, Google Cloud und Microsoft Foundry als Bezugswege. Die Modell-ID für Amazon Bedrock lautet anthropic.claude-haiku-5-5; die Claude API verwendet claude-haiku-5-5. Anthropics Modellseiten führen die aktuellen Plattform-IDs, Grenzen und Preise auf.
Anthropic zufolge sind die Betriebskosten von Haiku 5.5 im Durchschnitt rund 75 % niedriger als bei Haiku 4.5 im Durchschnitt. Die Fußnote kombiniert den um 90 % niedrigeren Listenpreis für Prompts bis 100.000 Token, den um 50 % niedrigeren Preis darüber, die Beobachtung, dass 90 % der Haiku-4.5-Anfragen in die kürzere Kategorie fielen, und die höhere Tokenzahl des neuen Tokenizers für dieselbe Arbeit. Diese Rechnung beschreibt Anthropics Anfrage-Mix und keinen einheitlichen Rabatt auf jede Anfrage. Auch der Anstieg um etwa 30 % ist eine Anbieterschätzung für denselben Eingabetext; die genaue Änderung hängt vom Inhalt ab. Anthropics Ankündigung zum Start nennt sowohl die Behauptung als auch die Berechnungsmethode.
Für eine nicht zwischengespeicherte Claude-API-Anfrage multiplizieren Sie die Ein- und Ausgabetoken von Haiku 5.5 jeweils mit dem Preis der Preisstufe für die Promptlänge dieser Anfrage und teilen die Summe durch eine Million. Beispielrechnung: 80.000 Eingabetoken und 10.000 Ausgabetoken kosten zu den Preisen für kurze Prompts 0,013 US-Dollar. Bei 120.000 Eingabe- und 10.000 Ausgabetoken ergeben die Preise für lange Prompts 0,085 US-Dollar. Das sind Preisberechnungen, keine beobachteten Aufträge oder Prognosen. Für Cache-Lese- und Schreibvorgänge gelten eigene Preise; die Batchverarbeitung weist einen Rabatt von 50 % auf Ein- und Ausgabe aus. Eine sinnvolle Schätzung gruppiert daher reale Aufrufe nach Promptlänge und Cache-Verhalten, bevor sie die Kosten addiert. Diese Kategorien sind auf der Modellseite von Haiku 5.5 aufgeführt .
Zählen Sie repräsentative gespeicherte Prompts mit dem Message-Endpunkt zur Tokenzählung erneut und geben Sie claude-haiku-5-5 an. Die Tokenzahlen des alten Modells zeigen nicht, in welche Preisstufe ein Prompt bei Version 5.5 fällt. Für eine Live-Stichprobe sollten Sie neben den Ergebnissen auch die Antwort-usage, Ausgabelänge, Cache-Felder, Effort und tatsächlichen Kosten erfassen. Nehmen Sie kurze Anfragen, die längsten wiederholten Gespräche und Fälle nahe 100.000 Token auf. BIG CHANGE hat die Dokumentation geprüft, Haiku 5.5 aber weder ausgeführt noch eine Produktionslast gemessen.
Einstellungen, die bei der Migration geprüft werden sollten
Anthropics Migrationsleitfaden für Haiku 5.5 enthält eine ungewöhnlich konkrete Checkliste für Clients, die von Haiku 4.5 wechseln:
- Ändern Sie die Modell-ID für die Plattform und zählen Sie die Prompts neu.
claude-haiku-5-5ist eine feste Claude-API-ID ohne Datumszusatz oder separates Alias. Prüfen Siemax_tokens, denn Thinking wird auf dieses Limit angerechnet und derselbe Text kann mehr Token benötigen. - Ersetzen Sie
thinking: {"type":"enabled","budget_tokens":N}durch adaptives Thinking oder lassen Siethinkingungesetzt. Mitoutput_config.effortlässt sich die Tiefe abstimmen; der dokumentierte Standardwert istmedium. Ein niedriger Wert fürmax_tokenskann die Antwort nach einem Thinking-Block beenden, bevor Text ausgegeben wird. - Lesen Sie Inhaltsblöcke anhand ihres
typeund nicht anhand ihrer Position. Geben Sie Thinking-Blöcke zusammen mit Werkzeugergebnissen unverändert zurück. Testen Sie jeden Gesprächsspeicher, der einen Block über ein anderes Konto wiedergibt oder frühere Nachrichten, Systemanweisungen oder Werkzeuge verändert. - Entfernen Sie benutzerdefinierte Einstellungen für
temperature,top_pundtop_k. Ersetzen Sie einen abschließenden Assistant-Prefill durch einen User-Turn. Verwenden Sie bei eingeschränkten Formaten den von Anthropic dokumentierten Ansatz mit strukturierter Ausgabe oder Werkzeugen. Behandeln Sie im Client einenstop_reasonmit dem Wertrefusal. - Wenn die Integration Computer Use über die Claude API oder Google Cloud nutzt, ersetzen Sie das ältere Werkzeug
computer_20250124durchcomputer_toolset_20260801und aktualisieren Sie die Werkzeugschleife wie im Leitfaden beschrieben. Organisationen mit Priority-Tier-Kapazität für Haiku 4.5 brauchen ebenfalls einen eigenen Plan: Laut Leitfaden ist Priority Tier bei Haiku 5.5 nicht verfügbar.
Diese Änderungen schreiben nicht für jede Aufgabe dieselbe Effort-Einstellung vor. Für einen Vergleich sollten die Anwendungsaufgabe und die Abnahmekriterien gleich bleiben. Erfassen Sie anschließend Antwortqualität, Ablehnungen, Abbrüche, Latenz und abgerechnete Token für die jeweiligen Einstellungen. Anthropic berichtet bei mehreren Benchmarks von besseren Ergebnissen für Haiku 5.5 als für 4.5, darunter 39,2 % gegenüber 0,0 % in der eigenen Tabelle zu Terminal-Bench 4.0. Das sind von Anthropic unter den eigenen Testbedingungen gemeldete Ergebnisse und keine Messung des Agenten eines Lesers. Für komplexe agentische Programmierung seien Sonnet 5.5 und Opus 5.5 in diesem Benchmark besser geeignet, so Anthropic. Für Haiku-4.5-Nutzer lautet die kurzfristige Frage, ob das kleinere Modell nach Berücksichtigung der API-Änderungen und der neuen Tokenzahl die Anforderungen jedes eng umrissenen Schritts erfüllt.
Quellen und weiterführende Informationen
- Anthropics Ankündigung zu Haiku 5.5Nennt Startdatum, vorgesehene Aufgaben und Verfügbarkeit und erläutert die Berechnung der durchschnittlichen Aufgabenkosten. Die Benchmark-Tabelle enthält Anthropics eigene Testergebnisse.
- Modellseite von Haiku 5.5 auf der Claude PlatformListet IDs, Kontext- und Ausgabelimits, Preisstufen nach Promptlänge, Cache-Preise und Plattformunterstützung. Die Seite zu Haiku 4.5nennt die Preise und Grenzen des Vorgängers.
- Migrationsleitfaden für Haiku 5.5Beschreibt Änderungen der Messages API und Fehler, die vor der Umstellung einer bestehenden Integration geprüft werden sollten. Die API-Referenz zur Tokenzählungerläutert, wie sich eine Anfrage mit einem gewählten Modell zählen lässt.
- Reuters-Bericht zum Start am 7. Oktoberbestätigt das Veröffentlichungsdatum unabhängig. Die technischen Einstellungen und Preise oben stammen aus der aktuellen Anthropic-Dokumentation.



