AI-translated from English; not yet reviewed by a fluent editor.

# Claude Haiku 5.5 senkt Tokenpreise, verändert aber die Migrationsrechnung

> Anthropics neues Haiku-Modell hat niedrigere Tokenpreise, einen anderen Tokenizer und Änderungen bei der Migration zur Messages API. Bestehende Nutzer von Haiku 4.5 sollten vor dem Wechsel ihre Anfragen neu zählen und die Antwortverarbeitung testen.

By BIG CHANGE Editorial

Published: 2026-10-08T01:08:04.633Z
Updated: 2026-10-08T01:08:04.633Z
Canonical: https://bigchange.ai/blog/claude-haiku-55-prices-tokenizer-migration

![Conceptual charcoal illustration of a mechanical adding machine with a long blank paper tape and one orange band.](https://bigchange.ai/api/media/file/claude-haiku-55-recount-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE; no actual usage, invoice or Anthropic product is depicted.

Anthropic hat Claude Haiku 5.5 am 7. Oktober für kurze, häufige Aufgaben veröffentlicht, die einen großen Teil der Aufrufe in einem Agentensystem ausmachen können. Die Listenpreise der Claude API beginnen bei 0,10 US-Dollar pro Million Eingabetoken und 0,50 US-Dollar pro Million Ausgabetoken – ein Zehntel der Preise von Haiku 4.5. Laut Anthropic benötigt derselbe Text beim neuen Modell jedoch rund 30 % mehr Token, und Prompts mit mehr als 100.000 Token fallen in eine höhere Preisstufe. Teams mit Haiku 4.5 müssen ihre eigenen Anfragen neu zählen, bevor sie die Kosten schätzen oder Produktionsverkehr verlagern.

Mit der Veröffentlichung ändert sich auch der Ablauf der Messages API. Manuelle Thinking-Budgets funktionieren bei Haiku 5.5 nicht, adaptives Thinking ist standardmäßig aktiviert, und der erste Antwortblock kann `thinking` statt Text sein. Das sind konkrete Kompatibilitätsprüfungen für Dienste, die ein kleines Modell wiederholt zum Klassifizieren, Extrahieren, Weiterleiten oder Zusammenfassen aufrufen.

## Die entscheidende Änderung

- **Was sich geändert hat:** Anthropic bringt sein neues Kontextfenster mit einer Million Token und adaptives Thinking in die günstigste Claude-Stufe. Haiku 5.5 senkt den Preis für kurze Prompts und ändert zugleich, wie Text gezählt wird und womit eine Antwort beginnen kann.
- **Warum das wichtig ist:** Teams können Claude jetzt für mehr häufige, klar abgegrenzte Agentenschritte zu einem niedrigeren Listenpreis in Betracht ziehen. Der Vorteil hängt von der Mischung aus Promptlängen, Ausgabe- und Thinking-Token, Cache-Nutzung und der Frage ab, ob das neue Modell das Qualitätsziel des jeweiligen Schritts erreicht.
- **Worauf zu achten ist:** Integrationen mit Haiku 4.5 müssen kontrolliert migriert werden. Nach der Neuzählung können Anfragen nahe der Grenze von 100.000 Token in die höhere Preisstufe wechseln. Code, der den ersten Inhaltsblock als Text voraussetzt, kann außerdem eine ansonsten erfolgreiche Antwort falsch verarbeiten.

## Der Preis hängt von der Promptlänge ab

In der Claude API kostet Haiku 5.5 bei Prompts mit bis zu 100.000 Token 0,10 US-Dollar pro Million Eingabetoken und 0,50 US-Dollar pro Million Ausgabetoken. Oberhalb dieser Grenze gelten 0,50 beziehungsweise 2,50 US-Dollar. Für Haiku 4.5 sind über das gesamte Kontextfenster von 200.000 Token Preise von 1 und 5 US-Dollar angegeben. Haiku 5.5 bietet ein Kontextfenster mit einer Million Token und eine maximale Ausgabe von 128.000 Token; bei Haiku 4.5 sind es 200.000 und 64.000. Anthropic nennt die Claude API, Amazon Bedrock, Claude Platform auf AWS, Google Cloud und Microsoft Foundry als Bezugswege. Die Modell-ID für Amazon Bedrock lautet `anthropic.claude-haiku-5-5`; die Claude API verwendet `claude-haiku-5-5`. [Anthropics Modellseiten](https://platform.claude.com/docs/en/models/haiku-5-5/overview) führen die aktuellen Plattform-IDs, Grenzen und Preise auf.

Anthropic zufolge sind die Betriebskosten von Haiku 5.5 im Durchschnitt rund 75 % niedriger als bei Haiku 4.5 *im Durchschnitt*. Die Fußnote kombiniert den um 90 % niedrigeren Listenpreis für Prompts bis 100.000 Token, den um 50 % niedrigeren Preis darüber, die Beobachtung, dass 90 % der Haiku-4.5-Anfragen in die kürzere Kategorie fielen, und die höhere Tokenzahl des neuen Tokenizers für dieselbe Arbeit. Diese Rechnung beschreibt Anthropics Anfrage-Mix und keinen einheitlichen Rabatt auf jede Anfrage. Auch der Anstieg um etwa 30 % ist eine Anbieterschätzung für denselben Eingabetext; die genaue Änderung hängt vom Inhalt ab. [Anthropics Ankündigung zum Start](https://www.anthropic.com/claude-haiku-5-5) nennt sowohl die Behauptung als auch die Berechnungsmethode.

Für eine nicht zwischengespeicherte Claude-API-Anfrage multiplizieren Sie die Ein- und Ausgabetoken von Haiku 5.5 jeweils mit dem Preis der *Preisstufe für die Promptlänge dieser Anfrage* und teilen die Summe durch eine Million. Beispielrechnung: 80.000 Eingabetoken und 10.000 Ausgabetoken kosten zu den Preisen für kurze Prompts 0,013 US-Dollar. Bei 120.000 Eingabe- und 10.000 Ausgabetoken ergeben die Preise für lange Prompts 0,085 US-Dollar. Das sind Preisberechnungen, keine beobachteten Aufträge oder Prognosen. Für Cache-Lese- und Schreibvorgänge gelten eigene Preise; die Batchverarbeitung weist einen Rabatt von 50 % auf Ein- und Ausgabe aus. Eine sinnvolle Schätzung gruppiert daher reale Aufrufe nach Promptlänge und Cache-Verhalten, bevor sie die Kosten addiert. [Diese Kategorien sind auf der Modellseite von Haiku 5.5 aufgeführt](https://platform.claude.com/docs/en/models/haiku-5-5/overview) .

Zählen Sie repräsentative gespeicherte Prompts mit dem [Message-Endpunkt zur Tokenzählung](https://platform.claude.com/docs/en/api/go/messages/count_tokens) erneut und geben Sie `claude-haiku-5-5` an. Die Tokenzahlen des alten Modells zeigen nicht, in welche Preisstufe ein Prompt bei Version 5.5 fällt. Für eine Live-Stichprobe sollten Sie neben den Ergebnissen auch die Antwort-`usage`, Ausgabelänge, Cache-Felder, Effort und tatsächlichen Kosten erfassen. Nehmen Sie kurze Anfragen, die längsten wiederholten Gespräche und Fälle nahe 100.000 Token auf. BIG CHANGE hat die Dokumentation geprüft, Haiku 5.5 aber weder ausgeführt noch eine Produktionslast gemessen.

## Einstellungen, die bei der Migration geprüft werden sollten

Anthropics [Migrationsleitfaden für Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) enthält eine ungewöhnlich konkrete Checkliste für Clients, die von Haiku 4.5 wechseln:

1. Ändern Sie die Modell-ID für die Plattform und zählen Sie die Prompts neu. `claude-haiku-5-5`ist eine feste Claude-API-ID ohne Datumszusatz oder separates Alias. Prüfen Sie `max_tokens`, denn Thinking wird auf dieses Limit angerechnet und derselbe Text kann mehr Token benötigen.
2. Ersetzen Sie `thinking: {"type":"enabled","budget_tokens":N}` durch adaptives Thinking oder lassen Sie `thinking` ungesetzt. Mit `output_config.effort` lässt sich die Tiefe abstimmen; der dokumentierte Standardwert ist `medium`. Ein niedriger Wert für `max_tokens` kann die Antwort nach einem Thinking-Block beenden, bevor Text ausgegeben wird.
3. Lesen Sie Inhaltsblöcke anhand ihres `type` und nicht anhand ihrer Position. Geben Sie Thinking-Blöcke zusammen mit Werkzeugergebnissen unverändert zurück. Testen Sie jeden Gesprächsspeicher, der einen Block über ein anderes Konto wiedergibt oder frühere Nachrichten, Systemanweisungen oder Werkzeuge verändert.
4. Entfernen Sie benutzerdefinierte Einstellungen für `temperature`, `top_p` und `top_k`. Ersetzen Sie einen abschließenden Assistant-Prefill durch einen User-Turn. Verwenden Sie bei eingeschränkten Formaten den von Anthropic dokumentierten Ansatz mit strukturierter Ausgabe oder Werkzeugen. Behandeln Sie im Client einen `stop_reason` mit dem Wert `refusal`.
5. Wenn die Integration Computer Use über die Claude API oder Google Cloud nutzt, ersetzen Sie das ältere Werkzeug `computer_20250124` durch `computer_toolset_20260801` und aktualisieren Sie die Werkzeugschleife wie im Leitfaden beschrieben. Organisationen mit Priority-Tier-Kapazität für Haiku 4.5 brauchen ebenfalls einen eigenen Plan: Laut Leitfaden ist Priority Tier bei Haiku 5.5 nicht verfügbar.

Diese Änderungen schreiben nicht für jede Aufgabe dieselbe Effort-Einstellung vor. Für einen Vergleich sollten die Anwendungsaufgabe und die Abnahmekriterien gleich bleiben. Erfassen Sie anschließend Antwortqualität, Ablehnungen, Abbrüche, Latenz und abgerechnete Token für die jeweiligen Einstellungen. Anthropic berichtet bei mehreren Benchmarks von besseren Ergebnissen für Haiku 5.5 als für 4.5, darunter 39,2 % gegenüber 0,0 % in der eigenen Tabelle zu Terminal-Bench 4.0. Das sind von Anthropic unter den eigenen Testbedingungen gemeldete Ergebnisse und keine Messung des Agenten eines Lesers. Für komplexe agentische Programmierung seien Sonnet 5.5 und Opus 5.5 in diesem Benchmark besser geeignet, so Anthropic. Für Haiku-4.5-Nutzer lautet die kurzfristige Frage, ob das kleinere Modell nach Berücksichtigung der API-Änderungen und der neuen Tokenzahl die Anforderungen jedes eng umrissenen Schritts erfüllt.

## Quellen und weiterführende Informationen

- [Anthropics Ankündigung zu Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5)Nennt Startdatum, vorgesehene Aufgaben und Verfügbarkeit und erläutert die Berechnung der durchschnittlichen Aufgabenkosten. Die Benchmark-Tabelle enthält Anthropics eigene Testergebnisse.
- [Modellseite von Haiku 5.5 auf der Claude Platform](https://platform.claude.com/docs/en/models/haiku-5-5/overview)Listet IDs, Kontext- und Ausgabelimits, Preisstufen nach Promptlänge, Cache-Preise und Plattformunterstützung. Die [Seite zu Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview)nennt die Preise und Grenzen des Vorgängers.
- [Migrationsleitfaden für Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide)Beschreibt Änderungen der Messages API und Fehler, die vor der Umstellung einer bestehenden Integration geprüft werden sollten. Die [API-Referenz zur Tokenzählung](https://platform.claude.com/docs/en/api/go/messages/count_tokens)erläutert, wie sich eine Anfrage mit einem gewählten Modell zählen lässt.
- [Reuters-Bericht zum Start am 7. Oktober](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722)bestätigt das Veröffentlichungsdatum unabhängig. Die technischen Einstellungen und Preise oben stammen aus der aktuellen Anthropic-Dokumentation.

## Sources

- [Anthropic: Start von Claude Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5) — Startdatum, vorgesehene Aufgaben, Anbieter-Benchmark und Aussagen zu durchschnittlichen Kosten, Berechnungsfußnote und Cloud-Verfügbarkeit.
- [Übersicht zum Modell Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/overview) — Aktuelle Modell-ID, API-Preise nach Promptlänge, Cache- und Batchpreise, Kontext, Ausgabe und Verfügbarkeit.
- [Übersicht zum Modell Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — Aktueller Legacy-Status, Listenpreise und Grenzen des Vorgängers.
- [Migrationsleitfaden für Claude Haiku 5.5](https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide) — Zentrale Checkliste zu Messages-API-Änderungen und Hinweise zum Tokenizer.
- [Token in einer Message zählen](https://platform.claude.com/docs/en/api/go/messages/count_tokens) — Endpunkt zur Tokenzählung und modellbezogene Zählung einer Anfrage.
- [Reuters: Anthropic bringt ein drittes Claude-5.5-Modell auf den Markt](https://www.marketscreener.com/news/anthropic-launches-third-claude-5-5-model-expanding-ai-lineup-before-planned-ipo-ce785ddedd89f722) — Dient nur der unabhängigen Bestätigung des Starts.
