DIE WELT BLEIBT NICHT STEHEN.RSS
BIG CHANGE.

Markdown-Ausgabe

AI-translated from English; not yet reviewed by a fluent editor.

# Claude Opus 5.5 senkt API-Preise und bringt Änderungen für die Migration mit

> Anthropics Opus 5.5 senkt die Tokenpreise und ist für betreute Arbeit in Unternehmen unterhalb von Fable 5.1 positioniert. API-Kunden müssen sich auf inkompatible Änderungen bei Thinking und Tools sowie auf bedingte Fallbacks einstellen.

By BIG CHANGE Editorial

Published: 2026-09-22T17:10:37.939Z
Updated: 2026-09-23T03:16:01.519Z
Canonical: https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access

![A large abstract work capsule travels on a broad supported track while a separate side track ends at an unlabelled gate.](https://bigchange.ai/api/media/file/claude-opus-5-5-access-boundary-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE. More affordable capable AI can put longer jobs within reach, while routing and safeguards still determine what work a service handles. This is a conceptual mechanism, not an Anthropic product, benchmark or measured customer result.

Anthropic [hat Claude Opus 5.5 eingeführt](https://www.anthropic.com/claude-opus-5-5) und zwar am 22. September. Das Unternehmen gibt an, dass die Leistung bei den meisten Aufgaben fast an Fable 5.1 heranreicht und die Preise unter denen von Opus 5 liegen.

Für Teams, die bereits Opus 5 nutzen, bedeutet das Update mehr als eine günstigere Modell-ID. Opus 5.5 verwendet immer adaptives Thinking, nutzt standardmäßig die mittlere Intensität und lehnt mehrere Anfrageformen ab, die Opus 5 akzeptierte. Außerdem empfiehlt Anthropic es unterhalb von Fable 5.1 als alltägliches Modell für betreute Arbeit. Fable bleibt den schwierigsten und längsten autonomen Aufträgen vorbehalten.

## Die große Veränderung

- **Was sich geändert hat:** Opus 5.5 senkt die Preise für Eingaben und Ausgaben um 20 Prozent und für Cache-Lesezugriffe um 60 Prozent. Das stets aktive adaptive Thinking verändert außerdem, wie bestehende API-Clients Aufgaben anfordern und ihre Kosten kalkulieren müssen.
- **Warum das wichtig ist:** Bei langen Agentenaufgaben werden frühere Anweisungen und Tool-Ergebnisse wiederholt abgerufen. Die größte Preissenkung betrifft diesen wiederverwendeten Kontext; daher ist die Cache-Nutzung entscheidend, um die Gesamtkosten eines Auftrags zu verstehen.
- **Worauf zu achten ist:** Sonnet 5.5 und Haiku 5.5 sind für die kommenden Wochen angekündigt; Opus ist zuerst verfügbar. Bei der Wahl eines Standardmodells müssen die Kosten abgeschlossener Aufgaben und der nötige Prüfaufwand pro Dienststufe verglichen werden.

## Opus 5.5 ist für den Produktiveinsatz unterhalb der Fable-Stufe vorgesehen

Anthropic empfiehlt Opus 5.5 in seiner Kommunikation mit Partnern als Standardmodell für den produktiven Einsatz in Unternehmen: beim Programmieren sowie bei Finanz- und Rechtsaufgaben und bei Agenten. In seinem [öffentlichen Leitfaden zur Modellauswahl](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) heißt es, für die meisten Arbeitslasten sei Opus 5.5 der Ausgangspunkt; das Modell wird mit komplexer agentischer Programmierung und Unternehmensaufgaben verknüpft. Ein eigener [Leitfaden zu den Aufgabenkosten](https://claude.com/blog/what-a-task-costs-on-opus-5-5) bezeichnet es als „Alltagsmodell“ für betreute Feature-Arbeit, Fehlersuche und Code-Reviews. Beide Leitfäden empfehlen Fable 5.1, wenn höchste Fähigkeiten oder ein langer, schwieriger Auftrag wichtiger sind als der Tokenpreis.

Anthropics [Prompting-Leitfaden](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) untermauert die Breite dieses Einsatzbereichs mit Unternehmenstests zu Ursachenanalyse, Codeprüfung, parallelen Subagenten, Recherche, Tabellen, Berichten und Präsentationen. Er beschreibt außerdem klarere Fortschrittsmeldungen und Abschlusszusammenfassungen sowie Verbesserungen bei Bildverarbeitung und Computersteuerung. Das sind Evaluationen von Anthropic, keine Tests von BIG CHANGE.

Der Unterschied zwischen Opus und Fable ist wichtig: Fable 5.1 kostet 10 US-Dollar je Million Eingabetokens und 50 US-Dollar je Million Ausgabetokens; bei Opus 5.5 sind es 4 und 20 US-Dollar. Die Preise für Cache-Lesezugriffe liegen mit 0,25 beziehungsweise 0,20 US-Dollar näher beieinander. Bei langen Sitzungen mit Cache-Nutzung kann der Preisabstand daher geringer ausfallen, als die Schlagzeilenwerte für Ein- und Ausgaben vermuten lassen.

## Claude Opus 5.5 ändert vier API-Preise

Die folgenden Standardpreise gelten je Million Tokens. Anthropics [Modellreferenz](https://platform.claude.com/docs/en/models/opus-5-5/overview) nennt für Opus 5.5 ein Kontextfenster von einer Million Tokens und eine maximale Ausgabe von 128.000 Tokens. Laut der [Preisdokumentation](https://platform.claude.com/docs/en/about-claude/pricing) gilt für das gesamte Kontextfenster der Standardtarif.

| API-Gebühr | Opus 5.5 | Opus 5 | Änderung |
| --- | --- | --- | --- |
| Eingabe | 4 $ | 5 $ | 20 % weniger |
| Ausgabe | 20 $ | 25 $ | 20 % weniger |
| Cache-Schreiben, 5 Minuten | 5 $ | 6,25 $ | 20 % weniger |
| Cache-Lesezugriff | 0,20 $ | 0,50 $ | 60 % weniger |

Anthropic gibt an, dass die typischen Kosten für Arbeitslasten bei Standardeinstellungen um 40 Prozent sinken; dabei werden Preise und Token-Effizienz zusammengenommen. Die [Erläuterung zu den Aufgabenkosten](https://claude.com/blog/what-a-task-costs-on-opus-5-5) zeigt, warum der Nutzungsmix entscheidend ist: Lange Agentensitzungen rufen wiederholt den wachsenden Kontext ab, Ausgaben enthalten Thinking-Tokens und eine Aufgabe kann viele Gesprächsrunden umfassen. Bei einer Sitzung mit intensiver Cache-Nutzung kann eine Senkung der Cache-Lesegebühr um 60 Prozent den Ausschlag geben. Eine kurze Anfrage ohne Cache und mit langer Antwort kommt der Senkung des Ausgabe-Tokenpreises um 20 Prozent näher.

Laut Prompting-Leitfaden ist die berichtete Steigerung der Ausgabegeschwindigkeit um mehr als 30 Prozent ein Maß für die Texterzeugung. Sie misst nicht die Wartezeit auf Tools, Tests, externe Dienste oder eine prüfende Person. Anthropic bietet außerdem einen schnelleren API-Modus zu 8 US-Dollar für Eingaben und 40 US-Dollar für Ausgaben je Million Tokens an. Er ist als Forschungsvorschau in der Claude API verfügbar, nicht aber auf den Cloud-Plattformen der Partner.

Anthropic hat außerdem die fünfstündigen Nutzungslimits in den Pro-, Max- und Team-Abonnements sowie in Enterprise-Abonnements mit nutzerbezogener Abrechnung erhöht und einen übertragbaren Guthaben-Reset bereitgestellt. Abonnementkapazität und API-Abrechnung sind getrennt.

## Unternehmenstests zeigen Stärken und Grenzen

Anthropic meldet im Terminal-Bench 4.0 Erfolgswerte von 66,4 Prozent für Opus 5.5 mit Xhigh, 52,3 Prozent für Opus 5 und 55,8 Prozent für Fable 5.1. Bei den meisten anderen hervorgehobenen Ergebnissen wurde die Einstellung Max verwendet.

GPT-6 Astra führt in den aufgeführten Ergebnissen für AutomationBench und Terminal-Bench-Science. Für abgesicherte Cyberaufgaben kam Opus 4.8 zum Einsatz, für Biologie- und Aufgaben zur Entwicklung fortgeschrittener Modelle Opus 5. In AutomationBench wurde kein Fallback verwendet.

Anthropic berichtet in seinem Verhaltensaudit von weniger irreversiblen oder unzulässigen Aktionen. Der [Prompting-Leitfaden](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) meldet außerdem eine stärkere Widerstandsfähigkeit gegen indirekte Prompt-Injection als bei früheren Opus-Modellen. Beides sind Ergebnisse eigener Unternehmenstests und keine allgemeine Sicherheitszertifizierung.

## Bestehende API-Clients müssen ausdrücklich migriert werden

API-Kunden müssen ausdrücklich `claude-opus-5-5` anfordern; bestehende Opus-5-Anfragen wechseln nicht stillschweigend das Modell. Die [Migrationsreferenz](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) führt mehrere Änderungen an Anfragen auf, die andernfalls Fehler auslösen oder den Ausgabestrom einer Anwendung verändern können.

| Migrationspunkt | Verhalten von Opus 5.5 |
| --- | --- |
| Modellauswahl | Wähle `claude-opus-5-5` explizit aus. |
| Thinking | Adaptives Thinking ist immer aktiv. Deaktiviertes Thinking und manuelle Tokenbudgets führen zu HTTP 400. |
| Intensität | Verwende `low`, `medium`, `high`, `xhigh` oder `max`; Standard ist `medium`. |
| Erzwungene Tools | `tool_choice`-Werte `any` und `tool` führen zu HTTP 400; `auto` und `none` werden weiterhin unterstützt. |
| Computersteuerung | Das bisherige Werkzeug `computer_20251124` wird in der Claude API und bei Google Cloud abgelehnt; Amazon Bedrock unterstützt es weiterhin. |
| Fortschrittstext | Text zwischen Toolaufrufen erscheint in Thinking-Blöcken. Deshalb kann ein Client, der die Anzeige standardmäßig auslässt, zwischen den Aufrufen still zu sein scheinen. |

Erhaltene Thinking-Blöcke bilden eine weitere Einschränkung für lange laufende Clients. Sie sind an ein Modell und den Gesprächspräfix gebunden. Bei API-Konten und Konten auf Cloud-Plattformen, die am oder nach dem 31. August 2026 erstellt wurden, führt eine Änderung früherer Anweisungen, Tools oder Nachrichten vor dem erneuten Einfügen eines solchen Blocks standardmäßig zu HTTP 400. [Anthropics Dokumentation zu erhaltenen Thinking-Blöcken](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) erläutert den ausschließlich ergänzenden Ablauf und die kontrollierte Möglichkeit, einen inkompatiblen Block zu verwerfen.

## Sicherheitsweiterleitung kann das antwortende Modell ändern

Der [Prompting-Leitfaden](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) beschreibt Schutzmaßnahmen auf dem Niveau von Fable 5.1 für Biologie sowie Klassifizierer für Cybersicherheit und das Herauslösen von Reasoning. Das Auffinden von Sicherheitslücken im Quellcode bleibt zulässig; Organisationen können eine Prüfung für Biowissenschaften beantragen. Eine erweiterte Überprüfung von Cyberaufgaben ist für die kommenden Wochen angekündigt.

Eine Ablehnung kann weiterhin mit HTTP 200 zurückgegeben werden; die Antwort enthält das Feld `stop_reason: "refusal"`. Die [Fallback-Dokumentation](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) beschreibt serverseitige Fallbacks, SDK-Middleware und vom Client verwaltete Wiederholungsversuche. Ein Fallback erfolgt nur, wenn einer dieser unterstützten Wege eingerichtet ist; er ist nicht automatisch bei jeder Opus-5.5-Anfrage zugesichert. Für Kategorien ohne empfohlenes Fallback kann die Anfrage weiterhin abgelehnt werden.

Damit wird das tatsächlich bereitgestellte Modell Teil des Ergebnisses. Eine Anwendung, die zu Opus 5.5 wechselt, sollte Ablehnungen und durch Fallback beantwortete Anfragen getrennt erfassen – besonders bei Aufgaben in abgesicherten Bereichen. Die niedrigeren Preise und die umfassenderen Fähigkeitsangaben beziehen sich auf Opus 5.5; eine weitergeleitete Anfrage richtet sich nach dem Verhalten und den Grenzen des Modells, das tatsächlich geantwortet hat.

## Sources

- [Anthropic: Claude Opus 5.5 wird vorgestellt](https://www.anthropic.com/claude-opus-5-5) — Primäre Ankündigung des Modells sowie von Anthropics Angaben zu typischen Aufgabenkosten, Geschwindigkeit, Benchmarks, Änderungen an Abonnementlimits und Sicherheitsansatz. Veröffentlichte Tests und Beispiele früher Nutzer stammen vom Unternehmen; sie sind keine unabhängigen Ergebnisse für alle Aufgaben.
- [Claude Platform: Neuerungen in Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — Aktuelle Modell- und Migrationsreferenz zu API-ID, Anbieter-Verfügbarkeit, Preisen, Standardwerten für die Reasoning-Intensität, nicht unterstützten Thinking- und Tool-Einstellungen, Geltungsbereich des Schnellmodus und Migration des Computersteuerungs-Tools. Vor einer Bereitstellung ist die Unterstützung beim gewählten Anbieter zu prüfen.
- [Claude Platform: Erhaltene Thinking-Blöcke](https://platform.claude.com/docs/en/build-with-claude/preserved-thinking) — Erläutert die Modellbindung und die ausschließlich ergänzenden Präfixregeln für zurückgegebene Thinking-Blöcke. Die standardmäßige Präfixprüfung gilt für Konten, die am oder nach dem 31. August 2026 erstellt wurden; bei von Anthropic verwalteten Benutzeroberflächen sind dafür keine direkten Client-Änderungen erforderlich.
- [Claude Platform: Ablehnungen und Fallback](https://platform.claude.com/docs/en/build-with-claude/refusals-and-fallback) — Dokumentiert Ablehnungen durch Klassifizierer als HTTP-200-Antworten mit stop_reason refusal und Angaben zur Kategorie sowie verfügbare Fallback-Optionen. Ein erfolgreicher HTTP-Status beweist nicht, dass das angefragte Modell die Aufgabe erledigt hat.
- [Claude Opus 5.5: Modellreferenz](https://platform.claude.com/docs/en/models/opus-5-5/overview) — Offizielle Spezifikation des Kontextfensters mit einer Million Tokens, der maximalen Ausgabe von 128.000 Tokens, Standard- und Cache-Preisen, der standardmäßigen mittleren Reasoning-Intensität, Modell-IDs und unterstützten Plattformen. Der Artikel leitet aus diesen Spezifikationen keine Leistungsangaben ab.
- [Was eine Aufgabe mit Opus 5.5 kostet](https://claude.com/blog/what-a-task-costs-on-opus-5-5) — Anthropics Produkthinweise erläutern, wie Gesprächsrunden, Cache-Lesezugriffe, Ausgaben und Reasoning-Intensität zu den Aufgabenkosten beitragen. Opus 5.5 wird als alltägliches Modell für betreute Arbeit unterhalb von Fable 5.1 positioniert. Die Beispiele sind illustrative Hinweise des Unternehmens, keine Tests von BIG CHANGE.
- [Claude Opus 5.5 richtig einsetzen](https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5) — Offizielle Hinweise zu von Anthropic getesteten Fähigkeiten beim Programmieren, bei Wissensarbeit, Kommunikation, visuellen Aufgaben, Computersteuerung und beim Einsatz mehrerer Agenten sowie zur behaupteten Ausgabegeschwindigkeit und zu Fortschrittsmeldungen. Es handelt sich um Evaluationen von Anthropic, nicht um Produkttests von BIG CHANGE.
- [Das passende Claude-Modell auswählen](https://platform.claude.com/docs/en/about-claude/models/choosing-a-model) — Die offizielle Auswahlmatrix empfiehlt für die meisten Arbeitslasten Opus 5.5, ordnet es komplexer agentischer Programmierung und Unternehmensaufgaben zu und reserviert Fable 5.1 für die höchstmögliche verfügbare Leistungsfähigkeit. Dies stützt die Einordnung der Modellstufen, ohne sich allein auf Aussagen von Partnern zu verlassen.
- [Claude Platform: Preise](https://platform.claude.com/docs/en/about-claude/pricing) — Die offizielle Preisliste bestätigt, dass Claude 4.6 und neuere Modelle das gesamte Kontextfenster von einer Million Tokens zu den regulären Tokenpreisen nutzen. Sie bestätigt auch die im Vergleich verwendeten Preise für Prompt-Caching und den Schnellmodus.