Anthropic hat Claude Opus 5.5 eingeführt und zwar am 22. September. Das Unternehmen gibt an, dass die Leistung bei den meisten Aufgaben fast an Fable 5.1 heranreicht und die Preise unter denen von Opus 5 liegen.

Für Teams, die bereits Opus 5 nutzen, bedeutet das Update mehr als eine günstigere Modell-ID. Opus 5.5 verwendet immer adaptives Thinking, nutzt standardmäßig die mittlere Intensität und lehnt mehrere Anfrageformen ab, die Opus 5 akzeptierte. Außerdem empfiehlt Anthropic es unterhalb von Fable 5.1 als alltägliches Modell für betreute Arbeit. Fable bleibt den schwierigsten und längsten autonomen Aufträgen vorbehalten.

Die große Veränderung

  • Was sich geändert hat: Opus 5.5 senkt die Preise für Eingaben und Ausgaben um 20 Prozent und für Cache-Lesezugriffe um 60 Prozent. Das stets aktive adaptive Thinking verändert außerdem, wie bestehende API-Clients Aufgaben anfordern und ihre Kosten kalkulieren müssen.
  • Warum das wichtig ist: Bei langen Agentenaufgaben werden frühere Anweisungen und Tool-Ergebnisse wiederholt abgerufen. Die größte Preissenkung betrifft diesen wiederverwendeten Kontext; daher ist die Cache-Nutzung entscheidend, um die Gesamtkosten eines Auftrags zu verstehen.
  • Worauf zu achten ist: Sonnet 5.5 und Haiku 5.5 sind für die kommenden Wochen angekündigt; Opus ist zuerst verfügbar. Bei der Wahl eines Standardmodells müssen die Kosten abgeschlossener Aufgaben und der nötige Prüfaufwand pro Dienststufe verglichen werden.

Opus 5.5 ist für den Produktiveinsatz unterhalb der Fable-Stufe vorgesehen

Anthropic empfiehlt Opus 5.5 in seiner Kommunikation mit Partnern als Standardmodell für den produktiven Einsatz in Unternehmen: beim Programmieren sowie bei Finanz- und Rechtsaufgaben und bei Agenten. In seinem öffentlichen Leitfaden zur Modellauswahl heißt es, für die meisten Arbeitslasten sei Opus 5.5 der Ausgangspunkt; das Modell wird mit komplexer agentischer Programmierung und Unternehmensaufgaben verknüpft. Ein eigener Leitfaden zu den Aufgabenkosten bezeichnet es als „Alltagsmodell“ für betreute Feature-Arbeit, Fehlersuche und Code-Reviews. Beide Leitfäden empfehlen Fable 5.1, wenn höchste Fähigkeiten oder ein langer, schwieriger Auftrag wichtiger sind als der Tokenpreis.

Anthropics Prompting-Leitfaden untermauert die Breite dieses Einsatzbereichs mit Unternehmenstests zu Ursachenanalyse, Codeprüfung, parallelen Subagenten, Recherche, Tabellen, Berichten und Präsentationen. Er beschreibt außerdem klarere Fortschrittsmeldungen und Abschlusszusammenfassungen sowie Verbesserungen bei Bildverarbeitung und Computersteuerung. Das sind Evaluationen von Anthropic, keine Tests von BIG CHANGE.

Der Unterschied zwischen Opus und Fable ist wichtig: Fable 5.1 kostet 10 US-Dollar je Million Eingabetokens und 50 US-Dollar je Million Ausgabetokens; bei Opus 5.5 sind es 4 und 20 US-Dollar. Die Preise für Cache-Lesezugriffe liegen mit 0,25 beziehungsweise 0,20 US-Dollar näher beieinander. Bei langen Sitzungen mit Cache-Nutzung kann der Preisabstand daher geringer ausfallen, als die Schlagzeilenwerte für Ein- und Ausgaben vermuten lassen.

Claude Opus 5.5 ändert vier API-Preise

Die folgenden Standardpreise gelten je Million Tokens. Anthropics Modellreferenz nennt für Opus 5.5 ein Kontextfenster von einer Million Tokens und eine maximale Ausgabe von 128.000 Tokens. Laut der Preisdokumentation gilt für das gesamte Kontextfenster der Standardtarif.

API-Gebühr

Opus 5.5

Opus 5

Änderung

Eingabe

4 $

5 $

20 % weniger

Ausgabe

20 $

25 $

20 % weniger

Cache-Schreiben, 5 Minuten

5 $

6,25 $

20 % weniger

Cache-Lesezugriff

0,20 $

0,50 $

60 % weniger

Anthropic gibt an, dass die typischen Kosten für Arbeitslasten bei Standardeinstellungen um 40 Prozent sinken; dabei werden Preise und Token-Effizienz zusammengenommen. Die Erläuterung zu den Aufgabenkosten zeigt, warum der Nutzungsmix entscheidend ist: Lange Agentensitzungen rufen wiederholt den wachsenden Kontext ab, Ausgaben enthalten Thinking-Tokens und eine Aufgabe kann viele Gesprächsrunden umfassen. Bei einer Sitzung mit intensiver Cache-Nutzung kann eine Senkung der Cache-Lesegebühr um 60 Prozent den Ausschlag geben. Eine kurze Anfrage ohne Cache und mit langer Antwort kommt der Senkung des Ausgabe-Tokenpreises um 20 Prozent näher.

Laut Prompting-Leitfaden ist die berichtete Steigerung der Ausgabegeschwindigkeit um mehr als 30 Prozent ein Maß für die Texterzeugung. Sie misst nicht die Wartezeit auf Tools, Tests, externe Dienste oder eine prüfende Person. Anthropic bietet außerdem einen schnelleren API-Modus zu 8 US-Dollar für Eingaben und 40 US-Dollar für Ausgaben je Million Tokens an. Er ist als Forschungsvorschau in der Claude API verfügbar, nicht aber auf den Cloud-Plattformen der Partner.

Anthropic hat außerdem die fünfstündigen Nutzungslimits in den Pro-, Max- und Team-Abonnements sowie in Enterprise-Abonnements mit nutzerbezogener Abrechnung erhöht und einen übertragbaren Guthaben-Reset bereitgestellt. Abonnementkapazität und API-Abrechnung sind getrennt.

Unternehmenstests zeigen Stärken und Grenzen

Anthropic meldet im Terminal-Bench 4.0 Erfolgswerte von 66,4 Prozent für Opus 5.5 mit Xhigh, 52,3 Prozent für Opus 5 und 55,8 Prozent für Fable 5.1. Bei den meisten anderen hervorgehobenen Ergebnissen wurde die Einstellung Max verwendet.

GPT-6 Astra führt in den aufgeführten Ergebnissen für AutomationBench und Terminal-Bench-Science. Für abgesicherte Cyberaufgaben kam Opus 4.8 zum Einsatz, für Biologie- und Aufgaben zur Entwicklung fortgeschrittener Modelle Opus 5. In AutomationBench wurde kein Fallback verwendet.

Anthropic berichtet in seinem Verhaltensaudit von weniger irreversiblen oder unzulässigen Aktionen. Der Prompting-Leitfaden meldet außerdem eine stärkere Widerstandsfähigkeit gegen indirekte Prompt-Injection als bei früheren Opus-Modellen. Beides sind Ergebnisse eigener Unternehmenstests und keine allgemeine Sicherheitszertifizierung.

Bestehende API-Clients müssen ausdrücklich migriert werden

API-Kunden müssen ausdrücklich claude-opus-5-5 anfordern; bestehende Opus-5-Anfragen wechseln nicht stillschweigend das Modell. Die Migrationsreferenz führt mehrere Änderungen an Anfragen auf, die andernfalls Fehler auslösen oder den Ausgabestrom einer Anwendung verändern können.

Migrationspunkt

Verhalten von Opus 5.5

Modellauswahl

Wähle claude-opus-5-5 explizit aus.

Thinking

Adaptives Thinking ist immer aktiv. Deaktiviertes Thinking und manuelle Tokenbudgets führen zu HTTP 400.

Intensität

Verwende low, medium, high, xhigh oder max; Standard ist medium.

Erzwungene Tools

tool_choice-Werte any und tool führen zu HTTP 400; auto und none werden weiterhin unterstützt.

Computersteuerung

Das bisherige Werkzeug computer_20251124 wird in der Claude API und bei Google Cloud abgelehnt; Amazon Bedrock unterstützt es weiterhin.

Fortschrittstext

Text zwischen Toolaufrufen erscheint in Thinking-Blöcken. Deshalb kann ein Client, der die Anzeige standardmäßig auslässt, zwischen den Aufrufen still zu sein scheinen.

Erhaltene Thinking-Blöcke bilden eine weitere Einschränkung für lange laufende Clients. Sie sind an ein Modell und den Gesprächspräfix gebunden. Bei API-Konten und Konten auf Cloud-Plattformen, die am oder nach dem 31. August 2026 erstellt wurden, führt eine Änderung früherer Anweisungen, Tools oder Nachrichten vor dem erneuten Einfügen eines solchen Blocks standardmäßig zu HTTP 400. Anthropics Dokumentation zu erhaltenen Thinking-Blöcken erläutert den ausschließlich ergänzenden Ablauf und die kontrollierte Möglichkeit, einen inkompatiblen Block zu verwerfen.

Sicherheitsweiterleitung kann das antwortende Modell ändern

Der Prompting-Leitfaden beschreibt Schutzmaßnahmen auf dem Niveau von Fable 5.1 für Biologie sowie Klassifizierer für Cybersicherheit und das Herauslösen von Reasoning. Das Auffinden von Sicherheitslücken im Quellcode bleibt zulässig; Organisationen können eine Prüfung für Biowissenschaften beantragen. Eine erweiterte Überprüfung von Cyberaufgaben ist für die kommenden Wochen angekündigt.

Eine Ablehnung kann weiterhin mit HTTP 200 zurückgegeben werden; die Antwort enthält das Feld stop_reason: "refusal". Die Fallback-Dokumentation beschreibt serverseitige Fallbacks, SDK-Middleware und vom Client verwaltete Wiederholungsversuche. Ein Fallback erfolgt nur, wenn einer dieser unterstützten Wege eingerichtet ist; er ist nicht automatisch bei jeder Opus-5.5-Anfrage zugesichert. Für Kategorien ohne empfohlenes Fallback kann die Anfrage weiterhin abgelehnt werden.

Damit wird das tatsächlich bereitgestellte Modell Teil des Ergebnisses. Eine Anwendung, die zu Opus 5.5 wechselt, sollte Ablehnungen und durch Fallback beantwortete Anfragen getrennt erfassen – besonders bei Aufgaben in abgesicherten Bereichen. Die niedrigeren Preise und die umfassenderen Fähigkeitsangaben beziehen sich auf Opus 5.5; eine weitergeleitete Anfrage richtet sich nach dem Verhalten und den Grenzen des Modells, das tatsächlich geantwortet hat.