Inhalt
- 1. Opus 5.5 im Überblick: Leistung, Preis, Risiken bei der Migration
- 2. Eckdaten und Verfügbarkeit
- 3. Preise: günstiger als Opus 5, aber es kommt auf den Vergleich an
- 4. Benchmarks: Vergleich nur innerhalb der Tabelle von Anthropic
- 5. Wo das Modell nicht vorne liegt und wie man die Tabelle liest
- 6. Was der neue Standard-Effort medium bedeutet
- 7. Vier Dinge, die beim Umstieg von Opus 5 brechen, und die Lösungen
- 8. Änderungen, die ohne Fehlermeldung passieren
- 9. Was sich in Claude Code und claude.ai ändert
- 10. Die Wahl zwischen Opus 5.5, Fable 5.1, Sonnet 5 und Opus 5
- 11. Migrationsschritte (für API-Nutzer)
- Fazit
- FAQ
Am 22. September 2026 hat Anthropic Claude Opus 5.5 veröffentlicht. Laut Ankündigung ist es das erste Modell der Claude-5.5-Familie, und es erscheint nur zwei Monate nach Opus 5 (veröffentlicht am 24. Juli). In der Modellübersicht der offiziellen Dokumentation ist es nun der empfohlene Ausgangspunkt für die meisten Anwendungsfälle, wenn Sie unsicher sind, welches Modell Sie wählen sollen, und Opus 5 ist in den Legacy-Status gewechselt (älter, aber weiterhin verfügbar).
Die Kurzfassung: Der Preis ist gegenüber Opus 5 gesunken ($4 Input / $20 Output statt $5 / $25 bei Opus 5). Das Verhalten der API hat sich aber deutlich verändert, und es gibt vier Änderungen, durch die Code, der mit Opus 5 funktioniert hat, 400-Fehler liefert. Hinzu kommt: Der Standard-Effort, den Sie ohne eigene Angabe bekommen, sinkt von high auf medium. Wer nur wegen des Preises umsteigt, läuft entweder in Fehler oder in eine Qualitätsveränderung, die ihm nie auffällt. Dieser Artikel gleicht die offizielle Dokumentation und die Ankündigung im Originaltext miteinander ab und geht durch, was sich geändert hat, was es kostet und was bei der Migration bricht – in der Reihenfolge, in der Sie damit tatsächlich zu tun bekommen.
Stand der Informationen: 24. September 2026. Geschrieben zwei Tage nach dem Release, nach Lektüre des Originaltexts der Dokumentation der Claude-Plattform (Modellübersicht, die Seite zu Opus 5.5, What's new, der Migrationsleitfaden und die Preise), der Ankündigung von Anthropic sowie der Dokumentation und des CHANGELOG von Claude Code. Claude Sonnet 5.5 und Claude Haiku 5.5, die laut Ankündigung in den kommenden Wochen folgen sollen, waren zu diesem Zeitpunkt noch nicht erschienen.
Preissenkung und vier Breaking Changes auf einmal
— Offiziell als Modell für lang laufendes agentisches Programmieren und Wissensarbeit positioniert
1. Opus 5.5 im Überblick: Leistung, Preis, Risiken bei der Migration
In der Vergleichstabelle von Anthropic erzielt es beim agentischen Programmieren, bei Wissensarbeit und bei Computer Use höhere Werte als Fable 5.1. Die Ankündigung selbst stellt es für die meisten Aufgaben auf eine Stufe mit Fable 5.1. Dieselbe Ankündigung sagt aber auch, dass Benchmark-Abstände auf diesem Niveau kein verlässlicher Hinweis auf Unterschiede in der Praxis mehr sind.
Input und Output sind mit $4 / $20 20 % günstiger als bei Opus 5, Cache-Lesezugriffe mit $0.20 sogar 60 % günstiger. Gegenüber Sonnet 5 kosten Input und Output allerdings das Doppelte, Cache-Lesezugriffe dagegen gleich viel. Was „günstiger“ heißt, hängt vom Vergleich ab.
Es sind vier: Thinking lässt sich nicht abschalten / erzwungene Tool-Nutzung liefert 400 / Thinking-Blöcke sind an Modell und Gespräch gebunden / das alte Computer-Use-Tool fällt weg. Außerdem sinkt der Standard-Effort auf medium, und der Text zwischen Tool-Aufrufen wandert in Thinking-Blöcke.
In einem Satz: Opus 5.5 ist „ein günstigeres Opus, das man genauso behandelt wie Fable 5.1“. Bei drei der vier Breaking Changes vermerkt die offizielle Dokumentation selbst, dass sie auch für Claude Fable 5.1 gelten. Wenn Ihr Code bereits eine Migration auf Fable 5.1 hinter sich hat, bleibt deutlich weniger zu tun.
2. Eckdaten und Verfügbarkeit
Beginnen wir mit den Zahlen. Verglichen werden drei Modelle: Opus 5, das abgelöst wird, Fable 5.1 als Stufe darüber und Sonnet 5 als Stufe darunter.
| Merkmal | Opus 5.5 | Opus 5 (Legacy) | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| API-Modell-ID | claude-opus-5-5 |
claude-opus-5 |
claude-fable-5-1 |
claude-sonnet-5 |
| Preis (Input/Output) | $4 / $20 | $5 / $25 | $10 / $50 | $2 / $10 |
| Kontext / max. Output | 1M / 128K | 1M / 128K | 1M / 128K | 1M / 128K |
| Thinking | Immer aktiv (nicht abschaltbar) | Standardmäßig aktiv. Abschaltbar bei Effort high oder darunter | Immer aktiv (nicht abschaltbar) | Standardmäßig aktiv. Bei jedem Effort abschaltbar |
| Standard-Effort | medium | high | high | high |
| Verlässlicher Wissensstand | Juni 2026 | Mai 2026 | Juni 2026 | Januar 2026 |
| Geschwindigkeit (offizielle relative Einstufung) | Moderate | — | Slower | Fast |
| Einstellung | Nicht vor dem 22. September 2027 | Nicht vor dem 24. Juli 2027 | Nicht vor dem 1. September 2027 | Nicht vor dem 30. Juni 2027 |
Quellen: Anthropic, "Models overview", "Claude Opus 5.5", "Claude Opus 5", "Migrating to Claude Opus 5.5" (abgerufen am 24. September 2026). Die Geschwindigkeit ist eine relative Einstufung innerhalb der aktuellen Modellpalette und wird für das Legacy-Modell Opus 5 nicht angegeben. Die Einstellungsdaten sind Zusagen für die von Anthropic betriebenen Plattformen; Amazon Bedrock und Google Cloud legen eigene Termine fest.
Auffällig an der Tabelle ist, dass sich nur zwei Zeilen, „Thinking“ und „Standard-Effort“, von Opus 5 unterscheiden. Kontext und maximaler Output sind identisch, der Wissensstand ist nur um einen Monat vorgerückt. Auf dem Datenblatt unterscheidet sich das Modell von Opus 5 also darin, wie man es behandelt und was es kostet; den Leistungsunterschied zeigt die Tabelle in Abschnitt 4. Außerdem gilt: Mit der Message Batches API hebt der Beta-Header output-300k-2026-03-24 die Output-Grenze auf 300K Tokens an (wie bei Opus 5).
Plattformen
Claude API (claude-opus-5-5), Amazon Bedrock (anthropic.claude-opus-5-5), Claude Platform on AWS, Google Cloud und Microsoft Foundry. Das Modell war vom ersten Tag an auf allen Plattformen verfügbar.
claude.ai, die Apps für iOS und Android sowie Claude Code. In Claude Code ist es ab v2.1.280 das Standardmodell in den wichtigsten Tarifen, Pro eingeschlossen (Abschnitt 9).
Die schnellere Variante ist eine Research Preview und laut offizieller Dokumentation nur über die Claude API verfügbar. Auf Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry gibt es sie nicht.
3. Preise: günstiger als Opus 5, aber es kommt auf den Vergleich an
Die offizielle Seite What's new nennt als Preis $4 / $20, unter den $5 / $25 von Opus 5. Es ist die erste Änderung der Opus-Preise, nachdem $5 / $25 von Opus 4.5 bis Opus 5 unverändert galten (bestätigt in der Tabelle auf der offiziellen Preisseite). Hier die Tarife im Detail.
| Pro Million Tokens | Opus 5.5 | Opus 5 | Fable 5.1 | Sonnet 5 |
|---|---|---|---|---|
| Input | $4 | $5 | $10 | $2 |
| Output | $20 | $25 | $50 | $10 |
| Cache-Schreiben (5 Min.) | $5 | $6.25 | $12.50 | $2.50 |
| Cache-Schreiben (1 Std.) | $8 | $10 | $20 | $4 |
| Cache-Lesen | $0.20 5 % des Input-Preises |
$0.50 10 % des Input-Preises |
$0.25 2,5 % des Input-Preises |
$0.20 10 % des Input-Preises |
| Batch API (Input/Output) | $2 / $10 | $2.50 / $12.50 | $5 / $25 | $1 / $5 |
| Fast Mode (Input/Output) | $8 / $40 | $10 / $50 | — | — |
Quelle: Anthropic, "Pricing" (abgerufen am 24. September 2026). Die Zeile Fast Mode umfasst nur Modelle, die in der Fast-Mode-Tabelle der Preisseite stehen. Die $2 / $10 von Sonnet 5 wurden zum Start als Einführungspreis bis zum 31. August angeboten und sind danach zum regulären Preis geworden (laut Hinweis auf derselben Seite).
„Günstiger“ bedeutet gegenüber jedem Modell etwas anderes
Gegenüber Opus 5 ist es in jeder Preisposition günstiger. Gegenüber Fable 5.1 oder Sonnet 5 fällt der Abstand dagegen nicht in allen Positionen gleich aus. Die Grafik unten zeigt den Tarif von Opus 5.5, wenn der Tarif des jeweils anderen Modells auf 100 gesetzt wird.
Tarif von Opus 5.5, wenn der Tarif des anderen Modells = 100
Quelle: eigene Berechnung aus den Tarifen in Anthropics "Pricing" (Balkenlänge so skaliert, dass 200 der vollen Breite entspricht)
Drei Erkenntnisse:
- Wer von Opus 5 kommt, spart umso mehr, je stärker die Arbeitslast den Cache nutzt. Input und Output sind 20 % günstiger, Cache-Lesezugriffe 60 %. Die Ankündigung weist selbst darauf hin, dass Cache-Lesezugriffe den Großteil der Kosten agentischer und programmierender Arbeit ausmachen.
- Gegenüber Fable 5.1 ist der Abstand beim Cache-Lesen klein. Input und Output kosten 40 % des Preises von Fable 5.1, Cache-Lesezugriffe aber $0.20 gegenüber $0.25 – nur 20 % Unterschied.
- Gegenüber Sonnet 5 kostet nur das Cache-Lesen gleich viel. Input und Output sind doppelt so teuer, doch Cache-Lesezugriffe kosten bei beiden $0.20. Je höher also der Anteil gecachter Tokens, desto kleiner der Preisabstand.
Rechenbeispiel: eine Aufgabe mit 10M Tokens Cache-Lesen, 500K Input und 300K Output (die Token-Mengen sind eine Annahme dieses Artikels; Kosten für Cache-Schreiben sind nicht berücksichtigt)
- Opus 5.5: $2.00 + $2.00 + $6.00 = $10.00
- Opus 5: $5.00 + $2.50 + $7.50 = $15.00 (Opus 5.5 kostet zwei Drittel davon)
- Fable 5.1: $2.50 + $5.00 + $15.00 = $22.50
- Sonnet 5: $2.00 + $1.00 + $3.00 = $6.00 (Opus 5.5 kostet etwa das 1,7-Fache, nicht das Doppelte)
Hier werden Tarife bei identischen Token-Mengen verglichen; in der Praxis verbraucht jedes Modell unterschiedlich viele Tokens. Tarife aus Anthropics "Pricing".
Noch ein Punkt: Der Preis pro Token und die Rechnung sind zwei verschiedene Dinge. Laut Ankündigung von Anthropic kostet das Modell mit Standardeinstellungen bei typischer Arbeit 40 % weniger als Opus 5, weil der Preis pro Token niedriger ist und es pro Aufgabe zudem weniger Tokens verbraucht. Das ist eine eigene Messung von Anthropic. Gleichzeitig sagt die offizielle Dokumentation aber auch, dass Opus 5.5 bei gleichem Effort pro Turn tendenziell mehr nachdenkt als Opus 5, besonders bei xhigh und max. Thinking-Tokens werden als Output-Tokens abgerechnet, auch wenn sie nicht angezeigt werden. Arbeitslasten, die Sie auf Opus 5 mit abgeschaltetem Thinking günstig betrieben haben, können Thinking auf Opus 5.5 nicht abschalten – die Output-Tokens können also steigen. Nach der Migration hilft nur eines: usage messen und auf Ihrer eigenen Arbeitslast neu vergleichen. Die Preise aller Claude-Modelle finden Sie in unserem Preisvergleich von Opus, Sonnet und Haiku.
4. Benchmarks: Vergleich nur innerhalb der Tabelle von Anthropic
Die Ankündigung von Opus 5 zeigte ihre Vergleichstabelle als Bild, diese Ankündigung dagegen als Texttabelle auf der Seite. Sie hat fünf Spalten: Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra und GPT-5.6 Sol. Zunächst die Bedingungen der Tabelle:
- Sofern nicht anders vermerkt, wurde Opus 5.5 mit maximalem Effort (max) gemessen. Die einzige Ausnahme ist Terminal-Bench 4.0: Opus 5.5 bei xhigh und GPT-6 Astra bei high (von OpenAI gemeldeter Wert), jeweils das beste Ergebnis des Modells
- GPT-6 Astra und GPT-5.6 Sol bei Terminal-Bench 4.0 sowie GPT-6 Astra bei Terminal-Bench-Science 0.1 sind von OpenAI gemeldete Werte. Bei den GPT-Werten in den übrigen Zeilen fehlt ein Hinweis, wer sie gemessen hat
- Die Werte für AutomationBench wurden von Zapier gemessen und gemeldet (Opus 5.5 aus Zapiers Early-Access-Evaluation; Opus 5 und die beiden GPT-Modelle aus Zapiers öffentlichem Leaderboard). Es ist die einzige Zeile, bei der die Tabelle ausdrücklich eine Messung durch Dritte angibt
- Opus 5.5 wurde mit denselben Schutzmechanismen gemessen wie im Produktivbetrieb. Bei Aufgaben, in die ein Schutzmechanismus eingriff, löste bei Cybersicherheit Opus 4.8 und bei Biologie und der Entwicklung von Frontier-LLMs Opus 5 die Aufgabe stattdessen. Anthropic merkt an, dass dies die Werte von Opus 5.5 vermutlich senkt
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench 4.0 Agentisches Programmieren im Terminal |
66,4 % | 55,8 % | 52,3 % | 57,9 % | 37,3 % |
| FrontierCode v1.1 (Main) Ob Änderungen gemergt werden |
54,4 % | 50,3 % | 48,0 % | 53,3 % | 47,5 % |
| CursorBench 4.0 Mehrdeutige Aufgaben über mehrere Dateien |
57,8 % | 51,8 % | 46,6 % | — | 41,7 % |
| GDPval-AA v2.1 (Elo) Reale Arbeit aus 44 Berufen |
1846 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench Geschäftsabläufe (gemessen von Zapier) |
40,0 % | 31,4 % | 26,9 % | 41,4 % | 28,8 % |
| Humanity's Last Exam Fachübergreifendes Schlussfolgern (mit Tools) |
67,7 % | 65,6 % | 63,6 % | 57,2 % | — |
| Terminal-Bench-Science 0.1 Agentische wissenschaftliche Forschung |
58,7 % | 52,6 % | 29,0 % | 64,6 % | 22,4 % |
| OSWorld 2.0 Computer Use (in der Tabelle als „partial“ markiert) |
81,8 % | 80,7 % | 74,0 % | — | — |
| Chartography Diagramme lesen (mit Tools) |
89,0 % | 88,4 % | 83,4 % | — | — |
Quelle: Vergleichstabelle in Anthropics "Introducing Claude Opus 5.5" (22. September 2026; abgerufen am 24. September). Grün bedeutet, dass Opus 5.5 in dieser Zeile den Bestwert hat; Rot bedeutet, dass dieselbe Tabelle in dieser Zeile einen höheren Wert als Opus 5.5 enthält. „—“ bedeutet, dass die Tabelle keinen Wert angibt.
Opus 5.5 hat in 7 der 9 Zeilen den Bestwert. Am größten ist der Vorsprung bei Terminal-Bench 4.0 (10,6 Punkte vor Fable 5.1) und GDPval-AA v2.1 (111 Punkte vor Fable 5.1). Gegenüber dem Vorgänger Opus 5 stieg Terminal-Bench-Science 0.1 von 29,0 % auf 58,7 %, also ungefähr auf das Doppelte.
Werte je Effort-Stufe laut den Diagrammbeschreibungen der Ankündigung
Die Tabellenwerte gelten für max (bei Terminal-Bench 4.0 für xhigh), doch die Ankündigung enthält auch Diagramme, die den Wert gegen die Kosten pro Aufgabe für jede Effort-Stufe auftragen, und deren Beschreibungen nennen Zahlen für die Standardeinstellung medium.
54,6 % bei medium. Damit schlägt es den Bestwert von GPT-6 Astra (53,3 %) zu etwa einem Fünftel der Kosten pro Aufgabe. Der Wert bei medium liegt über dem Wert bei max in der Tabelle (54,4 %).
52,5 % bei medium. Das liegt über Fable 5.1 (max) mit 51,8 % und Opus 5 (max) mit 46,6 % und schlägt den Bestwert von GPT-5.6 Sol (41,7 %) um 11 Punkte zu etwa einem Drittel der Kosten.
Beim Standard-Effort schlägt es Opus 5 bei max zu etwa einem Fünftel der Kosten. Mit GPT-6 Astra zieht es bei rund 40 % der Kosten gleich.
Bei medium schlägt es GPT-6 Astra bei max zu etwa einem Fünftel der Kosten pro Aufgabe.
Quelle: Diagrammbeschreibungen in Anthropics "Introducing Claude Opus 5.5" (alle Messungen und Vergleiche stammen von Anthropic selbst)
Bei FrontierCode lohnt es sich, kurz innezuhalten. Innerhalb derselben Ankündigung liegt medium (54,6 %) knapp vor max (54,4 %). Das seit Opus 5 beobachtete Muster, dass ein höherer Effort nicht immer höhere Werte bringt, setzt sich bei Opus 5.5 fort (Abschnitt 6). Die Ankündigung und die Zahlen von GPT-6 Astra selbst behandeln wir in unserer Analyse zum Release von GPT-6 Astra.
5. Wo das Modell nicht vorne liegt und wie man die Tabelle liest
Release-Berichte führen gern nur die Zeilen auf, in denen ein Modell gewinnt – hier deshalb die andere Seite. Alles Folgende stammt aus Anthropics eigener Ankündigung und Dokumentation.
In Anthropics eigener Tabelle liegt GPT-6 Astra bei AutomationBench vorne, 40,0 % gegenüber 41,4 %, und bei Terminal-Bench-Science 0.1, 58,7 % gegenüber 64,6 %. Zu beachten: AutomationBench lief ohne Fallback-Modell, und Eingriffe von Schutzmechanismen wurden als Fehlschläge gezählt (laut Anmerkung zur Tabelle).
Unter Verweis auf sehr starke Cyberfähigkeiten sagt die Ankündigung, dass Schutzmechanismen ähnlich wie bei Fable 5.1 greifen und der Großteil der Cybersicherheitsarbeit an Opus 4.8 weitergeleitet wird. Fehler in der alltäglichen Entwicklung finden und beheben funktioniert weiterhin wie gewohnt.
Für Biologie gelten dieselben Schutzmechanismen wie bei Fable 5.1. Wer das Modell für Forschung und Entwicklung nutzen will, muss sich beim Life Sciences Verification Program für geprüfte Organisationen bewerben.
Zwei Dinge, die Sie beim Lesen der Tabelle im Kopf behalten sollten: Erstens sagt die Ankündigung selbst, dass Benchmark-Abstände auf diesem Leistungsniveau zunehmend unzuverlässig als Hinweis auf Unterschiede in der Praxis werden und dass sich der Abstand zu Fable 5.1 bei Anthropics interner Nutzung kleiner anfühlt, als die Zahlen vermuten lassen. „10 Punkte vor Fable 5.1“ sollte man also nicht als 10 Punkte Unterschied in der Praxis lesen. Zweitens unterscheiden sich die Testversionen von denen in der Tabelle der Opus-5-Ankündigung (CursorBench 3.2 → 4.0, GDPval-AA v2 → v2.1 usw.). Wer Zahlen aus der Tabelle vom Juli und aus dieser nebeneinanderstellt, vergleicht Werte, die unter verschiedenen Bedingungen gemessen wurden.
6. Was der neue Standard-Effort medium bedeutet
Diese Änderung wird am ehesten übersehen. Eine Anfrage ohne Angabe des Effort läuft bei Opus 5 mit high und bei Opus 5.5 mit medium. Mit exakt demselben Code denkt das Modell eine Stufe weniger gründlich nach.
Laut der offiziellen Seite zu Effort verhält sich die ausdrückliche Angabe des Standardwerts (bei Opus 5.5 medium) genau so wie das Weglassen. Wenn Sie dieselbe Tiefe wie bei Opus 5 wollen, setzen Sie ausdrücklich high.
Bei gleichem Effort denkt Opus 5.5 pro Turn tendenziell mehr nach als Opus 5, besonders bei xhigh und max (What's new). Wer das high von Opus 5 übernimmt, bekommt also nicht zwingend dasselbe Ergebnis.
Weil sich Thinking nicht abschalten lässt, ist Effort das Einzige, was bestimmt, wie viel das Modell nachdenkt und was es kostet. Wo Sie bei Opus 5 Thinking abgeschaltet haben, senken Sie stattdessen den Effort.
Welche Stufe also? Hier die Empfehlungen der offiziellen Dokumentation, zusammengefasst für Opus 5.5.
| effort | Geeignet für (offizielle Beschreibung) | Hinweise zu Opus 5.5 |
|---|---|---|
| low | Einfache Aufgaben, bei denen Geschwindigkeit und Kosten Vorrang haben, etwa Subagenten | Ein möglicher Ersatz für Arbeitslasten, die bei Opus 5 Thinking abgeschaltet hatten |
| medium (Standard) | Agentische Arbeit, die eine Balance aus Geschwindigkeit, Kosten und Leistung braucht | Die Stufe, die in den Diagrammen der Ankündigung bei FrontierCode und CursorBench die Bestwerte der Konkurrenz schlug |
| high | Komplexes Schlussfolgern, schwieriges Programmieren und agentische Arbeit | Der Standard von Opus 5. Ein praktischer Vergleichsmaßstab direkt nach der Migration |
| xhigh | Lang laufendes agentisches Programmieren | max_tokens mit 64K Tokens beginnen und von dort aus anpassen (Migrationsleitfaden) |
| max | Schwere Probleme, die das tiefste Schlussfolgern erfordern | Die Doku von Claude Code warnt, dass die Zugewinne oft stagnieren und das Modell zum Überdenken neigt – vor breitem Einsatz also testen |
Quellen: Anthropic, "Effort", der Migrationsleitfaden, Claude Code, "Model configuration"
Die offizielle Empfehlung ist durchgängig dieselbe: Einstellungen des Vorgängermodells nicht übernehmen, sondern den Effort auf dem eigenen Evaluierungsset neu abstimmen. Die Ankündigung zitiert außerdem Unternehmen aus dem Kreis der frühen Tester, etwa Deloittes Bericht, dass das Modell selbst beim niedrigsten Effort mehr bekannte Fehler fand als Opus 5 bei high. Das sind jedoch Ergebnisse, die jedes Unternehmen an seiner eigenen Arbeit gemessen und die Anthropic zur Veröffentlichung ausgewählt hat; es gibt keine Garantie, dass sich Ihre Arbeitslast genauso verhält. Prüfen Sie an Ihrer eigenen Arbeit, ob medium die Qualität hält und was sich verbessert, wenn Sie auf high erhöhen. Bei Opus 5.5 können Sie den Effort außerdem mitten im Gespräch pro Nachricht ändern, ohne den Prompt-Cache zu brechen (Beta).
7. Vier Dinge, die beim Umstieg von Opus 5 brechen, und die Lösungen
Die offizielle Seite What's new in Claude Opus 5.5 führt vier Breaking Changes auf, die Code betreffen, der auf Opus 5 läuft. Alle liefern einen 400-Fehler invalid_request_error.
① Thinking lässt sich nicht abschalten
Opus 5 akzeptierte thinking: {"type": "disabled"} bei Effort high oder darunter. Bei Opus 5.5 ist Thinking immer aktiv, und sowohl disabled als auch ein manuelles Budget, {"type": "enabled", "budget_tokens": N}, liefern bei jeder Effort-Stufe einen Fehler. Die zurückgegebene Meldung lautet:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
Lösung: Entfernen Sie den Parameter thinking (dann wird er genauso behandelt wie {"type": "adaptive"}). Wo Sie Thinking zum Sparen abgeschaltet haben, senken Sie stattdessen den Effort.
# Vorher: funktioniert mit Opus 5, liefert 400 mit Opus 5.5 client.messages.create( model="claude-opus-5", max_tokens=16000, thinking={"type": "disabled"}, messages=[...], ) # Nachher: Thinking ist immer aktiv; effort legt fest, wie viel client.messages.create( model="claude-opus-5-5", max_tokens=16000, output_config={"effort": "low"}, messages=[...], )
Weil Thinking immer läuft, kann eine Antwort mit einem Thinking-Block beginnen. Code, der nach Position liest, etwa content[0].text, bricht dann – wählen Sie deshalb die Blöcke aus, deren type "text" ist. In Tool-Use-Schleifen schicken Sie Thinking-Blöcke unverändert zurück, auch wenn sie leer sind (Bearbeiten, Umsortieren oder Weglassen einzelner Blöcke liefert 400). max_tokens begrenzt Thinking und Antwort zusammen, daher muss das Limit bei Arbeitslasten mit abgeschaltetem Thinking überprüft werden.
② Erzwungene Tool-Nutzung liefert einen Fehler
Wird tool_choice auf {"type": "any"} oder {"type": "tool", "name": "..."} gesetzt, kommt 400 zurück. Die Token-Counting-API führt dieselbe Prüfung durch. Erlaubt sind nur auto (der Standard) und none.
tool_choice: type "tool" and "any" are not supported for this model.
Lösung: Lassen Sie tool_choice auf auto und ergänzen Sie in den Tool-Definitionen strict: true (Strict Tool Use), oder verlagern Sie das Schema in Structured Outputs. Anschließend schreiben Sie in den Prompt, wann das Tool verwendet werden soll. Wenn Sie erzwungene Tool-Nutzung nur verwendet haben, um eine JSON-Ausgabe zu garantieren, ist der Wechsel zu Structured Outputs der sauberere Weg. Eine Einschränkung: Strict Tool Use akzeptiert nur einen Teil von JSON Schema, und jedes Objekt im Schema braucht additionalProperties: false.
# Nachher: auto + strict; in Worten sagen, wann das Tool zu nutzen ist client.messages.create( model="claude-opus-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "Wie ist das Wetter in Paris? Nutze das Tool get_weather."}], )
③ Thinking-Blöcke sind an Modell und Gespräch gebunden
Jeder Thinking-Block hält fest, welches Modell ihn erzeugt hat. Opus 5.5 kann Thinking-Blöcke von Opus-, Sonnet- und Haiku-Modellen bis einschließlich Opus 5 lesen, nicht aber von Fable oder Mythos. Umgekehrt können nur Fable 5.1 und Mythos 5.1 auf der Claude API die Thinking-Blöcke von Opus 5.5 lesen.
- Beim Wechsel Opus 5 → Opus 5.5 oder Opus 5.5 → Fable 5.1 (Claude API) wird das bisherige Schlussfolgern übernommen
- Bei jedem anderen Wechsel (zum Beispiel Opus 5.5 → Sonnet 5) laufen die Turns nach dem Wechsel ohne das Schlussfolgern des vorherigen Modells. Die Anfrage selbst gelingt, und die verworfenen Blöcke werden nicht berechnet
Zusätzlich prüft die API, dass sich nichts vor einem Thinking-Block von Opus 5.5 (system, tools, frühere Nachrichten) seit der Erzeugung des Blocks geändert hat. Bei Konten, die am oder nach dem 31. August 2026, 00:00 (UTC) angelegt wurden, wird das standardmäßig durchgesetzt, und wer Blöcke auf einem mitten im Gespräch umgeschriebenen Verlauf mitschickt, bekommt 400.
Lösung: Führen Sie das Gespräch nur durch Anhängen fort. Wenn Sie Anweisungen oder Tools ändern wollen, verwenden Sie eine Systemnachricht mitten im Gespräch, statt den Verlauf umzuschreiben. Laut Migrationsleitfaden arbeiten Claude Code, claude.ai, Claude Managed Agents und das Claude Agent SDK bereits nur anhängend; wenn Sie darauf aufbauen, müssen Sie also nichts ändern. Lässt sich Umschreiben nicht vermeiden, fügen Sie den Beta-Header thinking-binding-controls-2026-08-01 hinzu und setzen thinking.block_binding.prefix_mismatch_behavior auf "drop_block", damit die betroffenen Blöcke verworfen werden, statt einen Fehler auszulösen. Der Mechanismus ist derselbe wie bei Fable 5.1, den wir ausführlich in unserem Artikel zu den Breaking Changes von Fable 5.1 behandelt haben.
④ Das alte Computer-Use-Tool ist auf der Claude API und Google Cloud nicht verfügbar
Opus 5 akzeptierte Computer Use sowohl über das neue Toolset computer_toolset_20260801 als auch über das ältere Tool computer_20251124 mit Beta-Header. Opus 5.5 akzeptiert auf der Claude API und Google Cloud nur das Toolset, und wer das alte Tool deklariert, bekommt 400. Die Meldung beginnt mit:
'claude-opus-5-5' does not support tool types: computer_20251124.
Lösung: Entfernen Sie den Beta-Header und ersetzen Sie tools durch [{"type": "computer_toolset_20260801"}] (ohne Namen, ohne Bildschirmgröße). Auch die Agentenschleife muss an drei Stellen angepasst werden: Die Art der Aktion steht im name des Blocks, nicht in input.action; ein einzelner Turn kann mehrere Aktionen enthalten; und jedes Ergebnis muss mit toolset_name zurückgegeben werden. Auf Amazon Bedrock funktioniert das alte Tool mit Opus 5.5 weiterhin, dort ist also keine Änderung nötig.
8. Änderungen, die ohne Fehlermeldung passieren
Die vier Breaking Changes liefern 400, Sie bemerken sie also. Tückisch sind die Änderungen, bei denen sich nur das Verhalten verschiebt, ohne jeden Fehler.
| Änderung | Was passiert / was zu tun ist |
|---|---|
| Text zwischen Tool-Aufrufen landet in Thinking-Blöcken | Kurze Zeilen wie „Als Nächstes prüfe ich X“, die bei Opus 5 Textblöcke waren, kommen jetzt als Fortschritts-Thinking-Blöcke zurück. Mit der Standard-Anzeigeeinstellung (display: "omitted") sind sie leer, sodass Oberflächen, die Nutzern den Fortschritt live gezeigt haben, zwischen Tool-Aufrufen verstummen. Setzen Sie display auf "updates" (Beta, Header thinking-display-updates-2026-08-18; liefert nur den Fortschritt, das Schlussfolgern bleibt verborgen) oder "summarized" (liefert Zusammenfassungen des Schlussfolgerns gemischt mit dem Fortschritt), und zeigen Sie nicht leere Thinking-Blöcke vor dem darauffolgenden tool_use an |
| Mehr Ablehnungskategorien | Neben dem Cyber-Klassifikator läuft jetzt auch einer für Biologie, und Anfragen, die das Modell dazu bringen wollen, sein internes Schlussfolgern in die Antwort zu schreiben, können als reasoning_extraction abgelehnt werden. Eine Ablehnung kommt als HTTP 200 mit stop_reason: "refusal" zurück; lesen Sie stop_details, um sie zu behandeln. Der serverseitige Fallback (fallbacks: "default", Beta) wiederholt bei reasoning_extraction nicht |
| Genaueres Lesen von Diagrammen und Abbildungen | Bilder mit feinteiligen Diagrammen oder layoutabhängigen Inhalten liest das Modell jetzt auch ohne Tools genau. Prompt-Umgehungen, die Sie für ältere Modelle eingebaut haben, sind möglicherweise nicht mehr nötig (bei den detailreichsten Eingaben verbessern Tools die Genauigkeit aber weiterhin) |
| Von Opus 4.8 kommend: kein Priority Tier | Opus 4.8 unterstützt Priority Tier, Opus 5.5 nicht. Organisationen mit entsprechendem Vertrag müssen die Kapazität separat planen |
Quellen: What's new in Claude Opus 5.5, Migrating to Claude Opus 5.5
9. Was sich in Claude Code und claude.ai ändert
Dieser Teil ist wichtig, wenn Sie die API nicht direkt aufrufen. Claude Code unterstützt Opus 5.5 seit v2.1.280 laut CHANGELOG.
default bedeutet jetzt Opus 5.5 bei Pro, Max, Team, Enterprise und der API. Pro und Team Standard hatten zuvor Sonnet 5 als Standard, für sie ist es also ein Wechsel von Sonnet zu Opus. Der Alias opus zeigt auf der Claude API, Claude Platform on AWS, Bedrock und Google Cloud ebenfalls auf Opus 5.5. Versionen vor v2.1.280 können es nicht nutzen, führen Sie also claude update aus.
Opus 5.5 startet mit medium. Die Effort-Stufe, die Sie zu Opus-5-Zeiten mit /effort gespeichert haben, wird nicht übernommen (weder die pro Modell gespeicherte Einstellung noch das ältere effortLevel auf oberster Ebene der Benutzereinstellungen gilt für Opus 5.5). Es läuft mit medium, bis Sie in /effort oder im Bildschirm /model neu wählen. Die Umgebungsvariable CLAUDE_CODE_EFFORT_LEVEL und ein in Projekt- oder verwalteten Einstellungen gesetztes effortLevel gelten für alle Modelle.
Alt+T (Option+T unter macOS), alwaysThinkingEnabled und MAX_THINKING_TOKENS=0 haben bei Opus 5.5 und Fable allesamt keine Wirkung. Seit v2.1.281 zeigt Claude Code bei Modellen, deren Thinking sich nicht abschalten lässt, statt des Umschaltens eine einzeilige Erklärung an.
Schlägt ein Klassifikator an, werden Biologie-Anfragen erneut auf Opus 5 und Cybersicherheits-Anfragen auf Opus 4.8 ausgeführt, und die Sitzung bleibt bei diesem Modell. Mit /model wechseln Sie zurück. Laut offizieller Dokumentation passiert das bei Penetrationstests, CTFs oder Codebasen mit viel Biologie oft schon bei der allerersten Anfrage.
Quellen: Claude Code, "Model configuration" und der CHANGELOG (v2.1.280 und v2.1.281, abgerufen am 24. September 2026)
Wie Claude Code den Effort speichert, erklärt unser Leitfaden zur Effort-Einstellung; wie Thinking selbst funktioniert, behandelt Adaptive vs. Extended Thinking. Laut der Ankündigung von Anthropic ist der Fast Mode (bis zu 2,5-mal schneller, $8 Input / $40 Output) auch in Claude Code verfügbar.
claude.ai und die Apps
Auf claude.ai und in den Apps für iOS und Android ist Opus 5.5 seit dem Veröffentlichungstag auswählbar (Anthropic hat einen Systemprompt für Opus 5.5 mit demselben Datum veröffentlicht). Die Ankündigung sagt außerdem, dass Anthropic zusammen mit der Preissenkung die Fünf-Stunden-Nutzungslimits für Pro, Max, Team und platzbasiertes Enterprise anhebt und Abonnenten ein einmaliges Zurücksetzen des Nutzungslimits zum frei wählbaren Zeitpunkt gibt. Um wie viel die Limits steigen, nennt die Ankündigung nicht. Die Preise der einzelnen Tarife behandelt unser Preisvergleich Claude vs. ChatGPT.
10. Die Wahl zwischen Opus 5.5, Fable 5.1, Sonnet 5 und Opus 5
Die Empfehlung in der offiziellen Modellübersicht ist kurz: Im Zweifel mit Opus 5.5 beginnen; Fable 5.1 für anspruchsvolles Schlussfolgern und lang laufende agentische Arbeit verwenden oder dann, wenn Opus 5.5 nach einer Evaluierung bei hohem Effort immer noch nicht ausreicht. Legt man Preise und API-Einschränkungen darüber, ergibt sich folgendes Bild.
- Sie wollen sich zunächst auf ein Modell festlegen (der offizielle Ausgangspunkt)
- Lang laufendes agentisches Programmieren und Wissensarbeit
- Sie nutzen Opus 5 (in jedem Tarif günstiger)
- Die Kosten von Fable 5.1 belasten Sie und Sie wollen testen, ob Opus 5.5 reicht
- Die Qualität reicht nach einer Evaluierung von Opus 5.5 bei high oder höher immer noch nicht
- Anspruchsvolles Schlussfolgern, sehr lange agentische Arbeit
- Bei cache-lastiger Arbeit ist der Tarifabstand kleiner als bei Input/Output ($0.25 gegenüber $0.20)
- Sie brauchen Geschwindigkeit oder hohes Volumen (offizielle Geschwindigkeitseinstufung: „Fast“)
- Sie wollen Thinking abschalten oder weiterhin erzwungene Tool-Nutzung verwenden
- Input und Output kosten die Hälfte von Opus 5.5 (Cache-Lesen kostet gleich viel)
- Der Nachfolger Sonnet 5.5 ist für die kommenden Wochen angekündigt
- Als Übergangslösung, bis Sie die vier Punkte aus Abschnitt 7 behoben haben
- Es ist Legacy, aber weiterhin verfügbar; die Einstellung erfolgt nicht vor dem 24. Juli 2027
- Jeder Tarif ist höher als bei Opus 5.5, es gibt also wenig Grund, lange zu bleiben
Wenn Sie unsicher sind, ist die Reihenfolge einfach: ① Opus 5.5 bei medium und high auf Ihrer eigenen Arbeit laufen lassen → ② reicht das nicht, xhigh ausprobieren → ③ reicht auch das nicht, zu Fable 5.1 wechseln → und wenn sich medium als völlig ausreichend erweist, prüfen, ob auch low oder Sonnet 5 genügen. Den Effort erhöhen und auf ein größeres Modell wechseln sind beides Wege, für Qualität zu bezahlen; welcher für den Gewinn günstiger ist, hängt von der Arbeit ab.
11. Migrationsschritte (für API-Nutzer)
Aus der Checkliste des Migrationsleitfadens hier die Punkte, die beim Umstieg von Opus 5 gelten, in der Reihenfolge, in der Sie sie abarbeiten würden. Claude Code bietet dafür auch /claude-api migrate an (ein mitgelieferter Skill, den der Migrationsleitfaden erwähnt; er stimmt den Umfang mit Ihnen ab, bevor er etwas bearbeitet).
- Die Modell-ID von
claude-opus-5aufclaude-opus-5-5ändern (anthropic.claude-opus-5-5auf Bedrock) disabledundenabled(mit Budget) austhinkingentfernen und stattdessen einen Effort wählen- Den Effort ausdrücklich setzen (ohne Angabe gilt medium; für dieselbe Tiefe wie bei Opus 5
highverwenden) anyundtoolintool_choicedurchautoplus Strict Tool Use oder durch Structured Outputs ersetzen- Wer Computer Use auf der Claude API oder Google Cloud nutzt: auf
computer_toolset_20260801umstellen und die Schleife anpassen - Antworten lesen, indem Blöcke nach
typeausgewählt werden, und in Tool-Schleifen Thinking-Blöcke unverändert zurückgeben - Wer den Fortschritt in einer Oberfläche anzeigt:
displayauf"updates"oder"summarized"setzen - Wer
system,toolsoder frühere Nachrichten mitten im Gespräch umschreibt: auf ein reines Anhänge-Muster umstellen - Wer Anfragen an andere Modelle weiterleitet: unter der Annahme testen, dass das Schlussfolgern von Opus 5.5 nicht übernommen wird
stop_reason: "refusal"behandeln und Fallbacks konfigurierenmax_tokensbei Arbeitslasten überprüfen, die Thinking abgeschaltet hatten (bei xhigh und max mit 64K beginnen)- Kosten und Latenz beim gewählten Effort neu messen
Quelle: Punkte aus dem Abschnitt "Every starting model" in Anthropic, "Migrating to Claude Opus 5.5", in Arbeitsreihenfolge umsortiert
Wenn Sie direkt von Opus 4.8 oder älter kommen, müssen Sie außerdem damit umgehen, dass Thinking jetzt auch bei Anfragen läuft, die es nie angegeben haben. Ein Blick auf die Migrationsschritte in unserer Analyse zum Release von Opus 5 lohnt sich ebenfalls.
Fazit
Claude Opus 5.5 ist ein Release, bei dem eine Preissenkung und eine veränderte Handhabung des Modells zusammenkommen. Die Tarife sind bei Input und Output um 20 % und beim Cache-Lesen um 60 % gesunken, und in Anthropics eigener Vergleichstabelle schlägt das Modell Fable 5.1 in vielen Zeilen. Andererseits lässt sich Thinking nicht mehr abschalten, und erzwungene Tool-Nutzung, das alte Computer-Use-Tool und das Umschreiben des Verlaufs führen jetzt zu 400-Fehlern.
Und die Absenkung des Standard-Effort auf medium wird gerade deshalb leicht übersehen, weil sie keinen Fehler erzeugt. Setzen Sie auf der API den Effort ausdrücklich; prüfen Sie in Claude Code, ob Ihre Einstellungen aus Opus-5-Zeiten stillschweigend nicht mehr greifen. Ob es tatsächlich günstiger geworden ist, messen Sie mit usage, nicht an den Preisen pro Token.
Und schließlich: Benchmark-Zahlen sind Werte, die in dieser Tabelle unter diesen Bedingungen gemessen wurden. Bei AutomationBench und Terminal-Bench-Science liegt GPT-6 Astra in derselben Tabelle höher, und Anthropic selbst sagt, dass der Abstand zu Fable 5.1 kleiner ist, als die Zahlen vermuten lassen. Vergleichen Sie zunächst medium und high an Ihrer eigenen Arbeit.
FAQ
F. Ist Opus 5.5 günstiger als Opus 5?
A. Die Preise pro Token sind in jeder Position niedriger ($4 Input, $20 Output, $0.20 Cache-Lesen gegenüber $5, $25 und $0.50 bei Opus 5). Anthropic gibt an, dass es mit Standardeinstellungen bei typischer Arbeit 40 % günstiger ist, das ist aber eine eigene Messung. Bei Arbeitslasten, die mit abgeschaltetem Thinking liefen, können die Output-Tokens steigen – prüfen Sie daher nach der Migration usage.
F. Gibt es eine Möglichkeit, Thinking abzuschalten?
A. Nein. Auf der API liefert disabled einen 400-Fehler, und Alt+T sowie ähnliche Einstellungen in Claude Code haben keine Wirkung. Um das Nachdenken zu reduzieren, setzen Sie den Effort auf low. Wenn Sie Thinking wirklich ausschalten müssen, ist Sonnet 5 die Option, das Thinking bei jedem Effort abschalten kann.
F. Ich habe die Modell-ID geändert und bekomme jetzt einen 400-Fehler.
A. Die Fehlermeldung verrät, um welchen Fall es sich handelt. "thinking.type.disabled" oder "thinking.type.enabled" weist auf die Thinking-Einstellung hin, tool_choice: type "tool" and "any" auf erzwungene Tool-Nutzung und computer_20251124 auf das alte Computer-Use-Tool. Trifft nichts davon zu und schreiben Sie den Verlauf mitten im Gespräch um, liegt die Prüfung der Thinking-Blöcke nahe (Abschnitt 7, ③).
F. In Claude Code scheint meine Effort-Einstellung aus Opus 5 nicht zu greifen.
A. Das ist so gewollt. Mit /effort gespeicherter Effort wird pro Modell abgelegt, und weder die Einstellung für Opus 5 noch das ältere effortLevel auf oberster Ebene der Benutzereinstellungen gilt für Opus 5.5. Opus 5.5 startet mit medium. Wählen Sie mit /effort neu, dann wird es als Einstellung pro Modell für Opus 5.5 gespeichert.
F. Mein eigener Agent zeigt während der Arbeit keinen Fortschritt mehr an.
A. Bei Opus 5.5 kommt der Text zwischen Tool-Aufrufen in Thinking-Blöcken zurück, die mit der Standard-Anzeigeeinstellung leer sind. Setzen Sie thinking.display auf "updates" (Beta) oder "summarized" und zeigen Sie die nicht leeren Thinking-Blöcke an.
* Die Angaben in diesem Artikel beruhen auf Anthropics offizieller Ankündigung "Introducing Claude Opus 5.5" (Benchmarks aus der Vergleichstabelle und den Diagrammbeschreibungen dieser Seite), der offiziellen Dokumentation "Models overview", "Claude Opus 5.5", "What's new in Claude Opus 5.5", "Migrating to Claude Opus 5.5" und "Pricing" sowie auf "Model configuration" und dem CHANGELOG von Claude Code (alle abgerufen am 24. September 2026). Spezifikationen und Preise können sich ändern; bitte prüfen Sie die endgültigen Details in der offiziellen Dokumentation.
Verwandte Artikel: Analyse zum Release von Claude Opus 5, Breaking Changes und Migration bei Claude Fable 5.1.