Inhalt
- 1. Sonnet 5.5 im Überblick: Leistung, Preis, Stolperfallen bei der Migration
- 2. Eckdaten und Verfügbarkeit
- 3. Preise: wie Sonnet 5, nur die Cache-Untergrenze ändert sich
- 4. Benchmarks: Vergleich nur innerhalb der Tabelle von Anthropic
- 5. Fünf Breaking Changes mit Fehler 400 beim Umstieg von Sonnet 5 und die Lösungen
- 6. Änderungen, die ohne Fehlermeldung passieren
- 7. Standard-Effort: high in der API, medium in Claude Code
- 8. Die Wahl zwischen Sonnet 5.5, Opus 5.5 und Haiku
- 9. Nutzung in Claude Code und GitHub Copilot
- 10. Migrationsschritte (für API-Nutzer)
- Fazit
- FAQ
Am 28. September 2026 hat Anthropic Claude Sonnet 5.5 veröffentlicht. Laut Ankündigung ist es nach Opus 5.5, das sechs Tage zuvor erschienen war, „das zweite Modell der Claude-5.5-Familie“, und das bisherige Sonnet 5 (veröffentlicht am 30. Juni 2026) ist in den Legacy-Status gewechselt (älter, aber weiterhin verfügbar). Die offizielle Modellübersicht beschreibt es als das Modell mit der besten Kombination aus Geschwindigkeit und Intelligenz.
Die Kurzfassung: Der Preis ist genau derselbe wie bei Sonnet 5 (pro Million Tokens $2 Input, $10 Output und $0,20 für Cache-Lesezugriffe), und in Anthropics Vergleichstabelle legt das Modell in den meisten Zeilen deutlich gegenüber Sonnet 5 zu. Das Verhalten der API hat sich aber geändert: Es gibt fünf Änderungen, durch die Code, der mit Sonnet 5 funktioniert hat, einen 400-Fehler liefert. Vor allem lässt sich Thinking nicht mehr mit thinking: {"type": "disabled"} abschalten, und der Ersatz between_tools wird nur bei Effort high oder darunter akzeptiert. Dieser Artikel gleicht die offizielle Dokumentation und die Ankündigung im Originaltext miteinander ab und geht in der Reihenfolge, in der Sie damit zu tun bekommen, durch, was sich geändert hat, was bei der Migration bricht und wie Sie zwischen Sonnet 5.5 und Opus 5.5 wählen.
Stand der Informationen: 29. September 2026. Geschrieben einen Tag nach dem Release, nach Lektüre des Originaltexts der offiziellen Dokumentation der Claude-Plattform (Modellübersicht, die Seite zu Sonnet 5.5, What's new, der Migrationsleitfaden, Preise, Thinking, Effort und Prompt Caching), der Ankündigung von Anthropic, der Dokumentation und des CHANGELOG von Claude Code sowie des Changelogs von GitHub. Claude Haiku 5.5, das laut Ankündigung „in den kommenden Wochen“ folgen soll, war zu diesem Zeitpunkt noch nicht erschienen.
Gleicher Preis, fünf Breaking Changes
— Offiziell positioniert als Modell mit der besten Kombination aus Geschwindigkeit und Intelligenz
1. Sonnet 5.5 im Überblick: Leistung, Preis, Stolperfallen bei der Migration
In Anthropics Vergleichstabelle liegt es in jeder Zeile über Sonnet 5 und kommt bei GDPval-AA bis auf 2 Punkte an Opus 5.5 heran. Die Ankündigung selbst schreibt aber, dass Opus 5.5 bei komplexer, offener Arbeit klar stärker bleibt.
Die Tarife sind in jedem Posten dieselben wie bei Sonnet 5. Geändert hat sich die Mindestlänge für das Caching: Sie sinkt von 1.024 auf 512 Tokens. Die Ankündigung spricht von „bis zu 30 % günstiger pro Aufgabe“, doch das ist eine Messung von Anthropic selbst.
Fünf Punkte: Thinking abschalten heißt jetzt between_tools / erzwungene Tool-Nutzung liefert 400 / Thinking-Blöcke sind an Modell und Gespräch gebunden / das alte Computer-Use-Tool wird abgelehnt / Einschränkungen bei Advisor-Kombinationen. Dazu kommt Text zwischen Tool-Aufrufen in Thinking-Blöcken zurück.
In einem Satz: Sonnet 5.5 ist ein Sonnet, das zum selben Preis eine Stufe zulegt und fast genauso behandelt werden will wie Opus 5.5. Drei der fünf Breaking Changes (erzwungene Tool-Nutzung, gebundene Thinking-Blöcke, das alte Computer-Use-Tool) gibt es auch bei Opus 5.5 und Fable 5.1. Nur Sonnet 5.5 betreffen zwei Punkte: dass es zum Abschalten des Denkens einen eigenen Wert namens between_tools gibt, und die Einschränkungen bei den Kombinationen des Advisor-Tools.
2. Eckdaten und Verfügbarkeit
Verglichen wird mit drei Modellen: dem abgelösten Sonnet 5, dem größeren Opus 5.5 und dem kleineren Haiku 4.5.
| Merkmal | Sonnet 5.5 | Sonnet 5 (Legacy) | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| API-Modell-ID | claude-sonnet-5-5 |
claude-sonnet-5 |
claude-opus-5-5 |
claude-haiku-4-5-20251001 |
| Preis (Input/Output) | $2 / $10 | $2 / $10 | $4 / $20 | $1 / $5 |
| Kontext / max. Output | 1M / 128K | 1M / 128K | 1M / 128K | 200K / 64K |
| Thinking | Standardmäßig Adaptive Thinking (Minimum ist between_tools) |
Standardmäßig Adaptive Thinking (mit disabled abschaltbar) |
Adaptive Thinking immer aktiv (nicht abschaltbar) | Extended Thinking (mit Budget) |
| Standard-Effort in der API | high | high | medium | Nicht unterstützt |
| Verlässlicher Wissensstand | Juni 2026 | Januar 2026 | Juni 2026 | Februar 2025 |
| Mindestlänge für das Caching | 512 Tokens | 1.024 Tokens | 512 Tokens | 4.096 Tokens |
| Geschwindigkeit (offizielle relative Einstufung) | Fast | — | Moderate | Fastest |
| Einstellung | Nicht vor dem 28. September 2027 | Nicht vor dem 30. Juni 2027 | Nicht vor dem 22. September 2027 | Nicht vor dem 15. Oktober 2026 |
Quellen: Anthropic, "Models overview", "Claude Sonnet 5.5", "Claude Sonnet 5", "Prompt caching" (abgerufen am 29. September 2026). Die Geschwindigkeit ist eine relative Einstufung innerhalb der aktiven Modellpalette und wird für das Legacy-Modell Sonnet 5 nicht angegeben. Die Einstellungsdaten sind Zusagen für die von Anthropic betriebenen Plattformen; Amazon Bedrock und Google Cloud legen eigene Termine fest.
Von Sonnet 5 unterscheiden sich in der Tabelle nur drei Zeilen: „Thinking“, „Wissensstand“ und „Mindestlänge für das Caching“. Kontext, maximaler Output und der Standard-Effort in der API sind identisch, und auch der Tokenizer ist derselbe wie bei Sonnet 5, sodass derselbe Text dieselbe Zahl an Tokens ergibt (What's new). Mit der Message Batches API hebt der Beta-Header output-300k-2026-03-24 die Output-Grenze auf 300K Tokens an (wie bei Sonnet 5). Außerdem liefern andere als die Standardwerte für temperature, top_p und top_k einen 400-Fehler. Das war bei Sonnet 5 schon genauso und betrifft nur, wer direkt von Sonnet 4.6 oder früher umsteigt.
Plattformen
Claude API (claude-sonnet-5-5), Amazon Bedrock (anthropic.claude-sonnet-5-5), Claude Platform on AWS, Google Cloud und Microsoft Foundry. Das Modell war vom ersten Tag an auf allen Plattformen verfügbar.
claude.ai und die Claude-Apps (Anthropic hat den Systemprompt für Sonnet 5.5 veröffentlicht), Claude Code (ab v2.1.284) und GitHub Copilot (Pro, Pro+, Max, Business und Enterprise).
Der Fast Mode (schnellere Variante) gilt laut Preisseite nur für Opus 5.5, Opus 5 und Opus 4.8, nicht für Sonnet 5.5. Auf Bedrock sind Structured Outputs (einschließlich Strict Tool Use) mit Sonnet 5.5 nicht verfügbar (Migrationsleitfaden).
3. Preise: wie Sonnet 5, nur die Cache-Untergrenze ändert sich
Die offizielle Seite What's new schreibt, dass Sonnet 5.5 so viel kostet wie Sonnet 5 und dass auch die Preise für Prompt Caching und Batch-Verarbeitung gleich bleiben. Hier die Tarife im Detail.
| Pro Million Tokens | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | Haiku 4.5 |
|---|---|---|---|---|
| Input | $2 | $2 | $4 | $1 |
| Output | $10 | $10 | $20 | $5 |
| Cache-Schreibzugriff (5 Minuten) | $2,50 | $2,50 | $5 | $1,25 |
| Cache-Schreibzugriff (1 Stunde) | $4 | $4 | $8 | $2 |
| Cache-Lesezugriff | $0,20 | $0,20 | $0,20 | $0,10 |
| Batch API (Input/Output) | $1 / $5 | $1 / $5 | $2 / $10 | $0,50 / $2,50 |
Quelle: Anthropic, "Pricing" (abgerufen am 29. September 2026). Die Batch API ist für Input und Output 50 % günstiger als der Normaltarif.
Zwei Dinge, die sich trotz „gleichem Preis“ ändern
Gleiche Tarife heißen nicht automatisch gleiche Rechnung. Zwei Faktoren können sich verschieben.
Erstens die Mindestlänge für das Caching. Bei Sonnet 5 wurden Prompts unter 1.024 Tokens auch mit cache_control nicht gecacht. Bei Sonnet 5.5 ist diese Untergrenze auf 512 Tokens gesunken. Ein Ablauf, der zum Beispiel bei jedem Aufruf einen System-Prompt samt Tool-Definitionen von 800 Tokens mitschickt, fiel bei Sonnet 5 aus dem Caching heraus, bei Sonnet 5.5 wird er gecacht. Ob gecacht wurde, zeigt usage in der Antwort: Sind cache_creation_input_tokens und cache_read_input_tokens beide 0, wurde nichts gecacht (offizielle Seite zu Prompt Caching). Wer unter der Grenze bleibt, bekommt keine Fehlermeldung. Es lohnt sich also, bei der Migration nachzusehen, ob Abläufe stillschweigend ohne Cache gelaufen sind.
Zweitens die Zahl der Tokens pro Aufgabe. Die Ankündigung schreibt, dass das Modell für dieselbe Arbeit deutlich weniger Tokens braucht, in Anthropics Tests pro Aufgabe bis zu 30 % günstiger ist und Output mehr als 30 % schneller erzeugt als Sonnet 5. Das sind Messungen von Anthropic selbst. Die offizielle Dokumentation schreibt zugleich, dass die Effort-Stufen „neu kalibriert“ wurden und das Modell auf derselben Stufe nicht unbedingt genauso viel nachdenkt wie Sonnet 5. Thinking-Tokens werden als Output-Tokens abgerechnet, auch wenn sie nicht angezeigt werden. Nach der Migration bleibt nur, usage zu messen und an Ihrer eigenen Arbeit neu zu vergleichen.
Beispielrechnung: eine Aufgabe mit 10 Mio. Tokens Cache-Lesezugriffen, 500.000 Tokens Input und 300.000 Tokens Output (Tokenzahlen sind Annahmen dieses Artikels; Schreibkosten weggelassen)
- Sonnet 5.5: $2,00 + $1,00 + $3,00 = $6,00 (bei Sonnet 5 genauso)
- Opus 5.5: $2,00 + $2,00 + $6,00 = $10,00 (etwa das 1,7-Fache von Sonnet 5.5, nicht das Doppelte)
- Haiku 4.5: $1,00 + $0,50 + $1,50 = $3,00 (genau die Hälfte von Sonnet 5.5)
Die Rechnung vergleicht Tarife bei gleicher Tokenzahl; in der Praxis verbraucht jedes Modell unterschiedlich viele Tokens. Tarife laut Anthropic, "Pricing".
Der Abstand zu Opus 5.5 erreicht nicht das Doppelte, weil allein der Cache-Lesezugriff auch bei Opus 5.5 $0,20 kostet. Je höher der Cache-Anteil einer agentischen Arbeit, desto weniger spart die Wahl von Sonnet 5.5. Die Preise aller Claude-Modelle finden Sie im Preisvergleich von Opus, Sonnet und Haiku.
4. Benchmarks: Vergleich nur innerhalb der Tabelle von Anthropic
Die Vergleichstabelle der Ankündigung hat vier Spalten: Sonnet 5.5, Sonnet 5, Opus 5.5 und GPT-6 Sol. Zunächst die Bedingungen der Tabelle:
- Die Tabelle stammt aus Anthropics Ankündigung, und die meisten Zeilen sind Werte, die Anthropic gemessen hat. Ausnahme: GDPval-AA v2.1 und AA-Briefcase v1.1 wurden von Artificial Analysis ausgeführt (Anmerkung 3 zur Tabelle).
- Diese Messung von Artificial Analysis lief in einer Umgebung vor dem Release, in der ein Fehler die Antworten auf Anfragen mit Structured Outputs verschlechtern konnte. Anthropic merkt an, dass der Effekt, falls vorhanden, klein sei und die Werte eher zu niedrig erscheinen lasse, und nennt den Fehler behoben.
- Der Wert von Opus 5.5 bei Terminal-Bench 4.0 gilt für xhigh und ist der beste Wert von Opus 5.5 (Anmerkung 1). Für FrontierCode stehen bei Sonnet 5.5 zwei Werte: 46,2 % bei max und 52,1 % bei xhigh (Anmerkung 2).
- Zu den Werten von GPT-6 Sol bei GDPval-AA, AA-Briefcase und Chartography gibt es den Hinweis, dass sie möglicherweise vor der Behebung eines Fehlers im Bildverständnis durch OpenAI gemessen wurden (Anmerkung 4).
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 Agentisches Programmieren im Terminal |
70,6 % | 10,3 % | 66,4 % (xhigh) | — |
| FrontierCode 1.1 (Main) Ob Änderungen gemergt werden |
52,1 % (xhigh) 46,2 % (max) |
42,4 % | 54,4 % | 49,3 % |
| CursorBench 4.0 Unklar formulierte Aufgaben über mehrere Dateien |
55,5 % | 34,1 % | 57,8 % | — |
| GDPval-AA v2.1 (Elo) Praxisaufgaben aus 44 Berufen (ausgeführt von Artificial Analysis) |
1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 (Elo) Lang laufende Wissensarbeit (ausgeführt von Artificial Analysis) |
1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam Fachübergreifendes Schlussfolgern (mit Tools) |
64,5 % | 54,9 % | 67,7 % | — |
| OSWorld 2.1 Computer Use (in der Tabelle als „partial“ markiert) |
80,1 % | 57,0 % | 81,8 % | — |
| Chartography Diagramme lesen (ohne Tools) |
61,6 % | 15,6 % | 64,4 % | 53,6 % |
Quelle: Vergleichstabelle und Anmerkungen in Anthropics "Introducing Claude Sonnet 5.5" (28. September 2026; abgerufen am 29. September). Fett ist der Bestwert der jeweiligen Zeile. „—“ bedeutet, dass die Tabelle keinen Wert angibt. Details zur Messmethode stehen in der Systemkarte zu Sonnet 5.5, auf die dieselbe Ankündigung verweist.
Drei Dinge lassen sich daraus ablesen.
- Der Sprung gegenüber Sonnet 5 ist groß. Terminal-Bench 4.0 steigt von 10,3 % auf 70,6 %, Chartography (ohne Tools) von 15,6 % auf 61,6 % – innerhalb derselben Tabelle ein Vielfaches. Bei GDPval-AA sind es rund 400 Punkte mehr.
- Der Abstand zu Opus 5.5 liegt in vielen Zeilen bei wenigen Punkten. GDPval-AA 2 Punkte, CursorBench 2,3 Prozentpunkte, OSWorld 2.1 1,7 Prozentpunkte. Bei Terminal-Bench 4.0 übertrifft Sonnet 5.5 sogar den besten Wert von Opus 5.5 (66,4 % bei xhigh).
- Trotzdem stellt Anthropic Opus 5.5 darüber. Die Ankündigung schreibt, dass Benchmarks nur einen Teil der Fähigkeiten erfassen und dass Opus 5.5 sowohl intern als auch bei externen Testern bei komplexer, offener Arbeit, die anhaltendes Urteilsvermögen verlangt, klar stärker bleibt.
Kosten nach Effort-Stufe: aus den Diagrammbeschreibungen der Ankündigung
Die Ankündigung enthält außerdem Diagramme, die für jede Effort-Stufe Wert und Kosten pro Aufgabe gegenüberstellen. Hier steht, was deren Beschreibungen sagen.
Bei medium, dem Standard der Claude-Apps, deutlich über dem Bestwert von Sonnet 5, zu weniger als einem Zehntel der Kosten pro Aufgabe.
Bei high, dem Standard der Claude-Plattform, gleichauf mit dem Bestwert von GPT-6 Sol, zu etwa einem Fünftel der Kosten pro Aufgabe. 10 Punkte über Sonnet 5 auf derselben Stufe high, zu etwa einem Fünfzehntel der Kosten.
Schon auf der niedrigsten Stufe low über dem Bestwert von Sonnet 5, zu weniger als einem Zehntel der Kosten pro Aufgabe.
Bei medium über dem Bestwert von Sonnet 5, zu etwa einem Neuntel der Kosten pro Aufgabe.
Quelle: Diagrammbeschreibungen in Anthropics "Introducing Claude Sonnet 5.5". Die Diagramme zu Terminal-Bench und CursorBench zeigen GPT-5.6 Sol, weil für GPT-6 Sol keine Werte veröffentlicht sind (Anmerkung auf derselben Seite).
Bemerkenswert sind hier die beiden Werte für FrontierCode: Sonnet 5.5 liegt bei max (46,2 %) niedriger als bei xhigh (52,1 %). Laut Anmerkung in Anthropics Ankündigung startet das Modell bei max häufiger den Code-Review-Skill von Claude Code und verteilt die Arbeit auf viele Subagenten, was in einigen Fällen zu Zeitüberschreitungen und Änderungen außerhalb des Aufgabenbereichs führte. Mehr Effort bringt also nicht zwangsläufig mehr; die Stufe sollten Sie an Ihrer eigenen Arbeit vergleichen und dann festlegen (Abschnitt 7). Die Zahlen von GPT-6 Sol behandelt die Analyse zum Release von GPT-6 Sol und Luna.
Nicht mit der Tabelle der Opus-5.5-Ankündigung mischen: Für dasselbe Opus 5.5 steht bei Chartography in der Opus-5.5-Ankündigung „mit Tools“ 89,0 %, in dieser Tabelle „ohne Tools“ 64,4 % – Werte unter unterschiedlichen Bedingungen. Wer Zahlen aus beiden Ankündigungen nebeneinanderstellt, vergleicht Werte, die unter verschiedenen Bedingungen gemessen wurden. Vergleichen Sie am besten nur Spalten innerhalb derselben Tabelle.
5. Fünf Breaking Changes mit Fehler 400 beim Umstieg von Sonnet 5 und die Lösungen
Die offizielle Seite What's new in Claude Sonnet 5.5 führt fünf Breaking Changes auf, die Code betreffen, der mit Sonnet 5 läuft. Alle liefern den Fehler 400 invalid_request_error.
① Thinking abschalten: between_tools statt disabled
Sonnet 5 ließ sich mit thinking: {"type": "disabled"} bei jeder Effort-Stufe ohne Thinking betreiben. Bei Sonnet 5.5 liefert disabled einen 400-Fehler mit dieser Meldung:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
Stattdessen nutzen Sie thinking: {"type": "between_tools"}. Das ist die niedrigste Thinking-Einstellung dieses Modells: Sie stoppt das vorgelagerte Denken, bei dem das Modell vor der Antwort gesammelt nachdenkt. Bei Anfragen ohne Tools besteht die Antwort wie bei disabled unter Sonnet 5 nur aus dem eigentlichen Text. Ein Beta-Header ist nicht nötig, und die Einstellung funktioniert auf jeder Plattform, die Sonnet 5.5 anbietet. Wer sie aber einfach als Ersatz für disabled einsetzt, stolpert über drei Punkte.
- Bei Effort xhigh und max kommt 400 zurück.
between_toolswird nur bei low, medium und high akzeptiert. Abläufe, die unter Sonnet 5 mit „xhigh + Thinking aus“ liefen, müssen den Effort auf high oder darunter senken oder auf das Abschalten des Denkens verzichten. - Keine weiteren Felder daneben. Werden
display,budget_tokensoderblock_bindingzusammen mitbetween_toolsgeschickt, kommt 400 zurück. - Der Effort lässt sich mitten im Gespräch nicht ändern. Wird über den Effort pro Nachricht (Beta) eine andere Stufe als bisher geschickt, kommt 400 zurück. Wer die Stufe von Zug zu Zug wechseln will, nutzt Adaptive Thinking (
thinkingweglassen oder{"type": "adaptive"}).
Hier das Vorher-nachher-Beispiel aus dem Migrationsleitfaden in Python. Beachten Sie, dass das Vorher-Beispiel xhigh verwendet und das Nachher-Beispiel deshalb auf high heruntergeht.
# Vorher: funktioniert mit Sonnet 5, liefert 400 mit Sonnet 5.5 client.messages.create( model="claude-sonnet-5", max_tokens=16000, thinking={"type": "disabled"}, output_config={"effort": "xhigh"}, messages=[{"role": "user", "content": "..."}], ) # Nachher: vorgelagertes Denken stoppen; effort high oder darunter client.messages.create( model="claude-sonnet-5-5", max_tokens=16000, thinking={"type": "between_tools"}, output_config={"effort": "high"}, messages=[{"role": "user", "content": "..."}], )
Auch mit between_tools kommen die kurzen Fortschrittsnotizen, die das Modell zwischen Tool-Aufrufen schreibt, als Thinking-Blöcke mit zusammenfassendem Text zurück. Verwerfen Sie sie nicht, sondern schicken Sie sie zusammen mit dem Rest des Assistant-Zugs unverändert zurück. Über die zurückgeschickten Blöcke erhält das Modell den vollständigen Text seiner Notizen (What's new). Ein manuelles Budget, {"type": "enabled", "budget_tokens": N}, liefert wie bei Sonnet 5 weiterhin 400.
② Erzwungene Tool-Nutzung liefert einen Fehler
Wird tool_choice auf {"type": "any"} oder {"type": "tool", "name": "..."} gesetzt, kommt 400 zurück. Die Token-Counting-API führt dieselbe Prüfung durch. Erlaubt sind nur auto (der Standard) und none.
tool_choice: type "tool" and "any" are not supported for this model.
Lösung: Lassen Sie tool_choice auf auto und ergänzen Sie in den Tool-Definitionen strict: true (Strict Tool Use), oder verlagern Sie das Schema in Structured Outputs. Mit auto kann das Modell auch in Textform antworten, ohne das Tool aufzurufen; schreiben Sie deshalb in den Prompt, wann das Tool verwendet werden soll. Strict Tool Use akzeptiert nur einen Teil von JSON Schema, und jedes Objekt im Schema braucht additionalProperties: false. Pro Anfrage lassen sich höchstens 20 Tools auf strict setzen, und die Toolsets für MCP, Computer Use und Browser Use können kein strict erhalten.
# Vorher: funktioniert mit Sonnet 5, liefert 400 mit Sonnet 5.5 client.messages.create( model="claude-sonnet-5", max_tokens=1024, tools=tools, tool_choice={"type": "tool", "name": "get_weather"}, messages=[{"role": "user", "content": "What's the weather in Paris?"}], ) # Nachher: auto + strict; in Worten sagen, wann das Tool zu nutzen ist client.messages.create( model="claude-sonnet-5-5", max_tokens=1024, tools=[{**tool, "strict": True} for tool in tools], tool_choice={"type": "auto"}, messages=[{"role": "user", "content": "What's the weather in Paris? Use the get_weather tool."}], )
Auf Amazon Bedrock liegt der Fall anders. Dort sind Structured Outputs (einschließlich Strict Tool Use) mit Sonnet 5.5 nicht verfügbar. Schicken Sie also auto ohne strict, schreiben Sie in den Prompt, wann das Tool aufgerufen werden soll, und prüfen Sie die Tool-Eingaben in Ihrem eigenen Code (Migrationsleitfaden).
③ Thinking-Blöcke sind an Modell und Gespräch gebunden
Jeder Thinking-Block hält fest, welches Modell ihn erzeugt hat. Sonnet 5.5 kann Thinking-Blöcke von Sonnet 5, Opus 4.8, Haiku 4.5 und älteren Modellen lesen, nicht aber die von Opus 5, Opus 5.5, Fable oder Mythos. Und kein anderes Modell kann die Thinking-Blöcke von Sonnet 5.5 lesen.
- Beim Wechsel von Sonnet 5 zu Sonnet 5.5 wird das bisherige Schlussfolgern übernommen.
- Beim Wechsel von Sonnet 5.5 zu einem beliebigen anderen Modell läuft der Zug nach dem Wechsel ohne das Schlussfolgern von Sonnet 5.5. Die Anfrage selbst gelingt, und die verworfenen Blöcke werden nicht berechnet.
Die Thinking-Blöcke von Opus 5.5 können Fable 5.1 und Mythos 5.1 lesen, die von Sonnet 5.5 dagegen niemand. Wenn Sie ein Routing gebaut haben, das nur die schwierigen Teile von Sonnet 5.5 an Opus 5.5 hochreicht, müssen Sie davon ausgehen, dass das Schlussfolgern von Sonnet 5.5 dort verloren geht, und das prüfen.
Außerdem wird geprüft, ob sich alles, was vor einem Thinking-Block von Sonnet 5.5 steht (system, tools und frühere Nachrichten), seit der Erzeugung des Blocks verändert hat. Bei Konten, die ab dem 31. August 2026, 0:00 Uhr (UTC), angelegt wurden, wird das auf der Claude API, Amazon Bedrock und Google Cloud standardmäßig durchgesetzt: Wer einen Block mit einem zwischendurch umgeschriebenen Verlauf schickt, bekommt 400.
Lösung: Führen Sie das Gespräch nur durch Anhängen fort. Wenn Sie Anweisungen oder Tools ändern wollen, schreiben Sie den Verlauf nicht um, sondern nutzen Sie System-Nachrichten mitten im Gespräch (neu bei Sonnet 5.5, bei Sonnet 5 nicht vorhanden). Lässt sich das Umschreiben nicht vermeiden, können Sie mit dem Beta-Header thinking-binding-controls-2026-08-01 und thinking.block_binding.prefix_mismatch_behavior auf "drop_block" erreichen, dass der betroffene Block statt eines Fehlers verworfen wird. block_binding funktioniert allerdings nur mit Adaptive Thinking. Bei between_tools hängen Sie also nur an oder entfernen die Thinking-Blöcke ab dem umgeschriebenen Zug selbst.
④ Das alte Computer-Use-Tool wird auf der Claude API und Google Cloud abgelehnt
Sonnet 5 akzeptierte die Bedienung des Computers (Computer Use) auch über das alte Tool computer_20251124 mit Beta-Header. Sonnet 5.5 nimmt auf der Claude API und Google Cloud nur das Toolset computer_toolset_20260801 an; wer das alte Tool deklariert, bekommt 400. Auf der Claude API beginnt die Meldung mit diesem Satz:
'claude-sonnet-5-5' does not support tool types: computer_20251124.
Lösung: Entfernen Sie den Beta-Header, ersetzen Sie tools durch [{"type": "computer_toolset_20260801"}] und passen Sie die Agent-Schleife an die Form des Toolsets an (tool_use-Blöcke der einzelnen Mitglieder, mehrere Aktionen auf einmal, toolset_name im Ergebnis). Wenn Sie den Beta-Header fine-grained-tool-streaming-2025-05-14 schicken, entfernen Sie ihn: Zusammen mit dem Toolset liefert er 400. Setzen Sie stattdessen bei jedem Tool, das es braucht, eager_input_streaming: true. Auf Amazon Bedrock funktioniert das alte Tool weiter, dort ist keine Änderung nötig.
⑤ Manche Kombinationen mit dem Advisor-Tool werden abgelehnt
Beim Advisor-Tool (Beta) holt sich das ausführende Modell Rat bei einem stärkeren Modell. Ist Sonnet 5.5 das ausführende Modell, liefert die Angabe von Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 oder Sonnet 4.6 als Berater einen 400-Fehler. Möglich sind Opus 5, Opus 5.5, Sonnet 5.5, Fable 5, Fable 5.1, Mythos 5 und Mythos 5.1.
Hinzu kommt: Jeder Berater, den Sonnet 5.5 akzeptiert, liefert seinen Rat verschlüsselt in einem advisor_redacted_result-Block, sodass der Client den Wortlaut nicht lesen kann. Abläufe, die den Inhalt des Rats protokolliert oder angezeigt haben, müssen umgebaut werden. Günstige Kombinationen wie „Sonnet 5 als ausführendes Modell, Opus 4.8 als Berater“ lassen sich mit Sonnet 5.5 nicht einfach übernehmen.
6. Änderungen, die ohne Fehlermeldung passieren
Die fünf Breaking Changes bemerken Sie, weil ein 400-Fehler kommt. Tückischer sind Änderungen, bei denen ohne Fehler nur das Verhalten anders wird.
| Änderung | Was passiert, was zu tun ist |
|---|---|
| Text zwischen Tool-Aufrufen landet in Thinking-Blöcken | Notizen, die länger als ein bis zwei Sätze sind, etwa „Ich prüfe jetzt …“, waren bei Sonnet 5 text-Blöcke und kommen jetzt als Thinking-Blöcke für den Fortschritt zurück (kurze Einzeiler bleiben text). Mit dem Standard display: "omitted" sind sie leer, sodass Oberflächen, die den Zwischenstand an Nutzer streamen, während der Tool-Aufrufe verstummen. Bei Adaptive Thinking setzen Sie display auf "updates" (Beta, Header thinking-display-updates-2026-08-18) oder "summarized" und zeigen nicht leere Thinking-Blöcke vor dem folgenden tool_use an. Bei between_tools kommt der Text ohne weitere Einstellung zurück. |
| Die Effort-Stufen wurden neu kalibriert | Auf derselben Stufe denkt das Modell nicht unbedingt so viel nach wie Sonnet 5. Die offizielle Doku rät, Einstellungen nicht zu übernehmen, sondern den Effort neu zu wählen (Abschnitt 7). |
| Fünf Kategorien für Ablehnungen | cyber, bio, frontier_llm, reasoning_extraction und general_harms. Bei einer Ablehnung kommen HTTP 200 und stop_reason: "refusal" zurück; lesen Sie stop_details und reagieren Sie darauf. Das serverseitige Fallback (fallbacks: "default", Beta, nur Claude API) wiederholt nur cyber und frontier_llm mit Sonnet 5. |
| Thinking-Blöcke sind an das erzeugende Konto gebunden | Thinking-Blöcke von Sonnet 5.5 lassen sich nur mit dem Konto verwenden, das sie erzeugt hat, oder mit damit verbundenen Konten. Von einem anderen Konto geschickt, werden die Blöcke verworfen, und die Anfrage gelingt. Die Ankündigung schreibt, dass das auch für einen Kontowechsel mitten in einer Sitzung in Claude Code gilt. |
| Die Cache-Untergrenze ist gesunken | Prompts mit 512 bis 1.023 Tokens werden neu gecacht. Dafür fallen Schreibkosten an (bei 5 Minuten das 1,25-Fache des Inputs), ab dem zweiten Mal gilt aber der Lesetarif (Abschnitt 3). |
Quellen: What's new in Claude Sonnet 5.5, Migrating to Claude Sonnet 5.5, Ankündigung von Anthropic
Auch bei den Schutzmaßnahmen beschreibt die Ankündigung Änderungen. Weil die für Cyberangriffe nutzbaren Fähigkeiten von Sonnet 5.5 das Niveau von Opus 5 erreicht haben, ist es das erste Sonnet, das mit Cyber-Schutzmaßnahmen und Fallback erscheint. Cybersicherheitsarbeit mit hohem Risiko wird sichtbar an Sonnet 5 übergeben. Das Finden und Beheben von Bugs in der normalen Entwicklung ist nicht betroffen. Die Schutzmaßnahmen für Biologie sind dieselben wie bei Sonnet 5.
Umgekehrt gibt es auch neue Funktionen. Effort pro Nachricht (Beta; die Stufe lässt sich ändern, ohne den Prompt-Cache zu verlieren), System-Nachrichten mitten im Gespräch und das Ändern von Tools mitten im Gespräch (Beta) gab es bei Sonnet 5 alle nicht. Außerdem nennt What's new die Compaction, mit der sich das Gespräch jederzeit zusammenfassen lässt (Beta, Header compact-2026-09-04), und die Definition von Tools innerhalb einer Nachricht (Beta, Header inline-tools-2026-09-15).
7. Standard-Effort: high in der API, medium in Claude Code
Bei Opus 5.5 ist der Standard-Effort auch in der API auf medium gesunken, bei Sonnet 5.5 bleibt er in der API high. Die Ankündigung schreibt dagegen, dass in Claude Code und den Apps medium als Standard gesetzt wurde. Dasselbe Sonnet 5.5 denkt also ohne eigene Angabe in der API eine Stufe tiefer nach als in Claude Code.
Die offizielle Seite zu Effort empfiehlt für Sonnet 5.5 folgende Ausgangspunkte.
| Art der Arbeit | Startstufe (offizielle Empfehlung) | Hinweis |
|---|---|---|
| Allgemeine Arbeit (alles außer den beiden folgenden) | high | Entspricht dem Standard der API |
| Agentisches Programmieren, mehrstufige Tool-Nutzung | Ab medium | Klar spezifizierte Arbeit mit medium, schwierige oder lange Arbeit mit high |
| Latenzkritische Arbeit wie Chat | medium oder low | Geschwindigkeit hat Vorrang |
| xhigh, max | Nur wenn Evaluationen eine höhere Qualität zeigen | Nicht mit between_tools kombinierbar |
Quelle: „Recommended effort levels for Claude Sonnet 5.5“ auf Anthropic, "Effort", Migrationsleitfaden
Dieselbe Seite empfiehlt außerdem, max_tokens so groß zu wählen, dass Thinking und Antworttext hineinpassen, und beim agentischen Programmieren max_tokens auf das Limit dieses Modells von 128.000 zu setzen und per Streaming zu empfangen. Auch wenn der Inhalt des Denkens nicht zurückgegeben wird, zählen die Thinking-Tokens zu max_tokens. Wie Effort funktioniert, erklärt der Artikel zur Effort-Einstellung, Adaptive Thinking der Artikel Adaptive vs. Extended Thinking.
8. Die Wahl zwischen Sonnet 5.5, Opus 5.5 und Haiku
Die offizielle Modellübersicht empfiehlt weiterhin, im Zweifel mit Opus 5.5 zu beginnen; Sonnet 5.5 ist nicht zum Ausgangspunkt geworden. Die Ankündigung beschreibt die Stärken von Sonnet 5.5 als „klar abgegrenzte alltägliche Arbeit, Bugfixes sowie das Erstellen von Dokumenten, Folien und Tabellen“, die von Opus 5.5 als „komplexe Arbeit, die sorgfältiges Urteilsvermögen verlangt“. Weiter heißt es: „Sonnet 5.5 ergänzt Opus 5.5 am besten bei niedrigerem Effort. Auf hohen Stufen können beide bei ähnlichen Kosten ähnliche Leistung erreichen.“ Das bedeutet: Wer mit xhigh oder max arbeitet, hat mit Sonnet 5.5 kaum einen Kostenvorteil.
- Klar spezifizierte Implementierungen und Bugfixes sollen schnell mit low bis high laufen.
- Sie erstellen viele Dokumente, Folien und Tabellen.
- Sie wollen das vorgelagerte Denken abschalten und Wartezeit sparen (
between_tools). - Sie nutzen Sonnet 5 (Austausch zum selben Preis).
- Offenes Design oder offene Recherche verlangt anhaltendes Urteilsvermögen.
- Sie können sich nicht entscheiden (offizieller Ausgangspunkt).
- Sie wollen mit hohem Effort arbeiten, wodurch der Kostenabstand zu Sonnet 5.5 schrumpft.
- Sie wollen den Fast Mode nutzen (nur Opus).
- Das Volumen ist hoch, und der Preis pro Anfrage hat Vorrang (Haiku 4.5 kostet die Hälfte von Sonnet 5.5).
- Ein Kontext von 200.000 Tokens reicht aus.
- Haiku 5.5 soll laut Ankündigung „in den kommenden Wochen“ erscheinen.
- Für Haiku 4.5 gilt als Einstellung „nicht vor dem 15. Oktober 2026“; prüfen Sie also Ihre weitere Planung.
Wenn Sie unsicher sind, gehen Sie so vor: ① Sonnet 5.5 mit medium und high an Ihrer eigenen Arbeit testen → ② reicht das nicht, mit Opus 5.5 auf medium vergleichen → ③ liegen die Kosten von Sonnet 5.5 auf xhigh und Opus 5.5 gleichauf, Opus 5.5 wählen. Einzelheiten zu Opus 5.5 stehen in der Analyse zum Release von Opus 5.5, eine Übersicht aller Modelle zum jeweiligen Zeitpunkt in der Liste der wichtigsten KI-Modelle und ihres Wissensstands.
9. Nutzung in Claude Code und GitHub Copilot
Claude Code hat Sonnet 5.5 mit v2.1.284 laut CHANGELOG (28. September 2026) hinzugefügt und es zum Standard-Sonnet auf der Anthropic API gemacht.
default ist bei Pro, Max, Team, Enterprise und in der API weiterhin Opus 5.5. Für Sonnet 5.5 wählen Sie /model sonnet (beim Start claude --model sonnet). Vor v2.1.284 ist es nicht verfügbar, führen Sie also claude update aus.
sonnet zeigt, hängt vom Anbieter abSonnet 5.5 bekommen Sie nur auf der Anthropic API. Auf Claude Platform on AWS zeigt es auf Sonnet 4.6, auf Bedrock, der Agent Platform von Google Cloud und Microsoft Foundry auf Sonnet 4.5. Wählen Sie dort den vollständigen Modellnamen oder setzen Sie ANTHROPIC_DEFAULT_SONNET_MODEL.
Sonnet 5.5 startet mit medium. Das ältere effortLevel auf oberster Ebene der Benutzereinstellungen gilt nicht für Opus 5.5 und neuere Modelle. Auch der Thinking-Schalter, alwaysThinkingEnabled und MAX_THINKING_TOKENS=0 haben bei Sonnet 5.5 keine Wirkung.
Schlagen die Klassifikatoren der Schutzmaßnahmen an, wird Cybersicherheitsarbeit mit Sonnet 5 wiederholt, und die Sitzung läuft mit diesem Modell weiter (zurück mit /model). Für Biologie gibt es bei Sonnet 5.5 kein Ersatzmodell; die Anfrage endet mit einer Ablehnung.
Quelle: Claude Code, "Model configuration" und CHANGELOG (v2.1.284, abgerufen am 29. September 2026)
Der Kontext umfasst auf der Anthropic API auch bei Sonnet 5.5 immer 1 Million Tokens, ohne Angabe von [1m] und ohne Aufpreis. Die automatische Zusammenfassung (Auto-Compact) läuft standardmäßig bei etwa 967.000 Tokens. Über ein LLM-Gateway (mit gesetztem ANTHROPIC_BASE_URL) wird der Kontext als 200.000 Tokens behandelt; wählen Sie dann in der Modellauswahl „Sonnet 5.5 (1M context)“ (sonnet[1m]).
opusplan, das die Planung Opus und die Ausführung Sonnet überlässt, läuft auf der Anthropic API mit Opus 5.5 und Sonnet 5.5. Die Nutzung erklärt der Artikel zu opusplan. Claude Code selbst führt Gespräche nur durch Anhängen fort, die Verlaufsprüfung aus Abschnitt 5, ③ macht dort also keine Probleme (laut Migrationsleitfaden zu Opus 5.5).
GitHub Copilot
GitHub hat am selben 28. September im Changelog die allgemeine Verfügbarkeit von Sonnet 5.5 bekanntgegeben. Es steht in Copilot Pro, Pro+, Max, Business und Enterprise zur Verfügung und lässt sich in der Modellauswahl von VS Code, Visual Studio, Copilot CLI, Copilot coding agent, github.com, JetBrains-IDEs, Xcode und weiteren wählen. Die Einführung erfolgt schrittweise, es kann also etwas dauern, bis es erscheint. Abgerechnet wird nach Nutzung zu den Listenpreisen des Anbieters. Bei Business und Enterprise legen Administratoren über die Modellrichtlinie in den Copilot-Einstellungen fest, ob es verfügbar ist.
10. Migrationsschritte (für API-Nutzer)
Aus der Checkliste des Migrationsleitfadens stehen hier die Punkte, die für den Umstieg von Sonnet 5 gelten, in der Reihenfolge der Arbeit. In Claude Code hilft außerdem /claude-api migrate dabei (ein mitgelieferter Skill, auf den der Migrationsleitfaden verweist; er fragt vor dem Bearbeiten den Umfang ab).
- Die Modell-ID von
claude-sonnet-5aufclaude-sonnet-5-5ändern (auf Bedrockanthropic.claude-sonnet-5-5). thinking: {"type": "disabled"}durch{"type": "between_tools"}ersetzen und den Effort auf high oder darunter setzen.anyundtoolintool_choicedurchautoplus Strict Tool Use ersetzen (auf Bedrock nurautound die Eingaben selbst prüfen).- Wenn Sie
system,toolsoder frühere Nachrichten zwischendurch umschreiben, auf reines Anhängen umstellen. - Wenn Sie Computer Use auf der Claude API oder Google Cloud nutzen, auf
computer_toolset_20260801umstellen und die Schleife anpassen. - Ist der Berater des Advisor-Tools Opus 4.8, Opus 4.7, Sonnet 5 oder Ähnliches, auf einen von Sonnet 5.5 akzeptierten Berater wechseln und davon ausgehen, dass der Rat verschlüsselt zurückkommt.
- Wenn Sie den Zwischenstand in einer Oberfläche anzeigen,
displayauf"updates"oder"summarized"setzen (beibetween_toolsnicht nötig). stop_reason: "refusal"behandeln und das Fallback einrichten.- Wenn Anfragen an andere Modelle weitergeleitet werden, davon ausgehen und prüfen, dass das Schlussfolgern von Sonnet 5.5 nicht übernommen wird.
- Den Effort neu wählen und Kosten sowie Wartezeit neu messen. Auch das Caching von Prompts unter 1.024 Tokens prüfen.
Quelle: die Abschnitte „Every starting model“ und „Migrating to Claude Sonnet 5.5 from Claude Sonnet 5“ in Anthropic, "Migrating to Claude Sonnet 5.5", in die Reihenfolge der Arbeit gebracht
Wer direkt von Sonnet 4.6 oder früher kommt, muss zusätzlich damit umgehen, dass auch Abläufe ohne Thinking-Angabe jetzt nachdenken, dass ein Budget und Parameter wie temperature 400 liefern und dass derselbe Text rund 30 % mehr Tokens ergibt. Wer das Modell in Claude Managed Agents nutzt, muss außer dem Modellnamen nichts ändern (Hinweis im Migrationsleitfaden).
Fazit
Claude Sonnet 5.5 ist ein Release, das die Leistung bei gleichem Preis deutlich anhebt und dafür die Regeln der API an Opus 5.5 angleicht. In Anthropics eigener Tabelle legt es gegenüber Sonnet 5 in jeder Zeile zu und liegt in vielen Zeilen nur wenige Punkte hinter Opus 5.5. Dafür führen jetzt disabled, erzwungene Tool-Nutzung, das alte Computer-Use-Tool, das Umschreiben des Verlaufs und einige Advisor-Kombinationen zu einem 400-Fehler.
Am leichtesten übersehen werden dass der Ersatz between_tools für das Abschalten des Denkens nur bei high oder darunter funktioniert und dass der Standard-Effort in der API high, in Claude Code aber medium ist. Geben Sie in der API den Effort ausdrücklich an, wählen Sie in Claude Code das Modell mit /model sonnet und prüfen Sie dann den Effort. Ob es günstiger wird, messen Sie nicht an den Tarifen, sondern an usage.
Und schließlich: Benchmark-Zahlen sind Werte, die in dieser Tabelle unter diesen Bedingungen gemessen wurden. Auch Anthropic selbst schreibt, dass Opus 5.5 bei komplexer, offener Arbeit klar stärker ist. Vergleichen Sie zunächst medium und high von Sonnet 5.5 an Ihrer eigenen Arbeit.
FAQ
F. Ist Sonnet 5.5 teurer als Sonnet 5?
A. Die Tarife sind in jedem Posten dieselben ($2 Input, $10 Output, $0,20 für Cache-Lesezugriffe, die Batch API zum halben Preis). Anthropic spricht von „bis zu 30 % günstiger pro Aufgabe“, doch das ist eine eigene Messung. Da die Effort-Stufen neu kalibriert wurden, prüfen Sie nach der Migration bitte usage.
F. Lässt sich Thinking abschalten?
A. In der API stoppt thinking: {"type": "between_tools"} das vorgelagerte Denken. Bei Anfragen ohne Tools besteht die Antwort dann nur aus dem eigentlichen Text. Bei Effort xhigh und max kommt allerdings 400 zurück, und Fortschrittsnotizen zwischen Tools kommen als Thinking-Blöcke. In Claude Code wirken die Einstellungen zum Abschalten des Denkens bei Sonnet 5.5 nicht.
F. Nach dem Wechsel der Modell-ID bekomme ich Fehler 400.
A. Die Fehlermeldung verrät, um welchen Fall es sich handelt. "thinking.type.disabled" weist auf die Thinking-Einstellung hin, tool_choice: type "tool" and "any" auf erzwungene Tool-Nutzung und computer_20251124 auf das alte Computer-Use-Tool. Tritt der Fehler mit between_tools auf, prüfen Sie, ob der Effort xhigh oder höher ist oder ob Sie display oder Ähnliches mitschicken. Nutzen Sie das Advisor-Tool, prüfen Sie das Beratermodell; schreiben Sie den Verlauf mitten im Gespräch um, liegt die Prüfung der Thinking-Blöcke nahe (Abschnitt 5, ③).
F. Claude Code nutzt nicht Sonnet 5.5.
A. Das Standardmodell ist Opus 5.5, wählen Sie also /model sonnet. Bleibt es trotzdem bei Sonnet 5, ist Ihre Version älter als v2.1.284; führen Sie claude update aus. Auf Bedrock, Google Cloud, Claude Platform on AWS und Microsoft Foundry zeigt sonnet auf ein älteres Sonnet; wählen Sie dort den vollständigen Modellnamen oder setzen Sie ANTHROPIC_DEFAULT_SONNET_MODEL.
F. Sollte Opus 5.5 oder Sonnet 5.5 mein Standard sein?
A. Der offizielle Ausgangspunkt ist Opus 5.5. Stehen klar abgegrenzte Implementierungen, Bugfixes und das Erstellen von Dokumenten im Mittelpunkt und arbeiten Sie mit Effort low bis high, kostet Sonnet 5.5 pro Input- und Output-Token nur die Hälfte. Arbeiten Sie mit xhigh oder max, schrumpft der Kostenabstand, wie die Ankündigung schreibt; vergleichen Sie dann beide an Ihrer eigenen Arbeit.
* Die Angaben in diesem Artikel beruhen auf Anthropics offizieller Ankündigung "Introducing Claude Sonnet 5.5" (Benchmarks aus der Vergleichstabelle und den Diagrammbeschreibungen dieser Seite), der offiziellen Dokumentation "Models overview", "Claude Sonnet 5.5", "What's new in Claude Sonnet 5.5", "Migrating to Claude Sonnet 5.5", "Pricing", "Thinking", "Effort" und "Prompt caching", auf "Model configuration" und dem CHANGELOG von Claude Code sowie dem Changelog von GitHub (alle abgerufen am 29. September 2026). Spezifikationen und Preise können sich ändern; bitte prüfen Sie die endgültigen Details in der offiziellen Dokumentation.
Verwandte Artikel: Analyse zum Release von Claude Opus 5.5, Breaking Changes und Migration bei Claude Fable 5.1, Preisvergleich der Claude-Modelle.