Die kurze Antwort Claude Sonnet 5.5 ist seit dem 28. September 2026 Anthropics neues Sonnet-Modell für Claude-Apps, Claude Code und API, laut unabhängigen Tests auch im Free-Plan. Es kostet unverändert 2 Dollar Input und 10 Dollar Output pro Million Tokens, ist laut Anthropic aber über 30 Prozent schneller und pro Aufgabe bis zu 30 Prozent günstiger. Opus 5.5 kostet das Doppelte.
Input und Output, unverändert gegenüber Sonnet 5.
Laut Anthropic.
Laut Anthropic in eigenen Tests gegenüber Sonnet 5.
Sonnet 5 erreicht 57,0 %, Opus 5.5 81,8 %. Herstellerangaben, von Anthropic als „partial“ gekennzeichnet.
Was ist neu an Claude Sonnet 5.5?
Sonnet 5.5 bringt mehr Tempo und deutlich mehr Leistung zum alten Preis. Anthropic beschreibt das Modell als „klares Upgrade gegenüber Claude Sonnet 5“, das über 30 Prozent schneller läuft und für die meisten Arbeiten bis zu 30 Prozent weniger kostet. Sonnet 5.5 ist nach Opus 5.5 das zweite Modell der Claude-5.5-Familie und löst Sonnet 5 als aktuelles Sonnet ab. Für die Praxis zählen sechs Punkte:
- Gleicher Tokenpreis, weniger Kosten pro Aufgabe. Sonnet 5.5 kostet pro Token genau so viel wie Sonnet 5 (2 $ / 10 $), arbeitet laut Anthropic aber über 30 % schneller und pro Aufgabe bis zu 30 % günstiger. Was hinter der Kostenaussage steckt, erkläre ich im Abschnitt Preise.
- Mehr Tempo. Schnellere Antworten verkürzen Wartezeiten bei Assistenten, Chatbots und Automationen mit vielen Einzelschritten.
- Fast auf Opus-Niveau. In Anthropics Benchmarks liegt Sonnet 5.5 bei Computer Use und bei Wissensarbeit nahezu gleichauf mit Opus 5.5. Sonnet 5 lag dort noch deutlich zurück.
- Aktuellerer Wissensstand. Sonnet 5.5 kennt die Welt bis Juni 2026, Sonnet 5 nur bis Januar 2026. Für Fragen zu Produkten, Gesetzen und Märkten aus dem ersten Halbjahr 2026 macht das einen Unterschied.
- Neue Effort-Standards. Effort ist der Regler, mit dem du festlegst, wie gründlich das Modell nachdenkt, in den Stufen
low,medium,high,xhighundmax. In den Claude-Apps und in Claude Code startet Sonnet 5.5 mitmedium, in der API mithigh. Adaptive Thinking, also selbstständiges Nachdenken nach Bedarf, ist standardmäßig an. - Fünf Breaking Changes in der API. Wer Claude in eigene Anwendungen oder in Tools wie n8n und Make eingebunden hat, muss vor dem Umstieg einige Parameter anpassen. Die Details stehen im Abschnitt für Entwickler und Automatisierer.
Dazu kommt eine neue Schutzregel: Bei risikoreicheren Cybersecurity-Aufgaben fällt Sonnet 5.5 in den Claude-Apps sichtbar auf Sonnet 5 zurück, in der API kommt stattdessen eine Ablehnung, mehr dazu im Abschnitt Sicherheit. Und Anthropic kündigt das kleinste Modell der Familie, Haiku 5.5, „in den kommenden Wochen“ an.
Welche Eckdaten hat Claude Sonnet 5.5?
Sonnet 5.5 verarbeitet bis zu 1 Million Tokens Kontext, gibt bis zu 128.000 Tokens aus und hat den Wissensstand Juni 2026. Die wichtigsten Daten laut Anthropics Ankündigung und Modellseite, Stand 4. Oktober 2026:
| Veröffentlicht | 28. September 2026 |
|---|---|
| Modell-ID | claude-sonnet-5-5 (Claude API), anthropic.claude-sonnet-5-5 (Amazon Bedrock) |
| Modellfamilie | zweites Modell der Claude-5.5-Familie nach Opus 5.5 |
| Preis pro Mio. Tokens | 2 $ Input, 10 $ Output (wie Sonnet 5) |
| Prompt-Cache | Schreiben 2,50 $ (5 Minuten) oder 4 $ (1 Stunde), Lesen 0,20 $ |
| Batch-API | 50 % Rabatt, also 1 $ Input und 5 $ Output |
| Kontextfenster | 1 Million Tokens |
| Maximale Ausgabe | 128.000 Tokens, über die Batch-API mit Beta-Header bis 300.000 |
| Wissensstand | Juni 2026 (Sonnet 5: Januar 2026) |
| Thinking | Adaptive Thinking standardmäßig an; niedrigste Stufe between_tools ohne Vorab-Denken (nur bis Effort high) |
| Effort | low bis max; Standard high in der API, medium in den Claude-Apps und in Claude Code |
| Verfügbar in | Claude-Apps (laut unabhängigen Tests auch im Free-Plan), Claude Code, Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Claude Platform on AWS |
| Zero Data Retention | verfügbar |
| Lebenszyklus | „Active (latest)“, Abschaltung laut Anthropic nicht vor dem 28. September 2027 |
Was kostet Claude Sonnet 5.5?
Über die API kostet Sonnet 5.5 2 Dollar pro Million Input-Tokens und 10 Dollar pro Million Output-Tokens, genauso viel wie Sonnet 5. In den Claude-Apps zahlst du nicht pro Token, sondern nutzt Sonnet 5.5 im Rahmen deines Plans. Die vollständige API-Preisliste in US-Dollar pro Million Tokens, Listenpreis laut Anthropic, abgerufen am 4. Oktober 2026:
| Position | Preis pro Mio. Tokens |
|---|---|
| Input | 2 $ |
| Output | 10 $ |
| Cache-Schreiben, 5 Minuten | 2,50 $ |
| Cache-Schreiben, 1 Stunde | 4 $ |
| Cache-Lesen | 0,20 $ |
| Batch-API | 50 % Rabatt: 1 $ Input, 5 $ Output |
Kurz erklärt: Beim Prompt-Cache speichert Claude gleichbleibende Teile eines Prompts zwischen, etwa lange Anweisungen oder ein Handbuch, wahlweise für 5 Minuten oder für 1 Stunde. Das Schreiben in den 5-Minuten-Cache kostet 2,50 Dollar pro Million Tokens, also das 1,25-Fache des Input-Preises, das Schreiben in den 1-Stunden-Cache 4 Dollar, also das Doppelte. Jedes weitere Lesen kostet 0,20 Dollar, ein Zehntel des Input-Preises. Die Batch-API verarbeitet Anfragen gesammelt statt sofort und kostet dafür die Hälfte.
Im Vergleich mit den anderen aktuellen Claude-Modellen sitzt Sonnet 5.5 in der Mitte: halb so teuer wie Opus 5.5, ein Fünftel des Preises von Fable 5.1 und doppelt so teuer wie Haiku 4.5. API-Listenpreise in US-Dollar pro Million Tokens; Sonnet 5.5 abgerufen am 4. Oktober, die übrigen Modelle am 27. September 2026:
| Modell | Input | Output | Cache-Lesen | Cache-Schreiben (5 Min.) | Faktor zu Sonnet 5.5 |
|---|---|---|---|---|---|
| Haiku 4.5 | 1 $ | 5 $ | 0,10 $ | 1,25 $ | 0,5x |
| Sonnet 5.5 | 2 $ | 10 $ | 0,20 $ | 2,50 $ | 1x |
| Sonnet 5 | 2 $ | 10 $ | 0,20 $ | 2,50 $ | 1x |
| Opus 5.5 | 4 $ | 20 $ | 0,20 $ | 5 $ | 2x |
| Fable 5.1 | 10 $ | 50 $ | 0,25 $ | 12,50 $ | 5x |
Über die Batch-API gibt es bei Sonnet 5.5 wie bei Fable 5.1 50 Prozent Rabatt. Sonnet 5 bleibt verfügbar, Anthropic führt aber Sonnet 5.5 als aktuelles Sonnet.
Gleicher Tokenpreis, trotzdem günstiger? Die Kosten einer KI-Aufgabe ergeben sich aus Tokenpreis mal Tokenmenge. Weil der Preis pro Token bei Sonnet 5 und Sonnet 5.5 identisch ist, kann Anthropics Aussage „bis zu 30 Prozent weniger pro Aufgabe“ nur bedeuten, dass Sonnet 5.5 in Anthropics Tests für dieselben Aufgaben weniger Tokens verbraucht hat. „Bis zu“ markiert dabei die Obergrenze. Wie viel davon bei euren Aufgaben ankommt, zeigt nur ein Vergleich mit echten Fällen.
Effort im Blick behalten. In der API startet Sonnet 5.5 mit Effort high, in den Apps mit medium. Mehr Denkaufwand heißt in der Regel mehr Tokens pro Aufgabe. Für einfache, häufige Aufgaben in Automationen lohnt deshalb ein Test mit medium oder low: Reicht das Ergebnis dort, sinken die Kosten weiter.
Rechenbeispiel mit Listenpreisen
Beispielablauf: Eine Automation sortiert an jedem Arbeitstag 500 eingehende E-Mails vor und schreibt einen Antwortentwurf. Pro Mail fallen 3.000 Input-Tokens an (davon 2.000 für gleichbleibende Anweisungen) und 500 Output-Tokens, Denkschritt eingerechnet. Bei 22 Arbeitstagen sind das 11.000 Läufe im Monat. Gerechnet ist rein mit API-Listenpreisen, ohne Werkzeugkosten; beim Cache-Beispiel sind die Schreibvorgänge nicht eingerechnet.
| Modell und Variante | Je 1.000 Mails | 11.000 Mails im Monat |
|---|---|---|
| Haiku 4.5 | 5,50 $ | 60,50 $ |
| Sonnet 5.5 über die Batch-API | 5,50 $ | 60,50 $ |
| Sonnet 5.5 mit Cache für die Anweisungen | 7,40 $ | 81,40 $ |
| Sonnet 5.5 (Sonnet 5 bei gleicher Tokenmenge) | 11 $ | 121 $ |
| Opus 5.5 | 22 $ | 242 $ |
| Fable 5.1 | 55 $ | 605 $ |
So liest du die Tabelle: Bei gleicher Tokenmenge kosten Sonnet 5 und Sonnet 5.5 exakt gleich viel. Trifft Anthropics Bestwert von 30 Prozent weniger pro Aufgabe auf diesen Ablauf zu, sinken die 121 Dollar auf rund 85 Dollar. Die größeren Hebel sind aber Cache und Batch: Der Cache für die festen Anweisungen spart hier rund ein Drittel, und wer die Entwürfe nicht sofort braucht, zahlt über die Batch-API nur die Hälfte. Die Abo-Seite der Rechnung, also was Free, Pro, Max und Team kosten, steht im Claude-Preis-Guide, das Gegenstück für OpenAI im ChatGPT-Preis-Guide.
Wie gut ist Sonnet 5.5 im Vergleich zu Sonnet 5 und Opus 5.5?
Laut Anthropics eigenen Messungen macht Sonnet 5.5 gegenüber Sonnet 5 einen großen Sprung und rückt in mehreren Benchmarks bis auf wenige Punkte an Opus 5.5 heran. Alle Werte sind Herstellerangaben aus Anthropics Ankündigung. Unabhängige Nachmessungen habe ich für diesen Artikel nicht ausgewertet.
| Benchmark (Herstellerangaben) | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6 % | k. A. | 66,4 % (Effort xhigh) |
| CursorBench 4.0 | 55,5 % | 34,1 % | 57,8 % |
| OSWorld 2.1 („partial“) | 80,1 % | 57,0 % | 81,8 % |
| GDPval-AA v2.1 (Punkte) | 1844 | 1449 | 1846 |
| FrontierCode 1.1 | 46,2 % (Effort max) bzw. 52,1 % (Effort xhigh) | 42,4 % | 54,4 % |
| Humanity's Last Exam mit Tools | 64,5 % | 54,9 % | 67,7 % |
So liest du die Werte: Terminal-Bench misst agentisches Programmieren in der Kommandozeile, CursorBench und FrontierCode messen weitere Programmieraufgaben, OSWorld die Bedienung eines Computers über Bildschirm, Maus und Tastatur, also Computer Use. GDPval-AA bewertet Aufgaben aus der Wissensarbeit verschiedener Berufe und wird als Punktwert angegeben, nicht in Prozent. Humanity's Last Exam ist ein Test mit sehr schweren Fachfragen, hier mit erlaubten Werkzeugen.
Drei Dinge fallen auf: Bei Computer Use und Wissensarbeit liegt Sonnet 5.5 fast gleichauf mit Opus 5.5. Gemessen in Prozentpunkten zeigt die Tabelle den größten Sprung gegenüber dem Vorgänger bei OSWorld 2.1 mit gut 23 Punkten, einem Wert, den Anthropic als „partial“ kennzeichnet; bei CursorBench sind es gut 21 Punkte. Und in den meisten Werten liegt Opus 5.5 knapp vorn, am deutlichsten bei FrontierCode und Humanity's Last Exam, bei Terminal-Bench 4.0 dagegen Sonnet 5.5. Die FrontierCode-Werte für Sonnet 5.5 weist Anthropic für zwei Effort-Stufen getrennt aus, den Terminal-Bench-Wert für Opus 5.5 für Effort xhigh.
Für Büroarbeit, deutsche Texte oder die Auswertung eurer eigenen Dokumente sagen diese Zahlen nur bedingt etwas. Mehr Klarheit bringt ein Test mit 20 bis 50 echten Aufgaben aus dem eigenen Alltag.
Vom Modell zum Team-Einsatz
Ein neues Modell im Modellwähler ändert noch nichts an eurem Alltag. Den Unterschied machen klare Anwendungsfälle, gemeinsame Prompts, Regeln für Daten und eine Einführung, die das Team mitnimmt. Genau darum geht es in der Claude-Schulung für Teams.
Claude-Schulung ansehenSonnet 5.5 oder Opus 5.5: Welches Modell für welche Aufgabe?
Anthropic empfiehlt in der Plattform-Dokumentation, für die meisten Workloads mit Opus 5.5 zu starten. Meine Einschätzung: Für die meisten Alltagsaufgaben im Unternehmen ist Sonnet 5.5 der bessere Startpunkt, Opus 5.5 lohnt sich für die anspruchsvollsten Analysen und für schwierigen Code. Opus 5.5 kostet pro Token das Doppelte von Sonnet 5.5. Laut Anthropics Benchmarks bekommst du dafür bei Computer Use und Wissensarbeit nur wenige Punkte mehr, bei sehr schweren Fachaufgaben und den meisten Coding-Tests etwas mehr; bei Terminal-Bench 4.0 liegt Sonnet 5.5 sogar vorn. Meine Zuordnung für die Praxis:
| Aufgabe | Startmodell | Warum |
|---|---|---|
| E-Mails, Zusammenfassungen, Protokolle, Übersetzungen, Alltagstexte | Sonnet 5.5 | halber Preis von Opus 5.5, schneller, für diese Aufgaben in der Regel ausreichend |
| Automationen mit hohem Volumen in n8n, Make oder eigenen Integrationen | Sonnet 5.5, für einfache Klassifikation Haiku 4.5 | die Kosten wachsen mit jeder Anfrage; Haiku 4.5 kostet die Hälfte von Sonnet 5.5 |
| Agenten mit Werkzeugen und Computer Use | Sonnet 5.5 | bei OSWorld 2.1 nur 1,7 Punkte hinter Opus 5.5 (Herstellerangabe) |
| Komplexe Analysen, Entscheidungsvorlagen, Code über viele Dateien | Opus 5.5 | in den meisten Benchmarks knapp vorn; Fehler kosten hier mehr als Tokens |
| Schwierigstes Reasoning, sehr lange autonome Läufe | Fable 5.1 | laut Anthropic erst, wenn Opus 5.5 auch auf höherem Effort nicht reicht |
| Free-Plan ohne Budget | Sonnet 5.5 | Opus 5.5 gibt es erst ab Pro |
Ein Punkt gehört zur ehrlichen Einordnung: Bei Agenten und langen Automationen zählt nicht nur der Tokenpreis. Ein stärkeres Modell kann Fehlversuche und Korrekturschleifen sparen, und die sind am Ende oft teurer als die Tokens selbst. Deshalb gehört die Modellwahl in eine Einstellung und nicht fest in den Code. Dann testest du Sonnet 5.5 und Opus 5.5 an denselben Fällen und stellst bei Bedarf in einer Zeile um. Wie so ein Routing zwischen Modellen aussieht, beschreibe ich unter KI-Automatisierung.
Alle Claude-Modelle im Überblick findest du im Claude-Modell-Vergleich, die Details zum größeren Modell im Artikel Claude Opus 5.5: Preise, Neuerungen und Vergleich mit Fable 5.1.
Wo ist Claude Sonnet 5.5 verfügbar?
Sonnet 5.5 läuft in den Claude-Apps, in Claude Code, in der Claude API und bei den großen Cloud-Anbietern. Der Standard-Effort unterscheidet sich je nach Umgebung. Die Übersicht:
- Claude-Apps (Web, Desktop, Mobile): Sonnet 5.5 steht im Modellwähler bereit, der Effort ist standardmäßig
medium. Im Free-Plan nutzt du seit Ende September Sonnet 5.5 (laut unabhängigen Tests, Anthropic nennt auf der Preisseite nur ‚Sonnet‘). Was der kostenlose Plan sonst kann und wo er endet, steht im Guide Claude kostenlos nutzen, das Pendant für OpenAI unter ChatGPT kostenlos. - Claude Code: Laut offiziellem Changelog ist Sonnet 5.5 seit Ende September (Version 2.1.284) in Claude Code das Standard-Sonnet auf der Anthropic API. Wer dort Sonnet wählt, arbeitet also mit 5.5, standardmäßig auf Effort
medium. Claude Code ist erst ab Pro enthalten. Mehr im Claude-Code-Guide, das Gegenstück bei OpenAI ist Codex. - Claude API: verfügbar seit dem 28. September 2026, Standard-Effort
high. Anthropic führt das Modell als „Active (latest)“ und schaltet es nicht vor dem 28. September 2027 ab. Wer heute eine Integration baut, hat also Planungssicherheit bis mindestens Ende September 2027. - Cloud-Plattformen: Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS. Für Unternehmen, die KI ohnehin über einen dieser Anbieter beziehen, ist das der einfachste Weg, Sonnet 5.5 in bestehende Verträge und Abrechnungen einzubinden.
- Zero Data Retention: Sonnet 5.5 ist laut Anthropic auch mit Zero Data Retention verfügbar, also ohne Speicherung der Anfragen nach der Verarbeitung. Das ist vor allem für Unternehmen mit strengen Vorgaben zu vertraulichen Daten interessant.
Was müssen Entwickler und Automatisierer beim Umstieg auf Sonnet 5.5 beachten?
Wer Claude über die API nutzt, muss vor dem Umstieg fünf Breaking Changes prüfen; nur die Modell-ID zu tauschen reicht nicht. Betroffen sind eigene Anwendungen und Skripte, aber auch Workflows in n8n, Make oder ähnlichen Tools, die Claude direkt über die API aufrufen. In den Claude-Apps und in Claude Code musst du nichts anpassen. Die fünf Änderungen laut Anthropics Release Notes vom 28. September 2026 beziehen sich auf den Umstieg von Sonnet 5; wer von einem älteren Modell kommt, hat weitere Punkte (siehe Sonnet 4.5). Die fünf Änderungen, jeweils mit dem, was zu tun ist:
- Thinking schaltest du anders ab. Bisher ließ sich das Nachdenken vor der Antwort mit
thinking: {"type": "disabled"}abschalten. Bei Sonnet 5.5 geht das nur noch überthinking: {"type": "between_tools"}, die niedrigste Thinking-Stufe, und nur bis Efforthigh. Was du tun musst: In jedem Aufrufdisableddurchbetween_toolsersetzen und den Effort dabei höchstens aufhighsetzen. - Erzwungene Tool-Nutzung liefert einen Fehler. Setzt dein Aufruf
tool_choiceaufanyoder auf ein bestimmtes Tool (tool), antwortet Sonnet 5.5 mit Fehler 400. Ein typischer Fall sind Workflows, die über ein Tool strukturierte Daten für den nächsten Schritt erzwingen. Was du tun musst:tool_choiceaufautostellen und, wie Anthropic empfiehlt, mit Strict Tool Use oder Structured Outputs kombinieren, damit die Ausgabe weiter dem erwarteten Format folgt. Im Prompt klar beschreiben, wann welches Tool zu nutzen ist, und den Ablauf testen. - Thinking-Blöcke sind an Verlauf und Konto gebunden. Die Denkblöcke, die Sonnet 5.5 erzeugt, gehören zu diesem Modell, zum bisherigen Verlauf und zu dem Konto, das sie erzeugt hat oder damit verknüpft ist. Wechselt ein Workflow das Modell oder das Konto, verwirft die API nicht lesbare Thinking-Blöcke selbst, die Anfrage läuft weiter. Einen Fehler 400 gibt es dagegen, wenn vor einem Thinking-Block nachträglich etwas geändert wurde, etwa der System-Prompt, die Tools oder eine frühere Nachricht. Was du tun musst: Verläufe nur anhängen und nicht nachträglich bearbeiten, so empfiehlt es Anthropic.
- Das ältere Computer-Use-Tool wird abgelehnt. Auf der Claude API und bei Google Cloud akzeptiert Sonnet 5.5 das Tool
computer_20251124nicht mehr. Betroffen sind Automationen, in denen Claude per Computer Use Bildschirm, Maus und Tastatur steuert. Was du tun musst: auf die aktuelle Computer-Use-Version umstellen, seit dem 19. August 2026 istcomputer_toolset_20260801allgemein verfügbar, und den Ablauf vor dem Livegang testen. - Das Advisor-Tool lehnt ältere Berater-Modelle ab. Mit dem Advisor-Tool holt sich ein Modell während einer Aufgabe Rat bei einem zweiten Modell. Sonnet 5.5 akzeptiert dort Opus 4.8, Opus 4.7 und Sonnet 5 nicht mehr als Advisor. Was du tun musst: ein anderes, aktuelles Modell als Advisor eintragen und prüfen, ob der Aufruf durchläuft.
Zusätzlich: Text zwischen Tool-Aufrufen. Längere Notizen, die Sonnet 5.5 zwischen zwei Tool-Aufrufen schreibt, kommen laut Modellseite als thinking-Blöcke zurück, nicht mehr als Text. Kein Aufruf schlägt dadurch fehl, aber eine Oberfläche, die solche Zwischenstände live anzeigt, bleibt zwischen den Tool-Aufrufen stumm. Was du tun musst: mit Adaptive Thinking einen display-Wert setzen, der die Zwischenstände zurückgibt, oder between_tools nutzen.
Schon seit Sonnet 5: temperature, top_p und top_k. Setzt dein Aufruf einen dieser drei Sampling-Parameter auf einen anderen als den Standardwert, liefert Sonnet 5.5 einen Fehler 400, so wie schon Sonnet 5. Neu ist das nur für alle, die von einem älteren Modell kommen. In No-Code-Tools können diese Werte in den Optionen eines Knotens oder Moduls stecken, ohne dass man sie auf den ersten Blick sieht. Was du tun musst: die drei Parameter entfernen oder auf Standard zurücksetzen und die Antworten stattdessen über Prompt und Effort steuern.
Mein Vorgehen für die Umstellung
Erstens auflisten, in welchen Workflows, Skripten und Umgebungsvariablen welches Claude-Modell steht. Zweitens je Workflow eine Kopie auf Sonnet 5.5 umstellen, die Punkte oben abarbeiten und den Effort bewusst setzen. Drittens 20 bis 50 echte Fälle durchlaufen lassen und Ergebnis, Laufzeit und Kosten vergleichen. Erst dann umschalten und die Modell-ID künftig zentral als Variable pflegen.
Was passiert mit Sonnet 4.5 und Sonnet 5?
Sonnet 4.5 wird auf der Claude API am 30. November 2026 abgeschaltet, Sonnet 5 bleibt verfügbar. Anthropic hat Sonnet 4.5 (claude-sonnet-4-5-20250929) am 30. September 2026 abgekündigt und empfiehlt die Migration auf Sonnet 5.5. Wer Sonnet 4.5 noch in Automationen oder eigenen Anwendungen nutzt, muss bis dahin umstellen, sonst schlagen die Aufrufe nach der Abschaltung fehl. Das Datum gilt für die Claude API; wer Sonnet 4.5 über einen Cloud-Anbieter nutzt, prüft die dort genannte Frist.
Beim Sprung von Sonnet 4.5 auf Sonnet 5.5 greifen die Breaking Changes aus dem vorigen Abschnitt, dazu kommen laut Migration Guide weitere Änderungen. Unter anderem liefern Thinking-Budgets über budget_tokens und vorausgefüllte Antworten einen Fehler 400, der Effort muss ausdrücklich gesetzt werden, und der neue Tokenizer erzeugt für denselben Text rund 30 Prozent mehr Tokens. Plane deshalb Zeit für Tests ein, arbeite die Checkliste im Migration Guide für dein Ausgangsmodell ab und fang nicht erst Ende November an.
Sonnet 5 läuft weiter, Anthropic nennt es aber nicht mehr als aktuelles Standardmodell. Auf Anthropics Übersicht der Modell-Lebenszyklen hat Sonnet 5 weiter den Status „Active“, abschalten will Anthropic es nicht vor dem 30. Juni 2027 (Stand 4. Oktober 2026). Einen guten Grund, bei Sonnet 5 zu bleiben, gibt es kaum: Sonnet 5.5 kostet pro Token dasselbe und ist laut Anthropic schneller, pro Aufgabe günstiger und in den hier gezeigten Benchmarks durchweg stärker. Die Ausnahme sind Workflows mit den oben genannten Parametern, bis du sie angepasst hast.
Warum antwortet bei Sicherheitsfragen manchmal Sonnet 5?
Weil Anthropic risikoreichere Cybersecurity-Aufgaben bei Sonnet 5.5 in den Claude-Apps sichtbar an Sonnet 5 abgibt. Laut Anthropic fallen solche Anfragen „sichtbar auf Sonnet 5 zurück“, die normale Fehlersuche im eigenen Code bleibt mit Sonnet 5.5 möglich. Für die meisten Unternehmen ändert das im Alltag nichts.
In der API läuft es anders: Dort lehnt Sonnet 5.5 solche Anfragen ab, die Antwort trägt den stop_reason "refusal". Eine Antwort von Sonnet 5 bekommst du nur, wenn du den serverseitigen Fallback (Beta, nur Claude API) einschaltest oder die Anfrage in deinem eigenen Code mit Sonnet 5 wiederholst. Automationen sollten Ablehnungen deshalb erkennen und gezielt behandeln.
IT-Teams und Dienstleister, die Claude für Sicherheitsprüfungen einsetzen, sollten die Regel aber kennen. Wenn bei solchen Anfragen plötzlich Sonnet 5 antwortet, ist das kein Fehler, sondern diese Schutzmaßnahme. Für die Bewertung der Antwort gilt dann der ältere Wissensstand von Sonnet 5 aus dem Januar 2026.
Läuft Claude Sonnet 5.5 in der EU?
Direkt bei Anthropic nicht: claude.ai und die Claude API bieten keine EU-Datenresidenz. Anthropic speichert Daten standardmäßig in den USA und leitet Anfragen an ausgewählte Länder in den USA, Europa, Asien und Australien weiter. Der API-Parameter inference_geo kennt nur „global“ und „USA“, die reine US-Verarbeitung kostet das 1,1-Fache. Eine EU-Option gibt es dort nicht.
Wer eine Verarbeitung in Europa braucht, geht über einen Cloud-Anbieter. Laut Sekundärquellen ist EU-Hosting für Claude-Modelle bisher nur über Amazon Bedrock und Google Cloud möglich; bei Microsoft Foundry läuft die Inferenz demnach auch bei EU-Regionen über Anthropic-Infrastruktur. Für Sonnet 5.5 habe ich keine Regionenliste ausgewertet. Ob das Modell in der EU-Region bereitsteht, die ihr braucht, und ob die Verarbeitung dort in der EU bleibt, prüft ihr im jeweiligen Cloud-Konto beziehungsweise in der Regionenübersicht des Anbieters.
Zwei weitere Punkte gehören zur Einordnung:
- Training: Unter den kommerziellen Bedingungen, also in Team, Enterprise und über die API, nutzt Anthropic eure Daten nicht für das Training. In den Consumer-Plänen Free, Pro und Max entscheidest du selbst; mit Zustimmung speichert Anthropic die Daten bis zu fünf Jahre, ohne Zustimmung 30 Tage. Für Kundendaten und interne Unterlagen ist der kostenlose Plan deshalb nicht der richtige Ort, auch wenn dort jetzt Sonnet 5.5 läuft.
- Zero Data Retention: Sonnet 5.5 ist mit Zero Data Retention verfügbar. Bei Fable 5.1 gilt dagegen eine verpflichtende Aufbewahrung von 30 Tagen, Zero Data Retention gibt es dort nur mit ausdrücklicher Freigabe durch Anthropic.
Welche Konstruktion für euren Fall tragfähig ist, klären wir im Erstgespräch; eine Rechtsberatung im Sinne des RDG ist das nicht. Die ausführliche Einordnung steht auf der Seite Claude und DSGVO, das Gegenstück für OpenAI unter ChatGPT und DSGVO.
Sonnet 5.5 oder GPT-6.1 Sol: Wie steht Claude gegen OpenAI?
Beim API-Preis herrscht Gleichstand: OpenAI hat am 29. September 2026, einen Tag nach Sonnet 5.5, GPT-6.1 Sol vorgestellt, ebenfalls für 2 Dollar Input und 10 Dollar Output pro Million Tokens. GPT-6.1 Sol kostet damit ein Fünftel von GPT-6 Astra und soll laut OpenAI bei Coding und Computer Use nah an Astra herankommen. In ChatGPT gibt es Sol nur in Work und Codex, nicht im normalen Chat. Die Unterschiede im Detail:
| Punkt | Claude Sonnet 5.5 | GPT-6.1 Sol |
|---|---|---|
| API-Preis pro Mio. Tokens | 2 $ Input, 10 $ Output | 2 $ Input, 10 $ Output |
| Zwischengespeicherter Input | Cache-Lesen 0,20 $ | Cached Input 0,10 $ |
| Cache-Schreiben pro Mio. Tokens | 2,50 $ (5 Minuten) | 2,50 $ |
| Kontext und Ausgabe | 1 Mio. / 128.000 Tokens | 1.050.000 / 128.000 Tokens |
| Wissensstand | Juni 2026 | 30. April 2026 |
| In der Chat-App | Claude-Apps, laut unabhängigen Tests auch im Free-Plan | nur ChatGPT Work und Codex (Plus, Pro, Business, Enterprise, Edu), nicht im normalen Chat |
Beide Anbieter berechnen das Schreiben in den Cache, bei beiden mit 2,50 Dollar pro Million Tokens (bei Sonnet 5.5 für den 5-Minuten-Cache); beim Lesen aus dem Cache ist GPT-6.1 Sol mit 0,10 Dollar günstiger. Vergleiche die Preise deshalb mit deinem eigenen Nutzungsmuster. Benchmarks lassen sich nicht direkt gegenüberstellen, weil beide Anbieter unterschiedliche Tests und Testversionen veröffentlichen, etwa OSWorld 2.1 bei Anthropic und OSWorld 2.0 bei OpenAI. Die Einordnung von OpenAIs neuem Modell steht im Artikel GPT-6.1 Sol, den Gesamtvergleich der Plattformen findest du unter Claude vs. ChatGPT.
Was kommt als Nächstes?
Als Nächstes folgt Haiku 5.5: Laut Anthropic soll es „in den kommenden Wochen“ zur Claude-5.5-Familie stoßen, ein Datum gibt es nicht (Stand 4. Oktober 2026). Bis dahin bleibt Haiku 4.5 mit 1 Dollar Input und 5 Dollar Output pro Million Tokens das günstigste aktuelle Claude-Modell, allerdings mit kleinerem Kontextfenster von 200.000 Tokens, Wissensstand Februar 2025 und ohne Adaptive Thinking. Haiku 4.5 hat weiter den Status „Active“ und ist nicht abgekündigt; abschalten will Anthropic es nicht vor dem 15. Oktober 2026.
Wer Automationen mit sehr hohem Volumen plant, sollte Haiku 5.5 im Blick behalten und die Modellwahl so anlegen, dass ein Wechsel ohne Umbau möglich ist. Neue Modelle, Abschaltungen und Preisänderungen fasse ich laufend in den KI-Updates zusammen.
Von der Modellfrage zur Umsetzung
Eure Automationen laufen noch auf Sonnet 4.5 oder Sonnet 5, oder ihr wollt wissen, ob Sonnet 5.5 für eure Aufgaben reicht? Beschreibe mir kurz, welche Abläufe betroffen sind und was ein gutes Ergebnis leisten muss. Wir klären, ob ein Modellvergleich, eine Umstellung oder ein Teamtraining sinnvoll ist.
Unsere Abläufe kurz schildernKostenfreier, unverbindlicher Erstkontakt. Ein fertiges Konzept ist nicht nötig.
Häufige Fragen zu Claude Sonnet 5.5
Was kostet Claude Sonnet 5.5?
Über die API kostet Sonnet 5.5 2 Dollar pro Million Input-Tokens und 10 Dollar pro Million Output-Tokens, genauso viel wie Sonnet 5. Cache-Schreiben kostet 2,50 Dollar für 5 Minuten oder 4 Dollar für 1 Stunde, Cache-Lesen 0,20 Dollar, und über die Batch-API gibt es 50 Prozent Rabatt. In den Claude-Apps nutzt du Sonnet 5.5 im Rahmen deines Plans, ohne Abrechnung pro Token.
Ist Claude Sonnet 5.5 kostenlos?
In der Claude-App ja: Im Free-Plan nutzt du seit Ende September Sonnet 5.5 (laut unabhängigen Tests, Anthropic nennt auf der Preisseite nur ‚Sonnet‘). Über die API zahlst du 2 Dollar Input und 10 Dollar Output pro Million Tokens. Für Kundendaten eignet sich der Free-Plan nicht, weil dort die Consumer-Bedingungen gelten und du selbst über das Training mit deinen Chats entscheidest.
Was ist der Unterschied zwischen Sonnet 5.5 und Opus 5.5?
Opus 5.5 kostet pro Token das Doppelte von Sonnet 5.5, nämlich 4 statt 2 Dollar Input und 20 statt 10 Dollar Output pro Million Tokens. In Anthropics Benchmarks liegt Opus 5.5 meist knapp vorn, etwa bei OSWorld 2.1 mit 81,8 zu 80,1 Prozent, bei Terminal-Bench 4.0 dagegen Sonnet 5.5 mit 70,6 zu 66,4 Prozent. Anthropic empfiehlt, für die meisten Workloads mit Opus 5.5 zu starten; meine Einschätzung: Für Alltagsarbeit, hohes Volumen und viele Agenten reicht Sonnet 5.5, Opus 5.5 lohnt sich für besonders anspruchsvolle Analysen und schwierigen Code.
Lohnt sich der Wechsel von Sonnet 5 auf Sonnet 5.5?
Ja, in den meisten Fällen: Sonnet 5.5 kostet pro Token genauso viel wie Sonnet 5, arbeitet laut Anthropic aber über 30 Prozent schneller und pro Aufgabe bis zu 30 Prozent günstiger. In Anthropics Benchmarks liegt es deutlich vorn, etwa bei OSWorld 2.1 mit 80,1 statt 57,0 Prozent. In eigenen API-Integrationen solltest du vor dem Umstieg die fünf Breaking Changes prüfen, etwa beim Abschalten des Thinkings und bei erzwungener Tool-Nutzung.
Wann wird Claude Sonnet 4.5 abgeschaltet?
Auf der Claude API am 30. November 2026. Anthropic hat Sonnet 4.5 am 30. September 2026 abgekündigt und empfiehlt die Migration auf Sonnet 5.5. Wer Sonnet 4.5 noch in Automationen wie n8n oder Make oder in eigenen Anwendungen nutzt, sollte die Umstellung samt Breaking Changes rechtzeitig testen.
Was muss ich in n8n oder Make beim Umstieg auf Sonnet 5.5 beachten?
Vor allem Parameter, die bei Sonnet 5.5 einen Fehler 400 liefern: Erzwungene Tool-Nutzung über tool_choice funktioniert nicht mehr, Thinking schaltest du nicht mehr mit disabled ab, sondern mit between_tools, und wer von einem älteren Modell als Sonnet 5 kommt, muss zusätzlich eigene Werte für temperature, top_p und top_k entfernen. Prüfe deshalb jeden Workflow in einer Kopie, bevor du die Modell-ID tauschst. In der API startet Sonnet 5.5 mit Effort high; für einfache, häufige Aufgaben lohnt ein Test mit medium oder low.
Läuft Claude Sonnet 5.5 in der EU?
Direkt bei Anthropic nicht: claude.ai und die Claude API bieten keine EU-Datenresidenz, der API-Parameter inference_geo kennt nur global und USA. Eine Verarbeitung in Europa ist bei Claude-Modellen laut Sekundärquellen nur über Cloud-Anbieter wie Amazon Bedrock oder Google Cloud möglich. Ob Sonnet 5.5 in der gewünschten EU-Region bereitsteht, prüfst du im jeweiligen Cloud-Konto.
Wann kommt Claude Haiku 5.5?
Laut Anthropic „in den kommenden Wochen“, ein Datum gibt es nicht. Stand 4. Oktober 2026 ist Haiku 5.5 noch nicht erschienen. Bis dahin bleibt Haiku 4.5 mit 1 Dollar Input und 5 Dollar Output pro Million Tokens das günstigste aktuelle Claude-Modell.
Offizielle Quellen und Stand der Recherche
Dieser Artikel wurde am 4. Oktober 2026 erstellt. Preise, Termine und Verfügbarkeiten zu Sonnet 5.5 stammen aus den verlinkten Primärquellen, abgerufen am 04.10.2026; die Preise und Eckdaten der übrigen Claude-Modelle wurden am 27.09.2026 geprüft. Benchmark-Werte sind Herstellerangaben von Anthropic. Simon Willison, Notebookcheck sowie die genannten Quellen zum EU-Hosting sind Sekundärquellen. Anthropic rollt Funktionen schrittweise aus; maßgeblich ist die Anzeige in deinem Konto.
- Anthropic: Introducing Claude Sonnet 5.5 (28.09.2026, Preise, Tempo, Benchmarks, Effort, Sicherheits-Fallback, Haiku 5.5; abgerufen am 04.10.2026)
- Anthropic Docs: Claude Sonnet 5.5, Spezifikationen, Plattformen, Lebenszyklus und Breaking Changes (abgerufen am 04.10.2026)
- Anthropic Docs: What's new in Claude Sonnet 5.5 (Modell-IDs, Thinking-Blöcke, Text zwischen Tool-Aufrufen, Ablehnungen und Fallback; abgerufen am 04.10.2026)
- Anthropic Docs: Migrating to Claude Sonnet 5.5 (Änderungen je Ausgangsmodell, Strict Tool Use, Tokenizer; abgerufen am 04.10.2026)
- Anthropic Docs: Model deprecations (Status und frühestes Abschaltdatum von Sonnet 5.5, Sonnet 5, Haiku 4.5 und Sonnet 4.5; abgerufen am 04.10.2026)
- Anthropic Docs: Release Notes (Sonnet 5.5 am 28.09., Abkündigung Sonnet 4.5 am 30.09.2026, Computer Use GA am 19.08.2026,
inference_geo; abgerufen am 04.10.2026) - Claude: Pläne und Preise (API-Preise Sonnet 5.5, Modelle im Free-Plan; abgerufen am 04.10.2026)
- Anthropic Docs: Modellübersicht (Opus 5.5, Fable 5.1, Sonnet 5, Haiku 4.5, Empfehlung zur Modellwahl; abgerufen am 27.09.2026)
- Anthropic: Introducing Claude Opus 5.5 und Claude Fable 5.1 und Mythos 5.1 (abgerufen am 27.09.2026)
- Anthropic Docs: Zero Data Retention (abgerufen am 27.09.2026)
- Anthropic Privacy Center: Speicherort und Verarbeitung der Daten (Artikel 7996890) und Anthropic: Updates to Consumer Terms and Privacy Policy (abgerufen am 27.09.2026)
- OpenAI: Introducing GPT-6.1 Sol und OpenAI: Modellvergleich (abgerufen am 04.10.2026)
- Sekundärquelle: Simon Willison, 28.09.2026, zu Sonnet 5.5 als Standardmodell im Free-Plan (abgerufen am 04.10.2026); ergänzend Notebookcheck, 30.09.2026
- Claude Code: offizielles Changelog (Version 2.1.284: Sonnet 5.5 als Standard-Sonnet auf der Anthropic API; abgerufen am 04.10.2026)
- Sekundärquellen zum EU-Hosting: Microsoft Q&A 5867930 vom 18.06.2026 zu Foundry-EU-Regionen sowie Einordnungen von compound.law und lingarogroup.com zu Bedrock- und Vertex-Regionen