Anthropic hat am 28. September 2026 Claude Sonnet 5.5 veröffentlicht, das zweite Modell der Sonnet-5.5-Reihe. Der Preis bleibt exakt auf dem Niveau von Sonnet 5 stehen, doch die Benchmark-Werte machen einen Sprung, der selbst erfahrene Entwickler aufhorchen lässt: Auf Terminal-Bench 4.0 klettert das Modell von 10,3 auf 70,6 Prozent. Gleichzeitig taucht Sonnet 5.5 binnen weniger Tage in GitHub Copilot auf, mitten in einer Welle neuer Modelle von OpenAI und xAI. Wer gerade entscheidet, welches KI-Modell die eigene Codebasis pflegen soll, bekommt damit einen weiteren, ziemlich konkreten Datenpunkt.

Anthropic bringt Claude Sonnet 5.5: Was am 28. September wirklich passiert ist

Claude Sonnet 5.5 ist laut Anthropics eigener Produktseite als das Modell mit der besten Kombination aus Geschwindigkeit und Intelligenz positioniert. Genau diese Formulierung ist Programm: Anthropic verkauft die 5.5-Generation nicht über neue Rohleistung, sondern über weniger Tool-Aufrufe und schnellere Antworten bei gleichbleibender Codequalität. Innerhalb von Stunden nach der Ankündigung folgte GitHub mit einem eigenen Changelog-Eintrag, der Sonnet 5.5 in Copilot bestätigt und auf spürbar schnellere Aufgabenerledigung verweist.

Bemerkenswert ist der Zeitpunkt. Nur wenige Tage zuvor hatte Anthropic bereits Claude Opus 5.5 mit gesenkten Tarifen ausgerollt, und praktisch zeitgleich brachte OpenAI mit GPT-6 Sol und GPT-6 Luna zwei neue, günstigere Modelle auf den Markt. Auch xAI legte nach: Grok 4.7 wurde am 28. September 2026 auf Amazon Bedrock allgemein verfügbar gemacht. Der Modell-Wettlauf, der den Coding-Markt seit Monaten prägt, hat sich damit innerhalb einer einzigen Woche noch einmal beschleunigt.

Für Entwicklerteams in Österreich und im gesamten DACH-Raum bedeutet das vor allem eines: Die Entscheidung für ein bestimmtes Modell hat eine kürzere Halbwertszeit als noch vor einem Jahr. Wer im August ein Modell evaluiert hat, sollte die Zahlen im Oktober erneut prüfen.

Preis und Kontextfenster: Was Sonnet 5.5 tatsächlich kostet

Der auffälligste Fakt zu Claude Sonnet 5.5 ist, was sich nicht verändert hat. Laut der offiziellen Preisliste von Anthropic kostet das Modell weiterhin 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, exakt identisch mit dem Vorgänger Sonnet 5. Für das Zwischenspeichern von Prompts (Prompt-Caching) fallen 2,50 US-Dollar pro Million Token beim Schreiben und 0,20 US-Dollar beim Lesen an. Anthropic wirbt zusätzlich mit bis zu 90 Prozent Einsparung durch Prompt-Caching und 50 Prozent Rabatt über die Batch-API.

Mehrere Fachmedien berichten übereinstimmend, dass Sonnet 5.5 ein Kontextfenster von rund 1 Million Token sowie eine Obergrenze von 128.000 Token pro Ausgabe mitbringt. Diese Werte entsprechen den bereits bei Sonnet 5 bekannten Spezifikationen und wurden von Anthropic selbst nicht als neue Eigenschaft beworben, sondern lediglich fortgeschrieben. Ein Branchenbericht bezeichnete die vor dem Launch kursierenden, angeblich “neuen” Spezifikationen treffend als die längst öffentlichen Zahlen von Sonnet 5, die fälschlich als Neuheit gehandelt wurden.

Der eigentliche Fortschritt liegt also nicht im Preis oder im Kontextfenster, sondern in der Effizienz: Anthropic gibt an, dass Sonnet 5.5 Aufgaben mehr als 30 Prozent schneller abschließt und dabei bis zu 30 Prozent weniger Gesamtkosten pro erledigter Aufgabe verursacht, weil das Modell weniger Tool-Aufrufe und weniger Token benötigt, um zum Ergebnis zu kommen. Das ist ein wichtiger Unterschied zu einer reinen Preissenkung, wie sie etwa bei Claude Opus 5.5 mit einer Tarifreduktion um rund 20 Prozent umgesetzt wurde.

Benchmark-Ergebnisse: Terminal-Bench 4.0 springt von 10,3 auf 70,6 Prozent

Die von Anthropic veröffentlichten Benchmark-Tabellen zeigen den größten Sprung ausgerechnet dort, wo es für Entwickler am meisten zählt: bei agentischen Coding-Aufgaben mit Terminalzugriff. Auf Terminal-Bench 4.0, das komplexe, mehrstufige Kommandozeilen-Workflows testet, erreicht Sonnet 5.5 70,6 Prozent. Sonnet 5 kam im selben Test lediglich auf 10,3 Prozent. Das entspricht einer Verbesserung von rund 60 Prozentpunkten innerhalb einer einzigen Modellgeneration, laut den auf Artificial Analysis dokumentierten Release-Daten.

Auf CursorBench 4.0, das IDE-nahe Coding-Aufgaben simuliert, liegt Sonnet 5.5 bei 55,5 Prozent gegenüber 34,1 Prozent bei Sonnet 5. Bei FrontierCode 1.1 Main erreicht das neue Modell im sogenannten “xhigh”-Reasoning-Modus 52,1 Prozent und im Modus “max” 46,2 Prozent, verglichen mit 42,4 Prozent bei Sonnet 5. Auf dem GDPval-AA-v2.1-Index, der die Modelle mit einem Elo-System bewertet, kommt Sonnet 5.5 auf 1844 Punkte, gegenüber 1449 bei Sonnet 5.

Warum ausgerechnet Terminal-Bench so stark steigt

Terminal-Bench 4.0 prüft, wie zuverlässig ein Modell mehrstufige Aufgaben in einer echten Shell-Umgebung ausführt, inklusive Fehlerbehebung, Paketverwaltung und Debugging über mehrere Befehle hinweg. Genau dieses Szenario spiegelt am direktesten wider, wie agentische Coding-Werkzeuge wie Claude Code oder GitHub Copilot in der Praxis eingesetzt werden. Ein Sprung von 10,3 auf 70,6 Prozent deutet darauf hin, dass Anthropic bei Sonnet 5.5 gezielt an der Fähigkeit gearbeitet hat, lange Werkzeugketten ohne Abbruch durchzuhalten, statt lediglich einzelne Codeausschnitte zu verbessern.

Sonnet 5.5 gegen Opus 5.5: Welches Modell für welche Aufgabe

Der direkte Vergleich zwischen Sonnet 5.5 und dem teureren Flaggschiff Opus 5.5 fällt differenzierter aus, als der Terminal-Bench-Wert zunächst vermuten lässt. Bei Terminal-Bench 4.0 liegt Sonnet 5.5 mit 70,6 Prozent sogar vor Opus 5.5, das 66,4 Prozent erreicht. Bei FrontierCode 1.1 Main dreht sich das Bild: Opus 5.5 kommt auf 54,4 Prozent, Sonnet 5.5 auf 52,1 Prozent. Auch bei CursorBench 4.0 liegt Opus 5.5 mit 57,8 Prozent knapp vor Sonnet 5.5 mit 55,5 Prozent. Beim GDPval-AA-Index trennen die beiden Modelle nur zwei Punkte, 1846 zu 1844.

Der Preisunterschied ist dabei erheblich: Opus 5.5 kostet 4 US-Dollar pro Million Input-Token und 20 US-Dollar pro Million Output-Token, also doppelt so viel wie Sonnet 5.5. Für Teams, die überwiegend Terminal- und Agentenaufgaben automatisieren, liefert Sonnet 5.5 damit bei halbem Preis vergleichbare oder sogar bessere Werte. Wer dagegen auf komplexe Architekturentscheidungen und tiefes Codeverständnis über viele Dateien hinweg angewiesen ist, fährt mit Opus 5.5 weiterhin leicht besser, wie auch unser Vergleich zwischen Claude Opus 5.5 und GPT-6 Astra gezeigt hat.

Preisvergleich der aktuellen Coding-Modelle im Überblick

Die folgende Tabelle fasst die aktuellen API-Preise der wichtigsten Anthropic-Modelle sowie des direkten OpenAI-Konkurrenten GPT-6 Sol zusammen, Stand Ende September 2026:

ModellInput je Mio. TokenOutput je Mio. TokenCache-Read je Mio. Token
Claude Sonnet 5.52 $10 $0,20 $
Claude Sonnet 52 $10 $0,20 $
Claude Opus 5.54 $20 $0,20 $
Claude Opus 55 $25 $0,50 $
Claude Haiku 4.51 $5 $n. a.
Claude Fable 5.110 $50 $n. a.
GPT-6 Sol2 $10 $n. a.

Auffällig ist, dass GPT-6 Sol preislich exakt auf Höhe von Claude Sonnet 5.5 liegt, Cent für Cent. Anthropic und OpenAI konkurrieren damit im mittleren Preissegment nicht mehr primär über den Tarif, sondern über Geschwindigkeit, Tool-Effizienz und Benchmark-Werte. Das ist eine spürbare Verschiebung gegenüber den Preiskämpfen, die den Markt noch Anfang 2026 dominiert hatten.

Der Wettbewerb: GPT-6 Sol, GPT-6 Luna und Grok 4.7 im selben Zeitfenster

Der Sonnet-5.5-Launch fällt in ein enges Zeitfenster, in dem gleich mehrere Anbieter neue Modelle veröffentlicht haben. OpenAI brachte GPT-6 Sol und GPT-6 Luna heraus, zwei kostengünstigere Modelle, die mit ähnlichen Trainingsmethoden wie das Flaggschiff GPT-6 Astra entstanden sind. Beide sind über die API, ChatGPT Work und Codex verfügbar und wurden im wöchentlichen GitHub-Copilot-Update vom 21. September in die Plattform aufgenommen.

GPT-6 Astra selbst war bereits am 3. September 2026 erschienen und wird von OpenAI als Flaggschiff für computergestützte Aufgaben positioniert, nicht nur als reines Chat-Modell. Am 14. September wurde es laut dem AWS-Wochenrückblick auf Amazon Bedrock allgemein verfügbar. xAI zog mit Grok 4.7 nach: Das Modell erhielt ein Kontextfenster von 500.000 Token und vier einstellbare Reasoning-Stufen und wurde am 28. September 2026, also am selben Tag wie Sonnet 5.5, auf Amazon Bedrock veröffentlicht.

Für Entwicklerteams bedeutet diese Verdichtung an Launches vor allem eines: Wer sein Modell nach reiner Marktneuheit auswählt, trifft in diesen Wochen fast täglich auf eine neue Option. Realistischer ist es, sich an konkreten Benchmark-Zahlen und am eigenen Aufgabenprofil zu orientieren, statt jedem Release-Zyklus hinterherzulaufen.

GitHub Copilot: Sonnet 5.5 in der Modell-Flut des Herbstes 2026

GitHub hat seine Modellauswahl in Copilot in den vergangenen Wochen drastisch erweitert. Laut dem September-Enterprise-Rückblick von GitHub wurden allein in diesem Monat unter anderem Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, Grok 4.7, Gemini 3.8 Flash und Microsofts eigenes MAI-Code-1.1-Flash in die Plattform integriert. GPT-6 Astra ist inzwischen allgemein verfügbar und wird von GitHub als Modell beschrieben, das lange Agenten-Aufgaben in weniger Schritten plant, validiert und selbst überprüft.

Claude Sonnet 5.5 reiht sich laut dem separaten Copilot-Changelog vom 28. September nahtlos in diese Liste ein und wird über nutzungsbasierte Abrechnung zu den Standard-Listenpreisen des Anbieters berechnet. Das bedeutet für Copilot-Nutzer: Die Kosten hängen direkt an Anthropics eigenem Tarif von 2 und 10 US-Dollar je Million Token, es gibt keinen zusätzlichen Copilot-Aufschlag auf das Modell selbst.

Diese Modellvielfalt ist Teil einer größeren strategischen Linie bei GitHub. Statt sich auf ein bevorzugtes Modell festzulegen, positioniert sich Copilot zunehmend als modellneutrale Plattform, auf der Entwickler und Unternehmen selbst wählen, welcher Anbieter für welche Aufgabe am besten passt. Für Teams, die zwischen den Optionen wechseln möchten, lohnt sich ein Blick auf unsere Einordnung der Copilot-Modellstufen mit Claude Opus 5.5.

Benchmark-Tabelle im direkten Vergleich

Die folgende Übersicht zeigt die von Anthropic veröffentlichten Benchmark-Werte für Sonnet 5.5 im Vergleich zum Vorgänger und zum hauseigenen Flaggschiff:

BenchmarkSonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.070,6 %10,3 %66,4 %
CursorBench 4.055,5 %34,1 %57,8 %
FrontierCode 1.1 Main (xhigh)52,1 %42,4 %54,4 %
FrontierCode 1.1 Main (max)46,2 %n. a.n. a.
GDPval-AA v2.1 (Elo)184414491846

Zur Einordnung: Auf dem unabhängigen Coding-Agent-Index von Artificial Analysis erzielte Claude Code mit Opus 5.5 zuletzt 66 Punkte gegenüber 62 Punkten für Codex mit GPT-6 Astra, wie bereits in unserem Bericht über Claude Opus 5.5 gegen GPT-6 Astra dargestellt. Vergleichbare unabhängige Messwerte für Sonnet 5.5 lagen zum Zeitpunkt der Veröffentlichung noch nicht vor, weshalb sich die obige Tabelle bewusst auf die von Anthropic selbst veröffentlichten Zahlen stützt.

Historischer Kontext: Von Sonnet 4.6 bis zur 5.5-Generation

Claude Sonnet hat sich seit seiner Einführung als Anthropics mittlere Modellklasse etabliert, positioniert zwischen dem kompakten Haiku und dem leistungsstärkeren, aber teureren Opus. Sonnet 5 selbst kam erst wenige Monate vor Sonnet 5.5 auf den Markt und brachte bereits deutliche Fortschritte gegenüber der Vorgängergeneration Sonnet 4.6 mit. Die Preisstruktur von 2 US-Dollar Input und 10 US-Dollar Output je Million Token hat Anthropic seither über zwei Modellgenerationen hinweg beibehalten, was in einem Markt mit häufigen Preisanpassungen eher ungewöhnlich ist.

Dieses Muster, gleicher Preis bei wachsender Leistung, unterscheidet sich deutlich von der Preispolitik bei Opus, wo Anthropic mit dem Sprung von Opus 5 auf Opus 5.5 die Tarife aktiv um rund 20 Prozent gesenkt hat. Die Entscheidung, bei Sonnet auf Preisstabilität und bei Opus auf Preissenkung zu setzen, deutet darauf hin, dass Anthropic die beiden Produktlinien bewusst unterschiedlich positioniert: Sonnet als verlässliches Arbeitspferd mit stetig wachsender Effizienz, Opus als das Modell, das zusätzlich über den Preis konkurrenzfähig gehalten werden muss.

Sonnet 5.5 in der Praxis: API-Zugriff und ein einfaches Beispiel

Für Entwickler, die Claude Sonnet 5.5 direkt über die Anthropic-API ansprechen möchten, ändert sich an der Integration selbst wenig. Der Modellname wird lediglich auf die neue Version umgestellt, die Parameter für Kontextlänge und Ausgabegröße bleiben unverändert zu Sonnet 5. Ein minimaler Aufruf über die REST-API sieht folgendermaßen aus:

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2026-01-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 4096,
    "messages": [
      {"role": "user", "content": "Refaktoriere diese Node.js-Funktion und erklaere die Aenderung."}
    ]
  }'

Wer bereits Sonnet 5 in einer Pipeline im Einsatz hat, muss lediglich den Modell-String austauschen. Anthropic hat keine strukturellen Änderungen an der API für den Wechsel auf Sonnet 5.5 vorgenommen, was den Umstieg für bestehende Integrationen deutlich vereinfacht, verglichen mit größeren Versionssprüngen in der Vergangenheit, bei denen teils Parameter entfernt oder umbenannt wurden.

Marktauswirkungen: Was der Preisstopp für Entwicklerteams bedeutet

Die wirtschaftliche Logik hinter Sonnet 5.5 ist für Unternehmen leicht nachvollziehbar. Wenn ein Modell zum gleichen Preis mehr als 30 Prozent schneller arbeitet und laut Anthropic bis zu 30 Prozent weniger Gesamtkosten pro abgeschlossener Aufgabe verursacht, sinkt der effektive Preis pro erledigtem Ticket, ohne dass sich der Listenpreis je Token ändert. Für Teams mit hohem Automatisierungsgrad, etwa bei CI/CD-Pipelines mit KI-gestützten Code-Reviews oder automatisierten Refactoring-Aufgaben, kann sich das direkt in der monatlichen API-Rechnung niederschlagen.

Gleichzeitig verschärft der Launch den Druck auf Wettbewerber, ähnliche Effizienzgewinne vorzuweisen, statt nur mit sinkenden Preisen zu werben. Ein Preiskampf allein reicht nicht mehr aus, wenn ein Konkurrent bei identischem Tarif eine deutlich bessere Kosten-Leistungs-Bilanz pro Aufgabe erzielt. Das könnte in den kommenden Monaten dazu führen, dass Anbieter ihre Modelle stärker über Tool-Effizienz und Aufgabenerfolgsquote statt über reine Token-Preise vermarkten.

Für IT-Entscheider in Österreich, die Budgets für KI-gestützte Entwicklung planen, lohnt sich deshalb ein Blick auf die tatsächliche Aufgabenerfolgsquote statt nur auf den Token-Preis. Ein Modell, das doppelt so viele Tool-Aufrufe für dieselbe Aufgabe benötigt, kann trotz niedrigerem Token-Preis am Ende teurer sein.

Analyse: Warum Anthropic auf Tempo statt auf rohe Intelligenz setzt

Die auffälligste Botschaft hinter Sonnet 5.5 ist keine reine Intelligenzsteigerung, sondern eine Effizienzsteigerung. Anthropic hätte die höheren Terminal-Bench-Werte auch als Beleg für ein “klügeres” Modell vermarkten können. Stattdessen betont das Unternehmen explizit die Geschwindigkeit und die geringere Anzahl an Tool-Aufrufen. Das ist eine bewusste Positionierung: In einem Markt, in dem Entwickler zunehmend agentische Workflows mit vielen aufeinanderfolgenden Aktionen einsetzen, zählt nicht mehr nur, ob ein Modell die richtige Antwort kennt, sondern wie effizient es dorthin gelangt.

Diese Verschiebung lässt sich auch am Benchmark-Design selbst ablesen. Terminal-Bench 4.0 und CursorBench 4.0 messen explizit mehrstufige, werkzeuggestützte Aufgaben und nicht mehr nur isolierte Codegenerierung. Dass Sonnet 5.5 gerade hier den größten Sprung zeigt, während es bei reinen Wissens- und Architektur-Benchmarks wie FrontierCode hinter Opus 5.5 zurückbleibt, bestätigt, dass Anthropic gezielt an der Agenten-Zuverlässigkeit gearbeitet hat, nicht an der allgemeinen Modellintelligenz.

Für die Produktstrategie insgesamt heißt das: Anthropic differenziert Sonnet und Opus nicht länger nur über die Modellgröße, sondern über den Anwendungsfall. Sonnet wird zum bevorzugten Modell für lange, autonome Agenten-Sessions, während Opus für einmalige, komplexe Entscheidungen mit hohem Anspruch an Tiefe reserviert bleibt.

Prognosen: Wie sich der KI-Coding-Markt bis Jahresende entwickelt

  • Weitere Anbieter werden bei ihren nächsten Modell-Updates verstärkt Tool-Effizienz-Kennzahlen statt nur Token-Preise bewerben, da Anthropic mit Sonnet 5.5 einen neuen Vergleichsmaßstab gesetzt hat.
  • GitHub Copilot dürfte seine Modellliste bis Jahresende weiter ausbauen und noch stärker als modellneutrale Plattform auftreten, auf der Nutzer je nach Aufgabe zwischen Anthropic-, OpenAI-, xAI- und Google-Modellen wechseln.
  • Terminal- und agentenzentrierte Benchmarks wie Terminal-Bench 4.0 werden an Bedeutung gewinnen, während klassische, statische Codegenerierungs-Benchmarks für die Kaufentscheidung an Gewicht verlieren.
  • Die Preisstabilität bei Sonnet-Modellen dürfte anhalten, solange Anthropic Effizienzgewinne statt Preissenkungen als Differenzierungsmerkmal nutzen kann. Ein Preiskampf bei den Mittelklasse-Modellen ist kurzfristig eher unwahrscheinlich.
  • Unternehmen, die heute noch auf ein einzelnes Modell setzen, werden zunehmend Multi-Modell-Strategien fahren, bei denen unterschiedliche Aufgaben automatisch an das jeweils kosteneffizienteste Modell weitergeleitet werden.

Diese Einschätzungen basieren auf den aktuell verfügbaren Produktentscheidungen und Preisstrukturen und sind als redaktionelle Einordnung zu verstehen, nicht als Zusicherung künftiger Entwicklungen.

Häufige Fragen zu Claude Sonnet 5.5

Wann wurde Claude Sonnet 5.5 veröffentlicht?

Claude Sonnet 5.5 wurde am 28. September 2026 von Anthropic veröffentlicht und am selben Tag in GitHub Copilot integriert.

Was kostet Claude Sonnet 5.5?

Das Modell kostet 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, identisch zum Vorgänger Claude Sonnet 5. Prompt-Caching kostet 2,50 US-Dollar beim Schreiben und 0,20 US-Dollar beim Lesen je Million Token.

Wie schneidet Claude Sonnet 5.5 im Vergleich zu Sonnet 5 ab?

Auf Terminal-Bench 4.0 steigt der Wert von 10,3 auf 70,6 Prozent. Auf CursorBench 4.0 verbessert sich das Modell von 34,1 auf 55,5 Prozent, und beim GDPval-AA-Index steigt der Elo-Wert von 1449 auf 1844 Punkte.

Ist Claude Sonnet 5.5 besser als Claude Opus 5.5?

Das kommt auf die Aufgabe an. Bei Terminal-Bench 4.0 liegt Sonnet 5.5 mit 70,6 Prozent sogar vor Opus 5.5 mit 66,4 Prozent. Bei FrontierCode und CursorBench liegt Opus 5.5 knapp vorn. Da Opus 5.5 doppelt so viel kostet, ist Sonnet 5.5 für viele Terminal- und Agentenaufgaben das wirtschaftlichere Modell.

Ist Claude Sonnet 5.5 in GitHub Copilot verfügbar?

Ja. GitHub hat die Integration im Changelog vom 28. September 2026 bestätigt. Die Abrechnung erfolgt über nutzungsbasierte Copilot-Tarife zu den Standard-Listenpreisen von Anthropic.

Welches Kontextfenster hat Claude Sonnet 5.5?

Berichten mehrerer Fachmedien zufolge liegt das Kontextfenster bei rund 1 Million Token mit einer Ausgabeobergrenze von 128.000 Token, identisch zu den bereits bei Sonnet 5 bekannten Werten.

Welche anderen Modelle sind zeitgleich mit Sonnet 5.5 erschienen?

Im selben Zeitraum wurden GPT-6 Sol und GPT-6 Luna von OpenAI sowie Grok 4.7 von xAI veröffentlicht. Grok 4.7 wurde am 28. September 2026, dem gleichen Tag wie Sonnet 5.5, auf Amazon Bedrock allgemein verfügbar gemacht.

Lohnt sich der Umstieg von Sonnet 5 auf Sonnet 5.5?

Für Teams mit agentischen, terminalnahen Workflows spricht der deutliche Benchmark-Sprung bei gleichbleibendem Preis klar für den Umstieg. Da Anthropic keine strukturellen API-Änderungen vorgenommen hat, lässt sich der Wechsel technisch mit minimalem Aufwand umsetzen.