KI-Modelle

Claude Sonnet 5.5: Schneller, effizienter, gleich teuer

Anthropic bringt sein neues Sonnet-Modell auf alle großen Plattformen. Was Preise, Leistung und Sicherheitsmaßnahmen bedeuten und welche Aussagen noch unabhängig geprüft werden müssen.

Claude Sonnet 5.5

Was Anthropic am 28. September veröffentlicht hat

Claude Sonnet 5.5 ist das zweite Modell der Claude-5.5-Familie nach Opus 5.5. Anthropic positioniert es als schnellere und günstigere Ergänzung für klar umrissene Alltagsaufgaben, Fehlerbehebung, Dokumente, Präsentationen und Tabellen. Für besonders komplexe, offene Aufgaben mit längerem Abwägen soll Opus 5.5 weiterhin die stärkere Wahl sein.

Das neue Modell ist nicht nur angekündigt, sondern laut Hersteller direkt verfügbar. In der API lautet die Modellkennung claude-sonnet-5-5. Zusätzlich nennt Anthropic Amazon Web Services, Google Cloud und Microsoft Azure als Bezugswege.

Wer Sonnet bisher ohne Thinking verwendet, muss bei der Migration eine technische Änderung beachten: Anthropic verweist auf die neue Einstellung between_tools. Sie hält das anfängliche Denken ausgeschaltet, erlaubt aber Denken zwischen Werkzeugaufrufen.

Ereignisdatum: 28. September 2026. Bestätigt sind Release, Modellkennung, Plattformen und Listenpreise. Leistungs- und Kostenvorteile sind Herstellerangaben.

Preise: gleiches Tokenmodell, niedrigere Kosten pro Aufgabe versprochen

Der reine API-Listenpreis ändert sich gegenüber Sonnet 5 nicht. Eine Million Eingabetokens kostet 2 US-Dollar, eine Million Ausgabetokens 10 US-Dollar. Für Cache-Schreibvorgänge nennt Anthropic 2,50 US-Dollar je Million Tokens, für Cache-Lesevorgänge 0,20 US-Dollar.

Die Aussage von bis zu 30 Prozent geringeren Kosten bezieht sich deshalb nicht auf einen niedrigeren Tokenpreis. Anthropic zufolge benötigt Sonnet 5.5 für dieselbe Arbeit häufig weniger Tokens und weniger Arbeitsschritte. Ob dieser Vorteil in einem konkreten System entsteht, hängt von Promptlänge, Tool-Aufrufen, Aufwandseinstellung, Fehlversuchen und Nachbearbeitung ab.

Für eine belastbare Kalkulation reicht der Preis pro Million Tokens nicht aus. Sinnvoller ist der Preis pro erfolgreich erledigter Aufgabe: Gesamte Modell- und Werkzeugkosten werden durch die Zahl fachlich akzeptierter Ergebnisse geteilt. So werden schnellere, aber fehlerhafte Läufe nicht versehentlich als Einsparung gezählt.

  • Eingabe: 2 US-Dollar pro Million Tokens
  • Ausgabe: 10 US-Dollar pro Million Tokens
  • Cache schreiben: 2,50 US-Dollar pro Million Tokens
  • Cache lesen: 0,20 US-Dollar pro Million Tokens
  • Bis zu 30 Prozent weniger Kosten pro Aufgabe laut Anthropic, nicht pauschal pro Token

Was die veröffentlichten Leistungswerte aussagen

Anthropic meldet große Fortschritte bei Coding, Computer-Nutzung, Bildverständnis und Wissensarbeit. Im agentischen Terminal-Benchmark Terminal-Bench 4.0 erreicht Sonnet 5.5 laut Hersteller 70,6 Prozent gegenüber 10,3 Prozent für Sonnet 5. Auf OSWorld 2.1 werden 80,1 Prozent gegenüber 57,0 Prozent ausgewiesen.

Solche Sprünge sind auffällig, aber nicht automatisch auf jeden Arbeitsprozess übertragbar. Benchmarks testen festgelegte Aufgaben, Werkzeuge und Bewertungsverfahren. Schon andere Aufwandseinstellungen oder ein Timeout können das Ergebnis verändern. Anthropic weist selbst darauf hin, dass Sonnet 5.5 bei maximalem Aufwand in einem Coding-Test schlechter abschnitt als bei der nächstniedrigeren Stufe, weil zusätzliche Prüfschritte zu Zeitüberschreitungen oder Änderungen außerhalb des Auftrags führten.

Für die Praxis ist daher weniger entscheidend, welcher einzelne Prozentwert am höchsten ist. Wichtiger ist, ob das Modell mit den eigenen Daten, Werkzeugen und Freigaberegeln zuverlässiger arbeitet und wie oft Ergebnisse ohne Korrektur akzeptiert werden können.

Die Benchmarkwerte sind veröffentlichte Herstellerergebnisse. Sie belegen keine unabhängige Überlegenheit in jedem Einsatzgebiet.

Warum Geschwindigkeit bei Agenten mehr als Komfort ist

Anthropic gibt an, dass Sonnet 5.5 Ausgaben mehr als 30 Prozent schneller erzeugt als Sonnet 5. Bei interaktiver Arbeit verkürzt das Wartezeiten. Bei Agenten kann der Effekt größer sein, weil ein Lauf aus vielen aufeinanderfolgenden Modellantworten, Werkzeugaufrufen und Prüfungen besteht.

Eine niedrigere Latenz kann mehr Versuche im gleichen Zeitfenster ermöglichen und blockierte Arbeitsabläufe schneller wieder freigeben. Sie kann aber auch Fehler schneller vervielfachen. Deshalb sollten Geschwindigkeitsgewinne nur zusammen mit Erfolgsquote, Zahl der Tool-Aufrufe, Abbruchrate und menschlicher Nacharbeit bewertet werden.

Anthropic nennt Medium als Standardeinstellung in den Claude-Anwendungen und High auf der Claude Platform. Niedrigere Aufwandseinstellungen sollen schneller und sparsamer arbeiten, höhere länger prüfen. Diese Wahl sollte pro Aufgabentyp erfolgen und nicht als einheitliche Systemeinstellung für alle Prozesse.

Welche neuen Sicherheitsmaßnahmen Anthropic nennt

Anthropic stuft die Cyberfähigkeiten von Sonnet 5.5 deutlich höher ein als die des Vorgängers. Das Modell startet deshalb mit Schutzmaßnahmen, die zuvor leistungsfähigeren Modellen vorbehalten waren. Bei bestimmten Hochrisiko-Anfragen soll das System sichtbar auf Sonnet 5 zurückfallen; gewöhnliche Softwareentwicklung und Fehlerbehebung sollen davon nicht betroffen sein.

Für Biologie gelten nach Herstellerangaben dieselben Schutzmaßnahmen wie bei Sonnet 5. Zusätzlich setzt Anthropic erstmals bei einem Sonnet-Modell Klassifikatoren gegen industrielle Destillationsangriffe ein. Erweitertes preserved thinking soll verhindern, dass interne Denkspuren von dem Konto getrennt werden, das sie erzeugt hat.

Diese Maßnahmen sind keine Garantie gegen Fehlverhalten. Anthropic berichtet über eine automatisierte Verhaltensprüfung mit rund 1.850 Szenarien und sieht überwiegend gleich gute oder bessere Werte als bei Sonnet 5. Die System Card dokumentiert die Prüfungen, bleibt aber eine Herstellerveröffentlichung.

  • Cyber-Schutzmaßnahmen und Modell-Fallbacks für Hochrisiko-Anfragen
  • Bestehende Biologie-Schutzmaßnahmen aus Sonnet 5
  • Klassifikatoren gegen groß angelegte Modelldestillation
  • Preserved thinking für stärker gebundene Denkspuren
  • Zero Data Retention laut Anthropic weiterhin verfügbar

So lässt sich Sonnet 5.5 sinnvoll gegen das bisherige Modell testen

Ein Modellwechsel sollte mit einem festen Satz realer, anonymisierter Aufgaben beginnen. Für jede Aufgabe braucht es vorab definierte Kriterien: fachliche Richtigkeit, Vollständigkeit, erlaubte Datenquellen, maximale Laufzeit und zulässige Kosten. Sonnet 5 und Sonnet 5.5 sollten mit denselben Eingaben, Werkzeugen und Limits antreten.

Neben Antwortqualität gehören auch Prozessmetriken in den Vergleich. Dazu zählen Tokens pro akzeptiertem Ergebnis, Tool-Aufrufe, Fehlversuche, Latenz, Abbrüche und Minuten menschlicher Nacharbeit. Bei Agenten muss zudem geprüft werden, ob das Modell häufiger eigenmächtig den Auftragsumfang erweitert oder unnötige Schritte ausführt.

Erst wenn Qualität und Kontrollierbarkeit mindestens gleich bleiben, ist eine breitere Umstellung sinnvoll. Kritische Abläufe sollten zunächst einen kleinen Anteil des Verkehrs erhalten und weiterhin menschliche Freigaben verlangen.

  • 20 bis 50 repräsentative Aufgaben mit erwarteten Ergebnissen festlegen
  • Beide Modelle mit identischen Prompts, Tools und Budgets vergleichen
  • Kosten pro akzeptiertem Ergebnis statt nur Tokenpreise messen
  • Fehlerklassen und Nacharbeit getrennt dokumentieren
  • Stufenweise ausrollen und bei Qualitätsverlust zurückschalten

Die MindrAils-Einordnung

Claude Sonnet 5.5 ist kein bloßer Teaser, sondern ein sofort verfügbares Modell mit klaren Preisen und Migrationshinweisen. Besonders relevant ist die Kombination aus unverändertem Tokenpreis, höherer Geschwindigkeit und dem Versprechen, Aufgaben mit weniger Tokens zu erledigen. Das kann den wirtschaftlichen Abstand zwischen einem schnellen Alltagsmodell und einem größeren Spitzenmodell verkleinern.

Wie groß der Vorteil wirklich ist, lässt sich aus den veröffentlichten Benchmarks allein nicht ableiten. Fast alle zentralen Vergleichswerte stammen von Anthropic oder von ausgewählten Vorabtests. Eine faire Entscheidung entsteht deshalb nicht aus der größten Prozentzahl, sondern aus einem kontrollierten Vergleich mit den eigenen Aufgaben.

Die nüchterne Schlussfolgerung lautet: Sonnet 5.5 ist ein ernst zu nehmender Kandidat für Coding, Wissensarbeit und Agenten mit hohem Durchsatz. Ein automatischer Austausch des Vorgängers ohne Migrationstest, Kostenmessung und Qualitätskontrolle wäre dennoch verfrüht.

Transparent belegt

Quellen und weiterführende Informationen

Die Quellen wurden zu den jeweils angegebenen Zeitpunkten abgerufen. Externe Inhalte können sich danach ändern.

  1. Introducing Claude Sonnet 5.5Anthropic · abgerufen am
    Quelle öffnen
  2. Claude Sonnet 5.5 System CardAnthropic · abgerufen am
    Quelle öffnen
Redaktioneller Hinweis

Dieser Beitrag wurde von der MindrAils Redaktion quellenbasiert eingeordnet. Er dient der allgemeinen Information und ersetzt keine Rechts-, Datenschutz- oder Fachberatung für einen konkreten Einzelfall.

Zurück zu allen Insights
Vom Wissen zur Anwendung

Wo kann KI in Ihrem Unternehmen konkret entlasten?

In der kostenlosen Business-Analyse betrachten wir Ihre Abläufe, Engpässe und realistischen Automatisierungspotenziale.