Anthropic hat Claude Sonnet 5.5 veröffentlicht. Laut Hersteller ist das Modell über 30 Prozent schneller und kostet pro Aufgabe bis zu 30 Prozent weniger.
Anthropic hat am Claude Sonnet 5.5 veröffentlicht, das zweite Modell der Familie Claude 5.5 nach Opus 5.5. Sonnet 5.5 ist für klar umrissene Alltagsaufgaben gedacht, etwa das Beheben von Fehlern im Code, das Schreiben von Dokumentationen und das Erstellen von Präsentationen und Tabellen. Opus 5.5 zielt auf komplexe Aufgaben. Für die kommenden Wochen hat Anthropic zudem Claude Haiku 5.5 angekündigt, das auf hohen Durchsatz bei niedrigen Kosten ausgelegt ist.
Claude Sonnet 5.5: Gleicher Tokenpreis, weniger Tokens
Der Preis pro Million Tokens bleibt gegenüber Sonnet 5 unverändert: 2 US-Dollar für Eingabe-Tokens, 10 Dollar für Ausgabe-Tokens und 0,20 Dollar für Cache-Lesezugriffe. Da das Modell pro Aufgabe weniger Tokens benötigt, sinken die effektiven Kosten laut Anthropic um bis zu 30 Prozent. Die Ausgabe soll mehr als 30 Prozent schneller erfolgen. Unabhängige Tests dazu stehen noch aus.

Sprung bei Terminal-Bench
Die größten Verbesserungen gegenüber dem Vorgänger nennt Anthropic beim Programmieren. Im Benchmark Terminal-Bench 4.0 für agentisches Programmieren erreicht Sonnet 5.5 nach Herstellerangaben 70,6 Prozent, Sonnet 5 kam auf 10,3 Prozent. In CursorBench 4.0, das reale Programmiersitzungen im Editor Cursor nachbildet, liegt Sonnet 5.5 mit 55,5 Prozent gut zwei Punkte hinter Opus 5.5.
Beim Benchmark FrontierCode schneidet Sonnet 5.5 auf der höchsten Aufwandsstufe „Max“ schlechter ab als auf der Stufe „Xhigh“. Laut Anthropic löst das Modell auf höchster Stufe häufiger eine Code-Review-Funktion aus, die Arbeit auf mehrere Sub-Agenten verteilt. Das führte teils zu Zeitüberschreitungen oder Änderungen außerhalb der Aufgabe.
Wissensarbeit auf Opus-Niveau
Im Benchmark GDPval-AA, der Aufgaben aus 44 Berufen und neun Branchen abdeckt, erreicht Sonnet 5.5 laut Anthropic 1.844 Punkte. Opus 5.5 kommt auf 1.846, Sonnet 5 auf 1.449 Punkte. Die Werte für Sonnet 5.5 stammen aus einer Vorabversion, bei der ein inzwischen behobener Fehler strukturierte Ausgaben beeinflusst haben könnte. In der Diagrammerkennung Chartography stieg der Wert von 15,6 auf 61,6 Prozent.

Schutzmaßnahmen für Cybersicherheit
Da Sonnet 5.5 bei Cybersicherheitsaufgaben deutlich leistungsfähiger ist als sein Vorgänger, versieht Anthropic erstmals ein Sonnet-Modell mit zusätzlichen Schutzmaßnahmen. Anfragen zu risikoreichen Cybersicherheitsaufgaben werden sichtbar an Sonnet 5 umgeleitet. Fachleute können über ein erweitertes Cyber Verification Program gestuften Zugang beantragen. Zudem setzt Anthropic Klassifikatoren gegen sogenannte Destillationsangriffe ein, mit denen Dritte ein Modell nachzubilden versuchen. Sonnet 5.5 ist über die Claude Platform unter der Modellkennung claude-sonnet-5-5 sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar.
(red)