Sprung bei Terminal-Bench

Claude Sonnet 5.5: Anthropic senkt Kosten pro Aufgabe

Claude Sonnet
Bildquelle: Nwz/Shutterstock.com

Anthropic hat Claude Sonnet 5.5 veröffentlicht. Laut Hersteller ist das Modell über 30 Prozent schneller und kostet pro Aufgabe bis zu 30 Prozent weniger.

Anthropic hat am Claude Sonnet 5.5 veröffentlicht, das zweite Modell der Familie Claude 5.5 nach Opus 5.5. Sonnet 5.5 ist für klar umrissene Alltagsaufgaben gedacht, etwa das Beheben von Fehlern im Code, das Schreiben von Dokumentationen und das Erstellen von Präsentationen und Tabellen. Opus 5.5 zielt auf komplexe Aufgaben. Für die kommenden Wochen hat Anthropic zudem Claude Haiku 5.5 angekündigt, das auf hohen Durchsatz bei niedrigen Kosten ausgelegt ist.

Anzeige

Claude Sonnet 5.5: Gleicher Tokenpreis, weniger Tokens

Der Preis pro Million Tokens bleibt gegenüber Sonnet 5 unverändert: 2 US-Dollar für Eingabe-Tokens, 10 Dollar für Ausgabe-Tokens und 0,20 Dollar für Cache-Lesezugriffe. Da das Modell pro Aufgabe weniger Tokens benötigt, sinken die effektiven Kosten laut Anthropic um bis zu 30 Prozent. Die Ausgabe soll mehr als 30 Prozent schneller erfolgen. Unabhängige Tests dazu stehen noch aus.

Bildschirmfoto 29 9 2026 112736 www.anthropic.com 1
Bildquelle: Screenshot/Anthropic

Sprung bei Terminal-Bench

Die größten Verbesserungen gegenüber dem Vorgänger nennt Anthropic beim Programmieren. Im Benchmark Terminal-Bench 4.0 für agentisches Programmieren erreicht Sonnet 5.5 nach Herstellerangaben 70,6 Prozent, Sonnet 5 kam auf 10,3 Prozent. In CursorBench 4.0, das reale Programmiersitzungen im Editor Cursor nachbildet, liegt Sonnet 5.5 mit 55,5 Prozent gut zwei Punkte hinter Opus 5.5.

Beim Benchmark FrontierCode schneidet Sonnet 5.5 auf der höchsten Aufwandsstufe „Max“ schlechter ab als auf der Stufe „Xhigh“. Laut Anthropic löst das Modell auf höchster Stufe häufiger eine Code-Review-Funktion aus, die Arbeit auf mehrere Sub-Agenten verteilt. Das führte teils zu Zeitüberschreitungen oder Änderungen außerhalb der Aufgabe.

Anzeige
Newsletter
Newsletter Box

Mit Klick auf den Button "Jetzt Anmelden" stimme ich der Datenschutzerklärung zu.

Wissensarbeit auf Opus-Niveau

Im Benchmark GDPval-AA, der Aufgaben aus 44 Berufen und neun Branchen abdeckt, erreicht Sonnet 5.5 laut Anthropic 1.844 Punkte. Opus 5.5 kommt auf 1.846, Sonnet 5 auf 1.449 Punkte. Die Werte für Sonnet 5.5 stammen aus einer Vorabversion, bei der ein inzwischen behobener Fehler strukturierte Ausgaben beeinflusst haben könnte. In der Diagrammerkennung Chartography stieg der Wert von 15,6 auf 61,6 Prozent.

Bildschirmfoto 29 9 2026 11285 www.anthropic.com 1
Bildquelle: Screenshot/Anthropic

Schutzmaßnahmen für Cybersicherheit

Da Sonnet 5.5 bei Cybersicherheitsaufgaben deutlich leistungsfähiger ist als sein Vorgänger, versieht Anthropic erstmals ein Sonnet-Modell mit zusätzlichen Schutzmaßnahmen. Anfragen zu risikoreichen Cybersicherheitsaufgaben werden sichtbar an Sonnet 5 umgeleitet. Fachleute können über ein erweitertes Cyber Verification Program gestuften Zugang beantragen. Zudem setzt Anthropic Klassifikatoren gegen sogenannte Destillationsangriffe ein, mit denen Dritte ein Modell nachzubilden versuchen. Sonnet 5.5 ist über die Claude Platform unter der Modellkennung claude-sonnet-5-5 sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar.

(red)

Anzeige

Weitere Artikel

Newsletter
Newsletter Box

Mit Klick auf den Button "Jetzt Anmelden" stimme ich der Datenschutzerklärung zu.