TradingKey – Anthropic hat die Einführung seines neuen Modells Claude Sonnet 5.5 bekannt gegeben. Das Modell ist das zweite Produkt der Serie Claude 5.5. Im Vergleich zur vorherigen Generation Sonnet 5 steigt die Ausgabegeschwindigkeit um über 30 %, für dieselbe Aufgabe werden weniger Tokens benötigt und die Kosten pro Aufgabe können um bis zu 30 % gesenkt werden.
Sonnet 5.5 ist für Routineprogrammierung, Software-Debugging sowie die Erstellung von Dokumenten, Präsentationen und Tabellenkalkulationen konzipiert und dient als kostengünstige Ergänzung zum höherklassigen Opus 5.5. Anthropic erklärte, dass Opus 5.5 besser für ergebnisoffene Aufgaben geeignet sei, die eine kontinuierliche Urteilskraft und komplexe logische Schlussfolgerungen erfordern, während Sonnet 5.5 den Schwerpunkt auf Geschwindigkeit, Effizienz und schnelle Iteration legt.
In Bezug auf die Leistung übertrifft Sonnet 5.5 das Modell Sonnet 5 in mehreren Evaluationen deutlich. Im Agentic-Programming-Benchmark Terminal-Bench 4.0 erzielte Sonnet 5.5 ein Ergebnis von 70,6 % und lag damit deutlich über den 10,3 % von Sonnet 5. In der GDPval-AA-Evaluierung, die 44 Berufe in 9 Hauptbranchen testet, erreichte Sonnet 5.5 einen Wert von 1844, was nahe an den 1846 von Opus 5.5 liegt und spürbar höher ist als die 1449 von Sonnet 5.

Quelle: Anthropic
Was die Preise betrifft, bleibt Sonnet 5.5 auf dem Niveau von Sonnet 5: 2 US-Dollar pro Million Input-Tokens, 10 US-Dollar pro Million Output-Tokens, 0,20 US-Dollar pro Million Tokens für Cache-Lesezugriffe und 2,50 US-Dollar pro Million Tokens für Cache-Schreibzugriffe. Im Vergleich dazu liegen die Input- und Output-Preise von Opus 5.5 bei 4 bzw. 20 US-Dollar pro Million Tokens. Anthropic gab an, dass Sonnet 5.5 die tatsächlichen Nutzungskosten senkt, indem die für die Erledigung von Aufgaben benötigte Token-Anzahl reduziert wird, anstatt lediglich die Listenpreise zu senken.
Aus kommerzieller Sicht deutet dieser Wandel darauf hin, dass sich der Wettbewerb zwischen KI-Modellen weiter von der einfachen Token-Preisgestaltung hin zu den Kosten pro Aufgabe und dem Verarbeitungsdurchsatz verlagert. Für Unternehmenskunden könnte die Frage, ob ein Modell Softwareentwicklungs-, Analyse- und Content-Erstellungsaufgaben mit weniger Aufrufen und in kürzerer Zeit erledigen kann, das Budget und die Kapitalrendite direkter beeinflussen als nominale API-Stückpreise.
Hinsichtlich der Sicherheit erklärte Anthropic, dass Sonnet 5.5 bei automatisierten Verhaltensüberprüfungen in rund 1.850 Szenarien bei den meisten Metriken besser als oder gleich gut wie Sonnet 5 abgeschnitten hat. Da seine Cybersicherheitsfähigkeiten nahezu das Niveau von Opus 5.5 erreichen, ist Sonnet 5.5 erstmals mit Cybersicherheits-Schutzmechanismen ausgestattet, die denen höherwertiger Modelle ähneln; bei Cybersicherheitsaufgaben mit höherem Risiko greift das System auf Sonnet 5 zurück. Das Modell verfügt zudem über Sicherheitsklassifikatoren, um eine großflächige Extraktion von Argumentationsfähigkeiten zu verhindern.