Anthropic hat Claude Sonnet 5.5 veröffentlicht: Im Wissensarbeits-Benchmark GDPval-AA liegt das Modell laut Anthropic nahezu gleichauf mit Opus 5.5 und soll pro Aufgabe bis zu 30 Prozent weniger kosten als Sonnet 5.
Sonnet 5.5 ist das zweite Modell der Claude-5.5-Familie. Anthropic sieht es vor allem bei klar umrissenen Aufgaben wie Fehlersuche, Dokumenten und Tabellen im Einsatz.
Im Benchmark GDPval-AA erreicht Sonnet 5.5 nach Anthropics Angaben 1844 Punkte. Opus 5.5 kommt auf 1846 Punkte, Sonnet 5 auf 1449. Der Wert für Sonnet 5.5 stammt aus einer Vorabversion. Ein inzwischen behobener Fehler könnte strukturierte Ausgaben beeinflusst haben.
Die Preise je Token bleiben gegenüber Sonnet 5 unverändert. Die geringeren Kosten pro Aufgabe erklärt Anthropic damit, dass das neue Modell für dieselbe Arbeit meist weniger Tokens benötigt. Ausgaben soll es zudem mehr als 30 Prozent schneller erzeugen.
Erstmals stattet Anthropic ein Sonnet-Modell mit Cyber-Schutzmaßnahmen und Rückfallmechanismen aus, wie sie auch bei seinen leistungsfähigsten Modellen zum Einsatz kommen.
Über Opus 5.5 hatten wir bereits berichtet. Damals hatte Anthropic Sonnet 5.5 für die folgenden Wochen angekündigt.
Quelle:
Anthropic