KI-Modell: Claude Sonnet 5.5 soll Coding und Alltagstauglichkeit optimieren - Golem.de


Anthropic hat Claude Sonnet 5.5 vorgestellt, das schneller als der Vorgänger sein und bei den meisten Aufgaben bis zu 30 Prozent weniger Kosten verursachen soll.

Claude 5.5 ist da. (Bild: Anthropic)

Claude 5.5 ist da. Bild: Anthropic

Anthropic hat Claude Sonnet 5.5(öffnet im neuen Fenster) als zweites Modell der Claude-5.5-Familie vorgestellt. Sonnet 5.5 schneide bei agentischen Coding-Benchmarks deutlich besser ab als sein Vorgänger, teilte Anthropic mit. Auf Terminal-Bench 4.0 erreichte das Modell 17,6 Prozent, während Sonnet 5 bei 10,3 Prozent blieb. Im Vergleich zu Opus 5.5 blieb Sonnet knapp zwei Prozentpunkte zurück.

Bei der Analyse von Bildern gelang Sonnet 5.5 erstmals die Steuerung des Spiels Pokémon Red ausschließlich anhand von Screenshots.

Leistungssteigerung vor allem beim Programmieren

Besonders bemerkbar macht sich der Leistungszuwachs beim Programmieren. Auf Frontiercode liegt der Abstand zu Sonnet 5 bei zwölf Punkten. Auf Cursorbench, das echte Sessions der Codingsoftware Cursor auswertet, erreichte Sonnet 5.5 etwa zwei Punkte unter Opus 5.5.

Auch in der Wissensarbeit zeigte Sonnet 5.5 Fortschritte. Auf GDPval-AA, das reale Aufgaben aus neun großen Industriezweigen testet, lag das Modell nahe an Opus 5.5 und rund 400 Punkte über Sonnet 5. Bei der Steuerung von Computersystemen und der Auswertung von Diagrammen hielt es mit Opus 5.5 nahezu Schritt.

Kostenstruktur und Sicherheit

Die Preisstruktur bleibt unverändert: zwei US-Dollar pro Million Input-Tokens, zehn US-Dollar pro Million Output-Tokens und 20 Cent für Cache-Lesezugriffe. Da das Modell jedoch weniger Tokens pro Aufgabe benötige, sänken die Kosten um bis zu 30 Prozent, teilte Anthropic mit.

Außerdem kommen erstmals Schutzmechanismen gegen Distillation-Angriffe zum Einsatz, bei denen Angreifer versuchten, Modellfähigkeiten industriell zu extrahieren.