Produkt · 2. Oktober 2026

Auch veröffentlicht auf Français, Italiano, Português (Brasil)

Anthropic führt Claude Sonnet 5.5 mit verbesserten Programmier- und Analysefähigkeiten ein

Two women collaborating at a desk with fabric swatches
Rodrigo Rodrigues | WOLF Λ R T / Unsplash

Anthropic hat Claude Sonnet 5.5 veröffentlicht, das zweite Modell der Claude 5.5-Familie nach Opus 5.5.

Wie Techsauce berichtete, ist das neue Modell deutlich leistungsfähiger als sein Vorgänger Claude Sonnet 5. Es arbeitet über 30 Prozent schneller, und die Kosten pro Aufgabe sind in den meisten Fällen um bis zu 30 Prozent gesunken. Während Opus 5.5 für komplexe Aufgaben mit tiefem Urteilsvermögen konzipiert ist, ist Sonnet 5.5 für tägliche Routineaufgaben mit klarem Umfang, die Fehlerbehebung sowie die Erstellung von Dokumenten, Präsentationen und Tabellen optimiert. Ein weiteres Modell, Claude Haiku 5.5, für kosteneffiziente Massenverarbeitung wird in einigen Wochen folgen.

In technischen Tests zeigt Sonnet 5.5 signifikante Fortschritte. Beim Terminal-Bench 4.0 stieg die Punktzahl von 10,3 Prozent auf 70,6 Prozent und übertraf damit sogar Opus 5.5. Bei CursorBench 4.0 erreichte es 55,5 Prozent gegenüber 34,1 Prozent von Sonnet 5. Im Bereich der Wissensarbeit erzielte es beim GDPval-AA v2.1 1844 Punkte, was fast dem Wert von Opus 5.5 entspricht. Bei der Computersteuerung auf OSWorld 2.1 erreichte das Modell 80,1 Prozent. Zudem ist es die erste Sonnet-Version, die das Spiel Pokémon Red allein durch die Analyse von Bildschirmbildern beenden konnte.

Die Preisgestaltung bleibt identisch zu Sonnet 5 mit 2 Dollar pro 1 Million Eingabetoken und 10 Dollar pro 1 Million Ausgabetoken. Die Kosten für Cache-Lesevorgänge liegen bei 0,20 Dollar und für Cache-Schreibvorgänge bei 2,50 Dollar. Die Kostenreduktion pro Aufgabe ergibt sich daraus, dass das Modell deutlich weniger Token pro Aufgabe benötigt.

Nutzer können zwischen verschiedenen Denkstufen wählen, um Geschwindigkeit, Kosten und Qualität zu steuern. In Claude Code und der Claude-App ist die mittlere Stufe voreingestellt, während die Claude Platform die hohe Stufe nutzt. Die niedrige Stufe ist für Routineaufgaben optimiert, während die hohe Stufe eine detailliertere Prüfung ermöglicht.

Im Bereich der Programmierung zeigt das Modell eine effizientere Nutzung von Werkzeugaufrufen, was die Anzahl der Schritte und die Kosten reduziert. In Tests mit Epic Games bewältigte das Modell zehntausende Zeilen Code für Spielarchitekturen. Slack berichtete ebenfalls von einer verbesserten Leistung ihres Slackbots, wobei die Ausgabetoken um etwa 14 Prozent sanken.

Neben den technischen Daten wurde eine natürlichere Kommunikation und ein besseres Auge für Benutzeroberflächen festgestellt. In internen Tests erstellte das Modell eine Präsentation aus Quartalsberichten, die von Experten als sofort versandbereit eingestuft wurde. Bezüglich der Verhaltensausrichtung konzentrierte sich Anthropic auf Risiken wie die Irreführung von Nutzern oder die Unterstützung von missbräuchlicher Nutzung.