Anthropic bringt Sonnet 5.5: Gleicher Preis, 30% weniger Aufwand
Sonnet 5.5 kostet 2 USD / 10 USD pro Million Tokens, halb so viel wie Opus 5.5, und hat nur zwei Punkte Unterschied im GDPval. Anthropic sagt, die Kosten pro Aufgabe sinken um bis zu 30%.

Anthropic hat am Montag, dem 28. März, den Claude Sonnet 5.5 zum gleichen Preis wie den Sonnet 5 eingeführt: 2 USD pro Million Eingabetokens und 10 USD pro Million Ausgabetokens, mit Cache-Lesegebühren von 0,20 USD. Die Veränderung liegt in der Leistung. Im Terminal-Bench 4.0, einem Test für agenzielle Programmierung, erzielt das Modell 70,6 %, im Vergleich zu 10,3 % des Vorgängermodells, so die Unternehmenswebsite zur Einführung.
Die interessante Kennzahl für Käufer von KI in großem Maßstab ist eine andere. Anthropic gibt an, dass der Sonnet 5.5 Antworten mehr als 30 % schneller generiert und die Kosten pro Aufgabe in seinen Tests um bis zu 30 % sinken, da er die Arbeit mit weniger Toolaufrufen und weniger Tokens löst. Der Listenpreis blieb gleich; die Gesamtkosten sanken.
Mittelklasse, nah am Spitzenmodell
Der Vergleich mit dem Opus 5.5, dem teuersten Modell im Portfolio, erklärt den Schritt. Der Opus 5.5 kostet 4 USD pro Million Eingabetokens und 20 USD pro Million Ausgabetokens, das Doppelte des Sonnet 5.5 an beiden Enden, gemäß der offiziellen Preisliste. Im GDPval-AA v2.1, das Wissensarbeit misst, erreicht der Sonnet 5.5 1.844 Elo-Punkte, im Vergleich zu 1.846 des Opus 5.5 und 1.449 des Sonnet 5.
Die Distanz ist nicht in allen Tests null. Im OSWorld 2.1, einem Computeranwendungsverfahren, liegt der Sonnet 5.5 bei 80,1 %, gegenüber 81,8 % des Opus 5.5. Im Humanity's Last Exam mit Tools ist der Unterschied größer: 64,5 % gegenüber 67,7 %. Bei Aufgaben mit langem Denken liefert das Spitzenmodell nach wie vor etwas, was das Zwischenmodell nicht bietet, und Anthropic positioniert den Sonnet 5.5 selbst für "klar definierte Alltagsaufgaben, Fehlersuche und Erstellung von Dokumenten, Präsentationen und Tabellen".
Für einen CIO ändert sich die Rechnung. Wenn ein Dokumentanalyseprozess heute im Opus ohne Alternative läuft, wird der erforderliche Test darauf hinauslaufen, dass das gleiche Batch im Sonnet 5.5 ausgeführt wird, um die Kosten pro abgeschlossener Aufgabe zu messen, nicht die Kosten pro Token.
Was die Kunden gemessen haben
Die von Anthropic veröffentlichten Kundenzahlen unterstützen diese Entwicklung. Balyasny Asset Management berichtet von überlegener Leistung bei 2.441 Finanzaufgaben, wobei der Tokenverbrauch von 497.000 auf 121.000 pro Antwort gesenkt wurde, eine Reduktion von etwa 76 %. Box berichtet, dass das Modell 2,4-mal schneller als der Sonnet 5 in sensiblen Finanz- und Gesundheitsdaten war. Zendesk behauptet, dass "die Tickets 20 % schneller verarbeitet wurden".
Daniel Vogel, COO von Epic Games, sagte, dass der Sonnet 5.5 "die gleiche Qualitätsmesslatte durchlaufen hat, die man von einem Premium-Modell erwarten würde" in einer Systemdesign-Audit. Die bei der Einführung gewählten Testimonials sind vom Anbieter ausgesucht und messen günstige Fälle; sie dienen als Hypothese für Tests, nicht als unabhängiger Benchmark.
Cyber-Schutzmaßnahmen vererbt vom Opus
Der Sonnet 5.5 kommt mit vergleichbaren Cybersicherheitsmaßnahmen wie dem Opus 5.5. Anfragen, die als höheres Risiko eingestuft sind, "werden sichtbar auf den Sonnet 5 zurückgreifen", so Anthropic, und Befürworter, die erweiterten Zugriff benötigen, können sich für das Cyber Verification Program anmelden. Für offensive Sicherheitsteams und Red-Teams bedeutet dies, dass ein Teil der Arbeit sichtbar auf das vorherige Modell migriert, und der Pilot muss diese Rückfallquote vor jeder Migration messen.
Das Modell ist bereits auf der Anthropic-Plattform unter der Kennung claude-sonnet-5-5 und auch auf AWS, Google Cloud und Microsoft Azure verfügbar, was die Vertragsbarriere für Unternehmen, die bereits KI von einem dieser drei Hyperskalierer konsumieren, beseitigt.
Die Rechnungen treffen die Dienstleistungsverträge
Die direkteste Auswirkung zeigt sich nicht in den Labors, sondern bei den Anbietern von Entwicklungskosten. In den Vereinigten Staaten haben Unternehmen wie Box und Zendesk bereits die Geschwindigkeitsgewinne in ihren Produkten integriert; der Endkunde profitiert ohne Neuaushandlung. In Indien, wo TCS, Infosys und Wipro einige der größten Software-Lieferzentren betreiben, übt ein Anstieg von 10,3 % auf 70,6 % in agenziellem Programmieren Druck auf Festpreisverträge aus: Der Kunde weiß, dass die Produktionskosten gesunken sind und wird einen Rabatt bei der Verlängerung verlangen.
In Brasilien, wo Beratungen wie CI&T Entwicklungsteams an amerikanische Kunden auf der Basis von Kosten und Zeitzonen verkaufen, schrumpft die arbitrage Vorteils erheblich, wenn das Zwischenmodell die gleiche Aufgabe um 30 % günstiger erledigt. Diese Exposition ist beiden Ländern gemeinsam: Wer stundenweise abrechnet, absorbiert den Kostenrückgang als Rückgang der Einnahmen, während diejenigen, die nach Ergebnissen preisen, die Marge einfangen.
Anthropic hat den Preis pro Token beibehalten, obwohl die Kosten pro Aufgabe gesunken sind. Für den Unternehmenskäufer ist die Listenmetrik kein guter Indikator mehr für das, was bezahlt wird; der Vertrag, der weiterhin Anbieter nach dem Preis pro Million Tokens vergleicht, misst das falsche.
Quellen
- anthropic.comhttps://www.anthropic.com/claude-sonnet-5-5
- claude.comhttps://claude.com/pricing
- marktechpost.comhttps://www.marktechpost.com/2026/09/28/anthropic-releases-claude-sonnet-5-5-70-6-on-terminal-bench-4-0-at-the-same-2-10-price/
- venturebeat.comhttps://venturebeat.com/technology/anthropic-launches-claude-sonnet-5-5-with-30-cost-reduction-per-task-due-to-faster-speeds-and-fewer-tool-calls