Strategie6 Min.Redaktion

Preissenkungen durch OpenAI und Anthropic am selben Tag

Subestação elétrica ao lado de um prédio baixo de data center, com transformadores atrás de cerca e unidades de resfriamento no telhado, sob luz cinzenta.

GPT-6 Sol fiel auf 2 US-Dollar pro Million Token, während Claude Opus 5.5 bei 4 US-Dollar lag. Ein Preisverfall wurde am 22. September angekündigt.

OpenAI hat den Preis für den GPT-6 Sol auf 2 US-Dollar pro Million Eingabetokens und 10 US-Dollar für Ausgaben am Dienstag gesenkt, die Hälfte des vorhergehenden Preises von 4 und 20 US-Dollar für den GPT-5.6 Sol. Das kleinere Modell, der GPT-6 Luna, beträgt jetzt 0,10 und 0,50 US-Dollar, im Vergleich zu 0,20 und 1,20 US-Dollar der vorherigen Generation. Ein Sprecher des Unternehmens sagte gegenüber VentureBeat, dass die Preise dauerhaft sind und keine Werbeaktion. Am selben Tag veröffentlichte Anthropic den Claude Opus 5.5 zu Preisen von 4 und 20 US-Dollar, im Vergleich zu 5 und 25 US-Dollar des Opus 5.


Die beiden Preissenkungen kamen nur wenige Stunden auseinander und betreffen denselben Kostenpunkt: den Cache. Die Cache-Lesekosten für den Opus 5.5 fielen auf 0,20 US-Dollar pro Million Tokens, 60 % weniger als die 0,50 US-Dollar, die für den Opus 5 verlangt wurden, laut der Veröffentlichungsseite von Anthropic. Auf der Seite von OpenAI lagen auch die Cache-Einführungskosten bei 0,20 US-Dollar pro Million, mit Schreibkosten von 2,50 US-Dollar. Für diejenigen, die Agenten betreiben, die bei jedem Schritt denselben Kontext wieder lesen, ist dieser Punkt oft der größte Teil der monatlichen Ausgaben und nicht der Ausgabepreis, der in den Schlagzeilen steht.


Was sich in der Preisliste geändert hat


Im Vergleich zu Anthropic's eigenem Spitzenprodukt bleibt der Claude Fable 5.1 bei 10 und 50 US-Dollar pro Million Tokens, also fünfmal so teuer wie der Sol auf beiden Seiten. Der Google Gemini 3.8 Flash operiert zu einer Einführungstarif von 0,75 und 3,75 US-Dollar, gültig bis zum 31. Dezember, und erhöht sich am 1. Januar 2027 auf 1,50 und 7,50 US-Dollar. Wer ein Budget für 2027 mit der heutigen Preisliste erstellt, wird die Kosten von Google um 100 % falsch einschätzen.


Anthropic gibt an, dass der Opus 5.5 über 30 % schneller Ausgaben generiert als der Opus 5 und 40 % weniger bei typischen Lasten in den Standardkonfigurationen kostet. Die 40 % stammen nicht von der Preisliste, die um 20 % gesenkt wurde, sondern aus der Kombination von günstigeren Caches und weniger Tokens für das Denken pro Aufgabe. Die Unterscheidung ist wichtig bei der Vertragsverhandlung: die Preissenkung ist vertraglich festgelegt, die 40 % hängen vom Nutzungsprofil jedes Kunden ab und sind daher nicht vertraglich erfassbar.


Der Benchmark hat aufgehört, zu entscheiden


Im Artificial Analysis Coding Agent Index erzielte der Sol 80 Punkte, über den 77,2 Punkten des Claude Fable 5. Im OSWorld 2.0 berichtet Anthropic von einer Erfolgsquote von 81,8 % für den Opus 5.5 bei Computerbenutzung. Dies sind nur geringe Punkte, und OpenAI veröffentlichte am 8. Juli eine Prüfung, die darauf hinweist, dass etwa 30 % der Aufgaben des SWE-bench Pro zu strenge Tests, unvollständige Anweisungen oder irreführende Beschreibungen enthalten. Ein Modell nach Benchmark-Score zu kaufen, ist gerade jetzt, da es nur statistischer Lärm ist.


Es gibt eine gegenteilige Sichtweise, die erwähnt werden muss: dass der Preis pro Token in eine strukturelle Deflation eingetreten ist und weiterhin fallen wird. Die Preisliste des Gemini 3.8 Flash widerlegt dies im Januar. Aggressive Einführungspreise sind ein Instrument zur Gewinnung von Lasten, und Lasten, die bereits migriert sind, sind teuer zurückzugewinnen. Die 2 US-Dollar des Sol gelten heute, weil OpenAI sie als dauerhaft erklärt hat, nicht weil die Kostenkurve für die Inferenz dies erfordert.


Wo sich die Rechnung ändert


Für indische Software-Fabriken hat dies direkte Auswirkungen auf die Margen. TCS, Infosys und Cognizant verkaufen Wartung von Anwendungen in Verträgen mit Festpreisen pro Kopf und integrieren agentenbasierte Tools in diese Lieferzentren. Eine 50 % günstigere Inferenz verbessert die Marge des aktuellen Vertrags und wird im nächsten Zyklus zu einem Rabatt, den der Kunde bei der Erneuerung verlangt. Der Gewinn dauert einen Vertragsverhandlungszyklus.


In Brasilien stehen Unternehmen wie CI&T und die Shared Services Centers, die US-amerikanische Kunden bedienen, vor derselben Gleichung mit einem Wechselkursproblem: die API wird in Dollar abgerechnet und ein großer Teil der lokalen Verträge erfolgt in Real. Ein Preisschnitt von 50 % in Dollar kommt nicht vollständig im P&L von denen an, die mit der Diskrepanz umgehen.


In Deutschland und im Rest der Europäischen Union ist die Entscheidung nicht mehr nur finanzieller Natur. Seit dem 2. August 2026 gelten die Verpflichtungen des AI Act für Modelle mit allgemeinem Zweck, und der Wechsel des Anbieters, um 0,50 US-Dollar pro Million Tokens einzusparen, bedeutet, dass technische Dokumentationen und Risikobewertungen neu erstellt werden müssen. Die Kosten für einen Wechsel sind gerade in dem Moment gestiegen, als der Anreiz zum Wechsel größer wurde.


Die Variable, die niemand veröffentlicht, ist, wie viele Tokens ein Agent verbraucht, bis er eine Aufgabe abgeschlossen hat. Während die Anbieter im Stückpreis konkurrieren und den Verbrauch verschweigen, bleibt dem Käufer die einzige Zahl, die die Rechnung schließt, weiterhin unbekannt.

Die Analyse der Woche, per E-Mail

Eine wöchentliche Ausgabe mit dem, was für Entscheider zählt. Keine Werbung, kein Sponsoring.

Jederzeit mit einem Klick kündbar.

Strategie