Anthropic hat jeden Preis von Claude Opus 5.5 gesenkt. Die Rechnung gegen Opus 5 stieg trotzdem.
Opus 5.5 senkt Token um 20% und Cache-Lesungen um 60% und erreicht 58 gegen Opus 5 mit 51. Die Kosten je Indexaufgabe stiegen dennoch auf 5,98 Dollar. Dazu vier brechende Änderungen.
GTM Architect & Growth Operator · Insights · 23. September 2026 · 9 Min. Lesezeit
Kurzfassung · Die wichtigsten Punkte
- Opus 5.5 listet zu 4 / 20 Dollar gegen Opus 5 mit 5 / 25 Dollar, und Cache-Lesungen fallen von 0,50 auf 0,20 Dollar, weil Anthropic dieses Modell auf einen Cache-Faktor von 0,05x statt der üblichen 0,1x gesetzt hat.
- Artificial Analysis bewertet Opus 5.5 mit 58 und Opus 5 mit 51, Platz eins von 212 Modellen gegen Platz elf. Die Kosten je Indexaufgabe bewegten sich kaum: 5,98 gegen 5,86 Dollar, weil Opus 5.5 260 Millionen Token schrieb gegen 140 Millionen bei Opus 5.
- Anthropics eigene Umstiegsempfehlung nennt eine Spanne von etwa 40% weniger bis etwa 20% mehr je gelöster Aufgabe. Die unabhängige Messung landete am oberen Ende dieser Spanne, nicht am unteren.
- Vier brechende Änderungen treffen Code, der bereits auf Opus 5 läuft: Denken lässt sich nicht abschalten, erzwungene Werkzeugnutzung gibt 400 zurück, Denkblöcke sind an das Modell gebunden, und das ältere Computer-Use-Werkzeug wird abgelehnt.
Anthropic hat jeden Preis der Opus-Reihe gesenkt und ein besseres Modell ausgeliefert. Eingabe 20% runter, Ausgabe 20% runter, Cache-Lesungen 60% runter, sieben Punkte höher im unabhängigen Index.
Dann ließ Artificial Analysis seinen Benchmark auf beiden laufen, und das neuere Modell kostete mehr. Nicht viel mehr, 2%, aber mehr. Diese Zahl ist der ganze Artikel, denn sie ist die, die Ihre Finanzabteilung sieht und Ihre Ankündigungszusammenfassung nicht.
| Info | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Eingabe / Ausgabe je 1 Mio. | $4 / $20 | $5 / $25 |
| Cache-Treffer und -Auffrischungen | $0.20 | $0.50 |
| Cache-Schreibvorgänge 5 Min. / 1 Std. | $5 / $8 | $6.25 / $10 |
| Intelligence Index v4.3.2 | 58 | 51 |
| Rang unter 212 Modellen | 1. | 11. |
| Kosten je Indexaufgabe | $5.98 | $5.86 |
| Im Index erzeugte Token | 260 Mio. | 140 Mio. |
| Ausgabetempo, Token/s | etwa 95 | etwa 54 |
| Standard-Denkaufwand | medium | high |
| Kontext / max. Ausgabe | 1 Mio. / 128K | 1 Mio. / 128K |
Preise von Anthropics Preisseite. Indexwert, Kosten je Aufgabe, Token und Tempo von den Modellseiten von Artificial Analysis, beide bei max effort gemessen. Gelesen am 23. September 2026.
Die Cache-Zeile ist die eigentliche Preissenkung
Alle werden $5 auf $4 zitieren. Das ist nicht die Zeile, die eine Agentenrechnung bewegt.
Anthropic bepreist Cache-Treffer und -Auffrischungen auf Opus 5.5 mit dem 0,05-Fachen des Basiseingabepreises, während jedes andere Modell der Reihe das 0,1-Fache nutzt. Das bringt eine Cache-Lesung von $0.50 auf $0.20 je Million Token, eine Senkung um 60%, und zwar bei der Komponente, die lang laufende Schleifen dominiert.
Anthropics eigener Kostenleitfaden sagt, dass Agentenschleifen über einen vollen Tag echten Verkehrs im Median 84% ihrer Eingabe aus dem Cache lesen. Wenn das Ihre Last beschreibt, ist die Eingabeseite Ihrer Rechnung gerade um mehr als die Hälfte gefallen. Die plakativen 20% sind die kleinere Hälfte der Geschichte.
Opus 5.5 liest Cache nun zu $0.20 je Million, demselben Satz, den GPT-6 Sol verlangt, bei einem Modell, das zum doppelten Eingabepreis von Sol listet. Vergleichen Sie Anbieter auf der Zeile, die Ihr Verkehr tatsächlich trifft.
Sieben Punkte hoch, und jetzt Erster
Artificial Analysis bewertet Opus 5.5 mit 58 und Opus 5 mit 51 im Intelligence Index v4.3.2. Opus 5.5 steht auf Platz eins der 212 Modelle dieser Klasse. Opus 5 war Elfter.
Dieselbe Seite hat auf der Opus-5-Seite bereits ein Veraltet-Banner gesetzt, das Leser auf das neuere Modell hinweist. Anthropics Modellübersicht ist mitgewandert: Die Zeile, die unsichere Leser früher zu Opus 5 schickte, schickt sie nun zu Opus 5.5.
Warum die Zahl je Aufgabe in die falsche Richtung lief
Opus 5.5 erzeugte im Indexlauf 260 Millionen Token. Opus 5 erzeugte 140 Millionen. Bei max effort denkt das neuere Modell fast doppelt so lange, und eine Senkung des Satzes um 20% deckt keinen Anstieg der geschriebenen Token um 86%.
Anthropic ist darin in der eigenen Kostenempfehlung ehrlich. Die Umstiegszeile besagt, dass das aktuelle Modell mehr Aufgaben löst, zu Kosten je gelöster Aufgabe von etwa 40% weniger bis etwa 20% mehr. Das ist eine Spanne mit einem schlechten Ende, kein Versprechen einer Ersparnis, und der unabhängige Lauf landete nahe am schlechten Ende.
Also: besser je Aufgabe, ungefähr gleich je Dollar, bei max effort. Die Ersparnis holen Sie, indem Sie den Aufwand senken. Die Modell-ID zu tauschen und auf eine bessere Rechnung zu warten, reicht nicht, und wer die 20% bereits als Ersparnis eingeplant hat, sollte diese Zeile zurückstellen, bis ein Lauf auf der eigenen Last etwas anderes sagt.
Vier Dinge, an denen Ihre Portierung scheitert
Das ist der Teil, der in jeder Zusammenfassung fehlt, die ich diese Woche gelesen habe. Anthropic dokumentiert vier brechende Änderungen gegenüber Code, der bereits auf Opus 5 läuft.
| Änderung | Was passiert | Die Lösung |
|---|---|---|
| Denken lässt sich nicht abschalten | Eine Anfrage mit thinking type disabled oder manuellem budget_tokens gibt 400 invalid_request_error zurück. | Das thinking-Feld weglassen oder adaptive senden, dann die Tiefe über effort steuern. |
| Erzwungene Werkzeugnutzung entfällt | tool_choice auf any oder auf ein benanntes Werkzeug gibt 400 zurück. Die Token-Zählung prüft genauso. | tool_choice auf auto mit strenger Werkzeugnutzung belassen oder das Schema auf strukturierte Ausgaben verlegen. |
| Denkblöcke sind modellgebunden | Opus 5.5 liest Blöcke von Opus 5 und früheren Opus, Sonnet und Haiku, aber nicht von Fable oder Mythos. | Inhaltsblöcke über den Typ statt über die Position wählen und Denkblöcke unverändert zurückgeben. |
| Älteres Computer-Use-Werkzeug abgelehnt | Auf der Claude API und Google Cloud wird computer_20251124 nicht akzeptiert. | Auf das aktuelle Computer-Use-Werkzeug wechseln, bevor Sie die Modell-ID tauschen. |
| Text zwischen Werkzeugaufrufen (nicht brechend) | Er kommt nun in Denkblöcken an, die bei der Standardanzeige leer sind, Fortschrittsströme verstummen also. | Einen Anzeigewert setzen, der den Text zurückgibt, wenn Nutzer diesen Strom beobachten. |
Aus Anthropics eigener Neuerungsseite zu Opus 5.5. Die ersten drei gelten auch für Claude Fable 5.1.
Die fünfte Zeile ist die, die Ihre Nutzer erreicht statt Ihrer Logs. Eine Anwendung, die Text zwischen Werkzeugaufrufen als Fortschritt streamt, wirft keinen Fehler. Sie verstummt nur zwischen den Aufrufen, und Stille sieht aus wie ein Hänger.
Der Standard hat sich verschoben, also Ihr Verhalten auch
Auf Opus 5.5 ist adaptives Denken dauerhaft aktiv, effort steuert die Tiefe, und der Standard dieses Modells ist medium, während der Rest der Reihe auf high steht.
Zwei Folgen. Erstens bekommt eine schlichte Portierung eines Opus-5-Aufrufs, der sich auf den Standard verließ, ein flacheres Modell als zuvor, was wie ein Qualitätsrückschritt aussieht und in Wahrheit eine Konfigurationsänderung ist. Zweitens ist jeder veröffentlichte Benchmark für Opus 5.5, einschließlich der $5.98 in diesem Artikel, bei max effort gemessen. Keine dieser Zahlen beschreibt den Standard.
Fällt die Qualität nach der Portierung, erhöhen Sie den Aufwand, bevor Sie das Modell beschuldigen. Steigen die Kosten, senken Sie ihn.
Welches ich nehmen würde
Opus 5 hat ehrlich gesagt keinen verbleibenden Fall. Es ist auf jeder Zeile teurer, sieben Punkte zurück, und Artificial Analysis hat es als veraltet markiert. Die Frage ist nicht, ob Sie wechseln, sondern wie.
| Die Lage | Tun Sie das | Warum |
|---|---|---|
| Cache-lastige Agentenschleifen auf Opus 5 | Jetzt wechseln | Cache-Lesungen fallen um 60%. Das ist die grösste Einzelzeile dieser Rechnung. |
| Code mit erzwungener Werkzeugnutzung oder abgeschaltetem Denken | Erst reparieren, dann wechseln | Beides gibt auf Opus 5.5 eine 400 zurück. Die Portierung scheitert laut beim ersten Aufruf. |
| Oberfläche, die Fortschritt zwischen Werkzeugaufrufen streamt | display setzen, dann wechseln | Kein Fehler, nur Stille. Schlimmer als ein Ausfall, weil nichts Sie alarmiert. |
| Kosten sind bereits die Grenze | Wechseln und Aufwand senken | Die Ersparnis kommt aus medium effort, nicht aus der Modell-ID. Max effort mass 2% mehr je Aufgabe. |
| Gespräche, die zu Fable oder Mythos springen | Denkblöcke prüfen | Opus 5.5 liest keine Denkblöcke von Fable oder Mythos. |
Der Umstieg lohnt sich. Planen Sie einen Nachmittag für die vier brechenden Änderungen ein, statt ihn wie einen Textaustausch zu behandeln.
Für die anbieterübergreifende Fassung dieser Entscheidung enthält GPT-6 Sol gegen Opus 5.5 die Rechnung je Aufgabe. Alle weiteren Paarungen stehen im Modellvergleich.
Was meine Meinung ändern würde
Eine Messung bei medium effort. Jede Zahl je Aufgabe hier ist max effort auf einem Modell, dessen Standard medium ist, und der Abstand könnte sich beim Standard umkehren.
Beide Fragen, mit denen dieser Abschnitt einmal öffnete, sind inzwischen beantwortet, und beide gingen zugunsten von Opus 5.5 aus. Es erzeugt etwa 95 Ausgabetoken pro Sekunde gegen 54 bei Opus 5, und im Coding Agent Index erreicht Claude Code mit Opus 5.5 66 Punkte zu $13.04 je Aufgabe gegen Opus 5 mit 60 zu $10.79. Sechs Punkte für 21% mehr je Aufgabe ist das klarste Argument für den Umstieg auf dieser Seite.
Fragen, die gestellt wurden
Ist Claude Opus 5.5 günstiger als Claude Opus 5?
Pro Token ja, um 20%: $4 je Million Eingabetoken und $20 Ausgabe gegen $5 und $25. Cache-Lesungen fallen stärker, von $0.50 auf $0.20, weil Anthropic Cache-Treffer auf Opus 5.5 mit 0,05x der Basiseingabe bepreist statt der üblichen 0,1x. Je fertiger Aufgabe ist es nicht automatisch. Artificial Analysis mass $5.98 je Indexaufgabe auf Opus 5.5 und $5.86 auf Opus 5, weil das neuere Modell bei max effort 260 Millionen Token schrieb gegen 140 Millionen des älteren.
Ist Claude Opus 5.5 besser als Claude Opus 5?
Ja, um sieben Punkte im unabhängigen Index. Artificial Analysis bewertet Opus 5.5 mit 58 und Opus 5 mit 51 im Intelligence Index v4.3.2, womit Opus 5.5 auf Platz eins von 212 Modellen steht, wo Opus 5 auf Platz elf sass. Anthropic hat zudem seine eigene Standardempfehlung auf Opus 5.5 umgestellt, und Artificial Analysis markiert Opus 5 inzwischen als veraltet.
Was bricht beim Umstieg von Claude Opus 5 auf Opus 5.5?
Vier Dinge, laut Anthropics eigenen Migrationsnotizen. Denken lässt sich nicht abschalten, eine Anfrage mit thinking type disabled oder manuellem Token-Budget gibt 400 zurück. Erzwungene Werkzeugnutzung entfällt, tool_choice auf any oder auf ein benanntes Werkzeug gibt 400 zurück. Denkblöcke sind an das erzeugende Modell gebunden, Gespräche zwischen Modellfamilien brauchen also Sorgfalt. Und auf der Claude API sowie Google Cloud wird das ältere Werkzeug computer_20251124 nicht akzeptiert. Eine fünfte Änderung ist leiser: Text zwischen Werkzeugaufrufen kommt nun in Denkblöcken an, die bei der Standardanzeige leer sind, Fortschrittsströme verstummen also, bis Sie diese Einstellung ändern.
Soll ich von Claude Opus 5 auf Opus 5.5 umsteigen?
Ja, aber messen Sie die Ersparnis, statt sie anzunehmen. Der Preis je Token ist 20% niedriger, Cache-Lesungen 60% niedriger, und das Modell löst mehr. Anthropics eigene Spanne für den Umstieg reicht von etwa 40% weniger bis etwa 20% mehr je gelöster Aufgabe, und der unabhängige Indexlauf kam 2% höher heraus. Senken Sie nach der Portierung den Aufwand, denn der Standard wanderte von high auf medium, und alle veröffentlichten Vergleiche sind bei max gemessen.
Wenn Sie diese Migration über einen produktiven Agenten-Stack planen, ist die Kontaktseite der schnellste Weg zu mir.



