Claude Opus 5.5 schlägt GPT-6 Astra in jedem Wert und kostet trotzdem mehr, um die Arbeit zu beenden
Opus 5.5 erreicht 58 gegen Astras 53, kostet 60% weniger je Token und stellt dennoch 5,98 Dollar je Aufgabe in Rechnung gegen 3,26. Es schreibt 260 Mio. Token gegen Astras 60 Mio.
GTM Architect & Growth Operator · Insights · 28. September 2026 · 8 Min. Lesezeit
Kurzfassung · Die wichtigsten Punkte
- Artificial Analysis bewertet Claude Opus 5.5 mit 58 und GPT-6 Astra mit 53. Opus 5.5 steht auf Platz eins von 211 Modellen, Astra auf Platz sechs. Opus 5.5 listet zudem 60% günstiger je Token, 4 / 20 Dollar gegen 10 / 50 Dollar.
- Trotz beidem ist Astra je fertiger Aufgabe das günstigere Modell: 3,26 gegen 5,98 Dollar. Opus 5.5 schrieb im Indexlauf 260 Millionen Token, Astra 60 Millionen.
- Opus 5.5 erzeugt schneller, etwa 95 Ausgabetoken pro Sekunde gegen 64, und braucht von Anfang bis Ende trotzdem deutlich länger, weil Tempo je Token gegen die vierfache Tokenzahl verliert.
- Als Coding-Agent wiederholt sich dieselbe Form. Claude Code mit Opus 5.5 führt den Coding Agent Index mit 66 gegen Codex mit Astra bei 62 und kostet 13,04 Dollar je Aufgabe in 1,1 Stunden gegen 7,47 Dollar in 29,4 Minuten.
Zwei Spitzenmodelle, und die Anzeigetafel sagt das eine, während die Rechnung das andere sagt.
Claude Opus 5.5 steht auf Platz eins von 211 Modellen im unabhängigen Index. Es ist zudem 60% günstiger je Token als GPT-6 Astra. Beides stimmt, und Astra kostet trotzdem weniger, um eine Aufgabe zu erledigen.
| Info | GPT-6 Astra | Claude Opus 5.5 |
|---|---|---|
| Eingabe / Ausgabe je 1 Mio. | $10 / $50 | $4 / $20 |
| Gecachte Eingabe je 1 Mio. | $1.00 | $0.20 |
| Intelligence Index v4.3.2 | 53 | 58 |
| Rang unter 211 Modellen | 6. | 1. |
| Kosten je Indexaufgabe | $3.26 | $5.98 |
| Im Index erzeugte Token | 60 Mio. | 260 Mio. |
| Ausgabetempo, Token/s | etwa 64 | etwa 95 |
| Über 272K Eingabetoken, ein / aus | $20 / $75 | $4 / $20 |
| Kontext / max. Ausgabe | 1 Mio. / 128K | 1 Mio. / 128K |
| Wissensstand | Apr. 2026 | Juni 2026 |
Preise und die 272K-Regel von OpenAIs Modellseite zu GPT-6 Astra sowie Anthropics Preis- und Modellseiten. Indexwert, Kosten je Aufgabe, Token und Tempo von den Modellseiten von Artificial Analysis, beide bei max effort. Gelesen am 28. September 2026.
Opus 5.5 gewinnt die Anzeigetafel klar
Fünf Punkte im Index, 58 gegen 53, und die Ränge machen das greifbar: Platz eins von 211 gegen Platz sechs. Anthropics eigene Modellseite schickt unsichere Leser nun für die meisten Lasten zu Opus 5.5.
Es hat auch die frischeren Trainingsdaten, Juni 2026 gegen April, was in einem Jahr mehr zählt als sonst, in dem die verglichenen Modelle im September erschienen.
Und verliert die Rechnung
Je Token ist Opus 5.5 mit weitem Abstand das günstige Modell. $4 und $20 gegen $10 und $50. Gecachte Eingabe kostet $0.20 gegen $1, weil Anthropic Cache-Treffer auf diesem Modell mit 0,05x der Basiseingabe bepreist, während der Rest der Reihe 0,1x nutzt.
Dann kommt der gemessene Lauf bei 5,98 Dollar je Aufgabe gegen 3,26 Dollar heraus.
Die gesamte Umkehrung steckt in einer Zeile der Tabelle. Opus 5.5 schrieb im Index 260 Millionen Token, Astra 60 Millionen. Das Vier-ein-Drittel-Fache an Ausgabe, zu 40% des Preises je Token, ergibt unterm Strich etwa 80% mehr auf der Rechnung.
Zwei Modelle, und die günstigere Preisliste gehört dem teureren Modell. Wer aus einer Preisliste statt aus einem gemessenen Lauf budgetiert, stolpert genau über dieses Paar.
Die Tempozahl ist für sich genommen eine Falle
Artificial Analysis misst Opus 5.5 mit etwa 95 Ausgabetoken pro Sekunde und Astra mit etwa 64. Opus 5.5 ist das schnellere Modell, und Artificial Analysis nennt Astra langsamer als der Durchschnitt.
Es wird trotzdem viel später fertig. Token pro Sekunde ist eine Rate, und Opus 5.5 hat den vierfachen Weg vor sich. Im Coding-Benchmark, wo die reale Zeit direkt gemessen wird, liest sich das als 1,1 Stunden je Aufgabe gegen 29,4 Minuten.
Ein schnelleres Modell, das doppelt so lange braucht, ist kein Widerspruch. Es ist der Unterschied zwischen einem Tacho und einer Ankunftszeit, und nur eines von beiden steht in Ihrem Kalender.
Coding-Agenten: dieselbe Form, lauter
Opus 5.5 ist nun im Coding Agent Index von Artificial Analysis, was es beim Erscheinen dieser Modelle noch nicht war.
| Info | Codex + Astra | Claude Code + Opus 5.5 |
|---|---|---|
| Coding Agent Index v1.5 | 62 | 66 |
| DeepSWE v1.1 | 68% | 68% |
| Terminal-Bench 4.0 | 56% | 63% |
| SWE-Atlas-QnA | 62% | 66% |
| Kosten je Aufgabe | $7.47 | $13.04 |
| Zeit je Aufgabe | 29,4 Min. | 1,1 Std. |
| Token je Aufgabe | 3,3 Mio. | 15,6 Mio. |
Coding Agent Index v1.5, jedes Modell in seinem eigenen Harness. Opus 5.5 führt in jedem Benchmark ausser DeepSWE, wo Gleichstand herrscht.
Opus 5.5 nimmt die Spitze dieser Tabelle und führt Terminal-Bench um sieben Punkte, den Benchmark, der ein Modell, das Code schreibt, von einem trennt, das eine Umgebung steuern kann. Es stellt 75% mehr je Aufgabe in Rechnung und braucht dafür mehr als die doppelte reale Zeit.
Beachten Sie den Vorbehalt zum Harness, der für jede Zeile hier gilt: Astras Zahlen stammen aus Codex und die von Opus 5.5 aus Claude Code, und der Harness verschiebt Ergebnisse ebenso stark wie das Modell.
Die 272K-Linie gehört weiterhin Anthropic
OpenAI bepreist einen Astra-Prompt oberhalb von 272K Eingabetoken für die gesamte Anfrage neu: doppelte Eingabe und Cache, anderthalbfache Ausgabe, also $20 / $75. Anthropic rechnet das volle 1-Millionen-Fenster von Opus 5.5 zu einem Satz ab.
Jenseits dieser Linie kostet Opus 5.5 ein Fünftel von Astra bei der Eingabe und unter einem Drittel bei der Ausgabe, obendrauf auf den ohnehin günstigeren Preis je Token. Für lange Dokumente, grosse im Kontext gehaltene Codebasen oder jede Schleife, deren Gespräch über 272K wächst, schützt die obige Umkehrung je Aufgabe Astra nicht mehr.
Welches ich nehmen würde
| Die Arbeit | Modell | Warum |
|---|---|---|
| Die Antwort entscheidet das Ergebnis | Claude Opus 5.5 | Platz eins von 211, und es führt jeden Coding-Benchmark ausser dem, in dem Gleichstand herrscht. |
| Hohe Menge, Zahlung je fertiger Aufgabe | GPT-6 Astra | $3.26 gegen $5.98 im Index, $7.47 gegen $13.04 beim Programmieren. |
| Jemand wartet darauf | GPT-6 Astra | 29,4 Minuten gegen 1,1 Stunden, obwohl es je Token das langsamere Modell ist. |
| Prompts, die 272K Token überschreiten | Claude Opus 5.5 | Ein Satz über 1 Million, während sich Astras gesamte Anfrage bei der Eingabe verdoppelt. |
| Cache-lastige Agentenschleifen | Claude Opus 5.5 | $0.20 gegen $1 auf der Zeile, die die Rechnung einer langen Schleife dominiert. |
| Ein Terminal steuern | Claude Opus 5.5 | Sieben Punkte auf Terminal-Bench 4.0, dem Benchmark, der das Schreiben von Code vom Ausführen trennt. |
Opus 5.5 für Qualität, lange Prompts und cache-lastige Schleifen. Astra für Durchsatz und für alles, worauf ein Mensch wartet.
Innerhalb von OpenAIs Reihe ist Sol gegen Astra die günstigere Fassung dieser Entscheidung. Gegen Anthropics eigenen Schritt nach oben behandelt Opus 5.5 gegen Opus 5 die vier brechenden Änderungen des Umstiegs.
Was meine Meinung ändern würde
Beide Modelle in einem Harness. Jede Coding-Zahl hier ist Astra in Codex gegen Opus 5.5 in Claude Code, und das sind zwei Variablen, die sich gleichzeitig bewegen.
Ein Effort-Durchlauf. Opus 5.5 steht standardmässig auf medium, und jede Zahl oben ist max effort, woher seine 260 Millionen Token stammen. Der Abstand je Aufgabe könnte sich beim Standard schliessen oder umkehren.
Eine Änderung der 272K-Regel. Sie ist die einzige Zeile, die Opus 5.5 bei langen Prompts um ein Mehrfaches günstiger macht.
Fragen, die gestellt wurden
Ist Claude Opus 5.5 besser als GPT-6 Astra?
In jedem veröffentlichten Wert ja. Artificial Analysis setzt Opus 5.5 auf 58 im Intelligence Index v4.3.2 und Astra auf 53, womit Opus 5.5 Platz eins von 211 Modellen belegt und Astra Platz sechs. Im Coding-Harness hält dieselbe Reihenfolge: Claude Code mit Opus 5.5 erreicht 66, Codex mit Astra 62, und Opus 5.5 führt Terminal-Bench 4.0 um sieben Punkte und SWE-Atlas-QnA um vier, bei einem Gleichstand auf DeepSWE v1.1 mit 68%.
Was ist günstiger, GPT-6 Astra oder Claude Opus 5.5?
Es hängt davon ab, welche Zahl Sie meinen, und die beiden widersprechen sich. Je Token ist Opus 5.5 um 60% günstiger: $4 Eingabe und $20 Ausgabe je Million gegen Astras $10 und $50, und $0.20 gegen $1 für gecachte Eingabe. Je fertiger Aufgabe ist Astra um 45% günstiger: Artificial Analysis mass $3.26 gegen $5.98, weil Opus 5.5 im Indexlauf 260 Millionen Token erzeugte und Astra 60 Millionen. Bei Coding-Aufgaben weitet sich der Abstand auf $7.47 gegen $13.04.
Was ist schneller, GPT-6 Astra oder Claude Opus 5.5?
Opus 5.5 erzeugt schneller und wird später fertig. Artificial Analysis misst etwa 95 Ausgabetoken pro Sekunde für Opus 5.5 und etwa 64 für Astra, aber Opus 5.5 schreibt rund viermal so viele Token und verbringt daher deutlich mehr Zeit mit derselben Arbeit. Im Coding-Benchmark zeigt sich das als 1,1 Stunden je Aufgabe gegen 29,4 Minuten.
Soll ich GPT-6 Astra oder Claude Opus 5.5 einsetzen?
Opus 5.5, wenn die Qualität der Antwort das Ergebnis entscheidet, wenn Prompts lang werden oder wenn die Arbeit ohnehin in Claude Code liegt: Es erreicht überall mehr Punkte, kostet bei gecachter Eingabe ein Fünftel von Astra und hält einen Satz über sein gesamtes 1-Millionen-Fenster. Astra, wenn Sie je fertiger Aufgabe zahlen und die Menge hoch ist, oder wenn ein Mensch wartet, denn es kostet etwa halb so viel je Aufgabe und liefert in einem Bruchteil der Zeit.
Wenn Sie ein Spitzenmodell für ein agentisches Produkt wählen und die Routing-Regel schriftlich haben wollen, ist die Kontaktseite der schnellste Weg zu mir.



