Claude Opus 5.5 hat den Index gewonnen. GPT-6 Sol hat die Rechnung gewonnen.
Opus 5.5 erreicht 58 gegen Sols 48 und kostet 5,98 Dollar pro Aufgabe gegen 1,06. Beide lesen Cache zu 0,20 Dollar. Wo der Abstand echt ist und wo er verschwindet.
GTM Architect & Growth Operator · Insights · 23. September 2026 · 8 Min. Lesezeit
Kurzfassung · Die wichtigsten Punkte
- Artificial Analysis bewertet Claude Opus 5.5 mit 58 und GPT-6 Sol mit 48 im Intelligence Index v4.3.2. Opus 5.5 steht auf Platz eins von 212 Modellen, Sol auf Platz achtzehn.
- Pro Token ist Opus 5.5 exakt doppelt so teuer wie Sol: 4 / 20 Dollar gegen 2 / 10 Dollar. Pro Aufgabe im Index sind es 5,6-mal, 5,98 gegen 1,06 Dollar, weil es bei max effort 260 Millionen Token schrieb gegen Sols 77 Millionen.
- Beide Modelle lesen Cache zu 0,20 Dollar je Million Token. In einer Agentenschleife, die den Grossteil ihrer Eingabe aus dem Cache liest, ist die Eingabeseite der Rechnung ein Unentschieden und der gesamte Abstand steckt in der Ausgabe.
- Die 5,98 Dollar sind Opus 5.5 bei max effort. Der API-Standard ist medium, diese Zahl ist also die Obergrenze des Modells, nicht der Preis seiner Nutzung.
Zwei Anbieter haben am selben Tag einen neuen Standard veröffentlicht. OpenAI stellte GPT-6 Sol zu $2 / $10 in die API. Anthropic setzte Claude Opus 5.5 zu $4 / $20 an die Spitze seiner Reihe und empfahl allen, dort anzufangen.
Die Preisliste sagt, das eine sei doppelt so teuer wie das andere. Der unabhängige Index sagt zehn Punkte. Die Rechnung sagt das 5,6-Fache. Alle drei stimmen, und der Unterschied zwischen ihnen ist genau der Ort, an dem die operative Entscheidung liegt.
| Info | GPT-6 Sol | Claude Opus 5.5 |
|---|---|---|
| Eingabe / Ausgabe je 1 Mio. | $2 / $10 | $4 / $20 |
| Gecachte Eingabe je 1 Mio. | $0.20 | $0.20 |
| Intelligence Index v4.3.2 | 48 | 58 |
| Rang unter 212 Modellen | 18. | 1. |
| Kosten je Indexaufgabe | $1.06 | $5.98 |
| Im Index erzeugte Token | 77 Mio. | 260 Mio. |
| Ausgabetempo, Token/s | etwa 125 | etwa 95 |
| Kontext / max. Ausgabe | 1.050.000 / 128.000 | 1 Mio. / 128K |
| Wissensstand | 20. Apr. 2026 | Juni 2026 |
| Standard-Denkaufwand | medium | medium |
Preise und Limits von OpenAIs Modellseite zu GPT-6 Sol sowie Anthropics Preis- und Modellseiten. Indexwert, Kosten je Aufgabe, Tokenzahl und Tempo von den Modellseiten von Artificial Analysis, gemessen bei max effort. Gelesen am 23. September 2026.
Zehn Punkte, und sie sind echt
Artificial Analysis bewertet Opus 5.5 mit 58 und Sol mit 48 im Intelligence Index v4.3.2. Das ist kein Rundungsabstand. Opus 5.5 steht auf Platz eins der 212 Modelle seiner Klasse. Sol steht auf Platz achtzehn.
Zehn Punkte kaufen etwas. Sie kaufen es nicht billig, und die beiden Modelle konkurrieren nicht um denselben Platz. OpenAI beschreibt Sol als gebaut für komplexes Programmieren und agentische Workflows, bepreist darauf, viele davon zu fahren. Anthropic sagt Ihnen, Sie sollen mit Opus 5.5 für die meisten Lasten anfangen und erst dann auf Fable 5.1 hochgehen, wenn Opus 5.5 bei höherem Aufwand weiterhin zu kurz greift.
Die Zahl je Aufgabe ist 5,6-mal, und Wortfülle ist der Grund
Pro Token beträgt der Abstand exakt zwei. Pro Aufgabe im selben Index sind es 5,98 gegen 1,06 Dollar.
Der Faktor kommt aus dem Ausgabevolumen. Im Indexlauf erzeugte Opus 5.5 260 Millionen Token, Sol 77 Millionen. Artificial Analysis nennt Opus 5.5 sehr wortreich gegenüber einem Median von 88 Millionen und nennt Sol recht knapp. Ein Modell, das ausführlich denkt, zahlt für dieses Denken zweimal: einmal in Token, einmal in der Ausgaberate.
Der Preis je Token unterschätzt diesen Abstand um den Faktor drei. Wer aus einer Preisliste statt aus einem gemessenen Lauf budgetiert, liegt in der teuren Richtung falsch.
Die Zeile, die niemand in eine Ankündigung schrieb: Cache-Lesungen sind gleichauf
Sol liest gecachte Eingabe zu $0.20 je Million, das sind 10% seines Eingabesatzes von $2. Opus 5.5 liest gecachte Eingabe zu $0.20 je Million, das sind 5% seines Satzes von $4. Anthropic hat den Faktor eigens für dieses Modell geändert: Cache-Treffer auf Opus 5.5 kosten das 0,05-Fache der Basiseingabe, während der Rest der Reihe das 0,1-Fache nutzt. Opus 5 las Cache zu $0.50.
Die beiden Modelle verlangen also denselben Preis dafür, einen Prompt erneut zu lesen.
Das wiegt schwerer, als es klingt, denn Agentenschleifen bestehen überwiegend aus Cache-Lesungen. Anthropics eigener Kostenleitfaden berichtet, dass Agentenschleifen über einen vollen Tag echten Verkehrs im Median 84% ihrer Eingabe aus dem Cache lesen, und das oberste Zehntel der Harnesses liest 94% oder mehr. In einer solchen Schleife ist die Eingabeseite der Rechnung ein Unentschieden, und jeder Dollar Unterschied sind Ausgabetoken.
| Wohin das Geld geht | GPT-6 Sol | Claude Opus 5.5 | Abstand |
|---|---|---|---|
| Gecachte Eingabe, das Gros einer Agentenschleife | $0.20 | $0.20 | keiner |
| Frische Eingabe | $2 | $4 | 2x |
| Ausgabe | $10 | $20 | 2x |
| Tatsächlich geschriebene Ausgabetoken | 77 Mio. | 260 Mio. | 3,4x |
Je Million Token. Das Zusammenwirken der letzten beiden Zeilen macht aus einer Preisliste mit Faktor 2 eine Rechnung mit Faktor 5,6.
5,98 Dollar sind die Obergrenze, nicht der Preis
Der Wert von Artificial Analysis ist Opus 5.5 bei max effort mit Standard-Fallback. Der API-Standard des Modells ist medium.
Anthropic hat adaptives Denken bei Opus 5.5 dauerhaft aktiviert und die Steuerung der Denktiefe auf den Effort-Parameter verlegt, dessen Standard bei diesem Modell medium ist statt des sonst üblichen high. Jeder Vergleich, den Sie diese Woche lesen, zitiert die Zahl bei max effort, weil das die Zahl ist, die Artificial Analysis veröffentlicht. Ihre Schleife läuft dort nicht, solange Sie sie nicht dorthin stellen.
Behandeln Sie 5,98 Dollar als das, was das Modell kostet, wenn Sie alles von ihm verlangen, und senken Sie den Aufwand, bevor Sie es für zu teuer erklären.
Coding-Agenten: die Messung ist unvollständig, und das zählt
Im Coding Agent Index v1.5 von Artificial Analysis erreicht Codex mit GPT-6 Sol 57 Punkte zu $2.99 je Aufgabe in 22,3 Minuten. Der nächste Anthropic-Eintrag war Claude Code mit Opus 5, bei 60 Punkten und $10.79 je Aufgabe über 41,9 Minuten.
Opus 5.5 ist inzwischen gemessen und führt diese Tabelle an: Claude Code mit Opus 5.5 erreicht 66 Punkte zu $13.04 je Aufgabe über 1,1 Stunden. Vier Punkte und die vierfache Rechnung gegenüber Sol, für Arbeit, die dreimal so lange dauert. Der Harness verschiebt die Ergebnisse ebenso stark wie das Modell, und Sols eigene Zahlen zeigen warum: Es schlägt Astra auf DeepSWE v1.1 mit 69% gegen 68% und verliert Terminal-Bench 4.0 um dreizehn Punkte. Ein Modell, zwei sehr verschiedene Antworten, je nach Benchmark.
Welches ich nehmen würde
| Die Arbeit | Modell | Warum |
|---|---|---|
| Agentisches Programmieren in Menge, mit Tests oder Prüfer | GPT-6 Sol | $1.06 gegen $5.98 je Aufgabe. Fehlschläge auf einer höheren Stufe wiederholen, statt Tiefe in jedem Lauf zu bezahlen. |
| Der härteste Denkschritt in einer Schleife | Claude Opus 5.5 | Platz eins von 212 im Index. Zehn Punkte lohnen sich bei dem Schritt, der das Ergebnis entscheidet. |
| Aufteilung in Ausführer und Berater | Beide | Sol hält die Schleife, Opus 5.5 wird befragt, wenn sie feststeckt. Zuerst den Berater allein bepreisen und die Konsultationsrate messen. |
| Cache-lastige, lang laufende Agenten | Näher als es aussieht | Beide lesen Cache zu $0.20. Vergleichen Sie über Ausgabetoken, nicht über die Eingabezeile. |
| Team ohnehin auf Anthropics Plattform | Claude Opus 5.5 | Anthropics eigene Standardempfehlung, und 20% günstiger je Token als das Opus 5, auf dem Sie sitzen. |
Sol gewinnt die Menge. Opus 5.5 gewinnt den harten Schritt. Die meisten Produktionsschleifen wollen eine Regel, die je Anfrage zwischen beiden wählt.
Für die Anthropic-Seite des Umstiegs behandelt Opus 5.5 gegen Opus 5 die vier brechenden Änderungen, an denen eine naive Portierung scheitert. Für die OpenAI-Seite ist Sol gegen Astra die Routing-Entscheidung innerhalb eines Anbieters.
Was meine Meinung ändern würde
Ein Effort-Durchlauf bei medium. Jede Zahl je Aufgabe hier ist max effort. Der Standard des Modells ist medium, und der Abstand beim Standard könnte halb so gross sein, wie er aussieht.
Fragen, die gestellt wurden
Ist Claude Opus 5.5 besser als GPT-6 Sol?
Im unabhängigen Index eindeutig. Artificial Analysis bewertet Claude Opus 5.5 mit 58 und GPT-6 Sol mit 48 im Intelligence Index v4.3.2, womit Opus 5.5 auf Platz eins von 212 Modellen steht und Sol auf Platz achtzehn. Beide zielen nicht auf dieselbe Aufgabe: OpenAI beschreibt Sol als gebaut für komplexes Programmieren und agentische Workflows zu $2 / $10, Anthropic empfiehlt Opus 5.5 als Standard für die meisten Lasten zu $4 / $20.
Wie viel teurer ist Claude Opus 5.5 als GPT-6 Sol?
Doppelt pro Token und 5,6-mal pro Aufgabe. Opus 5.5 listet zu $4 je Million Eingabetoken und $20 Ausgabe gegen Sols $2 und $10. Artificial Analysis mass $5.98 pro Aufgabe für den Indexlauf auf Opus 5.5 bei max effort und $1.06 auf Sol, weil Opus 5.5 im Lauf 260 Millionen Token erzeugte gegen Sols 77 Millionen. Gecachte Eingabe kostet bei beiden $0.20 je Million.
Was ist schneller, GPT-6 Sol oder Claude Opus 5.5?
Sol. Artificial Analysis misst etwa 125 Ausgabetoken pro Sekunde für Sol und etwa 95 für Opus 5.5, und Sol schreibt zudem rund ein Drittel so viele Token pro Aufgabe. Es ist also aus zwei getrennten Gründen früher fertig, nicht aus einem.
Soll ich GPT-6 Sol oder Claude Opus 5.5 einsetzen?
Sol für agentisches Programmieren in Menge, wo Sie die Ausgabe prüfen können, und für alles, wo die Kosten je fertiger Aufgabe die Architektur entscheiden. Opus 5.5 für den härtesten Denkschritt in der Schleife, für Teams, die ohnehin auf Anthropics Plattform arbeiten, und als beratendes Modell, das ein günstigerer Ausführer anruft, wenn er feststeckt. Routen Sie zwischen beiden, statt einen Standard zu wählen.
Wenn Sie eine Modellstufe für ein agentisches Produkt wählen und die Routing-Regel schriftlich haben wollen, ist die Kontaktseite der schnellste Weg zu mir.



