Claude Opus 5.5 jest dziesięć punktów przed GPT-6 Sol. Kosztuje 5,6 raza więcej za zadanie.
Opus 5.5 ma 58, Sol 48, a zadanie kosztuje $5,98 wobec $1,06. Cache obaj czytają po $0,20. Gdzie różnica jest realna, a gdzie znika.
GTM Architect & Growth Operator · Insights · 23 września 2026 · 8 min czytania
TL;DR · Najważniejsze wnioski
- Artificial Analysis daje Claude Opus 5.5 wynik 58, a GPT-6 Sol 48 w Intelligence Index v4.3.2. Opus 5.5 jest pierwszy na 212 modeli. Sol osiemnasty.
- Za token Opus 5.5 kosztuje dokładnie dwa razy tyle co Sol: $4 / $20 wobec $2 / $10. Na zadanie już 5,6 raza, $5,98 wobec $1,06, bo przy max effort wypisał 260 mln tokenów wobec 77 mln Sola.
- Oba modele czytają cache po $0,20 za milion tokenów. W pętli agentowej, która większość wejścia czyta z cache, strona wejściowa rachunku to remis, a cała różnica siedzi w wyjściu.
- Te $5,98 to Opus 5.5 przy max effort. Domyślny poziom w API to medium, więc ta liczba jest sufitem modelu, a nie ceną korzystania z niego.
Dwóch dostawców wypuściło nowy model domyślny tego samego dnia. OpenAI wstawiło do API GPT-6 Sol po $2 / $10. Anthropic postawiło Claude Opus 5.5 na szczycie swojej linii po $4 / $20 i powiedziało wszystkim, żeby zaczynali właśnie od niego.
Cennik mówi, że jeden jest dwa razy droższy. Niezależny indeks mówi o dziesięciu punktach. Faktura mówi 5,6 raza. Wszystkie trzy liczby są prawdziwe, a różnica między nimi to miejsce, w którym zapada decyzja operacyjna.
| Info | GPT-6 Sol | Claude Opus 5.5 |
|---|---|---|
| Wejście / wyjście za 1 mln | $2 / $10 | $4 / $20 |
| Cache na wejściu za 1 mln | $0,20 | $0,20 |
| Intelligence Index v4.3.2 | 48 | 58 |
| Miejsce wśród 212 modeli | 18. | 1. |
| Koszt zadania w indeksie | $1,06 | $5,98 |
| Tokeny wygenerowane w indeksie | 77 mln | 260 mln |
| Prędkość wyjścia, tokeny/s | ok. 125 | brak danych |
| Okno / maks. wyjście | 1 050 000 / 128 000 | 1 mln / 128 tys. |
| Granica wiedzy | 20 kwi 2026 | cze 2026 |
| Domyślny poziom rozumowania | medium | medium |
Ceny i limity ze stron modeli OpenAI i ze stron cennika oraz modeli Anthropica. Wynik indeksu, koszt zadania, liczba tokenów i prędkość z kart modeli Artificial Analysis, mierzone przy max effort. Odczyt 23 września 2026.
Dziesięć punktów, i są prawdziwe
Artificial Analysis daje Opusowi 5.5 wynik 58, a Solowi 48 w Intelligence Index v4.3.2. To nie jest różnica w granicach zaokrąglenia. Opus 5.5 stoi pierwszy wśród 212 modeli swojej klasy. Sol osiemnasty.
Dziesięć punktów coś kupuje. Nie kupuje tanio i nie oba modele biją się o to samo miejsce. OpenAI opisuje Sola jako model zbudowany do złożonego kodowania i pracy agentowej, wycenionej tak, żeby dało się jej puścić dużo. Anthropic każe zaczynać od Opusa 5.5 przy większości zadań i przechodzić wyżej, na Fable 5.1, dopiero gdy Opus 5.5 przy wyższym effortcie nadal nie wystarcza.
Na zadanie wychodzi 5,6 raza, i winna jest gadatliwość
Za token różnica to równe dwa. Na to samo zadanie w tym samym indeksie: $5,98 wobec $1,06.
Mnożnik bierze się z objętości wyjścia. Przy przebiegu indeksu Opus 5.5 wygenerował 260 mln tokenów, a Sol 77 mln. Artificial Analysis nazywa Opusa 5.5 bardzo gadatliwym przy medianie 88 mln, a Sola dość zwięzłym. Model, który myśli długo, płaci za to myślenie dwa razy: raz w tokenach, raz w stawce za wyjście.
Cena za token zaniża tę różnicę trzykrotnie. Jeśli budżetujesz z cennika, a nie ze zmierzonego przebiegu, pomylisz się w drogą stronę.
Linia, której nikt nie wstawił do ogłoszenia: odczyty z cache remisują
Sol czyta cache po $0,20 za milion, czyli 10% swojej stawki $2 za wejście. Opus 5.5 czyta cache po $0,20 za milion, czyli 5% swojej stawki $4. Anthropic zmienił mnożnik specjalnie dla tego modelu: trafienia w cache na Opusie 5.5 są liczone jako 0,05x ceny wejścia, kiedy reszta linii używa 0,1x. Opus 5 czytał cache po $0,50.
Czyli oba modele biorą tyle samo za ponowne przeczytanie promptu.
To waży więcej, niż brzmi, bo pętle agentowe to głównie odczyty z cache. Własny poradnik kosztowy Anthropica podaje, że przez cały dzień realnego ruchu pętle agentowe czytają z cache medianę 84% swojego wejścia, a górne dziesięć procent harnessów czyta 94% albo więcej. W takiej pętli strona wejściowa rachunku to remis, a każdy dolar różnicy to tokeny wyjściowe.
| Gdzie idą pieniądze | GPT-6 Sol | Claude Opus 5.5 | Różnica |
|---|---|---|---|
| Cache na wejściu, większość pętli agentowej | $0,20 | $0,20 | brak |
| Świeże wejście | $2 | $4 | 2x |
| Wyjście | $10 | $20 | 2x |
| Realnie wypisane tokeny wyjściowe | 77 mln | 260 mln | 3,4x |
Za milion tokenów. Złożenie dwóch ostatnich wierszy zamienia dwukrotny cennik w 5,6-krotny rachunek.
$5,98 to sufit, nie cena
Liczba z Artificial Analysis to Opus 5.5 przy max effort z domyślnym fallbackiem. Domyślny poziom w API dla tego modelu to medium.
Anthropic włączył w Opusie 5.5 adaptacyjne myślenie na stałe i przeniósł sterowanie nim do parametru effort, którego domyślna wartość na tym modelu to medium, a nie high używane w większości linii. Każde porównanie, które przeczytasz w tym tygodniu, cytuje liczbę z max effort, bo to jest liczba, którą Artificial Analysis publikuje. Twoja pętla tam nie pojedzie, jeśli jej tam nie postawisz.
Traktuj $5,98 jako cenę za wyciśnięcie z modelu wszystkiego i zjedź z effortem w dół, zanim uznasz, że jest za drogi.
Agenci programistyczni: pomiar jest niepełny i to ma znaczenie
W Coding Agent Index v1.5 od Artificial Analysis Codex na GPT-6 Sol ma 57 przy $2,99 na zadanie i 22,3 minuty. Najbliższy wpis Anthropica to Claude Code na Opusie 5, z wynikiem 60 przy $10,79 na zadanie i 41,9 minuty.
Opusa 5.5 w tej tabeli jeszcze nie ma. Kto w tym tygodniu mówi ci, jak Opus 5.5 radzi sobie jako agent programistyczny, ekstrapoluje z wyniku indeksu, a harness przesuwa rezultaty tak samo mocno jak model. Widać to po samym Solu: wygrywa z Astrą na DeepSWE v1.1, 69% do 68%, i przegrywa Terminal-Bench 4.0 o trzynaście punktów. Jeden model, dwie zupełnie różne odpowiedzi zależnie od benchmarku.
Czego bym użył
| Rodzaj pracy | Model | Dlaczego |
|---|---|---|
| Masowe kodowanie agentowe z testami albo weryfikatorem | GPT-6 Sol | $1,06 wobec $5,98 na zadanie. Puść wszystko tanio i powtórz same porażki wyżej. |
| Najtrudniejszy krok rozumowania w pętli | Claude Opus 5.5 | Pierwszy na 212 modeli. Dziesięć punktów warto kupić na kroku, który decyduje o wyniku. |
| Podział na wykonawcę i doradcę | Oba | Sol trzyma pętlę, Opus 5.5 dostaje pytanie, gdy Sol utknie. Najpierw wyceń samego doradcę i zmierz, jak często jest wołany. |
| Długie pętle oparte na cache | Bliżej niż wygląda | Oba czytają cache po $0,20. Porównuj po tokenach wyjściowych, nie po linii wejścia. |
| Zespół już na platformie Anthropica | Claude Opus 5.5 | Domyślna rekomendacja samego Anthropica i 20% taniej za token niż Opus 5, na którym siedzisz. |
Sol wygrywa objętość. Opus 5.5 wygrywa trudny krok. Większość produkcyjnych pętli chce reguły, która wybiera między nimi per zapytanie.
Stronę Anthropica tej decyzji opisuje Opus 5.5 kontra Opus 5, razem z czterema łamiącymi zmianami, które wywrócą naiwny port. Stronę OpenAI opisuje Sol kontra Astra, czyli ta sama decyzja o routingu wewnątrz jednego dostawcy.
Co zmieniłoby moje zdanie
Opus 5.5 w zmierzonym harnessie. Wynik z Claude Code w Coding Agent Index domknąłby tę część porównania, która dziś jest wnioskowaniem.
Opublikowana prędkość Opusa 5.5 przy max effort. Na razie połowa pytania o opóźnienie nie ma odpowiedzi.
Przebieg przy effortcie medium. Każda liczba kosztu na zadanie w tym tekście to max effort. Domyślny poziom modelu to medium, a różnica przy domyślnych ustawieniach może być o połowę mniejsza.
Pytania, które padają
Czy Claude Opus 5.5 jest lepszy od GPT-6 Sol?
W niezależnym indeksie wyraźnie tak. Artificial Analysis daje Claude Opus 5.5 wynik 58, a GPT-6 Sol 48 w Intelligence Index v4.3.2, co stawia Opusa 5.5 na pierwszym miejscu wśród 212 modeli, a Sola na osiemnastym. Tylko że nie celują w to samo zadanie: OpenAI opisuje Sola jako model do złożonego kodowania i pracy agentowej po $2 / $10, a Anthropic poleca Opusa 5.5 jako domyślny wybór do większości zadań po $4 / $20.
O ile Claude Opus 5.5 jest droższy od GPT-6 Sol?
Dwa razy za token i 5,6 raza na zadanie. Opus 5.5 kosztuje $4 za milion tokenów wejściowych i $20 za wyjściowe wobec $2 i $10 Sola. Artificial Analysis zmierzyło $5,98 na zadanie przy przebiegu indeksu na Opusie 5.5 przy max effort i $1,06 na Solu, bo Opus 5.5 wygenerował 260 mln tokenów wobec 77 mln Sola. Cache kosztuje $0,20 za milion w obu.
Co jest szybsze, GPT-6 Sol czy Claude Opus 5.5?
Sol, i to wyraźnie, na tym co zmierzono. Artificial Analysis podaje dla Sola ok. 125 tokenów wyjściowych na sekundę, trzydzieste drugie miejsce na 212 modeli, a dla Opusa 5.5 przy max effort nie publikuje wyniku prędkości. Sol pisze też około trzy razy mniej tokenów na zadanie, więc kończy wcześniej z dwóch niezależnych powodów.
Wybierać GPT-6 Sol czy Claude Opus 5.5?
Sola do masowej pracy agentowej, którą możesz sprawdzić, i wszędzie tam, gdzie o architekturze decyduje koszt ukończonego zadania. Opusa 5.5 do najtrudniejszego kroku w pętli, dla zespołów już siedzących na platformie Anthropica i jako model doradczy, do którego tańszy wykonawca dzwoni, kiedy utknie. Routuj między nimi zamiast wybierać jeden domyślny.
Jeśli wybierasz poziom modelu do produktu agentowego i chcesz mieć spisaną regułę routingu, strona kontaktowa to najszybsza droga do mnie.



