Przejdź do treści
wojciech.io
Wszystkie spostrzeżenia
AI SystemsAIOpenAIClaudeAI Systems

Claude Opus 5.5 jest dziesięć punktów przed GPT-6 Sol. Kosztuje 5,6 raza więcej za zadanie.

Opus 5.5 ma 58, Sol 48, a zadanie kosztuje $5,98 wobec $1,06. Cache obaj czytają po $0,20. Gdzie różnica jest realna, a gdzie znika.

Wojciech Łuszczyński

Wojciech Łuszczyński

GTM Architect & Growth Operator · Insights · 23 września 2026 · 8 min czytania

Udostępnij

TL;DR · Najważniejsze wnioski

  • Artificial Analysis daje Claude Opus 5.5 wynik 58, a GPT-6 Sol 48 w Intelligence Index v4.3.2. Opus 5.5 jest pierwszy na 212 modeli. Sol osiemnasty.
  • Za token Opus 5.5 kosztuje dokładnie dwa razy tyle co Sol: $4 / $20 wobec $2 / $10. Na zadanie już 5,6 raza, $5,98 wobec $1,06, bo przy max effort wypisał 260 mln tokenów wobec 77 mln Sola.
  • Oba modele czytają cache po $0,20 za milion tokenów. W pętli agentowej, która większość wejścia czyta z cache, strona wejściowa rachunku to remis, a cała różnica siedzi w wyjściu.
  • Te $5,98 to Opus 5.5 przy max effort. Domyślny poziom w API to medium, więc ta liczba jest sufitem modelu, a nie ceną korzystania z niego.

Dwóch dostawców wypuściło nowy model domyślny tego samego dnia. OpenAI wstawiło do API GPT-6 Sol po $2 / $10. Anthropic postawiło Claude Opus 5.5 na szczycie swojej linii po $4 / $20 i powiedziało wszystkim, żeby zaczynali właśnie od niego.

Cennik mówi, że jeden jest dwa razy droższy. Niezależny indeks mówi o dziesięciu punktach. Faktura mówi 5,6 raza. Wszystkie trzy liczby są prawdziwe, a różnica między nimi to miejsce, w którym zapada decyzja operacyjna.

InfoGPT-6 SolClaude Opus 5.5
Wejście / wyjście za 1 mln$2 / $10$4 / $20
Cache na wejściu za 1 mln$0,20$0,20
Intelligence Index v4.3.24858
Miejsce wśród 212 modeli18.1.
Koszt zadania w indeksie$1,06$5,98
Tokeny wygenerowane w indeksie77 mln260 mln
Prędkość wyjścia, tokeny/sok. 125brak danych
Okno / maks. wyjście1 050 000 / 128 0001 mln / 128 tys.
Granica wiedzy20 kwi 2026cze 2026
Domyślny poziom rozumowaniamediummedium

Ceny i limity ze stron modeli OpenAI i ze stron cennika oraz modeli Anthropica. Wynik indeksu, koszt zadania, liczba tokenów i prędkość z kart modeli Artificial Analysis, mierzone przy max effort. Odczyt 23 września 2026.

Dziesięć punktów, i są prawdziwe

Artificial Analysis daje Opusowi 5.5 wynik 58, a Solowi 48 w Intelligence Index v4.3.2. To nie jest różnica w granicach zaokrąglenia. Opus 5.5 stoi pierwszy wśród 212 modeli swojej klasy. Sol osiemnasty.

Dziesięć punktów coś kupuje. Nie kupuje tanio i nie oba modele biją się o to samo miejsce. OpenAI opisuje Sola jako model zbudowany do złożonego kodowania i pracy agentowej, wycenionej tak, żeby dało się jej puścić dużo. Anthropic każe zaczynać od Opusa 5.5 przy większości zadań i przechodzić wyżej, na Fable 5.1, dopiero gdy Opus 5.5 przy wyższym effortcie nadal nie wystarcza.

Na zadanie wychodzi 5,6 raza, i winna jest gadatliwość

Za token różnica to równe dwa. Na to samo zadanie w tym samym indeksie: $5,98 wobec $1,06.

Mnożnik bierze się z objętości wyjścia. Przy przebiegu indeksu Opus 5.5 wygenerował 260 mln tokenów, a Sol 77 mln. Artificial Analysis nazywa Opusa 5.5 bardzo gadatliwym przy medianie 88 mln, a Sola dość zwięzłym. Model, który myśli długo, płaci za to myślenie dwa razy: raz w tokenach, raz w stawce za wyjście.

Key takeaway

Cena za token zaniża tę różnicę trzykrotnie. Jeśli budżetujesz z cennika, a nie ze zmierzonego przebiegu, pomylisz się w drogą stronę.

Linia, której nikt nie wstawił do ogłoszenia: odczyty z cache remisują

Sol czyta cache po $0,20 za milion, czyli 10% swojej stawki $2 za wejście. Opus 5.5 czyta cache po $0,20 za milion, czyli 5% swojej stawki $4. Anthropic zmienił mnożnik specjalnie dla tego modelu: trafienia w cache na Opusie 5.5 są liczone jako 0,05x ceny wejścia, kiedy reszta linii używa 0,1x. Opus 5 czytał cache po $0,50.

Czyli oba modele biorą tyle samo za ponowne przeczytanie promptu.

To waży więcej, niż brzmi, bo pętle agentowe to głównie odczyty z cache. Własny poradnik kosztowy Anthropica podaje, że przez cały dzień realnego ruchu pętle agentowe czytają z cache medianę 84% swojego wejścia, a górne dziesięć procent harnessów czyta 94% albo więcej. W takiej pętli strona wejściowa rachunku to remis, a każdy dolar różnicy to tokeny wyjściowe.

Gdzie idą pieniądzeGPT-6 SolClaude Opus 5.5Różnica
Cache na wejściu, większość pętli agentowej$0,20$0,20brak
Świeże wejście$2$42x
Wyjście$10$202x
Realnie wypisane tokeny wyjściowe77 mln260 mln3,4x

Za milion tokenów. Złożenie dwóch ostatnich wierszy zamienia dwukrotny cennik w 5,6-krotny rachunek.

$5,98 to sufit, nie cena

Liczba z Artificial Analysis to Opus 5.5 przy max effort z domyślnym fallbackiem. Domyślny poziom w API dla tego modelu to medium.

Anthropic włączył w Opusie 5.5 adaptacyjne myślenie na stałe i przeniósł sterowanie nim do parametru effort, którego domyślna wartość na tym modelu to medium, a nie high używane w większości linii. Każde porównanie, które przeczytasz w tym tygodniu, cytuje liczbę z max effort, bo to jest liczba, którą Artificial Analysis publikuje. Twoja pętla tam nie pojedzie, jeśli jej tam nie postawisz.

Traktuj $5,98 jako cenę za wyciśnięcie z modelu wszystkiego i zjedź z effortem w dół, zanim uznasz, że jest za drogi.

Agenci programistyczni: pomiar jest niepełny i to ma znaczenie

W Coding Agent Index v1.5 od Artificial Analysis Codex na GPT-6 Sol ma 57 przy $2,99 na zadanie i 22,3 minuty. Najbliższy wpis Anthropica to Claude Code na Opusie 5, z wynikiem 60 przy $10,79 na zadanie i 41,9 minuty.

Opusa 5.5 w tej tabeli jeszcze nie ma. Kto w tym tygodniu mówi ci, jak Opus 5.5 radzi sobie jako agent programistyczny, ekstrapoluje z wyniku indeksu, a harness przesuwa rezultaty tak samo mocno jak model. Widać to po samym Solu: wygrywa z Astrą na DeepSWE v1.1, 69% do 68%, i przegrywa Terminal-Bench 4.0 o trzynaście punktów. Jeden model, dwie zupełnie różne odpowiedzi zależnie od benchmarku.

Czego bym użył

Rodzaj pracyModelDlaczego
Masowe kodowanie agentowe z testami albo weryfikatoremGPT-6 Sol$1,06 wobec $5,98 na zadanie. Puść wszystko tanio i powtórz same porażki wyżej.
Najtrudniejszy krok rozumowania w pętliClaude Opus 5.5Pierwszy na 212 modeli. Dziesięć punktów warto kupić na kroku, który decyduje o wyniku.
Podział na wykonawcę i doradcęObaSol trzyma pętlę, Opus 5.5 dostaje pytanie, gdy Sol utknie. Najpierw wyceń samego doradcę i zmierz, jak często jest wołany.
Długie pętle oparte na cacheBliżej niż wyglądaOba czytają cache po $0,20. Porównuj po tokenach wyjściowych, nie po linii wejścia.
Zespół już na platformie AnthropicaClaude Opus 5.5Domyślna rekomendacja samego Anthropica i 20% taniej za token niż Opus 5, na którym siedzisz.

Sol wygrywa objętość. Opus 5.5 wygrywa trudny krok. Większość produkcyjnych pętli chce reguły, która wybiera między nimi per zapytanie.

Stronę Anthropica tej decyzji opisuje Opus 5.5 kontra Opus 5, razem z czterema łamiącymi zmianami, które wywrócą naiwny port. Stronę OpenAI opisuje Sol kontra Astra, czyli ta sama decyzja o routingu wewnątrz jednego dostawcy.

Co zmieniłoby moje zdanie

Opus 5.5 w zmierzonym harnessie. Wynik z Claude Code w Coding Agent Index domknąłby tę część porównania, która dziś jest wnioskowaniem.

Opublikowana prędkość Opusa 5.5 przy max effort. Na razie połowa pytania o opóźnienie nie ma odpowiedzi.

Przebieg przy effortcie medium. Każda liczba kosztu na zadanie w tym tekście to max effort. Domyślny poziom modelu to medium, a różnica przy domyślnych ustawieniach może być o połowę mniejsza.

Pytania, które padają

Czy Claude Opus 5.5 jest lepszy od GPT-6 Sol?

W niezależnym indeksie wyraźnie tak. Artificial Analysis daje Claude Opus 5.5 wynik 58, a GPT-6 Sol 48 w Intelligence Index v4.3.2, co stawia Opusa 5.5 na pierwszym miejscu wśród 212 modeli, a Sola na osiemnastym. Tylko że nie celują w to samo zadanie: OpenAI opisuje Sola jako model do złożonego kodowania i pracy agentowej po $2 / $10, a Anthropic poleca Opusa 5.5 jako domyślny wybór do większości zadań po $4 / $20.

O ile Claude Opus 5.5 jest droższy od GPT-6 Sol?

Dwa razy za token i 5,6 raza na zadanie. Opus 5.5 kosztuje $4 za milion tokenów wejściowych i $20 za wyjściowe wobec $2 i $10 Sola. Artificial Analysis zmierzyło $5,98 na zadanie przy przebiegu indeksu na Opusie 5.5 przy max effort i $1,06 na Solu, bo Opus 5.5 wygenerował 260 mln tokenów wobec 77 mln Sola. Cache kosztuje $0,20 za milion w obu.

Co jest szybsze, GPT-6 Sol czy Claude Opus 5.5?

Sol, i to wyraźnie, na tym co zmierzono. Artificial Analysis podaje dla Sola ok. 125 tokenów wyjściowych na sekundę, trzydzieste drugie miejsce na 212 modeli, a dla Opusa 5.5 przy max effort nie publikuje wyniku prędkości. Sol pisze też około trzy razy mniej tokenów na zadanie, więc kończy wcześniej z dwóch niezależnych powodów.

Wybierać GPT-6 Sol czy Claude Opus 5.5?

Sola do masowej pracy agentowej, którą możesz sprawdzić, i wszędzie tam, gdzie o architekturze decyduje koszt ukończonego zadania. Opusa 5.5 do najtrudniejszego kroku w pętli, dla zespołów już siedzących na platformie Anthropica i jako model doradczy, do którego tańszy wykonawca dzwoni, kiedy utknie. Routuj między nimi zamiast wybierać jeden domyślny.

Jeśli wybierasz poziom modelu do produktu agentowego i chcesz mieć spisaną regułę routingu, strona kontaktowa to najszybsza droga do mnie.

Udostępnij artykuł

O autorze

Wojciech Łuszczyński

Wojciech Łuszczyński

Architekt GTM i operator wzrostu budujący natywne dla AI systemy przychodów dla B2B SaaS i firm technologicznych. Łączę pozycjonowanie, SEO, treści, płatne pozyskiwanie, CRM, automatyzację, analitykę i przepływy pracy AI w praktyczną infrastrukturę wzrostu.

Newsletter

Najpierw zdobądź następny.

Kiedy opublikuję nowy artykuł na temat systemów AI, architektury GTM lub modeli operacyjnych wzrostu, dowiesz się o tym jako pierwszy.

Subskrybuj