Przejdź do treści
wojciech.io
Porównania modeli
AI SystemsAIClaudeAI Systems

Claude Sonnet 5.5 ma 18 punktów więcej od Sonnet 5, a cennik się nie ruszył

Sonnet 5.5 ma 56 punktów wobec 38 Sonnet 5, przy identycznym cenniku $2 / $10. Pięć zmian łamiących zgodność, przeliczone poziomy effort i koszt zadania, którego nie da się porównać wprost.

Wojciech Łuszczyński

Wojciech Łuszczyński

GTM Architect & Growth Operator · Insights · 1 października 2026 · 6 min czytania

Udostępnij

TL;DR · Najważniejsze wnioski

  • Sonnet 5.5 ma 56 punktów w Intelligence Index v4.3.2 wobec 38 Sonnet 5. To 18 punktów przy niezmienionym cenniku $2 / $10, największy skok, jaki Anthropic zrobił wewnątrz jednego poziomu.
  • Cena naprawdę się nie ruszyła. $2 / $10 na Sonnet 5 było ceną wprowadzającą do 31 sierpnia 2026, a Anthropic odwołał podwyżkę do $3 / $15 zaplanowaną na 1 września.
  • Pięć zmian łamie kod działający na Sonnet 5, o jedną więcej niż przy przesiadce na Opus 5.5. Poziomy effort są dodatkowo przeliczone, więc ustawienie, które wystroiłeś, znaczy teraz co innego.
  • Przy 56 punktach i $7,62 za zadanie Sonnet 5.5 kosztuje za skończone zadanie więcej niż Opus 5.5, który ma 58 punktów przy $5,98. Na tym teście tańszy w cenniku wychodzi droższy w robocie.

Claude Sonnet 5.5 wyszedł 28 września 2026. Ma 56 punktów w Artificial Analysis Intelligence Index tam, gdzie Sonnet 5 ma 38, a cennik się nie ruszył: $2 za milion tokenów wejścia, $10 za wyjście, tyle samo co wcześniej.

Osiemnaście punktów za darmo to nie jest wymiana. To część tej premiery, którą warto przeczytać dwa razy, bo każda inna aktualizacja w tej rodzinie przez ostatni rok ruszała cenę albo liczbę tokenów, albo po cichu jedno i drugie, podczas gdy nagłówek mówił o testach.

Cena faktycznie stoi w miejscu

Identyczne w całym wierszu. $2 wejście, $10 wyjście, $0,20 odczyt z cache’u, $2,50 i $4 zapisy.

Warto to powiedzieć wprost, bo cena Sonnet 5 nigdy nie miała się utrzymać: $2 / $10 było ceną wprowadzającą do 31 sierpnia 2026, z podwyżką do $3 / $15 zaplanowaną na 1 września, którą Anthropic potem odwołał, robiąc z ceny wprowadzającej cenę standardową. Więc to nie całkiem „nowy model, ta sama cena”. To „nowy model, a przy okazji rabat został na stałe”.

Osiemnaście punktów to dużo jak na jeden poziom

Sonnet 5.5 ma 56. Opus 5.5 ma 58, w tej samej wersji indeksu, v4.3.2. Sonnet 5 miał 38, daleko pod obydwoma.

Aktualizacja wewnątrz poziomu, która domyka większość dystansu do flagowca przy ćwiartce jego ceny wyjścia, to zmiana, po której się testuje od nowa, a nie czyta od nowa. Pół roku temu mogłeś wybrać Opusa różnicą kilkunastu punktów. Ta różnica wynosi teraz dwa.

Kosztu za zadanie nie da się porównać wprost

Artificial Analysis podaje $7,62 za zadanie dla Sonnet 5.5 i $5,09 dla Sonnet 5. Wygląda na wzrost o 50%. Nie nazwę tego tak, bo te dwa biegi nie są tak samo skonfigurowane, a arytmetyka nie broni takiego nagłówka.

Sonnet 5.5 jest mierzony jako Adaptive Reasoning, Max Effort, Default Fallback. Sonnet 5 jako Adaptive Reasoning, Max Effort, bez fallbacku, a Artificial Analysis oznacza jego wyniki jako historyczne i już nieaktualizowane. Liczby tokenów to 410 mln wobec 370 mln, czyli około 11% różnicy. Przy identycznej cenie za token 11% więcej tokenów nie da 50% więcej kosztu. Różnica siedzi w tym, jak ustawiono biegi, a nie tylko w tym, ile który model pisze.

Co z tego zostaje: Sonnet 5.5 jest gadatliwy. 410 mln tokenów przy medianie 82 mln wśród porównywalnych modeli to pięciokrotność środka stawki. Jakikolwiek był twój rachunek za zadanie, załóż, że urośnie, i zmierz to na własnej robocie zamiast brać którąkolwiek z tych liczb.

Tańszy model nie jest tu tym tańszym

To jest liczba, która powinna zmienić decyzję.

Sonnet 5.5 Opus 5.5
Wynik w indeksie, v4.3.2 56 58
Cennik $2 / $10 $4 / $20
Koszt zadania w indeksie $7,62 $5,98
Tokeny na biegu 410 mln 260 mln

Sonnet 5.5 kosztuje o połowę mniej za token i więcej za skończone zadanie. Opus 5.5 ma wyższy wynik i mniejszy rachunek. Powód to długość: dochodzi do odpowiedzi w 260 mln tokenów tam, gdzie Sonnet 5.5 potrzebuje 410 mln.

To odwraca zwykły powód sięgania po Sonnet. Jeśli wybrałeś go, żeby oszczędzić na długich biegach agentowych, sprawdź rachunek, zanim zostaniesz przy tym uzasadnieniu. Jeśli wybrałeś go dla czasu odpowiedzi, logika się trzyma: tańszy i szybszy model, który pisze więcej, nadal jest szybszy na tokenie, a indeks nie mierzy tego, na czym ci zależy.

Pięć rzeczy, które zepsują ci przesiadkę

Anthropic dokumentuje pięć zmian łamiących kod, który już działa na Sonnet 5:

  1. Myślenie z góry wyłącza się przez between_tools, a nie przez przełącznik, którego używałeś.
  2. Wymuszone użycie narzędzia zwraca błąd.
  3. Bloki myślenia są przypisane do modelu i rozmowy, które je wytworzyły.
  4. W Claude API i Google Cloud starsze narzędzie computer use computer_20251124 nie jest przyjmowane.
  5. Narzędzie advisor odrzuca Claude Opus 4.8, Opus 4.7 i Sonnet 5 w roli doradcy.

To o jedną więcej niż przy przesiadce z Opus 5 na Opus 5.5, a punkty drugi, trzeci i czwarty to dokładnie te trzy, które tam ludzi łapały. Jeśli robiłeś tamtą migrację, większość tej masz już napisaną.

Poziomy effort znaczą teraz co innego

Cichsza zmiana nie trafiła na listę łamiących. Poziomy effort są przeliczone: to samo ustawienie nie daje tyle myślenia, ile dawało na Sonnet 5. Anthropic każe przepuścić swój zestaw testów od nowa, zamiast przenosić ustawienie.

Ich punkty wyjścia: high, chyba że robota jest agentowa albo czuła na czas odpowiedzi. Przy agentowym kodowaniu i wielokrokowym użyciu narzędzi medium dla dobrze opisanych zadań, high dla trudniejszych i dłuższych. Przy czacie i wszystkim, gdzie liczy się czas, medium albo low.

Jeśli wystroiłeś poziom effort pod sufit kosztowy, ten sufit się przesunął i nikt ci o tym nie powiedział.

Którego bym użył

Sonnet 5.5. Ta decyzja jest szybka: Sonnet 5 jest na liście zaszłych, jego wyniki w teście są zamrożone, a ma 18 punktów mniej za te same pieniądze. Nie ma wersji tej historii, w której zostanie przy starym jest lepszym wyborem.

Decyzja, która naprawdę jest otwarta, to Sonnet 5.5 wobec Opus 5.5, i jest bliższa, niż sugeruje cennik. Dwa punkty różnicy w indeksie, a tańszy wystawia wyższy rachunek za zadanie.

Co zmieniłoby moje zdanie

Jeśli twoje zadania są krótkie, powyższe koszty za zadanie przestają mieć znaczenie i do rachunku dociera cennik. Wtedy Sonnet 5.5 za połowę ceny Opusa jest oczywistym wyborem, a gadatliwość nie dostaje okazji, żeby cokolwiek kosztować.

Chciałbym też drugiego pomiaru, zanim oprę coś mocno na tych $7,62. Jeden bieg, jedna konfiguracja i jeden test nagradzający długie rozumowanie to cienka podstawa pod budżet. Puść własne zadania, policz własne tokeny i dopiero wtedy decyduj.

Pytania, które dostaję

Czy Claude Sonnet 5.5 jest tańszy niż Claude Sonnet 5?

Nie, ale nie jest też droższy. Oba kosztują $2 za milion tokenów wejścia i $10 za wyjście, z tym samym odczytem z cache’u po $0,20 i tymi samymi zapisami po $2,50 i $4. Anthropic wypuścił lepszy model bez ruszania cennika, co jest nietypowe: $2 / $10 na Sonnet 5 było ceną wprowadzającą do 31 sierpnia 2026, a podwyżka do $3 / $15 z 1 września nigdy nie weszła.

Czy Claude Sonnet 5.5 jest lepszy niż Claude Sonnet 5?

O 18 punktów w niezależnym indeksie, co jak na jeden poziom jest przepaścią. Artificial Analysis daje Sonnet 5.5 wynik 56, a Sonnet 5 wynik 38 w Intelligence Index v4.3.2. Anthropic przeniósł Sonnet 5 na listę modeli zaszłych, a Artificial Analysis oznacza go jako wycofany, więc Sonnet 5.5 to ten Sonnet, który dostaniesz, jeśli nie przypniesz starego identyfikatora modelu.

Co się psuje przy przesiadce z Claude Sonnet 5 na Sonnet 5.5?

Pięć rzeczy, według własnych notatek migracyjnych Anthropica. Myślenie z góry wyłącza się przez between_tools, a nie przez dawny przełącznik. Wymuszone użycie narzędzia zwraca błąd. Bloki myślenia są przypisane do modelu i rozmowy, które je wytworzyły. W Claude API i Google Cloud starsze narzędzie computer use computer_20251124 nie jest przyjmowane. Narzędzie advisor odrzuca Claude Opus 4.8, Opus 4.7 i Sonnet 5 w roli doradcy. Szósta zmiana nie łamie kodu, ale zmieni ci wyniki: poziomy effort są przeliczone, więc Anthropic każe przepuścić swój zestaw testów od nowa.

Claude Sonnet 5.5 czy Claude Opus 5.5?

W cenniku Sonnet 5.5 to połowa ceny Opusa 5.5: $2 / $10 wobec $4 / $20. W indeksie nie jest tańszą opcją. Artificial Analysis zmierzyło $7,62 za zadanie przy wyniku 56 dla Sonnet 5.5 i $5,98 przy 58 dla Opus 5.5. Sonnet 5.5 napisał na tym biegu 410 mln tokenów wobec 260 mln Opusa. Jeśli twoja praca przypomina ten indeks, oszczędność na tokenie nie przeżywa zderzenia z ich liczbą. Jeśli zadania są krótkie albo liczy się czas odpowiedzi, do rachunku dociera cennik.

Poziom wyżej opisuje Opus 5.5 kontra Opus 5. Wszystkie porównania w jednym miejscu zbiera zestawienie modeli.

Udostępnij artykuł

O autorze

Wojciech Łuszczyński

Wojciech Łuszczyński

Architekt GTM i operator wzrostu budujący natywne dla AI systemy przychodów dla B2B SaaS i firm technologicznych. Łączę pozycjonowanie, SEO, treści, płatne pozyskiwanie, CRM, automatyzację, analitykę i przepływy pracy AI w praktyczną infrastrukturę wzrostu.

Newsletter

Najpierw zdobądź następny.

Kiedy opublikuję nowy artykuł na temat systemów AI, architektury GTM lub modeli operacyjnych wzrostu, dowiesz się o tym jako pierwszy.

Subskrybuj