Każda pozycja w cenniku Opusa 5.5 poszła w dół. Zmierzony rachunek urósł o 2%.
Opus 5.5 tnie tokeny o 20%, a odczyt cache o 60%, i ma 58 wobec 51 Opusa 5. Koszt zadania i tak urósł do $5,98. Plus cztery łamiące zmiany.
GTM Architect & Growth Operator · Insights · 23 września 2026 · 8 min czytania
TL;DR · Najważniejsze wnioski
- Opus 5.5 kosztuje $4 / $20 wobec $5 / $25 Opusa 5, a odczyt cache spada z $0,50 do $0,20, bo Anthropic przestawił ten model na mnożnik 0,05x zamiast zwykłego 0,1x.
- Artificial Analysis daje Opusowi 5.5 wynik 58, a Opusowi 5 51, pierwsze miejsce na 212 modeli wobec jedenastego. Koszt zadania prawie nie drgnął: $5,98 wobec $5,86, bo Opus 5.5 wypisał 260 mln tokenów wobec 140 mln.
- Własna instrukcja Anthropica podaje zakres od ok. 40% taniej do ok. 20% drożej na rozwiązane zadanie. Niezależny pomiar wylądował przy górnym końcu tego zakresu, nie przy dolnym.
- Cztery łamiące zmiany uderzają w kod działający już na Opusie 5: myślenia nie da się wyłączyć, wymuszone użycie narzędzia zwraca 400, bloki myślenia są przypisane do modelu, a starsze narzędzie computer use jest odrzucane.
Anthropic ściął każdą cenę w linii Opus i wypuścił lepszy model. Wejście w dół o 20%, wyjście w dół o 20%, odczyt cache w dół o 60%, siedem punktów wyżej w niezależnym indeksie.
Potem Artificial Analysis puściło swój benchmark na obu i nowszy model wyszedł drożej. Nie dużo, o 2%, ale drożej. Ta jedna liczba jest całym tym tekstem, bo to ją zobaczy twój dział finansowy, a podsumowanie z ogłoszenia jej nie zawiera.
| Info | Claude Opus 5.5 | Claude Opus 5 |
|---|---|---|
| Wejście / wyjście za 1 mln | $4 / $20 | $5 / $25 |
| Trafienia i odświeżenia cache | $0,20 | $0,50 |
| Zapis cache 5 min / 1 godz. | $5 / $8 | $6,25 / $10 |
| Intelligence Index v4.3.2 | 58 | 51 |
| Miejsce wśród 212 modeli | 1. | 11. |
| Koszt zadania w indeksie | $5,98 | $5,86 |
| Tokeny wygenerowane w indeksie | 260 mln | 140 mln |
| Prędkość wyjścia, tokeny/s | brak danych | ok. 54 |
| Domyślny poziom rozumowania | medium | high |
| Okno / maks. wyjście | 1 mln / 128 tys. | 1 mln / 128 tys. |
Ceny ze strony cennika Anthropica. Wynik indeksu, koszt zadania, tokeny i prędkość z kart modeli Artificial Analysis, oba mierzone przy max effort. Odczyt 23 września 2026.
Prawdziwą obniżką jest linia cache
Wszyscy będą cytować $5 na $4. To nie ta linia rusza rachunkiem za agenta.
Anthropic wycenia trafienia i odświeżenia cache na Opusie 5.5 jako 0,05x ceny wejścia, kiedy cała reszta linii używa 0,1x. To zabiera odczyt cache z $0,50 na $0,20 za milion tokenów, czyli o 60%, na składniku, który dominuje w długich pętlach.
Własny poradnik kosztowy Anthropica podaje, że pętle agentowe czytają z cache medianę 84% wejścia przez cały dzień realnego ruchu. Jeśli to opisuje twoje obciążenie, wejściowa strona rachunku właśnie spadła o ponad połowę. Nagłówkowe 20% jest mniejszą połową tej historii.
Opus 5.5 czyta teraz cache po $0,20 za milion, dokładnie tyle, ile bierze GPT-6 Sol, przy cenie wejścia dwa razy wyższej niż u Sola. Porównuj dostawców po tej linii, w którą faktycznie uderza twój ruch.
Siedem punktów w górę, i pierwsze miejsce
Artificial Analysis daje Opusowi 5.5 wynik 58, a Opusowi 5 51 w Intelligence Index v4.3.2. Opus 5.5 jest pierwszy wśród 212 modeli swojej klasy. Opus 5 był jedenasty.
Ten sam serwis wstawił już na stronę Opusa 5 baner o przestarzałości, w którym informuje, że Anthropic wypuścił nowszy model i sugeruje rozważyć go zamiast tego. Strona modeli Anthropica też się przesunęła: linijka, która kiedyś kierowała niezdecydowanych na Opusa 5, dziś kieruje ich na Opusa 5.5.
Dlaczego koszt zadania poszedł w złą stronę
Opus 5.5 wygenerował w indeksie 260 mln tokenów. Opus 5 wygenerował 140 mln. Przy max effort nowszy model myśli prawie dwa razy dłużej, a 20-procentowa obniżka stawki nie pokrywa 86-procentowego wzrostu liczby wypisanych tokenów.
Anthropic mówi o tym wprost we własnej instrukcji kosztowej. Wiersz o przejściu na nowszy model brzmi, że aktualny model rozwiązuje więcej zadań, przy koszcie na rozwiązane zadanie od ok. 40% niższym do ok. 20% wyższego. To jest zakres ze złym końcem, a nie obietnica oszczędności, i niezależny przebieg wylądował blisko tego złego końca.
Odczyt, który się liczy: Opus 5.5 jest lepszy na zadanie i mniej więcej wyrównany na dolara przy max effort. Oszczędność łapiesz, schodząc z effortem w dół. Podmiana identyfikatora modelu i czekanie na lepszą fakturę tego nie zrobi, a jeśli masz już te 20% wpisane w budżet jako oszczędność, cofnij tę pozycję, dopóki przebieg na twoim własnym obciążeniu nie powie inaczej.
Cztery rzeczy, które wywrócą twój port
To jest część, której brakuje w każdym podsumowaniu, jakie przeczytałem w tym tygodniu. Anthropic dokumentuje cztery łamiące zmiany wobec kodu działającego już na Opusie 5.
| Zmiana | Co się dzieje | Co zrobić |
|---|---|---|
| Myślenia nie da się wyłączyć | Zapytanie z thinking typu disabled albo z ręcznym budget_tokens zwraca 400 invalid_request_error. | Pomiń pole thinking albo wyślij adaptive, a głębokość steruj przez effort. |
| Wymuszone użycie narzędzia zniknęło | tool_choice ustawione na any albo na nazwane narzędzie zwraca 400. Liczenie tokenów waliduje tak samo. | Zostaw tool_choice auto ze strict tool use albo przenieś schemat do structured outputs. |
| Bloki myślenia przypisane do modelu | Opus 5.5 czyta bloki z Opusa 5 i wcześniejszych Opusów, Sonnetów i Haiku, ale nie z Fable ani Mythos. | Wybieraj bloki treści po typie, nie po pozycji, i oddawaj bloki myślenia bez modyfikacji. |
| Starsze narzędzie computer use odrzucane | Na Claude API i Google Cloud computer_20251124 nie jest akceptowane. | Przejdź na aktualny zestaw computer use przed podmianą identyfikatora modelu. |
| Tekst między wywołaniami narzędzi (nie łamie) | Trafia teraz do bloków myślenia pustych przy domyślnym ustawieniu wyświetlania, więc strumień postępu milknie. | Ustaw display tak, żeby zwracał tekst, jeśli użytkownicy patrzą na ten strumień. |
Ze strony Anthropica o nowościach w Opusie 5.5. Pierwsze trzy dotyczą też Claude Fable 5.1.
Piąty wiersz jest tym, który dotrze do twoich użytkowników zamiast do twoich logów. Aplikacja, która streamuje tekst między narzędziami jako aktualizacje postępu, nie rzuca błędem. Po prostu milknie między wywołaniami, a cisza wygląda jak zawieszenie.
Domyślna wartość się przesunęła, więc zachowanie też
Na Opusie 5.5 adaptacyjne myślenie jest zawsze włączone, głębokością steruje effort, a domyślna wartość na tym modelu to medium, podczas gdy większość linii domyślnie idzie na high.
Dwie konsekwencje. Po pierwsze, prosty port wywołania z Opusa 5, które polegało na domyślnych ustawieniach, dostaje płytszy model niż miało, co wygląda jak regres jakości, a jest zmianą konfiguracji. Po drugie, każdy publikowany benchmark Opusa 5.5, łącznie z tymi $5,98, jest mierzony przy max effort. Żadna z tych liczb nie opisuje ustawień domyślnych.
Jeśli po porcie spada jakość, podnieś effort, zanim obwinisz model. Jeśli rośnie koszt, obniż go.
Czego bym użył
Opus 5, szczerze mówiąc, nie ma już żadnego argumentu. Jest droższy w każdej linii, siedem punktów z tyłu, a Artificial Analysis oznaczyło go jako przestarzały. Decyzja nie brzmi, czy przejść, tylko jak.
| Sytuacja | Zrób to | Dlaczego |
|---|---|---|
| Pętle agentowe oparte na cache, na Opusie 5 | Przenoś teraz | Odczyt cache spada o 60%. To największa pojedyncza pozycja w tym rachunku. |
| Kod z wymuszonym narzędziem albo wyłączonym myśleniem | Najpierw popraw, potem przenoś | Oba zwracają 400 na Opusie 5.5. Port wywala się głośno na pierwszym wywołaniu. |
| Interfejs streamujący postęp między narzędziami | Ustaw display, potem przenoś | Bez błędu, sama cisza. Gorzej niż awaria, bo nic cię o tym nie powiadomi. |
| Koszt jest już ograniczeniem | Przenieś i zjedź z effortem | Oszczędność bierze się z medium, nie z identyfikatora modelu. Przy max effort wyszło 2% drożej na zadanie. |
| Rozmowy przeskakujące na Fable albo Mythos | Sprawdź bloki myślenia | Opus 5.5 nie czyta bloków myślenia z Fable ani Mythos. |
Przejście warto zrobić. Zarezerwuj popołudnie na cztery łamiące zmiany zamiast traktować je jak podmianę stringa.
Wersję tej decyzji przez dwóch dostawców opisuje GPT-6 Sol kontra Opus 5.5, z całą arytmetyką kosztu na zadanie.
Co zmieniłoby moje zdanie
Pomiar przy effortcie medium. Każda liczba kosztu na zadanie w tym tekście to max effort na modelu, który domyślnie stoi na medium, a przy ustawieniach domyślnych różnica może się odwrócić.
Opublikowana prędkość Opusa 5.5. Opus 5 chodził w tempie ok. 54 tokenów wyjściowych na sekundę i był opisany jako wyraźnie wolny. Czy 5.5 to poprawił, na razie nie wiadomo.
Opus 5.5 w harnessie programistycznym. Coding Agent Index nadal pokazuje Opusa 5 z wynikiem 60 przy $10,79 na zadanie i nie ma wpisu dla 5.5.
Pytania, które padają
Czy Claude Opus 5.5 jest tańszy od Claude Opus 5?
Za token tak, o 20%: $4 za milion tokenów wejściowych i $20 za wyjściowe wobec $5 i $25. Odczyt cache spada mocniej, z $0,50 do $0,20, bo Anthropic wycenia trafienia w cache na Opusie 5.5 jako 0,05x ceny wejścia zamiast zwykłego 0,1x. Na ukończone zadanie to już nie jest automatyczne. Artificial Analysis zmierzyło $5,98 na zadanie w indeksie na Opusie 5.5 i $5,86 na Opusie 5, bo nowszy model wypisał 260 mln tokenów wobec 140 mln starszego przy max effort.
Czy Claude Opus 5.5 jest lepszy od Claude Opus 5?
Tak, o siedem punktów w niezależnym indeksie. Artificial Analysis daje Opusowi 5.5 wynik 58, a Opusowi 5 51 w Intelligence Index v4.3.2, co stawia Opusa 5.5 na pierwszym miejscu wśród 212 modeli, gdzie Opus 5 był jedenasty. Anthropic przestawił też własną domyślną rekomendację na Opusa 5.5, a Artificial Analysis oznaczyło Opusa 5 jako przestarzałego.
Co się psuje przy przejściu z Claude Opus 5 na Opusa 5.5?
Cztery rzeczy, według własnych notatek migracyjnych Anthropica. Myślenia nie da się wyłączyć, więc zapytanie z thinking typu disabled albo z ręcznym budżetem tokenów zwraca 400. Wymuszone użycie narzędzia zniknęło, więc tool_choice ustawione na any albo na nazwane narzędzie zwraca 400. Bloki myślenia są przypisane do modelu, który je wyprodukował, więc rozmowy przenoszone między rodzinami modeli wymagają uwagi. I na Claude API oraz Google Cloud starsze narzędzie computer_20251124 nie jest akceptowane. Piąta zmiana jest cichsza: tekst między wywołaniami narzędzi trafia teraz do bloków myślenia, które przy domyślnym ustawieniu wyświetlania są puste, więc strumień postępu milknie, dopóki tego ustawienia nie zmienisz.
Przechodzić z Claude Opus 5 na Opusa 5.5?
Tak, ale zmierz zamiast zakładać oszczędność. Cena za token jest o 20% niższa, odczyt cache o 60% niższy, a model rozwiązuje więcej. Własny zakres Anthropica dla takiego przejścia to od ok. 40% taniej do ok. 20% drożej na rozwiązane zadanie, a niezależny przebieg indeksu wyszedł 2% drożej. Po porcie zjedź z effortem, bo domyślny poziom przesunął się z high na medium, a wszystkie publikowane porównania są mierzone przy max.
Jeśli planujesz tę migrację na produkcyjnym stosie agentowym, strona kontaktowa to najszybsza droga do mnie.



