GPT-6 Astra i Claude Fable 5.1 remisują na szczycie i kosztują tyle samo za token. Przebieg indeksu na jednym z nich był o 59% tańszy.
GPT-6 Astra (52,81) i Claude Fable 5.1 (53,37) remisują w indeksie v4.3 przy tych samych $10 / $50, a test Astry kosztował 59% mniej. Gdzie wygrywa Fable.
GTM Architect & Growth Operator · Insights · 16 września 2026
TL;DR · Najważniejsze wnioski
- W Artificial Analysis Intelligence Index v4.3 Claude Fable 5.1 ma 53,37, a GPT-6 Astra 52,81. Artificial Analysis opisuje to jako remis Astry z Fable 5.1 na prowadzeniu.
- Oba modele kosztują $10 / $50 za milion tokenów. Przebieg całego indeksu kosztował $13 129 na Fable 5.1 i $5 324 na Astrze, bo Fable 5.1 wypisał 190 mln tokenów wobec 60 mln.
- Fable 5.1 wygrywa na dwóch stawkach: cache za $0,25 wobec $1 Astry oraz prompty powyżej 272 tys. tokenów, gdzie całe zapytanie do Astry kosztuje $20 / $75, a Fable 5.1 trzyma swoją stawkę.
- Na agentach kodujących remisują przy 62. Codex z Astrą kosztuje $7,47 na zadanie i zajmuje 29,4 minuty; Claude Code z Fable 5.1 kosztuje $12,39, zajmuje 34,8 minuty i wygrywa dwa z trzech benchmarków składowych.
Na szczycie Artificial Analysis Intelligence Index v4.3 stoją dwa modele z tym samym cennikiem, $10 za milion tokenów wejściowych i $50 za wyjście, i z 0,56 punktu różnicy.
Na papierze nie ma czego wybierać. Na fakturze jest.
| Info | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|
| Wej. / wyj. za 1 mln | $10 / $50 | $10 / $50 |
| Cache za 1 mln | $1,00 | $0,25 |
| Powyżej 272 tys. tokenów, wej. / wyj. | $20 / $75 | $10 / $50 |
| Intelligence Index v4.3 | 52,81 | 53,37 |
| Coding Agent Index, własne narzędzie | 62 (Codex) | 62 (Claude Code) |
| Koszt zadania programistycznego | $7,47 | $12,39 |
| Minuty na zadanie programistyczne | 29,4 | 34,8 |
| Koszt przebiegu całego indeksu | $5 324 | $13 129 |
| Tokeny wygenerowane w indeksie | 60 mln | 190 mln |
| Prędkość, tokeny/s | ok. 53 | ok. 65 |
| Granica wiedzy | kwiecień 2026 | czerwiec 2026 |
Ceny ze strony modelu GPT-6 Astra w OpenAI i z cennika Anthropic; granice wiedzy ze stron modeli obu firm. Indeks do dwóch miejsc po przecinku z danych wykresu v4.3 w Artificial Analysis; koszt przebiegu, tokeny i prędkość z ich stron modeli; liczby dla agentów kodujących z porównania Claude Code i Codeksa. Stan na 16 września 2026.
Remis w obu indeksach
Artificial Analysis daje Fable 5.1 53,37, a Astrze 52,81 w v4.3 i opisuje to jako remis Astry z Fable 5.1 na prowadzeniu. Na stronach modeli oba wyświetlają się jako 53.
W Coding Agent Index remisują znowu przy 62, każdy w narzędziu swojego producenta. Składowe się rozjeżdżają. Codex z Astrą wygrywa DeepSWE, czyli długie zadania na repozytoriach, 68% do 64%. Claude Code z Fable 5.1 wygrywa Terminal-Bench 4.0, 58% do 56%, i SWE-Atlas-QnA, 65% do 62%.
Ten sam cennik, bardzo różne rachunki
Oba biorą $10 za milion tokenów wejściowych i $50 za wyjście. Różni je to, ile każdy z nich pisze.
Artificial Analysis naliczyło w całym indeksie 190 mln tokenów od Fable 5.1 i 60 mln od Astry, a przebiegi kosztowały $13 129 i $5 324. Na agentach kodujących Codex z Astrą kosztował $7,47 za zadanie, a Claude Code z Fable 5.1 $12,39, i Astra skończyła przy tym szybciej, 29,4 minuty wobec 34,8.
To czyni Astrę tańszym modelem przy typowej pracy agentowej, choć żaden wiersz w jej cenniku nie jest niższy.
Remis w wynikach i remis w cenie za token i tak zostawiły dwuipółkrotną różnicę w koszcie pełnego przebiegu. Między tymi dwoma modelami rozstrzyga objętość tego, co piszą.
Gdzie tańszy jest Fable 5.1
Dwa wiersze w cennikach przemawiają za Fable 5.1.
Cache. Fable 5.1 czyta cache po $0,25 za milion, jedną czwartą stawki Astry. Załóżmy, że na twoim zadaniu Fable 5.1 pisze trzy razy więcej niż Astra, tak jak w całym indeksie. Wtedy jego zniżka na cache wygrywa dopiero, gdy wejście z cache przekracza mniej więcej 130-krotność wyjścia Astry, czyli przy pętli bardzo mocno opartej na cache i z krótkimi odpowiedziami.
Prompty powyżej 272 tys. tokenów. Gdy prompt przekroczy 272 tys., OpenAI liczy całe zapytanie do Astry po $20 za wejście, $2 za cache i $75 za wyjście. Anthropic trzyma Fable 5.1 na jednej stawce w całym oknie 1 mln. Przykład: prompt na 300 tys. tokenów z odpowiedzią na 5 tys. Na Astrze kosztuje $6,38, na Fable 5.1 $3,25.
Co jeszcze je różni
- Prędkość. Fable 5.1 generuje szybciej, ok. 65 tokenów na sekundę wobec 53 Astry. Astra i tak kończy zadania programistyczne wcześniej, bo pisze mniej.
- Wiedza. OpenAI podaje granicę wiedzy Astry na 30 kwietnia 2026. Anthropic podaje wiarygodną granicę wiedzy Fable 5.1 na czerwiec 2026.
- Odmowy w life sciences. W tabeli OpenAI z premiery Fable 5 i 5.1 pominięto w trzech benchmarkach life sciences, bo odmawiają odpowiedzi na większość pytań. Jeśli twoja praca dotyka medycyny albo biologii, sprawdź to najpierw.
- Monitorowalność. OpenAI pisze, że zapisane rozumowanie Astry jest trudniejsze do monitorowania niż w GPT-5.6 Sol.
Co bym wybrał
| Praca | Model | Dlaczego |
|---|---|---|
| Długie przebiegi agentowe, prompty poniżej 272 tys. | GPT-6 Astra | Ten sam wynik za mniej niż połowę kosztu pełnego przebiegu. |
| Długie zmiany na repozytoriach | GPT-6 Astra | Wygrywa DeepSWE w Codeksie, 68% do 64%. |
| Prompty regularnie powyżej 272 tys. tokenów | Claude Fable 5.1 | Jedna stawka w całym oknie 1 mln, a całe zapytanie do Astry drożeje dwukrotnie na wejściu. |
| Pętle mocno oparte na cache z krótkimi odpowiedziami | Claude Fable 5.1 | Cache za jedną czwartą stawki Astry. |
| Praca w terminalu i pytania o codebase | Claude Fable 5.1 | Wygrywa Terminal-Bench 4.0 i SWE-Atlas-QnA w Claude Code, minimalnie. |
W zdolnościach remis. O rachunku decydują objętość wyjścia, długość promptów i udział cache.
Krok niżej w ofercie Anthropic opisuję w GPT-6 Astra kontra Claude Opus 5, a szerszy obraz premiery Astry w GPT-6 Astra kontra Claude.
Co zmieniłoby moje zdanie
Przebieg w tym samym narzędziu. Każda liczba programistyczna tutaj łączy model z narzędziem jego własnego producenta.
Zmiana którejś ze stawek za cache albo reguły 272 tys. w OpenAI. To dwa wiersze, na których Fable 5.1 dziś wygrywa.
Kolejna wersja indeksu. Różnica 0,56 punktu może się odwrócić po zmianie wag.
Pytania, które padły
Czy GPT-6 Astra jest lepsza od Claude Fable 5.1?
Są na równi. Artificial Analysis Intelligence Index v4.3 daje Claude Fable 5.1 53,37, a GPT-6 Astra 52,81, co Artificial Analysis opisuje jako remis na prowadzeniu, a w Coding Agent Index oba mają 62. W ramach tego remisu Claude Code z Fable 5.1 wygrywa Terminal-Bench 4.0 i SWE-Atlas-QnA, a Codex z Astrą wygrywa DeepSWE, czyli długie zadania na repozytoriach.
Co jest tańsze, GPT-6 Astra czy Claude Fable 5.1?
W cenniku kosztują tyle samo, $10 za milion tokenów wejściowych i $50 za wyjście. Na pełnym obciążeniu tańsza jest Astra: Artificial Analysis wydało $5 324 na przebieg indeksu na Astrze wobec $13 129 na Fable 5.1 i zmierzyło $7,47 na zadanie programistyczne wobec $12,39. Fable 5.1 jest tańszy na cache, $0,25 wobec $1, i na promptach powyżej 272 tys. tokenów wejścia, gdzie całe zapytanie do Astry kosztuje $20 za wejście i $75 za wyjście.
Co jest szybsze, GPT-6 Astra czy Claude Fable 5.1?
Fable 5.1 generuje szybciej, ok. 65 tokenów wyjściowych na sekundę wobec 53 Astry w pomiarach Artificial Analysis. Astra zwykle kończy pierwsza, bo pisze dużo mniej: na agentach kodujących Codex z Astrą potrzebował średnio 29,4 minuty na zadanie wobec 34,8 w Claude Code z Fable 5.1.
Wybrać GPT-6 Astra czy Claude Fable 5.1?
GPT-6 Astra do długich przebiegów agentowych z promptami poniżej 272 tys. tokenów, gdzie dorównuje Fable 5.1 wynikiem za mniej niż połowę kosztu pełnego przebiegu. Claude Fable 5.1 do promptów powyżej 272 tys. tokenów, do pętli mocno opartych na cache z krótkimi odpowiedziami i dla zespołów pracujących w Claude Code.
Jeśli wybierasz model frontier do długo działających agentów, strona kontaktowa to najszybsza droga do mnie.