22 września 2026 Anthropic udostępnił Claude Opus 5.5. Firma obiecuje poziom Claude Fable 5.1 w większości zadań przy koszcie o 40 procent niższym niż w przypadku Opusa 5. Półtorej godziny później OpenAI odpowiedziało tańszym GPT-6 Sol, więc sprawdziłem, co z tych obietnic potwierdzają niezależne testy.

Grafika premierowa Anthropic z napisem Claude Opus 5.5 na tle horyzontu o zachodzie słońca
Grafika z ogłoszenia premiery Claude Opus 5.5 (Anthropic, anthropic.com).

Claude Opus 5.5: co nowego

Oszczędność bierze się z dwóch źródeł: cena za token spadła o 20 procent, a model zużywa mniej tokenów na to samo zadanie. W API płacisz 4 dolary za milion tokenów wejściowych i 20 za odpowiedź. Opus 5 kosztował 5 i 25, Fable 5.1 kosztuje 10 i 50. Odpowiedzi mają powstawać o ponad 30 procent szybciej.

Anthropic poprawił też styl pisania, na który narzekano przy Opusie 5: najważniejsza informacja ma trafiać na początek, żargonu ma być mniej. Model mieści w jednej rozmowie milion tokenów, a domyślny poziom wysiłku, czyli to, jak długo model myśli przed odpowiedzią, spadł z wysokiego na średni.

Gdzie jest dostępny i dla kogo

Opus 5.5 działa na planach Pro, Max, Team i Enterprise. Darmowe konto go nie dostaje. Anthropic podniósł przy okazji pięciogodzinne limity użycia. Najważniejsza zmiana dla osób z planem Pro: w Claude Code, narzędziu do programowania w terminalu, domyślnym modelem jest teraz Opus, a nie jak dotąd Sonnet. Sonnet 5.5 i Haiku 5.5 mają dołączyć w najbliższych tygodniach.

Claude Opus 5.5 w benchmarkach: porównanie z Fable 5.1 i GPT-6 Astra

Benchmarki to standardowe testy porównawcze modeli. Anthropic postawił na zadania, w których model sam doprowadza pracę do końca.

Test Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra
Terminal-Bench 4.0 (praca w terminalu)66,4%55,8%52,3%57,9%
FrontierCode (programowanie)54,4%50,3%48,0%53,3%
GDPval-AA (praca biurowa, punkty)1846173517081542
Humanity's Last Exam z narzędziami (wiedza)67,7%65,6%63,6%57,2%
AutomationBench (procesy biznesowe)40,0%31,4%26,9%41,4%
Terminal-Bench-Science (zadania naukowe)58,7%52,6%29,0%64,6%

Źródło: strona premiery Claude Opus 5.5 (Anthropic). Opus 5.5 przy maksymalnym poziomie wysiłku, w Terminal-Bench o stopień niższym. Wyróżnione wyniki Astry to testy, w których model OpenAI wygrywa.

Opus 5.5 prowadzi w czterech z sześciu testów, GPT-6 Astra wygrywa w automatyzacji procesów i w zadaniach naukowych. Sam Anthropic dodaje uczciwie, że realna różnica między Opusem 5.5 a Fable 5.1 jest mniejsza, niż sugerują te liczby. Do najtrudniejszego rozumowania i długich zadań wykonywanych samodzielnie przez model firma nadal poleca Fable.

Co mówią niezależne testy

W rankingu Artificial Analysis Opus 5.5 zajął pierwsze miejsce z 58 punktami, przed GPT-6 Astra i Fable 5.1 (po 53). Ma to swoją cenę: przy maksymalnym wysiłku model zużył na zadanie około 119 tysięcy tokenów odpowiedzi, Astra około 27 tysięcy. W ich własnym pomiarze w teście Terminal-Bench Opus 5.5 miał 59,6 procent, czyli mniej niż w tabeli Anthropic. Na Hacker News, forum programistów, przeważa opinia, że najlepszy stosunek jakości do ceny daje średni poziom wysiłku.

Warto zajrzeć też do karty systemowej, czyli dokumentu o bezpieczeństwie modelu. Opus 5.5 częściej niż poprzednicy wykonuje złośliwe polecenia ukryte w tekście, który użytkownik sam wkleja do rozmowy. Łatwiej też wierzy w niesprawdzone zapewnienia, takie jak „mam uprawnienia”. Jeśli wklejasz mu cudze maile albo strony, sprawdzaj, co z nimi robi.

Claude Opus 5.5 czy GPT-6 Sol

W zestawieniu wyników obu firm Opus 5.5 wypada lepiej od GPT-6 Sol, ale Sol jest w API dwa razy tańszy. Szczegóły opisałem we wpisie o GPT-6 Sol i Lunie. Wkrótce dorzucę film z własnym testem i, tak jak przy Opusie 5, sprawdzę, gdzie model zawodzi. Odpowiedzi kilku modeli na jedno polecenie porównasz w porównywarce AI. Jeśli chcesz lepiej wykorzystywać Claude'a, zacznij od kursu Skuteczne Prompty.

Najczęstsze pytania

Czy Claude Opus 5.5 jest za darmo?

Nie. Opus 5.5 jest dostępny na płatnych planach Pro, Max, Team i Enterprise oraz w API. Darmowe konto Claude go nie dostaje.

Ile kosztuje Claude Opus 5.5 w API?

4 dolary za milion tokenów wejściowych i 20 dolarów za milion tokenów odpowiedzi. To o 20 procent mniej niż Opus 5 i o 60 procent mniej niż Claude Fable 5.1.

Czym Claude Opus 5.5 różni się od Fable 5.1?

Według Anthropic Opus 5.5 osiąga poziom Fable 5.1 w większości zadań, jest szybszy i dużo tańszy. Fable 5.1 firma nadal poleca do najtrudniejszego rozumowania i długich zadań wykonywanych samodzielnie przez model.