Anthropic opublikowała Opus 5.5 22 września 2026 roku

Claude Opus 5.5więcej pracy, mniej tokenów

Pierwszy model z rodziny Claude 5.5. Osiąga poziom Claude Fable 5.1 w większości zadań, kosztuje o 40% mniej w eksploatacji niż Opus 5 i generuje odpowiedź ponad 30% szybciej.

22 wrz
Premiera 2026
Pierwszy model z rodziny Claude 5.5
4 $ / 20 $
API wejście / wyjście
Za milion tokenów, wobec 5 $ / 25 $ w Opus 5
medium
Domyślny effort
O poziom niżej niż Opus 5, który startuje z high
1 mln / 128 tys.
Kontekst / maks. wyjście
To samo okno co Opus 5, wiedza do czerwca 2026

Dostępny w wyszukiwaniu Felo

Wrzuć cały zestaw dokumentów, a potem zadaj pytanie.

Claude Opus 5.5 jest dostępny w wyszukiwaniu Felo przy zadaniach z długim wejściem: uzgadnianie liczb między plikami, prześledzenie twierdzenia do źródła i zwrócenie odpowiedzi, którą można komuś przekazać.

Wypróbuj Opus 5.5 w wyszukiwaniu Felo

01

Utrzymać cały kontekst

Okno kontekstu miliona tokenów i wiedza do czerwca 2026 roku. Długi wątek, całe repozytorium albo zestaw dokumentów mieszczą się w jednym zadaniu.

02

Sprawdzić liczbę, nie tylko wniosek

W wewnętrznym teście Anthropic 16 z 18 raportów przeszło próg jakości. Jedna wymyślona liczba lub cytat wystarczyłyby, by całe zadanie przepadło.

03

Powiedzieć, co zrobiono i czego brakuje

Anthropic przeprojektowała sposób komunikacji modelu: najważniejsze informacje są na początku, a raport wprost mówi, co gotowe, co ustalono i co pozostaje otwarte.

Krótka instrukcja

Przełącz na Claude Opus 5.5 w Felo

Claude Opus 5.5 pojawia się w wyborze modelu obok innych wiodących modeli na twoim koncie.

Otwórz wybór modelu, wybierz Claude Opus 5.5 i rozpocznij zadanie w tym samym obszarze roboczym.

Czym różni się Opus 5.5

Sam spadek kosztów jest argumentem.

Anthropic stawia na wydajność, a nie na wyższy wynik w benchmarku: mniej tokenów na zadanie, niższa cena za token i o 40% niższy koszt przy typowych obciążeniach. Właśnie to sprawia, że długotrwała praca agenta staje się opłacalna.

01

Dokończyć ogromną robotę

Anthropic podaje, że jeden z pierwszych testerów przeaudytował i naprawił bazę kodu o 200 000 linii w niecałe trzy godziny, podczas gdy Opus 5 potrzebował ponad 20 godzin i 2,5 raza więcej tokenów.

02

Złapać błąd przed scaleniem

Deloitte podaje, że nawet na najniższym poziomie effort Opus 5.5 wykrył 72% znanych błędów w przeglądzie kodu, wobec 56% dla Opus 5 na high, przy mniejszej liczbie fałszywych alarmów.

03

Zostawić raport, z którego da się korzystać

Teksty są krótsze i lepiej ustrukturyzowane. Box podaje odpowiedzi o 40% mniej rozwlekłe bez utraty dokładności i przy jednej trzeciej tokenów Opus 5.

Wybór modelu

Porównaj koszt tokenu z kosztem pomyłki.

Poniższe ceny to oficjalne publiczne stawki API za milion tokenów, a nie ceny subskrypcji ani użycia w Felo. Wiersz effort jest tak samo ważny jak wiersz ceny: ten sam prompt może kosztować bardzo różnie w zależności od tego, z jakiego poziomu startuje model.

Czynnik decyzyjny
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
Cena API / milion tokenów
4 $ wejście / 20 $ wyjście
10 $ wejście / 50 $ wyjście
5 $ wejście / 25 $ wyjście
10 $ wejście / 50 $ wyjście
Odczyt pamięci podręcznej / milion tokenów
0,20 $, czyli 0,05 ceny wejścia
0,25 $, czyli 0,025 ceny wejścia
0,50 $, standardowy mnożnik 0,1
Zależy od dostawcy i poziomu pamięci podręcznej
Domyślny effort
medium. Myślenie adaptacyjne jest zawsze włączone i nie da się go wyłączyć.
high. Myślenie adaptacyjne jest zawsze włączone.
high. Myślenie można wyłączyć na poziomie high i niżej.
Ustawia wywołujący przy każdym żądaniu
Gdzie się opłaca
Długotrwałe kodowanie agentowe, przegląd kodu i praca z wiedzą w cenie średniej półki.
Najtrudniejsze rozumowanie i najdłuższe przebiegi agenta, gdy Opus 5.5 nie wystarcza nawet na wyższym effort.
Poprzednia baza Opus. Porównaj realną dostępność i opóźnienia na własnym ruchu.
Flagowy poziom OpenAI w górnej części cennika.

Publiczne stawki API i wartości domyślne sprawdzono 23 września 2026 roku w ogłoszeniu Claude Opus 5.5 od Anthropic, na stronach modeli Claude Platform i na stronie GPT-6 Astra od OpenAI. Cena za token to tylko część całkowitego kosztu zadania. Deklaracja wydajności Anthropic to spadek kosztów o 40% przy typowych obciążeniach, łączący niższą cenę za token z mniejszą liczbą tokenów na zadanie.

Wyniki opublikowane przez Anthropic

Gdzie Opus 5.5 prowadzi, a gdzie nie.

Anthropic opublikowała własne liczby obok Fable 5.1, Opus 5, GPT-6 Astra i GPT-5.6 Sol. Dwa z czterech wykresów poniżej pokazują dokładność względem kosztu zadania, a nie samą dokładność, bo właśnie takie porównanie robi Anthropic.

Opublikowana przez Anthropic tabela porównawcza Claude Opus 5.5 z Fable 5.1, Opus 5, GPT-6 Astra i GPT-5.6 Sol

Pełne opublikowane porównanie

Kodowanie agentowe, praca z wiedzą, procesy biznesowe, rozumowanie interdyscyplinarne, badania naukowe, obsługa komputera i odczyt wykresów w pięciu zmierzonych modelach.

Opublikowane przez Anthropic wykresy kodowania agentowego dla Claude Opus 5.5

Kodowanie agentowe

Terminal-Bench 4.0, FrontierCode v1.1 i CursorBench 4.0 jako dokładność względem kosztu zadania.

Opublikowane przez Anthropic wykresy pracy z wiedzą dla Claude Opus 5.5

Praca z wiedzą

GDPval-AA v2.1 w 44 zawodach, AutomationBench i WANDR, benchmark zbierania danych od Perplexity.

Opublikowane przez Anthropic wykresy obsługi komputera i rozumowania dla Claude Opus 5.5

Obsługa komputera i rozumowanie

OSWorld 2.0, Humanity's Last Exam i Chartography, gdzie ostatni mierzy dokładność odczytu wartości z wykresu.

Opublikowane przez Anthropic wykresy dokładności względem kosztu zadania dla Claude Opus 5.5

Dokładność względem kosztu zadania

Główna teza Anthropic to nie wyższy wynik za każdą cenę, lecz ten sam lub lepszy wynik za ułamek kosztu jednej próby.

Liczby opublikowane przez dostawcę. O ile nie zaznaczono inaczej, Anthropic uruchamiała Opus 5.5 z myśleniem adaptacyjnym na max effort i oceniała go z włączonymi zabezpieczeniami produkcyjnymi. Gdy zabezpieczenia interweniowały, zadania z cyberbezpieczeństwa kończył Opus 4.8, a z biologii Opus 5, co prawdopodobnie obniża opublikowane wyniki Opus 5.5 w tych benchmarkach. Liczby dla GPT-6 Astra i GPT-5.6 Sol pochodzą od OpenAI. Różnice w benchmarkach między dostawcami to słaba wskazówka co do rzeczywistych różnic, co sama Anthropic mówi o tych danych.

Jeśli już używasz Opus 5

Cztery zmiany, które psują istniejący kod.

Anthropic wymienia cztery zmiany niekompatybilne dla integracji działających już na Claude Opus 5, plus piątą, która zmienia kształt odpowiedzi, nie powodując błędu żądania. Warto je przeczytać przed podmianą identyfikatora modelu, bo trzy z nich zwracają błąd 400 zamiast cichej degradacji.

01

Myślenia nie da się już wyłączyć

W Opus 5 myślenie można było wyłączyć na poziomie high i niżej. W Opus 5.5 jest zawsze włączone, a zarówno wyłączenie, jak i ręczny budżet tokenów zwracają błąd 400. Jedynym regulatorem staje się effort, a wartość domyślna zmienia się z high na medium.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

Wymuszone wywołanie narzędzia jest odrzucane

tool_choice ustawione na "any" lub na konkretne narzędzie zwraca błąd 400, również w punkcie końcowym zliczania tokenów. Użyj auto razem ze ścisłym wywoływaniem narzędzi lub wyjściem strukturalnym i powiedz w prompcie, kiedy narzędzie ma zastosowanie.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

Bloki myślenia są przypisane do modelu

Każdy blok myślenia zapisuje, który model go wytworzył. Opus 5.5 czyta bloki z Opus 5 oraz wcześniejszych modeli Opus, Sonnet i Haiku, ale nie z Fable ani Mythos. Jeśli router przeniesie rozmowę na inny model, kolejne tury przebiegną bez wcześniejszego rozumowania.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 zachowują myślenie; pozostałe modele je tracą

04

Stare narzędzie obsługi komputera zniknęło

W Claude API i Google Cloud narzędzie computer_20251124 zwraca błąd 400. Zadeklaruj zamiast niego zestaw computer_toolset_20260801, usuń nagłówek beta i dostosuj pętlę agenta do bloków member tool_use. W Amazon Bedrock stare narzędzie nadal działa.

computer_20251124 -> computer_toolset_20260801

Effort to teraz jedyny regulator myślenia

Skoro myślenia nie można wyłączyć, reguluje się effort. Opus 5.5 obsługuje wszystkie pięć poziomów i startuje z medium, o poziom niżej niż Opus 5. Anthropic zaleca ponowne przejście przez poziomy na własnych ewaluacjach zamiast przenoszenia ustawienia oraz ustawienie dużego max_tokens na wyższych poziomach, bo tokeny myślenia liczą się do tego limitu, nawet gdy tekst rozumowania nie jest zwracany.

Poziom
Domyślny
Zalecane zastosowanie według Anthropic
low
Nie
Najoszczędniejszy poziom z pewną utratą możliwości. Anthropic zaleca go do prostych zadań i subagentów.
medium
Tak
Domyślna wartość dla Opus 5.5. Według Anthropic dorównuje Opus 5 na high lub go przewyższa w ewaluacjach kodowania i pracy z wiedzą.
high
Nie
Domyślna wartość większości innych modeli Claude. Złożone rozumowanie i trudne problemy programistyczne.
xhigh
Nie
Długotrwała praca agentowa i programistyczna powyżej 30 minut, z budżetami tokenów rzędu milionów.
max
Nie
Najgłębsze dostępne rozumowanie bez ograniczeń wydatku tokenów. Zarezerwuj dla zadań, w których zmierzyłeś wzrost jakości.

Effort to sygnał behawioralny, a nie sztywny budżet tokenów: na niższym poziomie model nadal myśli nad naprawdę trudnymi problemami, tylko mniej niż na wyższym. Anthropic zauważa też, że na tym samym poziomie Opus 5.5 myśli więcej na turę niż Opus 5, zwłaszcza na xhigh i max, więc ustawienie przeniesione z Opus 5 da dłuższe i droższe tury.

Gdzie pasuje

Praca zbyt długa, by przy niej siedzieć.

Opus 5.5 się opłaca, gdy zadanie trwa godziny, obejmuje więcej plików, niż jedna osoba jest w stanie ogarnąć, albo daje wynik, który musi sprawdzić ktoś inny. To przypadki opisywane przez Anthropic i jej pierwszych testerów, a nie zwykłe prompty czatu.

Migracje i audyty całego repozytorium

Przeprowadzić zmianę przez duże repozytorium, aż przejdą testy, zamiast zatrzymywać się na pierwszej sensownej łatce. Anthropic podaje migrację 680 000 linii ukończoną przez jednego testera w niecały dzień.

Przegląd kodu, który znajduje prawdziwy błąd

Tester Anthropic o nazwie Column podał, że znalazł błąd, sprawdzając zewnętrzną dokumentację integracji zewnętrznej, którą kilka commitów wcześniej zamodelowano błędnie.

Analiza finansowa i dokumentowa

Zbudować model, a potem jednostronicowe podsumowanie, zachowując zastrzeżenia. Anthropic podaje analizę fuzji wykonaną w 63 minuty wobec 93 dla Opus 5, za połowę kosztu.

Długotrwale działające zespoły agentów

Model deleguje zadania subagentom i dopasowuje tempo do budżetu czasu. Anthropic zaleca przekazanie architekturze wieloagentowej sygnału upływu czasu, żeby równolegliła pracę zamiast ją szeregować.

Przetestuj na długim zadaniu

01

Przynieś prawdziwy kontekst

Dodaj repozytorium, dokumenty i wymagania, które użyteczna odpowiedź musi uwzględnić. Okno miliona tokenów istnieje właśnie po to.

02

Podaj warunek zakończenia

Powiedz, co musi być spełnione, żeby pracę uznać za skończoną. Rada Anthropic do pracy bez nadzoru to trzymanie części zadania na liście, którą model aktualizuje.

03

Porównaj gotowy efekt

Uruchom to samo zadanie na Opus 5.5, Opus 5 i Fable 5.1 w Felo. Porównuj nie tylko odpowiedź, ale też testy, zastrzeżenia i zużycie tokenów.

Wybierz Claude Opus 5.5, gdy pojawi się w wyborze modeli na twoim koncie.

Wypróbuj Opus 5.5 w Felo

Częste pytania o Claude Opus 5.5

Claude Opus 5.5 to model Anthropic do długotrwałego kodowania agentowego i pracy z wiedzą, opublikowany 22 września 2026 roku jako pierwszy model z rodziny Claude 5.5. Według Anthropic osiąga poziom Claude Fable 5.1 w większości zadań, a jego eksploatacja kosztuje o 40% mniej niż Claude Opus 5.

Uruchom długie zadanie w niższej cenie.

Postaw Claude Opus 5.5 obok innych wiodących modeli w Felo i sprawdź go na pracy, którą odkładasz, bo zajmuje godziny.

Wypróbuj Opus 5.5 w Felo

Zacznij od wyszukiwania Felo AI i wybierz model tam, gdzie jest dostępny.