Anthropic wydał Opus 5 24 lipca 2026 roku

Claude Opus 5do pracy, która wytrzymuje weryfikację

Od premiery użytkownicy Felo PRO mogą bezpłatnie wypróbować Claude Opus 5 przez 7 dni.

Anthropic Claude Opus 5 official illustration framed in Felo blue
Źródło wizualne: Anthropic; Felo dodało ramkę bez zmiany oryginalnych elementów.

Teraz w Felo Search

Zadawaj trudniejsze pytania. Otrzymuj odpowiedź wyszukiwania, która wytrzymuje sprawdzenie.

Claude Opus 5 jest teraz dostępny w Felo Search dla pytań wymagających głębszego badania, mocniejszej syntezy źródeł i końcowej odpowiedzi sprawdzonej względem dowodów.

Wypróbuj Opus 5 w Felo Search

01

Śledź właściwe pytanie

Przeanalizuj ograniczenia stojące za niejednoznacznym poleceniem, zamiast zatrzymywać się na pierwszej pozornie wiarygodnej interpretacji.

02

Waż sprzeczne dowody

Połącz konkurencyjne źródła i twierdzenia w jednym badaniu, a następnie wskaż, gdzie dowody są zgodne, a gdzie nie.

03

Wróć z mniejszą liczbą otwartych spraw

Użyj odpowiedzi jako gotowego do podjęcia decyzji punktu wyjścia, zachowując widoczne rozumowanie, zastrzeżenia i otwarte pytania.

Szybki przewodnik

Przełącz się na Claude Opus 5 w Felo

Otwórz wybór modeli, wybierz Claude Opus 5 i rozpocznij zadanie w tym samym obszarze roboczym.

24 lip.

premiera 2026

Najnowszy model Opus firmy Anthropic

$5 / $25

wejście / wyjście API

Za 1 mln tokenów, ta sama cena bazowa co Opus 4.8

~2,5x

szybkość Fast mode

Dostępny za 2x ceny bazowej na platformie Anthropic

Sprawdź + popraw

Praca długotrwała

Planowanie, użycie narzędzi, kontrole i iteracja

Różnica Opus

Nie kończ na pierwszym rozwiązaniu, które działa.

Anthropic pozycjonuje Opus 5 do pracy, w której liczy się trwały osąd: znaleźć problem u podstaw, zweryfikować wynik i wrócić do pracy, gdy dowody nie wystarczają.

01

Dotrzyj do źródła problemu

Przy trudnych błędach i niejednoznacznych zadaniach zacznij od dowodów, ograniczeń i rzeczywistej przyczyny źródłowej, a nie od powierzchownej poprawki.

02

Sprawdź pracę przed przekazaniem

Użyj modelu, który potrafi przeanalizować własne wyjście, przetestować założenia i wychwycić problem, zanim później odkryje go człowiek.

03

Zachowaj ciągłość przez poprawki

Włącz kod, materiały źródłowe, wyniki narzędzi i nowe ograniczenia do jednego dłuższego zadania, zamiast redukować pracę do oderwanych promptów.

Wybór modelu

Porównaj koszt tokena z kosztem pomyłki.

Poniższe ceny to oficjalne publiczne stawki API, a nie ceny subskrypcji lub użycia Felo. Pokazują kompromis bez udawania, że niepowiązane testy opóźnień różnych dostawców da się bezpośrednio porównać.

Czynnik decyzji
Claude Opus 5
GPT-5.6 Sol
Kimi K3
Claude Opus 4.8
Cena API / 1 mln tokenów
$5 wejście / $25 wyjście
$5 wejście / $0,50 cache / $30 wyjście
$3 wejście / $0,30 cache / $15 wyjście
$5 wejście / $25 wyjście
Szybkość i pojemność
Domyślna szybkość albo Fast mode około 2,5x szybciej za 2x cenę bazową.
OpenAI określa Sol jako Fast; okno kontekstu 1,05M tokenów.
Kontekst 1 048 576 tokenów; przepustowość zależy od poziomu limitu konta.
Poprzednia baza Opus. Porównaj bieżącą dostępność i opóźnienie w swoim workflow.
Najlepszy wybór dla
Długiej pracy o dużych konsekwencjach, która wymaga weryfikacji i starannej iteracji.
Złożonej pracy profesjonalnej z szybką odpowiedzią flagship i bardzo dużym oknem kontekstu.
Długofalowego coding i kompleksowej pracy z wiedzą przy niższej publicznej cenie tokena.
Istniejących workflow Opus, gdzie ciągłość jest ważniejsza niż natychmiastowa migracja.
Wybierz, gdy
Zadanie musi być ukończone, sprawdzone i możliwe do obrony, a nie tylko zarysowane.
Chcesz warstwę flagship OpenAI, a jej profil szybkości i kontekstu pasuje do zadania.
Potrzebujesz kontekstu 1M tokenów i chcesz kontrolować koszt przez caching oraz effort reasoning.
Oceniasz kontrolowaną migrację z ustalonej bazy poprzedniej generacji.

Oficjalne publiczne ceny API sprawdzono 25 lipca 2026 roku. Łączny koszt zadania zależy też od długości wyjścia, wejścia z cache, ustawień effort, wywołań narzędzi, ponowień i weryfikacji człowieka.

Oficjalne wykresy benchmarków

Co pokazują wykresy kosztu i wydajności Anthropic

Te oficjalne wykresy zestawiają wydajność modelu z raportowanym kosztem ewaluacji na różnych poziomach effort. To użyteczny kontekst dla decyzji kosztowej, ale są to wyniki opublikowane przez dostawcę, a nie niezależne testy Felo.

Oficjalny przegląd możliwości benchmarków Claude Opus 5 Anthropic porównujący Opus 5, Fable 5, Opus 4.8 i GPT-5.6 Sol w coding, pracy z wiedzą, wyszukiwaniu, użyciu komputera, procesach biznesowych, zdrowiu i biologii

Oficjalny przegląd możliwości przez rodziny benchmarków

Macierz zadań Anthropic porównuje opublikowane wyniki Opus 5, Fable 5, Opus 4.8 i GPT-5.6 Sol w coding, pracy z wiedzą, wyszukiwaniu, użyciu komputera, procesach biznesowych i innych obszarach.

Oficjalny wykres Anthropic dla coding agentowego według poziomu effort, porównujący Opus 5, Fable 5, Opus 4.8 i GPT-5.6 Sol według kosztu na zadanie

Coding agentowy według poziomu effort

Artificial Analysis Coding Agent Index: oficjalny wykres porównuje wynik z raportowanym kosztem na zadanie w dostępnych ustawieniach effort.

Oficjalny wykres Anthropic dla agentowego użycia komputera według poziomu effort, porównujący Opus 5, Fable 5, Opus 4.8 i GPT-5.6 Sol według kosztu na zadanie

Agentowe użycie komputera według poziomu effort

OSWorld 2.0: oficjalny wykres porównuje wydajność użycia komputera z raportowanym kosztem na zadanie w ustawieniach effort.

Oficjalny wykres Anthropic dla zadań wiedzy ze świata rzeczywistego według poziomu effort, porównujący Opus 5, Fable 5, Opus 4.8 i GPT-5.6 Sol według kosztu benchmarku

Zadania wiedzy ze świata rzeczywistego według poziomu effort

GDPval-AA v2: oficjalny wykres porównuje wynik Elo z raportowanym kosztem pełnego benchmarku w ustawieniach effort.

Oficjalny wykres Anthropic dla wyszukiwania agentowego DeepSearchQA według poziomu effort, porównujący Opus 5, Fable 5 i Opus 4.8 według kosztu na zadanie

Wyszukiwanie agentowe według poziomu effort

DeepSearchQA: oficjalny wykres porównuje wskaźnik zaliczenia zadań wyszukiwania z raportowanym kosztem na zadanie w dostępnych ustawieniach effort.

Wykresy i etykiety benchmarków pochodzą z ogłoszenia Claude Opus 5 Anthropic. Felo dodało tylko zewnętrzną ramkę prezentacji; zawartość wykresów zachowano tak, jak ją opublikowano.

Lepszy punkt wyjścia

Daj Opus 5 zadania, które zasługują na drugie przejście.

Model zasługuje na swoje miejsce, gdy weryfikacja zmienia wynik. To nie są ogólne prompty czatu, lecz wieloetapowe prace, gdzie pominięta zależność, niepoparte twierdzenie lub nieprzetestowany przypadek brzegowy kosztują później czas.

Kod produkcyjny i QA

Zbadaj regresję, odtwórz ją, sprawdź otaczający kod, wdroż ukierunkowaną poprawkę i przetestuj ścieżki, które szybki patch zwykle pomija.

Analiza finansowa i dokumentów

Uzgodnij tabele, przetestuj założenia, porównaj dokumenty źródłowe i przygotuj rekomendację z zachowaniem dowodów oraz zastrzeżeń.

Badanie wymagające wnikliwości

Czytaj konkurencyjne źródła, ujawniaj otwarte pytania, waż dowody i odróżniaj pewną odpowiedź od odpowiedzi rzeczywiście popartej.

Długotrwałe zadania agentowe

Używaj narzędzi, zachowuj ograniczenia zadania, odzyskuj sprawność po częściowych wynikach i prowadź większe zadanie przez świadome punkty kontrolne.

Wypróbuj zadanie z konsekwencjami

01

Wnieś prawdziwy kontekst

Dodaj kod, dokumenty, wymagania i dowody, które użyteczna odpowiedź musi uwzględnić.

02

Poproś o plan weryfikacji

Określ, co musi być sprawdzone, zanim praca zostanie uznana za ukończoną, a nie tylko co stworzyć.

03

Porównaj końcowy artefakt

Użyj tego samego zadania w czołowych modelach Felo. Oceń nie tylko odpowiedź, lecz także testy, zastrzeżenia i osąd stojące za nią.

Wybierz Claude Opus 5, gdy jest dostępny w aktywnym wyborze modeli na Twoim koncie.

Otwórz Felo LLM Playground

FAQ Claude Opus 5

Claude Opus 5 to model poziomu Opus firmy Anthropic wydany 24 lipca 2026 roku. Anthropic pozycjonuje go do długotrwałych agents, złożonej inżynierii oprogramowania, profesjonalnej pracy z wiedzą i zadań korzystających z weryfikacji oraz starannej iteracji.

Użyj modelu, który sprawdza pracę.

Ustaw Claude Opus 5 obok innych czołowych modeli w Felo, a następnie przetestuj go na zadaniu, w którym pierwsza wiarygodna odpowiedź nie wystarczy.

Wypróbuj Opus 5 w Felo

Zacznij w Felo AI Search i wybierz model, gdy jest dostępny.