Claude Opus 4.8
Najnowszy flagowy model Anthropic. Wydany 28 maja 2026 roku z silniejszym kodowaniem agentowym, dynamicznymi przepływami pracy, które rozgałęziają setki równoległych subagentów, oraz 3-krotnie tańszym trybem szybkim w tej samej regularnej cenie co Opus 4.7.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 4.8 to flagowa wersja Anthropic z 28 maja 2026 r., bezpośrednie ulepszenie Opus 4.7 w tej samej cenie katalogowej dostawcy 5 USD/25 USD. Osiąga najwyższe wyniki SWE-bench Pro (69,2%), OSWorld-Verified (83,4%), MCP-Atlas (82,2%) i Humanity's Last Exam (57,9% z narzędziami), jakie kiedykolwiek dostarczył Anthropic, i jest pierwszym modelem, który przekroczył 10% w standardzie all-pass dla agentów prawnych.
Dwie istotne zmiany strukturalne, o których warto wiedzieć, to dynamiczne przepływy pracy (planowanie zadania, rozdzielanie go na setki równoległych podagentów w jednej sesji) oraz obniżka cen w trybie szybkim do 2,5-krotnej prędkości za 10 USD/50 USD za 1 milion tokenów — trzy razy taniej niż tryb szybki w poprzednich modelach Claude. Poziomy wysiłku rozszerzają się na wysoki (domyślny), dodatkowy i maksymalny. Sam Anthropic określa to wydanie jako „skromne, ale namacalne ulepszenie”, a nie skok.
Czym jest Claude Opus 4.8?
28 maja 2026
Dwie zmiany strukturalne mają znaczenie dla użytkowników Okou. Po pierwsze, dynamiczne przepływy pracy: model może zaplanować zadanie i rozesłać je do setek równoległych subagentów w jednej sesji, co Anthropic opisuje jako krok w kierunku obsługi migracji na skalę bazy kodu obejmujących setki tysięcy linii kodu w jednym przebiegu. Po drugie, tryb szybki z prędkością 2.5× kosztuje teraz 10 USD / 50 USD za 1M tokenów — trzy razy taniej niż tryb szybki w poprzednich modelach Claude. Poziomy wysiłku rozszerzają się do trzech poziomów: wysoki (domyślny), ekstra (xhigh w Claude Code) i maksymalny.
Niezależne odczyty (LLM Stats, VentureBeat, Vellum) potwierdzają względne uporządkowanie w stosunku do 4.7 i konkurentów: 4.8 wygrywa w każdej komórce opublikowanego zestawu porównawczego Anthropic, z wyjątkiem Terminal-Bench 2.1, gdzie GPT-5.5 nadal prowadzi (78.2% vs 74.6% dla 4.8). Skok z 4.7 do 4.8 na SWE-bench Pro wynosi +4.9 punktów; na USAMO 2026 to +27.4; na nowym 1M-tokenowym GraphWalks long-context F1 to +27.8. Traktuj wyniki absolutne jako kierunkowe — SWE-bench Verified zbliża się do nasycenia we wszystkich modelach granicznych.
Co jest godne uwagi w Claude Opus 4.8
Architektura nagłówków i funkcje możliwości.
Opus 4.8 zachowuje okno kontekstowe 1M tokenów i maksymalną wydajność 128K z Opus 4.7, rozliczane według standardowych cen wejściowych w całym oknie. Kontrola wysiłku rozszerza się do trzech poziomów: wysoki (nowe domyślne), bardzo wysoki (xhigh w Claude Code) i maksymalny. Wiadomości API akceptują teraz wpisy systemowe w trakcie rozmowy bez przerywania buforowania podpowiedzi. Dynamiczne przepływy pracy pozwalają Claude planować i wysyłać setki równoległych subagentów w jednej sesji. Tryb szybki działa z prędkością ~2,5× standardowej za 10 USD / 50 USD za 1M tokenów. Multimodalne dane wejściowe w tekście, wizji i kodzie pozostają niezmienione.
Specyfikacje w skrócie
Benchmarki Claude Opus 4.8
Wyniki zgłoszone przez dostawców z karty systemowej Opus 4.8 Anthropic, z porównaniami do Opus 4.7, GPT-5.5 i Gemini 3.1 Pro przy maksymalnym wysiłku i średnich z 5 prób. 4.8 prowadzi w sześciu z siedmiu komórek publikowanych przez Anthropic; GPT-5.5 utrzymuje prowadzenie w Terminal-Bench 2.1. SWE-bench Verified zbliża się do nasycenia we wszystkich modelach granicznych — trudniejszy zestaw SWE-bench Pro jest bardziej trwałym sygnałem.
Cennik Claude Opus 4.8
Cena katalogowa dostawcy, za 1M tokenów.
Jak Claude Opus 4.8 zachowuje się w praktyce
Obserwowane zachowanie z uruchomień agentów produkcyjnych.
Dynamiczne przepływy pracy
Główna nowa funkcja. Opus 4.8 może zaplanować zadanie, a następnie uruchomić setki równoległych podagentów w ramach tej samej sesji — Anthropic pozycjonuje to jako drogę do migracji na skalę bazy kodu obejmującej setki tysięcy linii w jednym uruchomieniu. Na Okou oznacza to, że pojedyncze uruchomienie agenta może orkiestrować pracę rozproszoną, która wcześniej wymagała zewnętrznego planowania.
Edycje kodu pierwszej próby
Anthropic podaje, że Opus 4.8 jest około cztery razy mniej podatny na przeoczenie wad podczas przeglądania kodu niż 4.7, a skok +4.9 punktu w SWE-bench Pro (69.2% vs 64.3%) potwierdza to na trudniejszym, mniej nasyconym zestawie kodowania. Wybierz 4.8 dla poprawek, które muszą być czysto zastosowane w wielu plikach.
Przywoływanie długiego kontekstu
Wzrost GraphWalks F1 przy 1M tokenów z 40,3% do 68,1% – największy pojedynczy wzrost w benchmarku w tej wersji. Okno 1M tokenów jest teraz faktycznie użyteczne w górnym zakresie, a nie tylko nominalnie.
Uczciwość i nadmierna pewność siebie
Anthropic zgłasza ponad dziesięciokrotne zmniejszenie nadmiernej pewności siebie w porównaniu do 4.7, 0% w przypadku bezkrytycznego zgłaszania błędnych wyników (pierwszy raz dla rodziny Claude) i 3,7% wskaźnik niepowodzenia w zgłaszaniu ważnych zdarzeń użytkownikowi. Częstotliwość niezgodności wynosi ~1,9, co jest praktycznie równe najlepiej dopasowanemu Mythos Preview Anthropic.
Szybkość i tryb szybki
Standardowa prędkość jest porównywalna z Opus 4.7. Zmiana cen jest głównym tematem: tryb szybki z prędkością 2,5x kosztuje 10 USD / 50 USD za 1 milion tokenów, trzy razy taniej niż tryb szybki w poprzednich modelach Claude. Warto używać do etapów orkiestracji, gdzie liczy się opóźnienie zegara ściennego.
Zastrzeżenie dotyczące wstrzykiwania promptów
Karta systemowa Anthropic zauważa, że 4.8 jest nieco mniej odporny na agentowe wstrzykiwanie promptów niż 4.7 — testy Gray Swan red-teaming pokazują ~9,6% wskaźnik sukcesu ataku w porównaniu do 6,0% w 4.7. Zespoły używające 4.8 w potokach, które obsługują niezaufane dane wejściowe, powinny przejrzeć swoje podejście do piaskownicy.
Najlepsze zadania agenta dla Claude Opus 4.8
Migracja na skalę bazy kodu, która kiedyś wymagała sprintu
Przekaż Opus 4.8 migrację, która dotyka kilkuset plików — zamianę ORM, podniesienie wersji frameworka, poprawkę bezpieczeństwa w monorepo — i pozwól dynamicznym przepływom pracy rozdzielić zadanie na równoległe podagenty w ramach jednej sesji. Skok o +4,9 punktu w SWE-bench Pro i czterokrotne zmniejszenie liczby przeoczonych błędów w przeglądzie kodu to to, co się opłaca w tego rodzaju uruchomieniu.
Uruchomienie badania na 1M tokenów, które faktycznie się trzyma
Wrzuć 200-stronicowy projekt umowy, trzy propozycje konkurencji i opinie prawne z ostatniego kwartału do okna, a następnie poproś Opus 4.8 o oznaczenie każdej klauzuli, która jest bardziej restrykcyjna niż rynkowa. GraphWalks na 1M skaczące z 40.3% do 68.1% sprawia, że tego rodzaju synteza między dokumentami staje się nowo niezawodna.
Orkiestrator agentów, który nie kłamie na temat swojej pracy
Użyj 4.8 jako planisty, który dzieli żądanie na dziesięć kroków, wysyła każdy do tańszych podagentów i raportuje wynik. 0% wskaźnik bezkrytycznego zgłaszania wadliwych wyników, w połączeniu z dziesięciokrotnym spadkiem nadmiernej pewności siebie, jest powodem, dla którego zespoły produkcyjne sięgają po 4.8, gdy własny raport agenta musi być wiarygodny.
Przepływ wrażliwy na opóźnienia, który w końcu się opłaca w trybie szybkim
Tryb szybki z prędkością 2,5x kosztował kiedyś trzy razy więcej niż obecnie (10 USD/50 USD za 1M w porównaniu do poprzedniego poziomu). W przypadku interaktywnych kopilotów, podsumowań na żądanie lub dowolnego kroku, w którym opóźnienie zegara ściennego dominuje w doświadczeniu, tryb szybki 4.8 jest teraz domyślnym wyborem w rodzinie Claude.
Kiedy pominąć Claude Opus 4.8
Pomiń Opus 4.8 w przypadku rutynowych prac o dużej objętości, gdzie Sonnet 4.6 osiąga tę samą jakość za ułamek kosztów, w przypadku odpowiedzi na czacie o krytycznym znaczeniu dla opóźnień, gdzie Kimi K2.7 Code jest znacznie szybszy, w przypadku agentowego kodowania terminalowego, gdzie GPT-5.5 nadal prowadzi w Terminal-Bench 2.1 (78,2% vs 74,6% dla 4.8), oraz w przypadku potoków, które pobierają niezaufane dane wejściowe bez piaskownicy — odporność 4.8 na wstrzykiwanie promptów jest nieco słabsza niż 4.7.
Claude Opus 4.8 vs inne modele
Claude Opus 4.8 vs GPT-5.5
Opus 4.8 prowadzi w sześciu z siedmiu komórek w zestawie porównawczym Anthropic, z największymi różnicami w SWE-bench Pro (69,2% vs 58,6%) i OSWorld-Verified (83,4% vs 78,7%). GPT-5.5 utrzymuje prowadzenie w Terminal-Bench 2.1 (78,2% vs 74,6%). Wybierz 4.8 do kodowania między plikami i agentów do obsługi komputera; wybierz GPT-5.5 szczególnie, gdy dominuje praca sterowana terminalem.
Claude Opus 4.8 vs Gemini 3.1 Pro
Opus 4.8 prowadzi z dużym marginesem w SWE-bench Pro (+15.0) i OSWorld-Verified (+7.2). Oba modele pozostają w granicach szumu na nasyconych benchmarkach naukowych, takich jak GPQA Diamond. Domyślnie używaj 4.8 do pracy agentowej; rozważ Gemini szczególnie, gdy potrzebujesz integracji narzędzi Google.
Podsumowując: czy powinieneś używać Claude Opus 4.8?
Nowa domyślna opcja dla nowych agentów w rodzinie Claude. Migruj z 4.7, gdy możesz ponownie zweryfikować; domyślnie używaj jej bezpośrednio do nowych prac. Zachowaj Sonnet 4.6 jako tańszego konia roboczego pod nią.
Często zadawane pytania
Kiedy wydano Claude Opus 4.8?
Anthropic wydał Opus 4.8 28 maja 2026 roku, 41 dni po Opus 4.7. Jest dostępny dziś we wszystkich produktach Claude, Claude API (identyfikator modelu claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry i Okou.
Jak ceny Opus 4.8 wypadają w porównaniu do 4.7?
Standardowe ceny są identyczne: 5 USD za 1 mln tokenów wejściowych, 25 USD za 1 mln tokenów wyjściowych, 0,50 USD za 1 mln buforowanych danych wejściowych. Zmiana dotyczy trybu szybkiego, teraz 10 USD / 50 USD za 1 mln tokenów przy 2,5-krotnej prędkości — trzy razy taniej niż tryb szybki w poprzednich modelach Claude.
Czym są dynamiczne przepływy pracy?
Nowa funkcja, która pozwala Opus 4.8 planować zadania, a następnie uruchamiać setki równoległych subagentów w ramach jednej sesji. Anthropic pozycjonuje to jako drogę do migracji na skalę bazy kodu obejmującej setki tysięcy linii kodu w jednym uruchomieniu agenta.
Jakie poziomy wysiłku obsługuje Opus 4.8?
Trzy poziomy: wysoki (nowa wartość domyślna), bardzo wysoki (xhigh w Claude Code) i maksymalny. Wyższe ustawienia zużywają więcej tokenów na rozumowanie przed wygenerowaniem odpowiedzi; niższe ustawienia faworyzują szybkość i efektywność limitu szybkości.
Czy Opus 4.8 obsługuje buforowanie promptów?
Tak. Buforowane dane wejściowe są rozliczane po 0,50 USD za 1M tokenów, co stanowi 10-krotną zniżkę na buforowaną część. API wiadomości akceptuje teraz również wpisy systemowe w trakcie rozmowy bez naruszania pamięci podręcznej.
Alternatywy
Używanie Claude Opus 4.8 na Okou
Dwa sposoby dostępu do Claude Opus 4.8 na Okou
Okou obsługuje Claude Opus 4.8 jako wbudowany model rozliczany w kredytach Okou oraz poprzez własne rozwiązanie z Anthropic API key. Ścieżka wbudowana wykorzystuje zarządzane routowanie Okou i poziom cen wyjaśniony poniżej; ścieżka własna rozlicza Cię bezpośrednio z dostawcą nadrzędnym i całkowicie pomija konwersję kredytów Okou.
Rekomendacja Okou
Okou pozycjonuje Claude Opus 4.8 jako podstawowy model agenta do orkiestracji, pracy z kodem i innych kroków, gdzie błędna odpowiedź jest kosztowna.
Kredyty i poziom cen $$$
Okou wycenia każdy wbudowany model w czterostopniowej skali kredytowej — $, $$, $$$, $$$$ — wyświetlanej jako odznaka w selektorze modeli i w wierszu price tier w zero model ls. Claude Opus 4.8 znajduje się na $$$. Ten poziom to to, co wydajesz ze swojego salda kredytowego Okou; cena katalogowa dostawcy w powyższej tabeli to to, co pobiera dostawca nadrzędny, zanim Okou przeliczy to na kredyty.
Dostępne na Okou od May 28, 2026.

