Všechny modely

Claude Opus 4.8

Nejnovější vlajková loď Anthropic. Vydáno 28. května 2026 se silnějším agentním kódováním, dynamickými pracovními postupy, které rozvětvují stovky paralelních subagentů, a 3× levnějším rychlým režimem za stejnou běžnou cenu jako Opus 4.7.

1M tokens · Text / Vision / Code · Prompt cache

Claude Opus 4.8 je vlajková loď Anthropic vydaná 28. května 2026, přímá aktualizace Opus 4.7 za stejnou ceníkovou cenu 5 $/25 $. Dosahuje nejvyšších skóre SWE-bench Pro (69,2 %), OSWorld-Verified (83,4 %), MCP-Atlas (82,2 %) a Humanity's Last Exam (57,9 % s nástroji), jaké kdy Anthropic dodal, a je prvním modelem, který překonal 10 % v právním agentním standardu all-pass.

Dvě strukturální změny, které stojí za zmínku, jsou dynamické pracovní postupy (naplánujte úlohu, rozšiřte ji na stovky paralelních podagentů v jedné relaci) a snížení ceny rychlého režimu na 2,5násobnou rychlost za 10 $/50 $ za 1M tokenů – třikrát levnější než rychlý režim u předchozích modelů Claude. Úrovně úsilí se rozšiřují na vysokou (výchozí), extra a maximální. Samotný Anthropic označuje vydání jako „skromné, ale hmatatelné zlepšení“ spíše než skok.

Co je Claude Opus 4.8?

28. května 2026

Pro uživatele Okou jsou důležité dvě strukturální změny. Za prvé, dynamické pracovní postupy: model dokáže naplánovat úkol a rozdělit ho mezi stovky paralelních subagentů v jedné relaci, což Anthropic popisuje jako krok k řešení migrací v rozsahu kódu napříč stovkami tisíc řádků kódu v jednom běhu. Za druhé, rychlý režim s 2,5násobnou rychlostí je nyní 10 $ / 50 $ za 1M tokenů – třikrát levnější než rychlý režim u předchozích modelů Claude. Úrovně úsilí se rozšiřují na tři úrovně: vysoká (výchozí), extra (xhigh v Claude Code) a max.

Nezávislé čtení (LLM Stats, VentureBeat, Vellum) potvrzuje relativní pořadí oproti 4.7 a konkurentům: 4.8 vítězí ve všech buňkách sady srovnání publikované Anthropic kromě Terminal-Bench 2.1, kde GPT-5.5 stále vede (78.2 % vs. 74.6 % u 4.8). Skok z 4.7 na 4.8 na SWE-bench Pro je +4.9 bodů; na USAMO 2026 je to +27.4; na novém 1M-tokenovém GraphWalks long-context F1 je to +27.8. Absolutní skóre berte jako orientační – SWE-bench Verified se blíží saturaci napříč všemi hraničními modely.

Co je pozoruhodné na Claude Opus 4.8

Architektura nadpisů a funkce schopností.

Opus 4.8 si zachovává kontextové okno 1M tokenů a maximální výstup 128K z Opus 4.7, účtované za standardní vstupní ceny v celém okně. Kontrola úsilí se rozšiřuje na tři úrovně: vysoká (nové výchozí nastavení), extra (xhigh uvnitř Claude Code) a max. Zprávy API nyní přijímají systémové záznamy uprostřed konverzace, aniž by narušily ukládání výzev do mezipaměti. Dynamické pracovní postupy umožňují Claude plánovat a odesílat stovky paralelních podagentů v jedné relaci. Rychlý režim běží přibližně 2,5krát rychleji než standardní rychlost za 10 $ / 50 $ za 1M tokenů. Multimodální vstupy napříč textem, vizí a kódem zůstávají nezměněny.

Specifikace na první pohled

RodinaGenerace Claude 4
ModalitaText, vize, kód
JazykyAngličtina jako první, vícejazyčné
Ukládání výzev do mezipamětiPodporováno (Anthropic)
Kontextové okno1M tokenů
Maximální výstupAž 128K tokenů
Úrovně úsilíVysoká (výchozí) / Extra / Max
Cena dodavatele5 $ vstup / 25 $ výstup za 1M (rychlý režim 10 $/50 $, 2,5× rychlost)

Benchmarky Claude Opus 4.8

Výsledky hlášené dodavatelem z karty systému Opus 4.8 Anthropic, s porovnáním s Opus 4.7, GPT-5.5 a Gemini 3.1 Pro při maximálním úsilí a průměrech z 5 pokusů. 4.8 vede v šesti ze sedmi buněk, které Anthropic publikuje; GPT-5.5 si udržuje vedení na Terminal-Bench 2.1. SWE-bench Verified se blíží saturaci napříč všemi hraničními modely – tvrdší sada SWE-bench Pro je trvalejším signálem.

SWE-bench Verifiedhlášeno dodavatelem; nárůst z 87,6 % Opus 4.7
88.6%
SWE-bench Provede pole (4.7: 64.3%, GPT-5.5: 58.6%, Gemini 3.1 Pro: 54.2%)
69.2%
Terminal-Bench 2.1z 66,1 % verze 4.7 na 2.0; GPT-5.5 zde vede s 78,2 %
74.6%
OSWorld-ověřeno (použití počítače)vede pole (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (agent prohlížeče)nahlášeno dodavatelem
84%
MCP-Atlasoproti 77,3 % u Opus 4.7
82.2%
BrowseComp (jediný agent)oproti 79,3 % u Opus 4.7
84.3%
GraphWalks dlouhý kontext F1 (1M tokenů)oproti 40,3 % u Opus 4.7
68.1%
Poslední zkouška lidstva (s nástroji)49,8 % bez nástrojů; vede v oboru
57.9%
GPQA Diamondplochý vs 4.7 — nasycený napříč hraničními modely
~93%
USAMO 2026 (matematika)oproti 69,3 % u Opus 4.7
96.7%
GDPval-AA (znalostní práce)vede (4.7: 1753, GPT-5.5: 1769)
1890 Elo
Finanční agent v2vede v oboru
53.9%
Právní zástupce – vše projdeprvní model, který porušil tento standard
>10%

Ceny Claude Opus 4.8

Cena poskytovatele, za 1M tokenů.

Vstup$5.00
Výstup$25.00
Čtení z mezipaměti$0.50
Zápis do mezipaměti$6.25

Jak se Claude Opus 4.8 chová v praxi

Pozorované chování z běhů produkčních agentů.

Dynamické pracovní postupy

Hlavní nová schopnost. Opus 4.8 dokáže naplánovat úkol a poté spustit stovky paralelních podagentů v rámci stejné relace – Anthropic to prezentuje jako cestu k migracím v rozsahu kódu napříč stovkami tisíc řádků v jednom běhu. Na Okou to znamená, že jeden běh agenta může orchestrálně rozdělit práci, která dříve vyžadovala externí plánování.

První pokusy o úpravy kódu

Anthropic uvádí, že Opus 4.8 je přibližně čtyřikrát méně pravděpodobné než 4.7, že přehlédne chyby při revizi kódu, a skok +4.9 bodu v SWE-bench Pro (69.2 % vs 64.3 %) to potvrzuje na obtížnější, méně nasycené sadě kódování. Vyberte 4.8 pro opravy, které se musí čistě aplikovat na mnoho souborů.

Vyvolání dlouhého kontextu

GraphWalks F1 při 1M tokenech skočí z 40,3 % na 68,1 % – největší jednotlivý benchmarkový zisk v této verzi. Okno 1M tokenů je nyní skutečně použitelné na horním konci svého rozsahu, nejen nominálně.

Upřímnost a přehnaná sebedůvěra

Anthropic hlásí více než desetinásobné snížení přehnané sebedůvěry oproti 4.7, 0% v nekritickém hlášení chybných výsledků (poprvé u rodiny Claude) a 3,7% míru selhání při upozorňování uživatele na důležité události. Incidence nesouladu je ~1,9, což je prakticky shodné s nejlépe sladěným Mythos Preview od Anthropic.

Rychlost a rychlý režim

Standardní rychlost je srovnatelná s Opus 4.7. Hlavní zprávou je změna cen: rychlý režim s 2,5násobnou rychlostí stojí 10 $ / 50 $ za 1 milion tokenů, třikrát levněji než rychlý režim u předchozích modelů Claude. Vyplatí se používat pro kroky orchestrace, kde záleží na latenci reálného času.

Upozornění na vložení výzvy

Systémová karta Anthropic uvádí, že 4.8 je poněkud méně odolná vůči agentní injekci promptů než 4.7 – red-teaming Gray Swan ukazuje ~9,6% úspěšnost útoku oproti 6,0% u 4.7. Týmy provozující 4.8 v pipelinech, které zpracovávají nedůvěryhodný vstup, by měly zkontrolovat svůj přístup k sandboxing.

Nejlepší úkoly agenta pro Claude Opus 4.8

Migrace kódu v měřítku, která dříve vyžadovala sprint

Předložte Opusu 4.8 migraci, která se dotýká několika stovek souborů – výměna ORM, zvýšení verze frameworku, bezpečnostní oprava napříč monorepem – a nechte dynamické pracovní postupy rozdělit práci na paralelní podagenty v rámci jedné relace. Skok o +4,9 bodu v SWE-bench Pro a čtyřnásobné snížení počtu přehlédnutých chyb při revizi kódu jsou to, co se vyplatí u tohoto typu běhu.

Výzkumný běh s 1M tokeny, který skutečně drží pohromadě

Vložte 200stránkový návrh smlouvy, tři konkurenční návrhy a právní stanoviska z minulého čtvrtletí do okna a poté požádejte Opus 4.8, aby označil každou klauzuli, která je přísnější než tržní. GraphWalks na 1M skákající z 40,3 % na 68,1 % je to, co činí tento druh mezidokumentové syntézy nově spolehlivým.

Orchestrátor agentů, který nelže o své práci

Použijte 4.8 jako plánovač, který rozdělí požadavek na deset kroků, každý odešle levnějším podagentům a nahlásí výsledek. 0% míra nekritického hlášení chybných výsledků v kombinaci s desetinásobným poklesem přehnané sebedůvěry je důvodem, proč produkční týmy sahají po 4.8, když musí být vlastní zpráva agenta důvěryhodná.

Tok s citlivostí na latenci, který se konečně vyplatí v rychlém režimu

Rychlý režim s 2,5násobnou rychlostí dříve stál třikrát tolik, co nyní (10 $/50 $ za 1M oproti předchozí úrovni). Pro interaktivní kopiloty, on-call sumarizátory nebo jakýkoli krok, kde latence na reálném čase dominuje zážitku, je rychlý režim 4.8 nyní výchozí volbou v rodině Claude.

Kdy přeskočit Claude Opus 4.8

Opus 4.8 přeskočte u rutinní práce s vysokým objemem, kde Sonnet 4.6 dosahuje stejné kvality za zlomek nákladů, u chatových odpovědí kritických z hlediska latence, kde je Kimi K2.7 Code mnohem rychlejší, u agentního terminálového kódování, kde GPT-5.5 stále vede Terminal-Bench 2.1 (78,2 % oproti 74,6 % u 4.8), a u pipeline, které přijímají nedůvěryhodný vstup bez sandboxingu – robustnost 4.8 proti vkládání promptů je o něco slabší než u 4.7.

Claude Opus 4.8 vs. jiné modely

Claude Opus 4.8 vs GPT-5.5

Opus 4.8 vede v šesti ze sedmi buněk v porovnávací sadě Anthropic, s největšími rozdíly v SWE-bench Pro (69,2 % vs. 58,6 %) a OSWorld-Verified (83,4 % vs. 78,7 %). GPT-5.5 si udržuje náskok v Terminal-Bench 2.1 (78,2 % vs. 74,6 %). Vyberte 4.8 pro kódování napříč soubory a agenty pro práci s počítačem; GPT-5.5 vyberte konkrétně, když dominuje práce řízená terminálem.

Claude Opus 4.8 vs Gemini 3.1 Pro

Opus 4.8 vede s velkým náskokem na SWE-bench Pro (+15.0) a OSWorld-Verified (+7.2). Oba modely zůstávají v rámci šumu na nasycených vědeckých benchmarcích jako GPQA Diamond. Pro agentní práci použijte výchozí 4.8; Gemini zvažte konkrétně, když potřebujete integraci nástrojů Google.

Sečteno a podtrženo: měli byste používat Claude Opus 4.8?

Nový výchozí stav pro nové agenty v rodině Claude. Migrujte z verze 4.7, jakmile budete moci znovu ověřit; pro novou práci se k ní přímo přikloňte. Ponechte Sonnet 4.6 jako levnějšího tahouna pod ní.

Často kladené otázky

Kdy byl vydán Claude Opus 4.8?

Anthropic vydal Opus 4.8 28. května 2026, 41 dní po Opus 4.7. Je k dispozici dnes napříč produkty Claude, Claude API (ID modelu claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry a Okou.

Jak se srovnává cena Opus 4.8 s 4.7?

Běžné ceny jsou stejné: 5 $ za 1M vstupních tokenů, 25 $ za 1M výstupních tokenů, 0,50 $ za 1M cachovaných vstupů. Změnou je rychlý režim, nyní 10 $ / 50 $ za 1M tokenů při 2,5násobné rychlosti – třikrát levnější než rychlý režim u předchozích modelů Claude.

Co jsou dynamické workflow?

Nová schopnost, která umožňuje Opus 4.8 plánovat úkol a poté spustit stovky paralelních subagentů v rámci jedné relace. Anthropic to považuje za cestu k migracím v rozsahu kódu napříč stovkami tisíc řádků kódu v jednom běhu agenta.

Jaké úrovně úsilí podporuje Opus 4.8?

Tři úrovně: vysoká (nový výchozí), extra (xhigh v Claude Code) a max. Vyšší nastavení spotřebují více tokenů na uvažování před vytvořením odpovědi; nižší nastavení upřednostňují rychlost a efektivitu omezení rychlosti.

Podporuje Opus 4.8 ukládání promptů do mezipaměti?

Ano. Uložený vstup se účtuje 0,50 $ za 1M tokenů, což je 10násobná sleva na uloženou část. API zpráv nyní také přijímá systémové záznamy uprostřed konverzace bez narušení mezipaměti.

Alternativy

Používání Claude Opus 4.8 na Okou

Dva způsoby přístupu k Claude Opus 4.8 na Okou

Okou podporuje Claude Opus 4.8 jako vestavěný model účtovaný v kreditech Okou a prostřednictvím vlastního přinesení s Anthropic API key. Vestavěná cesta používá Okou Managed routing a cenovou úroveň vysvětlenou níže; cesta vlastního přinesení vám účtuje přímo u dodavatele a zcela přeskočí konverzi kreditů Okou.

Doporučení Okou

Okou staví Claude Opus 4.8 jako základní model agenta pro orchestraci, práci s kódem a další kroky, kde je špatná odpověď drahá.

Kredity a cenová úroveň $$$

Okou oceňuje každý vestavěný model na čtyřstupňové kreditní škále – $, $$, $$$, $$$$ – zobrazené jako odznak ve výběru modelu a na řádku price tier v zero model ls. Claude Opus 4.8 se nachází na $$$. Tato úroveň je to, co utratíte ze svého kreditního zůstatku Okou; ceníková cena dodavatele v tabulce výše je to, co si účtuje upstream poskytovatel, než to Okou převede na kredity.

Dostupné na Okou od May 28, 2026.