Claude Opus 4.8
Anthropic:s nyaste flaggskepp. Släpptes den 28 maj 2026 med starkare agentisk kodning, dynamiska arbetsflöden som förgrenar hundratals parallella underagenter, och ett 3× billigare snabbläge till samma ordinarie pris som Opus 4.7.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 4.8 är Anthropic:s flaggskeppsversion den 28 maj 2026, en direkt uppgradering till Opus 4.7 till samma listpris på 5 USD/25 USD. Den uppvisar de högsta SWE-bench Pro (69,2 %), OSWorld-Verified (83,4 %), MCP-Atlas (82,2 %) och Humanity's Last Exam (57,9 % med verktyg) poängen Anthropic någonsin har levererat, och är den första modellen som bryter 10 % på den juridiska agentens all-pass-standard.
De två strukturella förändringarna som är värda att känna till är dynamiska arbetsflöden (planera ett jobb, fördela det över hundratals parallella underagenter i en enda session) och en prissänkning i snabbläge till 2,5 gånger hastigheten för 10 USD/50 USD per 1M tokens – tre gånger billigare än snabbläget på tidigare Claude-modeller. Ansträngningsnivåerna expanderar till hög (standard), extra och max. Anthropic själv beskriver releasen som en "blygsam men påtaglig förbättring" snarare än ett språng.
Vad är Claude Opus 4.8?
28 maj 2026
Två strukturella förändringar är viktiga för Okou-användare. För det första, dynamiska arbetsflöden: modellen kan planera en uppgift och sprida ut den över hundratals parallella underagenter i en enda session, vilket Anthropic beskriver som ett steg mot att hantera kodbasomfattande migreringar över hundratusentals rader kod i en körning. För det andra är snabbläget med 2,5 gånger hastighet nu 10 USD / 50 USD per 1M tokens – tre gånger billigare än snabbläget på tidigare Claude-modeller. Ansträngningsnivåerna utökas till tre nivåer: hög (standard), extra (xhigh i Claude Code) och max.
Oberoende läsningar (LLM Stats, VentureBeat, Vellum) bekräftar den relativa ordningen mot 4.7 och konkurrenter: 4.8 vinner på varje cell i Anthropic:s publicerade jämförelsesats utom Terminal-Bench 2.1, där GPT-5.5 fortfarande leder (78.2% mot 4.8:s 74.6%). Hoppet från 4.7 till 4.8 på SWE-bench Pro är +4.9 poäng; på USAMO 2026 är det +27.4; på den nya 1M-token GraphWalks långkontext F1 är det +27.8. Behandla absoluta poäng som riktningsgivande – SWE-bench Verified närmar sig mättnad över alla frontlinjemodeller.
Vad är anmärkningsvärt med Claude Opus 4.8
Rubrikarkitektur och funktionsfunktioner.
Opus 4.8 behåller 1M-token kontextfönstret och 128K max utdata från Opus 4.7, fakturerat till standardinmatningspriser över hela fönstret. Ansträngningskontrollen utökas till tre nivåer: hög (den nya standarden), extra (xhigh inuti Claude Code) och max. Meddelanden API accepterar nu systemposter mitt i konversationen utan att bryta promptcaching. Dynamiska arbetsflöden låter Claude planera och skicka hundratals parallella underagenter i en enda session. Snabbläget körs med ~2.5× standardhastighet för $10 / $50 per 1M tokens. Multimodala indata över text, vision och kod är oförändrade.
Specifikationer i korthet
Claude Opus 4.8 benchmarks
Leverantörsrapporterade poäng från Anthropic:s Opus 4.8-systemkort, med jämförelser mot Opus 4.7, GPT-5.5 och Gemini 3.1 Pro vid maximal ansträngning och 5-försöksgenomsnitt. 4.8 leder i sex av sju celler som Anthropic publicerar; GPT-5.5 behåller ledningen på Terminal-Bench 2.1. SWE-bench Verified närmar sig mättnad över alla frontlinjemodeller – den svårare SWE-bench Pro-uppsättningen är den mer hållbara signalen.
Claude Opus 4.8 prissättning
Leverantörens listpris, per 1M tokens.
Hur Claude Opus 4.8 beter sig i praktiken
Observerat beteende från produktionsagentkörningar.
Dynamiska arbetsflöden
Den nya huvudfunktionen. Opus 4.8 kan planera en uppgift och sedan köra hundratals parallella underagenter inom samma session – Anthropic positionerar detta som vägen till kodbas-skaliga migreringar över hundratusentals rader i en körning. På Okou innebär detta att en enda agentkörning kan orkestrera fan-out-arbete som tidigare krävde extern schemaläggning.
Första försöket till kodredigeringar
Anthropic rapporterar att Opus 4.8 är ungefär fyra gånger mindre benägen än 4.7 att förbise brister vid kodgranskning, och +4.9 poängs SWE-bench Pro-hoppet (69.2% vs 64.3%) bekräftar detta på den svårare, mindre mättade kodningsuppsättningen. Välj 4.8 för patchar som måste tillämpas rent över många filer.
Återkallning med lång kontext
GraphWalks F1 vid 1M tokens hoppar från 40,3% till 68,1% – den största enskilda benchmark-vinsten i releasen. Fönstret på 1M tokens är nu faktiskt användbart i den övre delen av sitt intervall, inte bara nominellt.
Ärlighet och övermod
Anthropic rapporterar en mer än tiofaldig minskning av övermod jämfört med 4.7, 0% på okritiskt rapporterande av felaktiga resultat (en första för Claude-familjen), och en 3.7% frekvens av att misslyckas med att uppmärksamma användaren på viktiga händelser. Avvikelseincidensen är ~1.9, i princip lika med Anthropic:s bäst anpassade Mythos Preview.
Hastighet och snabbläge
Standardhastigheten är jämförbar med Opus 4.7. Prisförändringen är rubriken: snabbt läge med 2,5 gånger hastigheten kostar 10 USD / 50 USD per 1 miljon tokens, tre gånger billigare än snabbt läge på tidigare Claude-modeller. Värt att använda för orkestreringssteg där väggklockans latens spelar roll.
Varning för prompt-injektion
Anthropic:s systemkort noterar att 4.8 är något mindre robust mot agentisk promptinjektion än 4.7 – Gray Swan red-teaming visar en ~9,6% attackframgångsfrekvens jämfört med 6,0% på 4.7. Team som kör 4.8 i pipelines som hanterar opålitlig input bör granska sin sandlådemetod.
Bästa agentuppgifter för Claude Opus 4.8
Kodbas-skalig migrering som tidigare krävde en sprint
Ge Opus 4.8 en migrering som berör några hundra filer – ORM-byte, ramverksversionsuppdatering, säkerhetsfix över ett monorepo – och låt dynamiska arbetsflöden sprida ut arbetet till parallella underagenter inom en session. Hoppet på +4.9 poäng i SWE-bench Pro och den fyrfaldiga minskningen av missade fel vid kodgranskning är vad som ger utdelning på denna typ av körning.
Den 1M-token forskningskörningen som faktiskt håller ihop
Släpp ett 200-sidigt kontraktsutkast, tre konkurrentförslag och förra kvartalets juridiska yttranden i fönstret, be sedan Opus 4.8 att flagga varje klausul som är stramare än marknaden. GraphWalks på 1M som hoppar från 40,3 % till 68,1 % är det som gör denna typ av tvärdokumentssyntes ny tillförlitlig.
Agentorkestratorn som inte ljuger om sitt arbete
Använd 4.8 som planerare som delar upp en begäran i tio steg, skickar varje steg till billigare underagenter och rapporterar resultatet. Den 0 %-iga frekvensen av okritiskt rapporterade felaktiga resultat, i kombination med den tiofaldiga minskningen av övermod, är anledningen till att produktionsteam väljer 4.8 när agentens egen självrapport måste vara pålitlig.
Det latenskänsliga flödet som äntligen fungerar i snabbläge
Snabbläge med 2,5 gånger hastigheten kostade tidigare tre gånger så mycket som det gör nu (10 USD/50 USD per 1M jämfört med den tidigare nivån). För interaktiva copiloter, on-call-sammanfattare eller något steg där väggklockans latens dominerar upplevelsen, är snabbläge 4.8 nu standardvalet i Claude-familjen.
När man ska hoppa över Claude Opus 4.8
Hoppa över Opus 4.8 för rutinmässigt arbete med hög volym där Sonnet 4.6 uppnår samma kvalitetsnivå till en bråkdel av kostnaden, för latenskritiska chattrepliker där Kimi K2.7 Code är mycket snabbare, för agentisk terminalkodning där GPT-5.5 fortfarande leder Terminal-Bench 2.1 (78,2 % mot 4.8:s 74,6 %), och för pipelines som tar emot otillförlitlig input utan sandlåda – 4.8:s robusthet mot prompt-injektion är något svagare än 4.7:s.
Claude Opus 4.8 vs andra modeller
Claude Opus 4.8 vs GPT-5.5
Opus 4.8 leder på sex av sju celler i Anthropic:s jämförelseset, med de största skillnaderna på SWE-bench Pro (69.2% vs 58.6%) och OSWorld-Verified (83.4% vs 78.7%). GPT-5.5 behåller ledningen på Terminal-Bench 2.1 (78.2% vs 74.6%). Välj 4.8 för kodning över flera filer och datoranvändningsagenter; välj GPT-5.5 specifikt när terminaldrivet arbete dominerar.
Claude Opus 4.8 vs Gemini 3.1 Pro
Opus 4.8 leder med bred marginal på SWE-bench Pro (+15.0) och OSWorld-Verified (+7.2). De två modellerna håller sig inom brus på mättade vetenskapliga benchmarks som GPQA Diamond. Använd 4.8 som standard för agentarbete; överväg Gemini specifikt när du behöver Googles verktygsintegration.
Slutsats: ska du använda Claude Opus 4.8?
Den nya standarden för nya agenter i Claude-familjen. Migrera från 4.7 när du kan omvalidera; använd den direkt för nytt arbete. Behåll Sonnet 4.6 som den billigare arbetshästen under den.
Vanliga frågor
När släpptes Claude Opus 4.8?
Anthropic släppte Opus 4.8 den 28 maj 2026, 41 dagar efter Opus 4.7. Den är tillgänglig idag över Claude-produkter, Claude API (modell-ID claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry och Okou.
Hur jämför Opus 4.8:s prissättning med 4.7?
Ordinarie prissättning är identisk: 5 USD per 1 miljon inmatningstokens, 25 USD per 1 miljon utmatningstokens, 0,50 USD per 1 miljon cachade inmatningstokens. Förändringen är snabbläget, nu 10 USD / 50 USD per 1 miljon tokens med 2,5 gånger hastigheten – tre gånger billigare än snabbläget på tidigare Claude-modeller.
Vad är dynamiska arbetsflöden?
En ny funktion som låter Opus 4.8 planera en uppgift och sedan köra hundratals parallella underagenter inom en enda session. Anthropic positionerar detta som vägen till kodbasomfattande migreringar över hundratusentals rader kod i en enda agentkörning.
Vilka ansträngningsnivåer stöder Opus 4.8?
Tre nivåer: hög (den nya standarden), extra (xhigh i Claude Code) och max. Högre inställningar spenderar fler tokens på resonemang innan de producerar ett svar; lägre inställningar gynnar hastighet och effektivitet vid hastighetsbegränsning.
Stöder Opus 4.8 prompt-caching?
Ja. Cachelagrad inmatning debiteras med 0,50 USD per 1 miljon tokens, en 10 gånger rabatt på den cachelagrade delen. Meddelanden API accepterar nu även systeminmatningar mitt i konversationen utan att bryta cachen.
Alternativ
Använder Claude Opus 4.8 på Okou
Två sätt att komma åt Claude Opus 4.8 på Okou
Okou stöder Claude Opus 4.8 som en inbyggd modell som faktureras i Okou-krediter, och genom att ta med egen med en Anthropic API key. Den inbyggda vägen använder Okou hanterad routing och den prisnivå som förklaras nedan; den egna vägen fakturerar dig direkt med den uppströms leverantören och hoppar över Okou-kreditkonverteringen helt.
Okou:s rekommendation
Okou positionerar Claude Opus 4.8 som en kärnagentmodell för orkestrering, kodrelaterat arbete och andra steg där ett felaktigt svar är kostsamt.
Krediter och $$$ prisnivå
Okou prissätter varje inbyggd modell på en fyrstegs kreditsskala – $, $$, $$$, $$$$ – som visas som ett märke i modellväljaren och på price tier-raden i zero model ls. Claude Opus 4.8 ligger på $$$. Den nivån är vad du spenderar från ditt Okou-kreditbalans; leverantörens listpris i tabellen ovan är vad den uppströms leverantören debiterar innan Okou konverterar det till krediter.
Tillgänglig på Okou sedan May 28, 2026.

