Alle modeller

Claude Opus 4.8

Anthropics nyeste flaggskip. Utgitt 28. mai 2026 med sterkere agentisk koding, dynamiske arbeidsflyter som sprer seg til hundrevis av parallelle underagenter, og en 3× billigere hurtigmodus til samme vanlige pris som Opus 4.7.

1M tokens · Text / Vision / Code · Prompt cache

Claude Opus 4.8 er Anthropics flaggskiputgivelse 28. mai 2026, en direkte oppgradering til Opus 4.7 til samme listepris på 5 USD/25 USD. Den har de høyeste SWE-bench Pro (69,2 %), OSWorld-Verified (83,4 %), MCP-Atlas (82,2 %) og Humanity's Last Exam (57,9 % med verktøy) poengsummene Anthropic noensinne har levert, og er den første modellen som bryter 10 % på den juridiske agentens all-pass-standard.

De to strukturelle endringene det er verdt å vite om, er dynamiske arbeidsflyter (planlegg en jobb, fordel den over hundrevis av parallelle underagenter i en enkelt økt) og en priskutt i hurtigmodus til 2,5 ganger hastighet til 10 USD/50 USD per 1 million tokens – tre ganger billigere enn hurtigmodus på tidligere Claude-modeller. Innsatsnivåene utvides til høy (standard), ekstra og maks. Anthropic selv rammer inn utgivelsen som en «beskjeden, men håndgripelig forbedring» snarere enn et sprang.

Hva er Claude Opus 4.8?

28. mai 2026

To strukturelle endringer er viktige for Okou-brukere. Først, dynamiske arbeidsflyter: modellen kan planlegge en oppgave og spre den utover hundrevis av parallelle underagenter i en enkelt økt, noe Anthropic beskriver som et skritt mot å håndtere kodebase-skala migreringer over hundretusenvis av kodelinjer i en enkelt kjøring. For det andre er rask modus med 2.5× hastighet nå $10 / $50 per 1M tokens – tre ganger billigere enn rask modus på tidligere Claude-modeller. Innsatsnivåene utvides til tre nivåer: høy (standard), ekstra (xhigh i Claude Code) og maks.

Uavhengige lesninger (LLM Stats, VentureBeat, Vellum) bekrefter den relative rekkefølgen mot 4.7 og konkurrenter: 4.8 vinner på hver celle i Anthropics publiserte sammenligningssett unntatt Terminal-Bench 2.1, der GPT-5.5 fortsatt leder (78.2% vs 4.8s 74.6%). Hoppet fra 4.7 til 4.8 på SWE-bench Pro er +4.9 poeng; på USAMO 2026 er det +27.4; på den nye 1M-token GraphWalks long-context F1 er det +27.8. Behandle absolutte poengsummer som retningsgivende – SWE-bench Verified nærmer seg metning på tvers av alle grensemodeller.

Hva er bemerkelsesverdig med Claude Opus 4.8

Overskriftsarkitektur og funksjonsfunksjoner.

Opus 4.8 beholder kontekstvinduet på 1M-token og 128K maks utdata fra Opus 4.7, fakturert til standard inndatapriser over hele vinduet. Innsatskontrollen utvides til tre nivåer: høy (den nye standarden), ekstra (xhigh inne i Claude Code), og maks. Meldinger API aksepterer nå systemoppføringer midt i samtalen uten å bryte hurtigbufring av ledetekster. Dynamiske arbeidsflyter lar Claude planlegge og sende hundrevis av parallelle underagenter i en enkelt økt. Rask modus kjører med ~2,5× standardhastighet for $10 / $50 per 1M tokens. Multimodale inndata på tvers av tekst, visjon og kode er uendret.

Spesifikasjoner på et øyeblikk

FamilieClaude 4 generasjon
ModaliteterTekst, syn, kode
SpråkEngelsk-først, flerspråklig
LedetekstbufringStøttet (Anthropic)
Kontekstvindu1M tokens
Maks utdataOpptil 128K tokens
AnstrengelsesnivåerHøy (standard) / Ekstra / Maks
Leverandørens listepris$5 input / $25 output per 1M (rask modus $10/$50, 2,5× hastighet)

Claude Opus 4.8 referansepunkter

Leverandørrapporterte poengsummer fra Anthropics Opus 4.8 systemkort, med sammenligninger mot Opus 4.7, GPT-5.5 og Gemini 3.1 Pro ved maksimal innsats og 5-prøve gjennomsnitt. 4.8 leder i seks av syv celler Anthropic publiserer; GPT-5.5 beholder ledelsen på Terminal-Bench 2.1. SWE-bench Verified nærmer seg metning på tvers av alle grensemodeller – det vanskeligere SWE-bench Pro-settet er det mer varige signalet.

SWE-bench Verifiedleverandørrapportert; opp fra Opus 4.7s 87,6%
88.6%
SWE-bench Proleder feltet (4.7: 64,3 %, GPT-5.5: 58,6 %, Gemini 3.1 Pro: 54,2 %)
69.2%
Terminal-Bench 2.1opp fra 4.7s 66.1% på 2.0; GPT-5.5 leder her med 78.2%
74.6%
OSWorld-verifisert (datamaskinbruk)leder feltet (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (nettleseragent)leverandør-rapportert
84%
MCP-Atlasopp fra Opus 4.7s 77,3 %
82.2%
BrowseComp (enkeltagent)opp fra Opus 4.7s 79,3 %
84.3%
GraphWalks langkontekst F1 (1M tokens)opp fra Opus 4.7s 40,3 %
68.1%
Menneskehetens siste eksamen (med verktøy)49,8 % uten verktøy; leder feltet
57.9%
GPQA Diamondflat vs 4.7 – mettet på tvers av grensemodeller
~93%
USAMO 2026 (matematikk)opp fra Opus 4.7s 69,3 %
96.7%
GDPval-AA (kunnskapsarbeid)leder (4.7: 1753, GPT-5.5: 1769)
1890 Elo
Finansagent v2leder an
53.9%
Juridisk agent all-passførste modell som bryter denne standarden
>10%

Claude Opus 4.8 priser

Leverandørens listepris, per 1M tokens.

Inndata$5.00
Utdata$25.00
Cache-lesing$0.50
Cache-skriving$6.25

Hvordan Claude Opus 4.8 oppfører seg i praksis

Observert atferd fra produksjonsagentkjøringer.

Dynamiske arbeidsflyter

Den nye hovedfunksjonen. Opus 4.8 kan planlegge en oppgave og deretter kjøre hundrevis av parallelle underagenter innenfor samme økt – Anthropic posisjonerer dette som veien til kodebase-skala-migreringer på tvers av hundretusenvis av linjer i én kjøring. På Okou betyr dette at en enkelt agentkjøring kan orkestrere fan-out-arbeid som tidligere krevde ekstern planlegging.

Første forsøk på kodeendringer

Anthropic rapporterer at Opus 4.8 er omtrent fire ganger mindre sannsynlig enn 4.7 til å overse feil ved gjennomgang av kode, og +4.9 poengs SWE-bench Pro-hopp (69.2 % vs 64.3 %) støtter dette på det vanskeligere, mindre mettede kodesettet. Velg 4.8 for patcher som må anvendes rent på tvers av mange filer.

Langkontekstgjenkalling

GraphWalks F1 ved 1M tokens hopper fra 40,3 % til 68,1 % – den største enkelt-benchmark-gevinsten i utgivelsen. 1M-token-vinduet er nå faktisk brukbart i den øvre enden av sitt område, ikke bare nominelt.

Ærlighet og overmot

Anthropic rapporterer en mer enn tidoblet reduksjon i overkonfidens sammenlignet med 4.7, 0 % på ukritisk rapportering av feilaktige resultater (en første for Claude-familien), og en 3.7 % feilrate i å ikke varsle brukeren om viktige hendelser. Avviksforekomsten er ~1.9, praktisk talt lik Anthropics best justerte Mythos Preview.

Hastighet og rask modus

Standardhastigheten er sammenlignbar med Opus 4.7. Prisendringen er hovednyheten: rask modus med 2,5 ganger hastighet koster $10 / $50 per 1M tokens, tre ganger billigere enn rask modus på tidligere Claude-modeller. Verdt å bruke for orkestreringstrinn der veggklokkelatens er viktig.

Advarsel om prompt-injeksjon

Anthropics systemkort bemerker at 4.8 er noe mindre robust mot agentisk promptinjeksjon enn 4.7 – Gray Swan red-teaming viser en ~9.6% angrepssuksessrate versus 6.0% på 4.7. Team som kjører 4.8 i pipelines som håndterer ubetrodd input, bør gjennomgå sin sandkassemetode.

Beste agentoppgaver for Claude Opus 4.8

Kodebase-skala-migreringen som pleide å kreve en sprint

Gi Opus 4.8 en migrering som berører noen hundre filer – ORM-bytte, rammeverksversjonsoppgradering, sikkerhetsfiks på tvers av et monorepo – og la dynamiske arbeidsflyter spre arbeidet til parallelle underagenter innenfor en enkelt økt. Hoppet på +4,9 poeng i SWE-bench Pro og den firedobbelte reduksjonen i oversett feil ved kodegjennomgang er det som gir uttelling på denne typen kjøringer.

Den 1M-token forskningskjøringen som faktisk henger sammen

Slipp et 200-siders kontraktsutkast, tre konkurrentforslag og forrige kvartals juridiske uttalelser inn i vinduet, og be deretter Opus 4.8 om å flagge hver klausul som er strammere enn markedet. GraphWalks på 1M som hopper fra 40,3 % til 68,1 % er det som gjør denne typen tverrdokumentsyntese nylig pålitelig.

Agentorkestratoren som ikke lyver om arbeidet sitt

Bruk 4.8 som planleggeren som bryter en forespørsel ned i ti trinn, sender hvert til billigere underagenter, og rapporterer resultatet. Den 0 %-ige frekvensen av ukritisk rapportering av feilaktige resultater, kombinert med den tidobbelte reduksjonen i overmot, er grunnen til at produksjonsteam velger 4.8 når agentens egen selvrapport må være pålitelig.

Den latensfølsomme flyten som endelig lønner seg i rask modus

Rask modus med 2,5x hastighet kostet tidligere tre ganger så mye som nå ($10/$50 per 1M mot det tidligere nivået). For interaktive copiloter, on-call-oppsummerere, eller ethvert trinn der veggklokke-latens dominerer opplevelsen, er rask-modus 4.8 nå standardvalget i Claude-familien.

Når du skal hoppe over Claude Opus 4.8

Hopp over Opus 4.8 på rutinearbeid med høyt volum der Sonnet 4.6 oppnår samme kvalitetsnivå til en brøkdel av kostnaden, på latenskritiske chat-svar der Kimi K2.7 Code er mye raskere, på agentisk terminalkoding der GPT-5.5 fortsatt leder Terminal-Bench 2.1 (78,2 % vs 4.8s 74,6 %), og på pipelines som inntar upålitelig input uten sandboxing – 4.8s robusthet mot prompt-injeksjon er litt svakere enn 4.7s.

Claude Opus 4.8 vs andre modeller

Claude Opus 4.8 vs GPT-5.5

Opus 4.8 leder på seks av syv celler i Anthropics sammenligningssett, med de største forskjellene på SWE-bench Pro (69,2 % vs 58,6 %) og OSWorld-Verified (83,4 % vs 78,7 %). GPT-5.5 beholder ledelsen på Terminal-Bench 2.1 (78,2 % vs 74,6 %). Velg 4.8 for kryssfilkoding og datamaskinbruksagenter; velg GPT-5.5 spesifikt når terminaldrevet arbeid dominerer.

Claude Opus 4.8 vs Gemini 3.1 Pro

Opus 4.8 leder med store marginer på SWE-bench Pro (+15.0) og OSWorld-Verified (+7.2). De to modellene holder seg innenfor støy på mettede vitenskapsbenchmarks som GPQA Diamond. Bruk 4.8 som standard for agentarbeid; vurder Gemini spesifikt når du trenger Googles verktøyintegrasjon.

Konklusjon: bør du bruke Claude Opus 4.8?

Den nye standarden for nye agenter i Claude-familien. Migrer fra 4.7 når du kan revalidere; bruk den direkte for nytt arbeid. Behold Sonnet 4.6 som den billigere arbeidshesten under den.

Ofte stilte spørsmål

Når ble Claude Opus 4.8 utgitt?

Anthropic lanserte Opus 4.8 den 28. mai 2026, 41 dager etter Opus 4.7. Den er tilgjengelig i dag på tvers av Claude-produkter, Claude API (modell-ID claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry og Okou.

Hvordan sammenlignes Opus 4.8-priser med 4.7?

Vanlig pris er identisk: $5 per 1M inndatatokener, $25 per 1M utdatatokener, $0.50 per 1M bufret inndata. Endringen er rask modus, nå $10 / $50 per 1M tokener med 2,5× hastighet – tre ganger billigere enn rask modus på tidligere Claude-modeller.

Hva er dynamiske arbeidsflyter?

En ny funksjon som lar Opus 4.8 planlegge en oppgave og deretter kjøre hundrevis av parallelle underagenter innenfor en enkelt sesjon. Anthropic posisjonerer dette som veien til kodebase-skala migreringer på tvers av hundretusenvis av kodelinjer i en enkelt agentkjøring.

Hvilke innsatsnivåer støtter Opus 4.8?

Tre nivåer: høy (den nye standarden), ekstra (xhigh i Claude Code) og maks. Høyere innstillinger bruker flere tokens på resonnement før de produserer et svar; lavere innstillinger favoriserer hastighet og rate-limit-effektivitet.

Støtter Opus 4.8 hurtigbuffer for prompter?

Ja. Bufret input faktureres til $0,50 per 1M tokens, en 10× rabatt på den bufrede delen. Meldingene API aksepterer nå også systemoppføringer midt i samtalen uten å bryte bufferen.

Alternativer

Bruker Claude Opus 4.8 på Okou

To måter å få tilgang til Claude Opus 4.8 på Okou

Okou støtter Claude Opus 4.8 som en innebygd modell fakturert i Okou-kreditter, og gjennom bring-your-own med en Anthropic API key. Den innebygde veien bruker Okou Managed-ruting og prisnivået forklart nedenfor; bring-your-own-veien fakturerer deg direkte med den oppstrøms leverandøren og hopper over Okou-kredittkonverteringen helt.

Okous anbefaling

Okou posisjonerer Claude Opus 4.8 som en kjerneagentmodell for orkestrering, kodeberøringsarbeid og andre trinn der et feil svar er dyrt.

Kreditter og $$$ prisnivå

Okou priser hver innebygde modell på en fire-trinns kredittskala – $, $$, $$$, $$$$ – vist som et merke i modellvelgeren og på price tier-linjen i zero model ls. Claude Opus 4.8 ligger på $$$. Det nivået er det du bruker fra din Okou-kredittsaldo; leverandørens listepris i tabellen ovenfor er det oppstrømsleverandøren tar før Okou konverterer det til kreditter.

Tilgjengelig på Okou siden May 28, 2026.