Claude Opus 4.8
Anthropic's nyeste flagskib. Udgivet 28. maj 2026 med stærkere agentisk kodning, dynamiske workflows, der spreder hundredvis af parallelle subagenter, og en 3× billigere hurtig tilstand til samme normale pris som Opus 4.7.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 4.8 er Anthropic's flagskibsudgivelse den 28. maj 2026, en direkte opgradering til Opus 4.7 til samme listepris på 5 USD/25 USD. Den opnår de højeste SWE-bench Pro (69,2 %), OSWorld-Verified (83,4 %), MCP-Atlas (82,2 %) og Humanity's Last Exam (57,9 % med værktøjer) resultater, Anthropic nogensinde har leveret, og er den første model, der bryder 10 % på den juridiske agent all-pass standard.
De to strukturelle ændringer, der er værd at kende til, er dynamiske arbejdsgange (planlæg et job, fordel det på tværs af hundredvis af parallelle underagenter i en enkelt session) og en prisnedsættelse i hurtig tilstand til 2,5× hastighed til 10 USD/50 USD pr. 1M tokens – tre gange billigere end hurtig tilstand på tidligere Claude-modeller. Anstrengelsesniveauer udvides til høj (standard), ekstra og maks. Anthropic selv beskriver udgivelsen som en "beskeden, men håndgribelig forbedring" snarere end et spring.
Hvad er Claude Opus 4.8?
28. maj 2026
To strukturelle ændringer er vigtige for Okou-brugere. For det første dynamiske arbejdsgange: modellen kan planlægge en opgave og fordele den på tværs af hundredvis af parallelle underagenter i en enkelt session, hvilket Anthropic beskriver som et skridt mod at håndtere kodebase-skala-migrationer på tværs af hundredtusindvis af kodelinjer i én kørsel. For det andet er hurtig tilstand med 2,5× hastighed nu $10 / $50 pr. 1M tokens — tre gange billigere end hurtig tilstand på tidligere Claude-modeller. Anstrengelsesniveauer udvides til tre niveauer: høj (standard), ekstra (xhigh i Claude Code) og maks.
Uafhængige læsninger (LLM Stats, VentureBeat, Vellum) bekræfter den relative rækkefølge i forhold til 4.7 og konkurrenter: 4.8 vinder på hver celle i Anthropic's offentliggjorte sammenligningssæt undtagen Terminal-Bench 2.1, hvor GPT-5.5 stadig fører (78.2% vs 4.8's 74.6%). Springet fra 4.7 til 4.8 på SWE-bench Pro er +4.9 point; på USAMO 2026 er det +27.4; på den nye 1M-token GraphWalks long-context F1 er det +27.8. Betragt absolutte scores som retningsgivende — SWE-bench Verified nærmer sig mætning på tværs af alle frontlinjemodeller.
Hvad er bemærkelsesværdigt ved Claude Opus 4.8
Overskriftsarkitektur og kapacitetsfunktioner.
Opus 4.8 bevarer kontekstvinduet på 1M-token og 128K maks. output fra Opus 4.7, faktureret til standard inputpriser på tværs af hele vinduet. Anstrengelseskontrol udvides til tre niveauer: høj (den nye standard), ekstra (xhigh inde i Claude Code) og maks. Messages API accepterer nu systemindtastninger midt i samtalen uden at bryde prompt-caching. Dynamiske arbejdsgange lader Claude planlægge og afsende hundredvis af parallelle subagenter i en enkelt session. Hurtig tilstand kører med ~2,5× standardhastighed for $10 / $50 pr. 1M tokens. Multimodale inputs på tværs af tekst, vision og kode er uændrede.
Specifikationer på et øjeblik
Claude Opus 4.8 benchmarks
Leverandørrapporterede scores fra Anthropic's Opus 4.8 systemkort, med sammenligninger mod Opus 4.7, GPT-5.5 og Gemini 3.1 Pro ved maksimal indsats og 5-forsøgsgennemsnit. 4.8 fører i seks ud af syv celler, Anthropic publicerer; GPT-5.5 bevarer føringen på Terminal-Bench 2.1. SWE-bench Verified nærmer sig mætning på tværs af alle frontlinjemodeller – det sværere SWE-bench Pro-sæt er det mere holdbare signal.
Claude Opus 4.8 priser
Udbyderens listepris, pr. 1M tokens.
Hvordan Claude Opus 4.8 opfører sig i praksis
Observeret adfærd fra produktionsagentkørsler.
Dynamiske arbejdsgange
Den nye hovedfunktion. Opus 4.8 kan planlægge en opgave og derefter køre hundredvis af parallelle underagenter inden for samme session — Anthropic positionerer dette som vejen til kodebase-skala migrationer på tværs af hundredtusindvis af linjer i én kørsel. På Okou betyder dette, at en enkelt agentkørsel kan orkestrere fan-out arbejde, der tidligere krævede ekstern planlægning.
Første forsøg på kodeændringer
Anthropic rapporterer, at Opus 4.8 er omkring fire gange mindre tilbøjelig end 4.7 til at overse fejl ved gennemgang af kode, og det +4.9 point SWE-bench Pro spring (69.2% vs. 64.3%) understøtter dette på det sværere, mindre mættede kodesæt. Vælg 4.8 til patches, der skal anvendes rent på tværs af mange filer.
Lang-kontekst genkaldelse
GraphWalks F1 ved 1M tokens springer fra 40,3% til 68,1% – den største enkelt-benchmark-gevinst i udgivelsen. 1M-token-vinduet er nu faktisk brugbart i den høje ende af dets rækkevidde, ikke kun nominelt.
Ærlighed og overmod
Anthropic rapporterer en mere end ti gange reduktion i overmod sammenlignet med 4.7, 0% på ukritisk rapportering af fejlbehæftede resultater (en første for Claude-familien) og en 3.7% rate for manglende rapportering af vigtige begivenheder til brugeren. Uoverensstemmelsesincidensen er ~1.9, effektivt bundet med Anthropic's bedst justerede Mythos Preview.
Hastighed og hurtig tilstand
Standardhastigheden kan sammenlignes med Opus 4.7. Prisændringen er hovednyheden: hurtig tilstand med 2,5× hastighed koster $10 / $50 pr. 1M tokens, tre gange billigere end hurtig tilstand på tidligere Claude-modeller. Værd at bruge til orkestreringstrin, hvor wall-clock-latens er vigtig.
Prompt-injektionsadvarsel
Anthropic's systemkort bemærker, at 4.8 er noget mindre robust over for agentisk prompt-injektion end 4.7 – Gray Swan red-teaming viser en ~9,6% angrebssuccesrate versus 6,0% på 4.7. Teams, der kører 4.8 i pipelines, der håndterer upålidelig input, bør gennemgå deres sandboxing-tilgang.
Bedste agentopgaver for Claude Opus 4.8
Den kodebase-skala migration, der plejede at kræve en sprint
Giv Opus 4.8 en migration, der berører et par hundrede filer – ORM-udskiftning, framework-versionsopdatering, sikkerhedsrettelse på tværs af et monorepo – og lad dynamiske arbejdsgange fordele arbejdet til parallelle underagenter inden for én session. Springet på +4,9 point i SWE-bench Pro og den firedobbelte reduktion i oversete fejl ved kodegennemgang er det, der giver udbytte ved denne type kørsel.
Den 1M-token forskningskørsel, der faktisk hænger sammen
Drop et 200-siders kontraktudkast, tre konkurrentforslag og sidste kvartals juridiske udtalelser ind i vinduet, og bed derefter Opus 4.8 om at markere hver klausul, der er strammere end markedet. GraphWalks ved 1M, der springer fra 40,3 % til 68,1 %, er det, der gør denne form for tværdokumentsyntese ny pålidelig.
Agentorkestratoren, der ikke lyver om sit arbejde
Brug 4.8 som planlæggeren, der opdeler en anmodning i ti trin, sender hver til billigere underagenter og rapporterer resultatet. Den 0 %-rate for ukritisk rapportering af fejlbehæftede resultater, kombineret med det tidobbelte fald i overmod, er grunden til, at produktionsteams griber til 4.8, når agentens egen selvrapportering skal være troværdig.
Den latenstidssensitive strøm, der endelig giver pote i hurtig tilstand
Hurtig tilstand med 2,5× hastighed kostede tidligere tre gange så meget som nu ($10/$50 pr. 1M mod den tidligere tier). For interaktive copiloter, on-call summarizers eller ethvert trin, hvor wall-clock latens dominerer oplevelsen, er hurtig tilstand 4.8 nu standardvalget i Claude-familien.
Hvornår man skal springe Claude Opus 4.8 over
Spring Opus 4.8 over ved rutinepræget arbejde med høj volumen, hvor Sonnet 4.6 opnår samme kvalitetsniveau til en brøkdel af prisen, ved latency-kritiske chat-svar, hvor Kimi K2.7 Code er meget hurtigere, ved agentisk terminalkodning, hvor GPT-5.5 stadig fører Terminal-Bench 2.1 (78,2 % vs. 4.8's 74,6 %), og ved pipelines, der indtager upålideligt input uden sandboxing – 4.8's robusthed over for prompt-injektion er lidt svagere end 4.7's.
Claude Opus 4.8 vs. andre modeller
Claude Opus 4.8 vs GPT-5.5
Opus 4.8 fører på seks af syv celler i Anthropic's sammenligningssæt, med de største forskelle på SWE-bench Pro (69,2% vs 58,6%) og OSWorld-Verified (83,4% vs 78,7%). GPT-5.5 bevarer føringen på Terminal-Bench 2.1 (78,2% vs 74,6%). Vælg 4.8 til tværgående kodning og computerbrugsagenter; vælg GPT-5.5 specifikt, når terminaldrevet arbejde dominerer.
Claude Opus 4.8 vs Gemini 3.1 Pro
Opus 4.8 fører med stor margin på SWE-bench Pro (+15.0) og OSWorld-Verified (+7.2). De to modeller holder sig inden for støj på mættede videnskabsbenchmarks som GPQA Diamond. Standard til 4.8 for agentarbejde; overvej Gemini specifikt, når du har brug for Googles værktøjsintegration.
Bundlinjen: skal du bruge Claude Opus 4.8?
Den nye standard for nye agenter i Claude-familien. Migrer fra 4.7, når du kan genvalidere; brug den direkte til nyt arbejde. Behold Sonnet 4.6 som den billigere arbejdshest under den.
Ofte stillede spørgsmål
Hvornår blev Claude Opus 4.8 udgivet?
Anthropic udgav Opus 4.8 den 28. maj 2026, 41 dage efter Opus 4.7. Den er tilgængelig i dag på tværs af Claude-produkter, Claude API (model-id claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry og Okou.
Hvordan sammenlignes Opus 4.8-priser med 4.7?
Regulær prissætning er identisk: $5 per 1M input-tokens, $25 per 1M output-tokens, $0.50 per 1M cachelagrede input. Ændringen er hurtig tilstand, nu $10 / $50 per 1M tokens ved 2,5× hastighed — tre gange billigere end hurtig tilstand på tidligere Claude-modeller.
Hvad er dynamiske arbejdsgange?
En ny funktion, der lader Opus 4.8 planlægge en opgave og derefter køre hundredvis af parallelle subagenter inden for en enkelt session. Anthropic positionerer dette som vejen til kodebase-skala migrationer på tværs af hundredtusindvis af kodelinjer i en enkelt agentkørsel.
Hvilke indsatsniveauer understøtter Opus 4.8?
Tre niveauer: høj (den nye standard), ekstra (xhigh i Claude Code) og maks. Højere indstillinger bruger flere tokens på ræsonnement, før de producerer et svar; lavere indstillinger favoriserer hastighed og rate-limit effektivitet.
Understøtter Opus 4.8 prompt-caching?
Ja. Cachelagret input faktureres til $0,50 pr. 1M tokens, en 10x rabat på den cachelagrede del. Meddelelser API accepterer nu også systemindtastninger midt i samtalen uden at bryde cachen.
Alternativer
Bruger Claude Opus 4.8 på Okou
To måder at få adgang til Claude Opus 4.8 på Okou
Okou understøtter Claude Opus 4.8 som en indbygget model, der faktureres i Okou-kreditter, og via bring-your-own med en Anthropic API key. Den indbyggede sti bruger Okou Managed routing og den prisklasse, der er forklaret nedenfor; bring-your-own-stien fakturerer dig direkte hos den oprindelige leverandør og springer Okou-kreditkonverteringen helt over.
Okou's anbefaling
Okou positionerer Claude Opus 4.8 som en kerneagentmodel for orkestrering, kode-berørende arbejde og andre trin, hvor et forkert svar er dyrt.
Kreditter og $$$ prisniveau
Okou prissætter hver indbygget model på en firetrins kredit-skala — $, $$, $$$, $$$$ — vist som et badge i modelvælgeren og på price tier-linjen i zero model ls. Claude Opus 4.8 ligger på $$$. Det niveau er, hvad du bruger fra din Okou-kreditbalance; leverandørens listepris i tabellen ovenfor er, hvad den opstrøms udbyder opkræver, før Okou konverterer det til kreditter.
Tilgængelig på Okou siden May 28, 2026.

