Alle modellen

Claude Opus 4.8

Anthropic's nieuwste vlaggenschip. Uitgebracht op 28 mei 2026 met sterkere agentic coding, dynamische workflows die honderden parallelle subagents uitwaaieren, en een 3× goedkopere snelle modus voor dezelfde reguliere prijs als Opus 4.7.

1M tokens · Text / Vision / Code · Prompt cache

Claude Opus 4.8 is Anthropic's vlaggenschiprelease op 28 mei 2026, een directe upgrade naar Opus 4.7 voor dezelfde catalogusprijs van $5/$25. Het behaalt de hoogste SWE-bench Pro (69,2%), OSWorld-Verified (83,4%), MCP-Atlas (82,2%) en Humanity's Last Exam (57,9% met tools) scores die Anthropic ooit heeft geleverd, en is het eerste model dat 10% doorbreekt op de juridische-agent all-pass standaard.

De twee structurele veranderingen die het vermelden waard zijn, zijn dynamische workflows (plan een taak, verdeel deze over honderden parallelle subagents in één sessie) en een prijsverlaging voor de snelle modus naar 2,5× snelheid voor $10/$50 per 1M tokens — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. Inspanningsniveaus worden uitgebreid naar hoog (standaard), extra en maximaal. Anthropic zelf omschrijft de release als een "bescheiden maar tastbare verbetering" in plaats van een sprong.

Wat is Claude Opus 4.8?

28 mei 2026

Twee structurele veranderingen zijn van belang voor Okou-gebruikers. Ten eerste, dynamische workflows: het model kan een taak plannen en deze verspreiden over honderden parallelle subagents in één sessie, wat Anthropic beschrijft als een stap naar het afhandelen van codebase-brede migraties over honderdduizenden regels code in één keer. Ten tweede, de snelle modus met 2,5x snelheid kost nu $10 / $50 per 1M tokens — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. Inspanningsniveaus worden uitgebreid naar drie niveaus: hoog (standaard), extra (xhigh in Claude Code), en maximaal.

Onafhankelijke metingen (LLM Stats, VentureBeat, Vellum) bevestigen de relatieve rangschikking ten opzichte van 4.7 en concurrenten: 4.8 wint op elke cel van Anthropic's gepubliceerde vergelijkingsset, behalve Terminal-Bench 2.1, waar GPT-5.5 nog steeds leidt (78,2% versus 74,6% van 4.8). De sprong van 4.7 naar 4.8 op SWE-bench Pro is +4,9 punten; op USAMO 2026 is het +27,4; op de nieuwe 1M-token GraphWalks long-context F1 is het +27,8. Beschouw absolute scores als richtinggevend — SWE-bench Verified nadert verzadiging bij alle grensmodellen.

Wat is opmerkelijk aan Claude Opus 4.8

Koparchitectuur en functionaliteiten.

Opus 4.8 behoudt het 1M-token contextvenster en 128K maximale output van Opus 4.7, gefactureerd tegen standaard invoerprijzen over het gehele venster. De inspanningscontrole breidt uit naar drie niveaus: hoog (de nieuwe standaard), extra (xhigh binnen Claude Code), en max. De Messages API accepteert nu systeeminvoer midden in een gesprek zonder prompt caching te onderbreken. Dynamische workflows laten Claude honderden parallelle subagenten plannen en verzenden in één sessie. De snelle modus draait met ~2,5× standaardsnelheid voor $10 / $50 per 1M tokens. Multimodale invoer over tekst, visie en code is ongewijzigd.

Specificaties in één oogopslag

FamilieClaude 4 generatie
ModaliteitenTekst, visie, code
TalenEngels-eerst, meertalig
Prompt cachingOndersteund (Anthropic)
Contextvenster1M tokens
Max uitvoerTot 128K tokens
InspanningsniveausHoog (standaard) / Extra / Max
Leverancierslijstprijs$5 invoer / $25 uitvoer per 1M (snelle modus $10/$50, 2,5× snelheid)

Claude Opus 4.8 benchmarks

Door de leverancier gerapporteerde scores van Anthropic's Opus 4.8 systeemkaart, met vergelijkingen met Opus 4.7, GPT-5.5 en Gemini 3.1 Pro bij maximale inspanning en gemiddelden van 5 proeven. 4.8 leidt in zes van de zeven cellen die Anthropic publiceert; GPT-5.5 behoudt de leiding op Terminal-Bench 2.1. SWE-bench Verified nadert verzadiging over alle frontier-modellen heen — de moeilijkere SWE-bench Pro-set is het duurzamere signaal.

SWE-bench Geverifieerddoor leverancier gerapporteerd; omhoog van Opus 4.7's 87,6%
88.6%
SWE-bench Proleidt het veld (4.7: 64,3%, GPT-5.5: 58,6%, Gemini 3.1 Pro: 54,2%)
69.2%
Terminal-Bench 2.1omhoog van 66,1% van 4.7 op 2.0; GPT-5.5 leidt hier met 78,2%
74.6%
OSWorld-Geverifieerd (computergebruik)leidt het veld (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (browseragent)door leverancier gerapporteerd
84%
MCP-Atlasomhoog van Opus 4.7's 77,3%
82.2%
BrowseComp (single-agent)omhoog van Opus 4.7's 79,3%
84.3%
GraphWalks lange-context F1 (1M tokens)gestegen van 40,3% van Opus 4.7
68.1%
Laatste examen van de mensheid (met hulpmiddelen)49,8% zonder tools; toonaangevend in het veld
57.9%
GPQA Diamondvlak vs 4.7 — verzadigd over grensmodellen
~93%
USAMO 2026 (wiskunde)gestegen van 69,3% van Opus 4.7
96.7%
GDPval-AA (kenniswerk)leidt (4.7: 1753, GPT-5.5: 1769)
1890 Elo
Financiële agent v2leidt het veld
53.9%
Juridisch-agent all-passeerste model dat deze standaard doorbreekt
>10%

Claude Opus 4.8 prijzen

Catalogusprijs van de provider, per 1M tokens.

Invoer$5.00
Uitvoer$25.00
Cache lezen$0.50
Cache schrijven$6.25

Hoe Claude Opus 4.8 zich in de praktijk gedraagt

Waargenomen gedrag van productieve agentruns.

Dynamische workflows

De belangrijkste nieuwe functionaliteit. Opus 4.8 kan een taak plannen en vervolgens honderden parallelle subagents binnen dezelfde sessie uitvoeren — Anthropic positioneert dit als de weg naar codebase-brede migraties over honderdduizenden regels in één keer. Op Okou betekent dit dat één agentrun fan-out werk kan orkestreren dat voorheen externe planning vereiste.

Eerste poging codebewerkingen

Anthropic meldt dat Opus 4.8 ongeveer vier keer minder snel gebreken over het hoofd ziet dan 4.7 bij het controleren van code, en de +4.9 punt SWE-bench Pro sprong (69.2% vs 64.3%) ondersteunt dit op de moeilijkere, minder verzadigde codeerset. Kies 4.8 voor patches die netjes moeten worden toegepast over veel bestanden.

Lange-context herinnering

GraphWalks F1 bij 1M tokens springt van 40,3% naar 68,1% — de grootste enkele benchmarkwinst in de release. Het 1M-tokenvenster is nu daadwerkelijk bruikbaar aan de bovenkant van zijn bereik, niet alleen nominaal.

Eerlijkheid en overmoed

Anthropic rapporteert een meer dan tienvoudige vermindering van overmoed ten opzichte van 4.7, 0% bij het onkritisch rapporteren van gebrekkige resultaten (een primeur voor de Claude-familie), en een percentage van 3.7% bij het niet melden van belangrijke gebeurtenissen aan de gebruiker. De incidentie van misalignement is ~1.9, effectief gelijk aan Anthropic's best afgestemde Mythos Preview.

Snelheid en snelle modus

De standaardsnelheid is vergelijkbaar met Opus 4.7. De prijswijziging is het belangrijkste nieuws: de snelle modus met 2,5x snelheid kost $10 / $50 per 1M tokens, drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. De moeite waard om te gebruiken voor orkestratie stappen waar wandkloklatentie van belang is.

Prompt-injectie waarschuwing

De systeemkaart van Anthropic merkt op dat 4.8 iets minder robuust is tegen agentische promptinjectie dan 4.7 — Gray Swan red-teaming toont een aanvalssuccespercentage van ~9,6% versus 6,0% op 4.7. Teams die 4.8 gebruiken in pijplijnen die onbetrouwbare invoer verwerken, moeten hun sandboxing-aanpak herzien.

Beste agenttaken voor Claude Opus 4.8

De codebase-brede migratie die vroeger een sprint nodig had

Geef Opus 4.8 een migratie die een paar honderd bestanden raakt — ORM-swap, frameworkversie-update, beveiligingsfix over een monorepo — en laat dynamische workflows het werk verdelen over parallelle subagents binnen één sessie. De +4,9 punt SWE-bench Pro-sprong en de vier keer lagere fouten bij codebeoordeling zijn wat deze soort run oplevert.

De 1M-token onderzoeksrun die daadwerkelijk samenhangt

Deponeer een contractconcept van 200 pagina's, drie voorstellen van concurrenten en de juridische adviezen van vorig kwartaal in het venster, en vraag vervolgens aan Opus 4.8 om elke clausule te markeren die strenger is dan de markt. GraphWalks bij 1M die van 40,3% naar 68,1% springen, maakt dit soort cross-document synthese nieuw betrouwbaar.

De agent-orchestrator die niet liegt over zijn werk

Gebruik 4.8 als de planner die een verzoek in tien stappen opdeelt, elk naar goedkopere sub-agents stuurt en het resultaat rapporteert. Het 0%-percentage voor het kritiekloos rapporteren van gebrekkige resultaten, gecombineerd met de tienvoudige daling in overmoed, is de reden waarom productieteams 4.8 gebruiken wanneer het zelfrapport van de agent betrouwbaar moet zijn.

De latentiegevoelige flow die uiteindelijk uitkomt in de snelle modus

De snelle modus met 2,5x snelheid kostte vroeger drie keer zoveel als nu ($10/$50 per 1M versus de vorige tier). Voor interactieve copiloten, on-call samenvatters, of elke stap waarbij de 'wall-clock' latentie de ervaring domineert, is de snelle modus 4.8 nu de standaardkeuze in de Claude-familie.

Wanneer Claude Opus 4.8 overslaan

Sla Opus 4.8 over voor routinematig werk met grote volumes, waar Sonnet 4.6 dezelfde kwaliteitsstandaard haalt tegen een fractie van de kosten, voor latency-kritieke chatantwoorden waar Kimi K2.7 Code veel sneller is, voor agentic terminal coding waar GPT-5.5 nog steeds Terminal-Bench 2.1 leidt (78,2% versus 74,6% van 4.8), en voor pijplijnen die onbetrouwbare invoer zonder sandboxing verwerken — de robuustheid van 4.8 tegen prompt-injectie is iets zwakker dan die van 4.7.

Claude Opus 4.8 versus andere modellen

Claude Opus 4.8 vs GPT-5.5

Opus 4.8 leidt op zes van de zeven cellen in de vergelijkingsset van Anthropic, met de grootste verschillen op SWE-bench Pro (69,2% vs 58,6%) en OSWorld-Verified (83,4% vs 78,7%). GPT-5.5 behoudt de leiding op Terminal-Bench 2.1 (78,2% vs 74,6%). Kies 4.8 voor cross-file codering en computergebruik-agents; kies GPT-5.5 specifiek wanneer terminal-gedreven werk domineert.

Claude Opus 4.8 vs Gemini 3.1 Pro

Opus 4.8 leidt met ruime marges op SWE-bench Pro (+15.0) en OSWorld-Verified (+7.2). De twee modellen blijven binnen de ruis op verzadigde wetenschappelijke benchmarks zoals GPQA Diamond. Standaard naar 4.8 voor agentisch werk; overweeg Gemini specifiek wanneer je Google's toolintegratieverhaal nodig hebt.

Conclusie: moet je Claude Opus 4.8 gebruiken?

De nieuwe standaard voor nieuwe agents in de Claude-familie. Migreer van 4.7 wanneer je opnieuw kunt valideren; gebruik het direct voor nieuw werk. Houd Sonnet 4.6 als het goedkopere werkpaard eronder.

Veelgestelde vragen

Wanneer werd Claude Opus 4.8 uitgebracht?

Anthropic heeft Opus 4.8 uitgebracht op 28 mei 2026, 41 dagen na Opus 4.7. Het is vandaag beschikbaar in alle Claude producten, de Claude API (model-ID claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry en Okou.

Hoe verhoudt de prijs van Opus 4.8 zich tot 4.7?

Reguliere prijzen zijn identiek: $5 per 1M invoertokens, $25 per 1M uitvoertokens, $0,50 per 1M gecachte invoer. De verandering is de snelle modus, nu $10 / $50 per 1M tokens met 2,5× snelheid — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen.

Wat zijn dynamische workflows?

Een nieuwe mogelijkheid waarmee Opus 4.8 een taak kan plannen en vervolgens honderden parallelle subagenten binnen één sessie kan uitvoeren. Anthropic positioneert dit als de weg naar codebase-brede migraties over honderdduizenden regels code in één agentrun.

Welke inspanningsniveaus ondersteunt Opus 4.8?

Drie niveaus: hoog (de nieuwe standaard), extra (xhigh in Claude Code) en max. Hogere instellingen besteden meer tokens aan redeneren voordat ze een antwoord produceren; lagere instellingen geven de voorkeur aan snelheid en efficiëntie van de snelheidslimiet.

Ondersteunt Opus 4.8 prompt caching?

Ja. Gecachte invoer wordt gefactureerd tegen $0,50 per 1M tokens, een korting van 10× op het gecachte gedeelte. De Berichten API accepteert nu ook systeeminvoer midden in een gesprek zonder de cache te verbreken.

Alternatieven

Claude Opus 4.8 gebruiken op Okou

Twee manieren om toegang te krijgen tot Claude Opus 4.8 op Okou

Okou ondersteunt Claude Opus 4.8 als een ingebouwd model dat wordt gefactureerd in Okou-credits, en via 'bring-your-own' met een Anthropic API key. Het ingebouwde pad maakt gebruik van Okou Managed routing en de hieronder uitgelegde prijscategorie; het 'bring-your-own' pad factureert u rechtstreeks bij de upstream leverancier en slaat de Okou-creditconversie volledig over.

Aanbeveling van Okou

Okou positioneert Claude Opus 4.8 als een kernagentmodel voor orkestratie, code-aanrakend werk en andere stappen waarbij een verkeerd antwoord duur is.

Credits en de $$$ prijscategorie

Okou prijst elk ingebouwd model op een vierstaps creditschaal — $, $$, $$$, $$$$ — weergegeven als een badge in de modelkiezer en op de price tier-regel van zero model ls. Claude Opus 4.8 bevindt zich op $$$. Die laag is wat je uitgeeft van je Okou-creditsaldo; de catalogusprijs van de leverancier in de bovenstaande tabel is wat de upstream-provider in rekening brengt voordat Okou het omzet in credits.

Beschikbaar op Okou sinds May 28, 2026.