Alle modeller

Claude Opus 4.7: Anthropic ræsonnementsmodel

Anthropic's flagskibs Claude 4-model. Det stærkeste valg i familien til langsigtede agentloops, hård ræsonnement og første forsøg på kodeændringer.

1M tokens · Text / Vision / Code · Prompt cache

Okou kører ikke længere Claude Opus 4.7. Denne side opbevares som reference for dens specifikationer, priser og benchmarks. Til samme type arbejde, brug GPT 5.6 Luna.

Se GPT 5.6 Luna

Claude Opus 4.7 er den model, du griber til, når arbejdet skal være korrekt første gang: kode, der kompilerer rent, flertrinsplaner, der ikke mister tråden på tværs af lange værktøjskæder, abstrakte gåder, som mindre modeller snubler over. Leverandørbenches (SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2, OSWorld, BrowseComp) sætter konkrete tal på gevinsterne i forhold til Opus 4.6.

Leverandørens listepris er $5 / $25 pr. 1M tokens med cachelagret input til $0,50 / 1M, den højeste i Claude-familien. Det omkostningseffektive mønster er at beholde Sonnet 4.6 som standard og kun dirigere de sværeste trin til Opus.

Hvad er Claude Opus 4.7?

April 2026 (efterfølger Opus 4.6) · Topniveau af Claude 4-familien. Anthropic's anbefalede opgradering til brugere på Opus 4.6.

Claude Opus 4.7 er flagskibet i Anthropic's Claude 4-familie, udgivet i april 2026 som den anbefalede opgradering fra Opus 4.6. Anthropic beskriver den som en trinvis forbedring af agentisk kodning og abstrakt ræsonnement snarere end en opfriskning af overfladen API. Kontekstvinduet på 1M-token og de adaptive tænkeindsatsniveauer, der blev introduceret i 4.6, overføres uændret, så eksisterende agentkode kan bruges uden omskrivninger.

Sammenlignet med Sonnet 4.6 (arbejdshesten i samme familie) investerer Opus mere computerkraft pr. token. Den adfærdsmæssige gevinst viser sig tre steder: færre tabte instruktioner på lange agent-loops, væsentligt bedre første-forsøg kode-patches og stærkere genkaldelse, når samtalens historie vokser ud over 100K tokens. Ulempen er den højeste listepris i Claude-familien ($5 / $25 pr. 1M tokens) og langsommere outputhastighed pr. token, hvilket er grunden til, at Anthropic selv positionerer Opus som orkestratoren eller eskaleringstrinnet snarere end den overalt-standard.

Uafhængige ranglister (Artificial Analysis, Vellum) bekræfter den relative rækkefølge i forhold til Opus 4.6, men de absolutte tal skifter ugentligt, og OpenAI har markeret træningsdataforurening på SWE-bench Verified på tværs af alle frontlinjemodeller. Betragt de offentlige scores som retningsgivende snarere end autoritative; de strukturerede adfærdsmæssige forskelle (langsløjfet sammenhæng, første forsøg på patchkvalitet, multi-værktøjs routing-pålidelighed) er det mere holdbare signal.

Specifikationer på et øjeblik

FamilieClaude 4. generation
ModaliteterTekst, vision, kode
SprogEngelsk-først, flersproget
Prompt-cachelagringUnderstøttet (Anthropic)
Kontekstvindue1M tokens
Max outputOp til 64K tokens
AnstrengelsesniveauerLav / Medium / Høj / Maks
Leverandørens listepris5 $ input / 25 $ output pr. 1M

Claude Opus 4.7 benchmarks

Leverandørrapporterede scores fra Anthropic's Opus 4.7-udgivelsesmateriale, med forskelle vist i forhold til de offentlige Opus 4.6-tal. Uafhængige anmeldelser placerer 4.7 foran GPT-5.2 på de fleste agentiske kodningsopgaver og inden for få point af Gemini 3 Pro på abstrakt ræsonnement. Behandl absolutte procenter som retningsgivende; OpenAI har markeret træningsdataforurening på SWE-bench Verified på tværs af alle frontlinjemodeller.

SWE-bench Verificeretleverandørrapporteret; op fra Opus 4.6's 80,8%
~83.5%
SWE-bench Proleverandør-rapporteret
Leder Claude-familien ved udgivelse
Terminal-Bench 2.0leverandørrapporteret; op fra Opus 4.6's 65,4%
~71%
τ2-bench Detailhandelleverandørrapporteret brug af værktøjer
~93%
OSWorld (computerbrug)leverandørrapporteret; op fra Opus 4.6's 72,7%
~76%
BrowseCompleverandørrapporterede webopgaver
~88%
ARC AGI 2leverandørrapporteret; op fra Opus 4.6's 68,8%
~75%
Menneskehedens sidste eksamen (med værktøjer)leverandør-rapporteret
Leads Claude-familien
GPQA Diamondleverandørrapporteret videnskab på kandidatniveau
~92%
MRCR v2 (1M, 8-nåle)lang-kontekst genkaldelse
Forbedret i forhold til 4.6's 76%
MMMU Pro (multimodal)leverandør-rapporteret
Leads Claude-familien

Claude Opus 4.7 priser

Udbyderens listepris, pr. 1M tokens.

Input$5.00
Output$25.00
Cachelæsning$0.50
Cache-skrivning$6.25

Hvordan Claude Opus 4.7 opfører sig i praksis

Observeret adfærd fra produktionsagentkørsler.

Værktøjsrouting

Laveste rate af fejlrouterede værktøjskald i Claude-familien. Forskellen i forhold til Sonnet 4.6 udvides på svære grænsetilfælde som betinget værktøjsvalg, dybt indlejrede argumenter og værktøjskald afsendt efter lange perioder med ræsonnement.

Lang-kontekst genkaldelse

Sammenhængende på tværs af 200K+ token agent transkriptioner. 1M-token vinduet holder meget bedre end forgængerne takket være de kontekst-rot forbedringer Anthropic introducerede i Opus 4.6 og yderligere forfinede til 4.7. Leverandørrapporteret MRCR v2 ved 1M viser en målbar forbedring i forhold til Opus 4.6's 76%.

Første forsøg på kodeændringer

Stærkeste patchkvalitet i Claude-familien. Det rigtige valg, når en agent skal ændre kode, der skal fortsætte med at kompilere og bestå tests, især når patchen strækker sig over flere filer. Anthropic's Terminal-Bench 2.0-resultat afspejler dette direkte.

Hastighed

Langsommere end Sonnet 4.6 og mærkbart langsommere end Kimi K2.7 Code. Anthropic udgiver ~41 tokens/sek. ved maksimal indsats for Opus 4.6, og 4.7 er i et lignende område. Reserver den til de trin, der faktisk kræver den ekstra ræsonnementsdybde, og kør lettere niveauer parallelt.

Hallucinationsadfærd

Opus 4.7 bevarer Anthropic's konservative afvisningsholdning og har en tendens til at indrømme usikkerhed frem for at konfabulere, hvilket er grunden til, at produktionsteams fortsat betaler præmien for højrisiko-ræsonnement på trods af billigere open-weight alternativer som Kimi K2.7 Code og DeepSeek V4 Pro nu matcher det på benchmarks.

Bedste agentopgaver for Claude Opus 4.7

PR-gennemgangen, der fanger det, mennesker overser

Når en pull-anmodning ændrer 30 filer, beholder Opus 4.7 hele ændringen i arbejdshukommelsen og skriver en gennemgang, der forbinder det, der blev ændret i auth/middleware.ts, med den test, den brød i routes/admin.test.ts. Junioranmeldere får den form for feedback på tværs af filer, som senioringeniører normalt fanger ved en anden gennemgang, og teamet sender færre patches, der passerer CI, men går i stykker i produktion.

Forskningskørslen, der læser hele bunken

Drop et 200-siders kontraktudkast, tre konkurrentforslag og sidste kvartals juridiske udtalelser ind i 1M-token kontekstvinduet, og bed derefter Opus om at markere hver klausul, der er strammere end markedet, og liste de sandsynlige forhandlingspunkter. Mindre modeller begynder at droppe tidligere sektioner efter 100K tokens; Opus holder hele billedet i syne og refererer til det nøjagtige afsnit, det citerer.

Orkestratoren, der kører en multi-værktøjsplan

Brug Opus 4.7 som planlæggeren, der opdeler en kundes anmodning i ti trin, sender hvert trin til en Sonnet- eller omkostningsbesparende underagent og samler resultaterne igen. At køre Opus kun på planlæggerlaget (og de billigere niveauer overalt ellers) koster en brøkdel af at køre Opus ende-til-ende, med det meste af kvaliteten bevaret.

De første kodeændringer, der ikke spilder en CI-kørsel

Bed Opus 4.7 om at migrere en kodebase på 50 filer fra én ORM til en anden, refaktorere et sammenfiltret modul eller anvende en sikkerhedsrettelse på tværs af repoet. Patchen anvendes rent ved første forsøg oftere end nogen anden model i familien, hvilket er, hvad leverandørrapporterede Terminal-Bench 2.0 afspejler, og hvad din CI-regning også vil afspejle.

Hvornår man skal springe Claude Opus 4.7 over

Spring Opus 4.7 over på rutinearbejde med højt volumen, hvor Sonnet 4.6 rammer den samme kvalitetsstandard til en brøkdel af prisen, på latensfølsomme chat-svar, hvor Kimi K2.7 Code er meget hurtigere, og på bulkklassificerings- eller ekstraktionsjob, hvor GPT-5.4 Mini er den billigere understøttede bulk-mulighed.

Claude Opus 4.7 vs. andre modeller

Claude Opus 4.7 vs Claude Sonnet 4.6

Sonnet 4.6 er standardarbejdshesten i Claude-familien og det rigtige valg for de fleste agenter. Opgrader kun til Opus 4.7, når Sonnet synligt fejler på svær ræsonnement, lang kontekst eller første forsøg på kodeændringer, normalt som orkestratoren, der delegerer nedad til Sonnet- eller omkostningsbesparende underagenter.

Claude Opus 4.7 vs Claude Opus 4.6

Samme kontekstvindue (1M tokens), samme leverandørpriser og den samme adaptive-tænkende arkitektur. Opus 4.7 er den nyere generation med leverandørrapporterede forbedringer på tværs af SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2 og OSWorld. Vælg 4.7 til nye agenter; fastlås 4.6 kun når en eksisterende agent er blevet valideret mod den version, og du har brug for stabilitet i adfærd.

Bundlinjen: skal du bruge Claude Opus 4.7?

Opus 4.7 er eskaleringsniveauet. Standard er Sonnet 4.6; opgrader kun til Opus på de specifikke trin, hvor Sonnet tydeligt fejler.

Ofte stillede spørgsmål

Hvad er Claude Opus 4.7's kontekstvindue?

1 million tokens, med op til 64K tokens output pr. svar. Hele vinduet faktureres til standardpriser. En anmodning på 900K tokens har samme pris pr. token som en anmodning på 9K tokens.

Kan Claude Opus 4.7 håndtere billeder?

Ja. Opus 4.7 er multimodal. Den accepterer billedinput sammen med tekst og kode, så skærmbillede-drevne og dokument-vision-agenter fungerer nativt.

Hvornår skal jeg vælge Opus 4.7 frem for Sonnet 4.6?

Når (a) agenten er planlæggeren/orkestratoren, og beslutninger kaskaderer, (b) kørslen er lang nok til, at Sonnet begynder at droppe instruktioner, eller (c) outputtet skal anvendes rent ved første forsøg (kodeændringer, strukturerede payloads).

Understøtter Opus 4.7 prompt-caching?

Ja. Cachelagret input faktureres til $0,50 pr. 1M tokens. En 10x rabat på den cachelagrede del. Værd at bruge, når din systemprompt eller værktøjsskema er stabilt på tværs af opkald.

Alternativer

Tilgængelighed af Claude Opus 4.7 på Okou

Claude Opus 4.7 er blevet fjernet fra Okou-udvalget, så den kan ikke længere vælges i chat eller i en arbejdsgang, og den er ikke tilgængelig med din egen API-nøgle. GPT 5.6 Luna dækker det samme omkostningsbesparende niveau.