Claude Opus 4.8
Anthropic:n uusin lippulaiva. Julkaistu 28. toukokuuta 2026 vahvemmalla agenttisella koodauksella, dynaamisilla työnkuluilla, jotka haarautuvat sadoiksi rinnakkaisiksi ala-agenteiksi, ja 3 kertaa edullisemmalla nopealla tilalla samalla normaalihinnalla kuin Opus 4.7.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 4.8 on Anthropic:n lippulaivajulkaisu 28. toukokuuta 2026, suora päivitys Opus 4.7:ään samalla 5 $/25 $ myyjän listahinnalla. Se saavuttaa korkeimmat SWE-bench Pro (69,2 %), OSWorld-Verified (83,4 %), MCP-Atlas (82,2 %) ja Humanity's Last Exam (57,9 % työkaluilla) -tulokset, jotka Anthropic on koskaan toimittanut, ja on ensimmäinen malli, joka ylittää 10 %:n rajan oikeudellisen agentin all-pass-standardissa.
Kaksi rakenteellista muutosta, jotka kannattaa tietää, ovat dynaamiset työnkulut (suunnittele työ, jaa se satoihin rinnakkaisiin ala-agentteihin yhdessä istunnossa) ja nopean tilan hinnoittelun leikkaus 2,5-kertaiseen nopeuteen 10 $/50 $ per 1M tokenia – kolme kertaa halvempaa kuin nopean tilan aiemmissa Claude-malleissa. Vaatimustasot laajenevat korkeaan (oletus), ylimääräiseen ja maksimiin. Anthropic itse kuvaa julkaisua "vaatimattomaksi mutta konkreettiseksi parannukseksi" pikemminkin kuin harppaukseksi.
Mikä on Claude Opus 4.8?
28. toukokuuta 2026
Kaksi rakenteellista muutosta on merkityksellisiä Okou-käyttäjille. Ensinnäkin dynaamiset työnkulut: malli voi suunnitella tehtävän ja jakaa sen satoihin rinnakkaisiin ala-agentteihin yhdessä istunnossa, mitä Anthropic kuvaa askeleena kohti koodipohjan laajuisten siirtojen käsittelyä sadoissa tuhansissa koodiriveissä yhdellä ajolla. Toiseksi, nopea tila 2,5-kertaisella nopeudella on nyt 10 $ / 50 $ per 1M tokenia – kolme kertaa edullisempi kuin nopea tila aiemmissa Claude-malleissa. Vaatimustasot laajenevat kolmeen tasoon: korkea (oletus), erittäin korkea (xhigh Claude Code:ssä) ja maksimi.
Riippumattomat lukemat (LLM Stats, VentureBeat, Vellum) vahvistavat suhteellisen järjestyksen 4.7:ää ja kilpailijoita vastaan: 4.8 voittaa kaikilla Anthropic:n julkaistun vertailujoukon soluilla paitsi Terminal-Bench 2.1:ssä, jossa GPT-5.5 on edelleen johdossa (78.2 % vs. 4.8:n 74.6 %). 4.7:stä 4.8:aan hyppy SWE-bench Prossa on +4.9 pistettä; USAMO 2026:ssa se on +27.4; uudessa 1M-tokenin GraphWalks long-context F1:ssä se on +27.8. Käsittele absoluuttisia pisteitä suuntaa antavina – SWE-bench Verified lähestyy kyllästymistä kaikissa huippumalleissa.
Mitä Claude Opus 4.8:ssä on huomattavaa
Otsikkoarkkitehtuuri ja ominaisuudet.
Opus 4.8 säilyttää Opus 4.7:n 1M-tokenin konteksti-ikkunan ja 128K maksimitulosteen, ja siitä veloitetaan standardin mukainen syöttöhinta koko ikkunan osalta. Vaivannäön hallinta laajenee kolmelle tasolle: korkea (uusi oletus), lisä (xhigh Claude Code:n sisällä) ja maksimi. Messages API hyväksyy nyt järjestelmämerkinnät keskustelun keskellä rikkomatta kehotteiden välimuistiin tallennusta. Dynaamiset työnkulut antavat Claude:n suunnitella ja lähettää satoja rinnakkaisia aliedustajia yhdessä istunnossa. Nopea tila toimii noin 2,5 kertaa standardinopeudella hintaan 10 $ / 50 $ per 1M tokenia. Multimodaaliset syötteet tekstin, näön ja koodin osalta ovat ennallaan.
Tekniset tiedot yhdellä silmäyksellä
Claude Opus 4.8 vertailuarvot
Myyjän ilmoittamat pisteet Anthropic:n Opus 4.8 -järjestelmäkortista, vertailussa Opus 4.7:ään, GPT-5.5:een ja Gemini 3.1 Prohon maksimiponnistuksella ja 5 kokeen keskiarvoilla. 4.8 johtaa kuudessa seitsemästä Anthropic:n julkaisemasta solusta; GPT-5.5 säilyttää johtoaseman Terminal-Bench 2.1:ssä. SWE-bench Verified lähestyy kyllästymispistettä kaikissa huippumalleissa – vaikeampi SWE-bench Pro -sarja on kestävämpi signaali.
Claude Opus 4.8 hinnoittelu
Palveluntarjoajan listahinta, per 1M tokenia.
Miten Claude Opus 4.8 käyttäytyy käytännössä
Havainnoitu käyttäytyminen tuotantoagenttien ajosta.
Dynaamiset työnkulut
Uusi pääominaisuus. Opus 4.8 voi suunnitella tehtävän ja sitten suorittaa satoja rinnakkaisia ala-agentteja saman istunnon aikana – Anthropic asettaa tämän poluksi koodipohjan laajuisiin siirtoihin satojen tuhansien rivien yli yhdellä ajolla. Okou:ssä tämä tarkoittaa, että yksi agentin suoritus voi orkestroida hajautettua työtä, joka aiemmin vaati ulkoista aikataulutusta.
Ensimmäisen yrityksen koodimuokkaukset
Anthropic raportoi, että Opus 4.8 jättää noin neljä kertaa harvemmin huomiotta virheitä koodia tarkistaessaan kuin 4.7, ja +4.9 pisteen SWE-bench Pro -hyppy (69.2 % vs. 64.3 %) tukee tätä vaikeammassa, vähemmän kyllästetyssä koodausjoukossa. Valitse 4.8 korjauksiin, joiden on sovellettava puhtaasti useisiin tiedostoihin.
Pitkän kontekstin palautus
GraphWalks F1 1M tokenilla hyppää 40,3 %:sta 68,1 %:iin – suurin yksittäinen vertailuarvovoitto julkaisussa. 1M tokenin ikkuna on nyt todella käyttökelpoinen alueensa yläpäässä, ei vain nimellisesti.
Rehellisyys ja yli-itsevarmuus
Anthropic raportoi yli kymmenkertaisen vähennyksen liiallisessa itseluottamuksessa verrattuna versioon 4.7, 0 % kriittisesti virheellisten tulosten raportoinnissa (ensimmäinen Claude-perheessä) ja 3,7 %:n epäonnistumisasteen tärkeiden tapahtumien ilmoittamisessa käyttäjälle. Kohdistusvirheiden esiintyvyys on ~1,9, mikä on käytännössä sama kuin Anthropic:n parhaiten kohdistetun Mythos Preview -version.
Nopeus ja nopea tila
Vakionopeus on verrattavissa Opus 4.7:ään. Hintamuutos on pääasia: nopea tila 2,5-kertaisella nopeudella maksaa 10 $ / 50 $ per 1M tokenia, kolme kertaa halvempaa kuin nopea tila aiemmissa Claude-malleissa. Kannattaa käyttää orkestrointivaiheissa, joissa todellinen viive on tärkeä.
Kehotteen injektiovaroitus
Anthropic:n järjestelmäkortti toteaa, että 4.8 on jonkin verran vähemmän kestävä agenttikehotteen injektiota vastaan kuin 4.7 – Gray Swanin punainen tiimi osoittaa ~9,6 %:n hyökkäyksen onnistumisasteen verrattuna 6,0 %:iin 4.7:ssä. Tiimien, jotka käyttävät 4.8:aa putkistoissa, jotka käsittelevät epäluotettavaa syötettä, tulisi tarkistaa hiekkalaatikointimenetelmänsä.
Parhaat agenttitehtävät Claude Opus 4.8:lle
Koodipohjan laajuinen siirto, joka ennen vaati sprintin
Anna Opus 4.8:lle siirto, joka koskettaa muutamia satoja tiedostoja – ORM-vaihto, kehysversion päivitys, tietoturvakorjaus monirepossa – ja anna dynaamisten työnkulkujen jakaa työ rinnakkaisille ala-agenteille yhden istunnon aikana. +4,9 pisteen SWE-bench Pro -hyppy ja nelinkertainen virheiden väheneminen koodikatselmuksessa ovat ne, jotka tuottavat tulosta tällaisessa ajossa.
1 miljoonan tokenin tutkimusajo, joka todella pysyy koossa
Pudota 200-sivuinen sopimusluonnos, kolme kilpailijan ehdotusta ja viime vuosineljänneksen oikeudelliset lausunnot ikkunaan ja pyydä sitten Opus 4.8:aa merkitsemään kaikki lausekkeet, jotka ovat tiukempia kuin markkinat. GraphWalks 1M:ssä hyppäämällä 40,3 %:sta 68,1 %:iin tekee tällaisesta dokumenttien välisestä synteesistä jälleen luotettavaa.
Agentin orkestroija, joka ei valehtele työstään
Käytä 4.8:aa suunnittelijana, joka jakaa pyynnön kymmeneen vaiheeseen, lähettää jokaisen halvemmille ala-agenteille ja raportoi tuloksen. 0 %:n virheellisten tulosten raportointiaste yhdistettynä kymmenkertaiseen ylitarkkuuden laskuun on syy, miksi tuotantotiimit käyttävät 4.8:aa, kun agentin oma itse-raportti on oltava luotettava.
Viiveherkkä virtaus, joka lopulta onnistuu nopeassa tilassa
Nopea tila 2,5-kertaisella nopeudella maksoi aiemmin kolme kertaa sen, mitä se nyt maksaa (10 $/50 $ per 1M vs. edellinen taso). Interaktiivisille apuohjelmille, päivystäville yhteenvetäjille tai mille tahansa vaiheelle, jossa kellonajan viive hallitsee kokemusta, nopea tila 4.8 on nyt oletusvalinta Claude-perheessä.
Milloin ohittaa Claude Opus 4.8
Ohita Opus 4.8 suurivolyymisessä rutiinityössä, jossa Sonnet 4.6 saavuttaa saman laatutason murto-osalla kustannuksista, viivekriittisissä chat-vastauksissa, joissa Kimi K2.7 Code on paljon nopeampi, agenttisessa terminaalikoodauksessa, jossa GPT-5.5 johtaa edelleen Terminal-Bench 2.1:ssä (78,2 % vs. 4.8:n 74,6 %), ja putkilinjoissa, jotka ottavat vastaan epäluotettavaa syötettä ilman hiekkalaatikkoa – 4.8:n kehotteen injektion kestävyys on hieman heikompi kuin 4.7:n.
Claude Opus 4.8 vs. muut mallit
Claude Opus 4.8 vs GPT-5.5
Opus 4.8 johtaa kuudessa seitsemästä solusta Anthropic:n vertailujoukossa, suurimmat erot ovat SWE-bench Prossa (69,2 % vs. 58,6 %) ja OSWorld-Verifiedissä (83,4 % vs. 78,7 %). GPT-5.5 säilyttää johtoaseman Terminal-Bench 2.1:ssä (78,2 % vs. 74,6 %). Valitse 4.8 tiedostojen väliseen koodaukseen ja tietokoneen käyttöagentteihin; valitse GPT-5.5 erityisesti silloin, kun terminaaliohjattu työ hallitsee.
Claude Opus 4.8 vs Gemini 3.1 Pro
Opus 4.8 johtaa selvästi SWE-bench Prossa (+15.0) ja OSWorld-Verifiedissä (+7.2). Nämä kaksi mallia pysyvät kohinan sisällä kylläisillä tiede-vertailuarvoilla, kuten GPQA Diamond. Oletuksena 4.8 agenttityöhön; harkitse Geminiä erityisesti, kun tarvitset Googlen työkalujen integrointia.
Lopputulos: pitäisikö sinun käyttää Claude Opus 4.8:ää?
Uusi oletus uusille agenteille Claude-perheessä. Siirry versiosta 4.7, kun voit vahvistaa uudelleen; oletuksena suoraan uuteen työhön. Pidä Sonnet 4.6 edullisempana työhevosena sen alla.
Usein kysytyt kysymykset
Milloin Claude Opus 4.8 julkaistiin?
Anthropic julkaisi Opus 4.8:n 28. toukokuuta 2026, 41 päivää Opus 4.7:n jälkeen. Se on saatavilla tänään kaikissa Claude-tuotteissa, Claude API:ssä (mallitunnus claude-opus-4-8), Amazon Bedrockissa, Google Cloud Vertex AI:ssä, Microsoft Foundryssa ja Okou:ssä.
Miten Opus 4.8:n hinnoittelu vertautuu 4.7:ään?
Normaalihinta on sama: 5 dollaria per 1M syöttötunnusta, 25 dollaria per 1M tulostustunnusta, 0,50 dollaria per 1M välimuistiin tallennettua syöttötunnusta. Muutos on nopea tila, nyt 10 dollaria / 50 dollaria per 1M tunnusta 2,5-kertaisella nopeudella – kolme kertaa edullisempi kuin nopea tila aiemmissa Claude-malleissa.
Mitä ovat dynaamiset työnkulut?
Uusi ominaisuus, jonka avulla Opus 4.8 voi suunnitella tehtävän ja sitten suorittaa satoja rinnakkaisia ala-agentteja yhden istunnon aikana. Anthropic asettaa tämän poluksi koodikannan laajuisiin siirtoihin satojen tuhansien koodirivien yli yhdessä agentin ajossa.
Mitä vaatimustasoja Opus 4.8 tukee?
Kolme tasoa: korkea (uusi oletus), erittäin korkea (xhigh Claude Code:ssä) ja maksimi. Korkeammat asetukset käyttävät enemmän tokeneita päättelyyn ennen vastauksen tuottamista; alemmat asetukset suosivat nopeutta ja nopeusrajoituksen tehokkuutta.
Tukeeko Opus 4.8 kehotteiden välimuistia?
Kyllä. Välimuistiin tallennettu syöte laskutetaan 0,50 dollarilla per 1M tokenia, mikä on 10-kertainen alennus välimuistiin tallennetusta osasta. Messages API hyväksyy nyt myös järjestelmämerkinnät keskustelun keskellä rikkomatta välimuistia.
Vaihtoehdot
Käyttäen Claude Opus 4.8:ää Okou:ssä
Kaksi tapaa käyttää Claude Opus 4.8:ää Okou:ssä
Okou tukee Claude Opus 4.8:ää sisäänrakennettuna mallina, joka laskutetaan Okou-krediiteillä, ja omalla Anthropic API key:llä. Sisäänrakennettu polku käyttää Okou Managed -reititystä ja alla selitettyä hintatasoa; oma polku laskuttaa sinua suoraan ylävirran toimittajalta ja ohittaa Okou-krediittimuunnoksen kokonaan.
Okou:n suositus
Okou sijoittaa Claude Opus 4.8:n ydinkäyttäjäagenttimalliksi orkestrointiin, koodin koskettamiseen ja muihin vaiheisiin, joissa väärä vastaus on kallista.
Krediitit ja $$$-hintataso
Okou hinnoittelee jokaisen sisäänrakennetun mallin nelivaiheisella krediittiasteikolla – $, $$, $$$, $$$$ – joka näkyy merkkinä mallinvalitsimessa ja price tier-rivillä zero model ls:ssä. Claude Opus 4.8 sijaitsee $$$:ssä. Tämä taso on se, mitä käytät Okou-krediittisaldostasi; yllä olevassa taulukossa oleva myyjän listahinta on se, mitä ylävirran toimittaja veloittaa ennen kuin Okou muuntaa sen krediiteiksi.
Saatavilla Okou:ssä May 28, 2026:stä lähtien.

