← Kaikki mallit

Claude Opus 4.8: mallin historiatiedot

1M tokens · Text / Vision / Code · Prompt cache

Okou ei enää käytä Claude Opus 4.8:ää. Tämä sivu on säilytetty viitteenä sen teknisistä tiedoista, hinnoittelusta ja vertailuarvoista. Samanlaiseen työhön käytä Claude Opus 5.5:ää.

Katso Claude Opus 5.5

Claude Opus 4.8 on Anthropic:n lippulaivajulkaisu 28. toukokuuta 2026, suora päivitys Opus 4.7:ään samalla 5 $/25 $ myyjän listahinnalla. Se saavuttaa korkeimmat SWE-bench Pro (69,2 %), OSWorld-Verified (83,4 %), MCP-Atlas (82,2 %) ja Humanity's Last Exam (57,9 % työkaluilla) -tulokset, jotka Anthropic on koskaan toimittanut, ja on ensimmäinen malli, joka ylittää 10 %:n rajan oikeudellisen agentin all-pass-standardissa.

Kaksi rakenteellista muutosta, jotka kannattaa tietää, ovat dynaamiset työnkulut (suunnittele työ, jaa se satoihin rinnakkaisiin ala-agentteihin yhdessä istunnossa) ja nopean tilan hinnoittelun leikkaus 2,5-kertaiseen nopeuteen 10 $/50 $ per 1M tokenia – kolme kertaa halvempaa kuin nopean tilan aiemmissa Claude-malleissa. Vaatimustasot laajenevat korkeaan (oletus), ylimääräiseen ja maksimiin. Anthropic itse kuvaa julkaisua "vaatimattomaksi mutta konkreettiseksi parannukseksi" pikemminkin kuin harppaukseksi.

Mikä on Claude Opus 4.8?

28. toukokuuta 2026

Riippumattomat lukemat (LLM Stats, VentureBeat, Vellum) vahvistavat suhteellisen järjestyksen 4.7:ää ja kilpailijoita vastaan: 4.8 voittaa kaikilla Anthropic:n julkaistun vertailujoukon soluilla paitsi Terminal-Bench 2.1:ssä, jossa GPT-5.5 on edelleen johdossa (78.2 % vs. 4.8:n 74.6 %). 4.7:stä 4.8:aan hyppy SWE-bench Prossa on +4.9 pistettä; USAMO 2026:ssa se on +27.4; uudessa 1M-tokenin GraphWalks long-context F1:ssä se on +27.8. Käsittele absoluuttisia pisteitä suuntaa antavina – SWE-bench Verified lähestyy kyllästymistä kaikissa huippumalleissa.

Mitä Claude Opus 4.8:ssä on huomattavaa

Otsikkoarkkitehtuuri ja ominaisuudet.

Opus 4.8 säilyttää Opus 4.7:n 1M-tokenin konteksti-ikkunan ja 128K maksimitulosteen, ja siitä veloitetaan standardin mukainen syöttöhinta koko ikkunan osalta. Vaivannäön hallinta laajenee kolmelle tasolle: korkea (uusi oletus), lisä (xhigh Claude Code:n sisällä) ja maksimi. Messages API hyväksyy nyt järjestelmämerkinnät keskustelun keskellä rikkomatta kehotteiden välimuistiin tallennusta. Dynaamiset työnkulut antavat Claude:n suunnitella ja lähettää satoja rinnakkaisia aliedustajia yhdessä istunnossa. Nopea tila toimii noin 2,5 kertaa standardinopeudella hintaan 10 $ / 50 $ per 1M tokenia. Multimodaaliset syötteet tekstin, näön ja koodin osalta ovat ennallaan.

Tekniset tiedot yhdellä silmäyksellä

PerheClaude 4. sukupolvi
ModaalisuudetTeksti, näkö, koodi
KieletEnglanti ensin, monikielinen
Kehotteen välimuistiin tallennusTuettu (Anthropic)
Konteksti-ikkuna1M tokenia
MaksimitulosteJopa 128K tunnusta
VaikeustasotKorkea (oletus) / Erittäin / Maksimi
Myyjän listahinta5 $ syöte / 25 $ tuloste per 1M (nopea tila 10 $/50 $, 2,5x nopeus)

Claude Opus 4.8 vertailuarvot

Myyjän ilmoittamat pisteet Anthropic:n Opus 4.8 -järjestelmäkortista, vertailussa Opus 4.7:ään, GPT-5.5:een ja Gemini 3.1 Prohon maksimiponnistuksella ja 5 kokeen keskiarvoilla. 4.8 johtaa kuudessa seitsemästä Anthropic:n julkaisemasta solusta; GPT-5.5 säilyttää johtoaseman Terminal-Bench 2.1:ssä. SWE-bench Verified lähestyy kyllästymispistettä kaikissa huippumalleissa – vaikeampi SWE-bench Pro -sarja on kestävämpi signaali.

SWE-bench Verifiedtoimittajan raportoima; noussut Opus 4.7:n 87,6 %:sta
88.6%
SWE-bench Projohtaa alaa (4.7: 64.3%, GPT-5.5: 58.6%, Gemini 3.1 Pro: 54.2%)
69.2%
Terminal-Bench 2.1noussut 4.7:n 66.1%:sta 2.0:ssa; GPT-5.5 johtaa tässä 78.2%:lla
74.6%
OSWorld-vahvistettu (tietokoneen käyttö)alan johtaja (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (selainagentti)toimittajan raportoima
84%
MCP-Atlasnousi Opus 4.7:n 77,3 %:sta
82.2%
BrowseComp (yksittäinen agentti)nousi Opus 4.7:n 79,3 %:sta
84.3%
GraphWalks pitkän kontekstin F1 (1M tokenia)nousua Opus 4.7:n 40,3 %:sta
68.1%
Ihmiskunnan viimeinen koe (työkaluilla)49,8 % ilman työkaluja; alan johtava
57.9%
GPQA Diamondtasainen vs. 4.7 – kyllästetty rajapintamalleissa
~93%
USAMO 2026 (matematiikka)nousua Opus 4.7:n 69,3 %:sta
96.7%
GDPval-AA (tietotyö)johtaa (4.7: 1753, GPT-5.5: 1769)
1890 Elo
Rahoitusagentti v2johtaa alaa
53.9%
Lakimiesagentin läpäisyensimmäinen malli, joka rikkoo tämän standardin
>10%

Claude Opus 4.8 hinnoittelu

Palveluntarjoajan historialliset listahinnat miljoonaa tokenia kohti. Nämä viitearvot eivät ole Okou:n nykyisiä maksuja.

Syöte$5.00
Tuloste$25.00
Välimuistin luku$0.50
Välimuistin kirjoitus$6.25

Miten Claude Opus 4.8 käyttäytyy käytännössä

Havainnoitu käyttäytyminen tuotantoagenttien ajosta.

Ensimmäisen yrityksen koodimuokkaukset

Anthropic raportoi, että Opus 4.8 jättää noin neljä kertaa harvemmin huomiotta virheitä koodia tarkistaessaan kuin 4.7, ja +4.9 pisteen SWE-bench Pro -hyppy (69.2 % vs. 64.3 %) tukee tätä vaikeammassa, vähemmän kyllästetyssä koodausjoukossa. Valitse 4.8 korjauksiin, joiden on sovellettava puhtaasti useisiin tiedostoihin.

Pitkän kontekstin palautus

GraphWalks F1 1M tokenilla hyppää 40,3 %:sta 68,1 %:iin – suurin yksittäinen vertailuarvovoitto julkaisussa. 1M tokenin ikkuna on nyt todella käyttökelpoinen alueensa yläpäässä, ei vain nimellisesti.

Rehellisyys ja yli-itsevarmuus

Anthropic raportoi yli kymmenkertaisen vähennyksen liiallisessa itseluottamuksessa verrattuna versioon 4.7, 0 % kriittisesti virheellisten tulosten raportoinnissa (ensimmäinen Claude-perheessä) ja 3,7 %:n epäonnistumisasteen tärkeiden tapahtumien ilmoittamisessa käyttäjälle. Kohdistusvirheiden esiintyvyys on ~1,9, mikä on käytännössä sama kuin Anthropic:n parhaiten kohdistetun Mythos Preview -version.

Nopeus ja nopea tila

Vakionopeus on verrattavissa Opus 4.7:ään. Hintamuutos on pääasia: nopea tila 2,5-kertaisella nopeudella maksaa 10 $ / 50 $ per 1M tokenia, kolme kertaa halvempaa kuin nopea tila aiemmissa Claude-malleissa. Kannattaa käyttää orkestrointivaiheissa, joissa todellinen viive on tärkeä.

Kehotteen injektiovaroitus

Anthropic:n järjestelmäkortti toteaa, että 4.8 on jonkin verran vähemmän kestävä agenttikehotteen injektiota vastaan kuin 4.7 – Gray Swanin punainen tiimi osoittaa ~9,6 %:n hyökkäyksen onnistumisasteen verrattuna 6,0 %:iin 4.7:ssä. Tiimien, jotka käyttävät 4.8:aa putkistoissa, jotka käsittelevät epäluotettavaa syötettä, tulisi tarkistaa hiekkalaatikointimenetelmänsä.

Parhaat agenttitehtävät Claude Opus 4.8:lle

Koodipohjan laajuinen siirto, joka ennen vaati sprintin

Anna Opus 4.8:lle siirto, joka koskettaa muutamia satoja tiedostoja – ORM-vaihto, kehysversion päivitys, tietoturvakorjaus monirepossa – ja anna dynaamisten työnkulkujen jakaa työ rinnakkaisille ala-agenteille yhden istunnon aikana. +4,9 pisteen SWE-bench Pro -hyppy ja nelinkertainen virheiden väheneminen koodikatselmuksessa ovat ne, jotka tuottavat tulosta tällaisessa ajossa.

1 miljoonan tokenin tutkimusajo, joka todella pysyy koossa

Pudota 200-sivuinen sopimusluonnos, kolme kilpailijan ehdotusta ja viime vuosineljänneksen oikeudelliset lausunnot ikkunaan ja pyydä sitten Opus 4.8:aa merkitsemään kaikki lausekkeet, jotka ovat tiukempia kuin markkinat. GraphWalks 1M:ssä hyppäämällä 40,3 %:sta 68,1 %:iin tekee tällaisesta dokumenttien välisestä synteesistä jälleen luotettavaa.

Agentin orkestroija, joka ei valehtele työstään

Käytä 4.8:aa suunnittelijana, joka jakaa pyynnön kymmeneen vaiheeseen, lähettää jokaisen halvemmille ala-agenteille ja raportoi tuloksen. 0 %:n virheellisten tulosten raportointiaste yhdistettynä kymmenkertaiseen ylitarkkuuden laskuun on syy, miksi tuotantotiimit käyttävät 4.8:aa, kun agentin oma itse-raportti on oltava luotettava.

Viiveherkkä virtaus, joka lopulta onnistuu nopeassa tilassa

Nopea tila 2,5-kertaisella nopeudella maksoi aiemmin kolme kertaa sen, mitä se nyt maksaa (10 $/50 $ per 1M vs. edellinen taso). Interaktiivisille apuohjelmille, päivystäville yhteenvetäjille tai mille tahansa vaiheelle, jossa kellonajan viive hallitsee kokemusta, nopea tila 4.8 on nyt oletusvalinta Claude-perheessä.

Milloin ohittaa Claude Opus 4.8

Ohita Opus 4.8 suurivolyymisessä rutiinityössä, jossa Sonnet 4.6 saavuttaa saman laatutason murto-osalla kustannuksista, viivekriittisissä chat-vastauksissa, joissa Kimi K2.7 Code on paljon nopeampi, agenttisessa terminaalikoodauksessa, jossa GPT-5.5 johtaa edelleen Terminal-Bench 2.1:ssä (78,2 % vs. 4.8:n 74,6 %), ja putkilinjoissa, jotka ottavat vastaan epäluotettavaa syötettä ilman hiekkalaatikkoa – 4.8:n kehotteen injektion kestävyys on hieman heikompi kuin 4.7:n.

Claude Opus 4.8 vs. muut mallit

Claude Opus 4.8 vs GPT-5.5

Opus 4.8 johtaa kuudessa seitsemästä solusta Anthropic:n vertailujoukossa, suurimmat erot ovat SWE-bench Prossa (69,2 % vs. 58,6 %) ja OSWorld-Verifiedissä (83,4 % vs. 78,7 %). GPT-5.5 säilyttää johtoaseman Terminal-Bench 2.1:ssä (78,2 % vs. 74,6 %). Valitse 4.8 tiedostojen väliseen koodaukseen ja tietokoneen käyttöagentteihin; valitse GPT-5.5 erityisesti silloin, kun terminaaliohjattu työ hallitsee.

Claude Opus 4.8 vs Gemini 3.1 Pro

Opus 4.8 johtaa selvästi SWE-bench Prossa (+15.0) ja OSWorld-Verifiedissä (+7.2). Nämä kaksi mallia pysyvät kohinan sisällä kylläisillä tiede-vertailuarvoilla, kuten GPQA Diamond. Oletuksena 4.8 agenttityöhön; harkitse Geminiä erityisesti, kun tarvitset Googlen työkalujen integrointia.

Usein kysytyt kysymykset

Miten Opus 4.8:n hinnoittelu vertautuu 4.7:ään?

Normaalihinta on sama: 5 dollaria per 1M syöttötunnusta, 25 dollaria per 1M tulostustunnusta, 0,50 dollaria per 1M välimuistiin tallennettua syöttötunnusta. Muutos on nopea tila, nyt 10 dollaria / 50 dollaria per 1M tunnusta 2,5-kertaisella nopeudella – kolme kertaa edullisempi kuin nopea tila aiemmissa Claude-malleissa.

Mitä ovat dynaamiset työnkulut?

Uusi ominaisuus, jonka avulla Opus 4.8 voi suunnitella tehtävän ja sitten suorittaa satoja rinnakkaisia ala-agentteja yhden istunnon aikana. Anthropic asettaa tämän poluksi koodikannan laajuisiin siirtoihin satojen tuhansien koodirivien yli yhdessä agentin ajossa.

Mitä vaatimustasoja Opus 4.8 tukee?

Kolme tasoa: korkea (uusi oletus), erittäin korkea (xhigh Claude Code:ssä) ja maksimi. Korkeammat asetukset käyttävät enemmän tokeneita päättelyyn ennen vastauksen tuottamista; alemmat asetukset suosivat nopeutta ja nopeusrajoituksen tehokkuutta.

Tukeeko Opus 4.8 kehotteiden välimuistia?

Kyllä. Välimuistiin tallennettu syöte laskutetaan 0,50 dollarilla per 1M tokenia, mikä on 10-kertainen alennus välimuistiin tallennetusta osasta. Messages API hyväksyy nyt myös järjestelmämerkinnät keskustelun keskellä rikkomatta välimuistia.

Vaihtoehdot

Claude Opus 4.8:n saatavuus Okou:ssä

Claude Opus 4.8 ei ole enää saatavilla Okou:ssa. Katso Claude Opus 5.5, jos etsit tällä hetkellä tuettua vaihtoehtoa. Tämä sivu säilyttää mallin historiatiedot, ei Okou:n nykyisiä hintoja.