← Alle modellen

Claude Opus 4.8: historische modelreferentie

1M tokens · Text / Vision / Code · Prompt cache

Okou draait Claude Opus 4.8 niet langer. Deze pagina wordt bewaard als referentie voor de specificaties, prijzen en benchmarks. Gebruik Claude Opus 5.5 voor hetzelfde soort werk.

Zie Claude Opus 5.5

Claude Opus 4.8 is Anthropic's vlaggenschiprelease op 28 mei 2026, een directe upgrade naar Opus 4.7 voor dezelfde catalogusprijs van $5/$25. Het behaalt de hoogste SWE-bench Pro (69,2%), OSWorld-Verified (83,4%), MCP-Atlas (82,2%) en Humanity's Last Exam (57,9% met tools) scores die Anthropic ooit heeft geleverd, en is het eerste model dat 10% doorbreekt op de juridische-agent all-pass standaard.

De twee structurele veranderingen die het vermelden waard zijn, zijn dynamische workflows (plan een taak, verdeel deze over honderden parallelle subagents in één sessie) en een prijsverlaging voor de snelle modus naar 2,5× snelheid voor $10/$50 per 1M tokens — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. Inspanningsniveaus worden uitgebreid naar hoog (standaard), extra en maximaal. Anthropic zelf omschrijft de release als een "bescheiden maar tastbare verbetering" in plaats van een sprong.

Wat is Claude Opus 4.8?

28 mei 2026

Onafhankelijke metingen (LLM Stats, VentureBeat, Vellum) bevestigen de relatieve rangschikking ten opzichte van 4.7 en concurrenten: 4.8 wint op elke cel van Anthropic's gepubliceerde vergelijkingsset, behalve Terminal-Bench 2.1, waar GPT-5.5 nog steeds leidt (78,2% versus 74,6% van 4.8). De sprong van 4.7 naar 4.8 op SWE-bench Pro is +4,9 punten; op USAMO 2026 is het +27,4; op de nieuwe 1M-token GraphWalks long-context F1 is het +27,8. Beschouw absolute scores als richtinggevend — SWE-bench Verified nadert verzadiging bij alle grensmodellen.

Wat is opmerkelijk aan Claude Opus 4.8

Koparchitectuur en functionaliteiten.

Opus 4.8 behoudt het 1M-token contextvenster en 128K maximale output van Opus 4.7, gefactureerd tegen standaard invoerprijzen over het gehele venster. De inspanningscontrole breidt uit naar drie niveaus: hoog (de nieuwe standaard), extra (xhigh binnen Claude Code), en max. De Messages API accepteert nu systeeminvoer midden in een gesprek zonder prompt caching te onderbreken. Dynamische workflows laten Claude honderden parallelle subagenten plannen en verzenden in één sessie. De snelle modus draait met ~2,5× standaardsnelheid voor $10 / $50 per 1M tokens. Multimodale invoer over tekst, visie en code is ongewijzigd.

Specificaties in één oogopslag

FamilieClaude 4 generatie
ModaliteitenTekst, visie, code
TalenEngels-eerst, meertalig
Prompt cachingOndersteund (Anthropic)
Contextvenster1M tokens
Max uitvoerTot 128K tokens
InspanningsniveausHoog (standaard) / Extra / Max
Leverancierslijstprijs$5 invoer / $25 uitvoer per 1M (snelle modus $10/$50, 2,5× snelheid)

Claude Opus 4.8 benchmarks

Door de leverancier gerapporteerde scores van Anthropic's Opus 4.8 systeemkaart, met vergelijkingen met Opus 4.7, GPT-5.5 en Gemini 3.1 Pro bij maximale inspanning en gemiddelden van 5 proeven. 4.8 leidt in zes van de zeven cellen die Anthropic publiceert; GPT-5.5 behoudt de leiding op Terminal-Bench 2.1. SWE-bench Verified nadert verzadiging over alle frontier-modellen heen — de moeilijkere SWE-bench Pro-set is het duurzamere signaal.

SWE-bench Geverifieerddoor leverancier gerapporteerd; omhoog van Opus 4.7's 87,6%
88.6%
SWE-bench Proleidt het veld (4.7: 64,3%, GPT-5.5: 58,6%, Gemini 3.1 Pro: 54,2%)
69.2%
Terminal-Bench 2.1omhoog van 66,1% van 4.7 op 2.0; GPT-5.5 leidt hier met 78,2%
74.6%
OSWorld-Geverifieerd (computergebruik)leidt het veld (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (browseragent)door leverancier gerapporteerd
84%
MCP-Atlasomhoog van Opus 4.7's 77,3%
82.2%
BrowseComp (single-agent)omhoog van Opus 4.7's 79,3%
84.3%
GraphWalks lange-context F1 (1M tokens)gestegen van 40,3% van Opus 4.7
68.1%
Laatste examen van de mensheid (met hulpmiddelen)49,8% zonder tools; toonaangevend in het veld
57.9%
GPQA Diamondvlak vs 4.7 — verzadigd over grensmodellen
~93%
USAMO 2026 (wiskunde)gestegen van 69,3% van Opus 4.7
96.7%
GDPval-AA (kenniswerk)leidt (4.7: 1753, GPT-5.5: 1769)
1890 Elo
Financiële agent v2leidt het veld
53.9%
Juridisch-agent all-passeerste model dat deze standaard doorbreekt
>10%

Claude Opus 4.8 prijzen

Historische lijstprijzen van de provider per miljoen tokens. Deze referentiewaarden zijn geen actuele Okou-kosten.

Invoer$5.00
Uitvoer$25.00
Cache lezen$0.50
Cache schrijven$6.25

Hoe Claude Opus 4.8 zich in de praktijk gedraagt

Waargenomen gedrag van productieve agentruns.

Eerste poging codebewerkingen

Anthropic meldt dat Opus 4.8 ongeveer vier keer minder snel gebreken over het hoofd ziet dan 4.7 bij het controleren van code, en de +4.9 punt SWE-bench Pro sprong (69.2% vs 64.3%) ondersteunt dit op de moeilijkere, minder verzadigde codeerset. Kies 4.8 voor patches die netjes moeten worden toegepast over veel bestanden.

Lange-context herinnering

GraphWalks F1 bij 1M tokens springt van 40,3% naar 68,1% — de grootste enkele benchmarkwinst in de release. Het 1M-tokenvenster is nu daadwerkelijk bruikbaar aan de bovenkant van zijn bereik, niet alleen nominaal.

Eerlijkheid en overmoed

Anthropic rapporteert een meer dan tienvoudige vermindering van overmoed ten opzichte van 4.7, 0% bij het onkritisch rapporteren van gebrekkige resultaten (een primeur voor de Claude-familie), en een percentage van 3.7% bij het niet melden van belangrijke gebeurtenissen aan de gebruiker. De incidentie van misalignement is ~1.9, effectief gelijk aan Anthropic's best afgestemde Mythos Preview.

Snelheid en snelle modus

De standaardsnelheid is vergelijkbaar met Opus 4.7. De prijswijziging is het belangrijkste nieuws: de snelle modus met 2,5x snelheid kost $10 / $50 per 1M tokens, drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. De moeite waard om te gebruiken voor orkestratie stappen waar wandkloklatentie van belang is.

Prompt-injectie waarschuwing

De systeemkaart van Anthropic merkt op dat 4.8 iets minder robuust is tegen agentische promptinjectie dan 4.7 — Gray Swan red-teaming toont een aanvalssuccespercentage van ~9,6% versus 6,0% op 4.7. Teams die 4.8 gebruiken in pijplijnen die onbetrouwbare invoer verwerken, moeten hun sandboxing-aanpak herzien.

Beste agenttaken voor Claude Opus 4.8

De codebase-brede migratie die vroeger een sprint nodig had

Geef Opus 4.8 een migratie die een paar honderd bestanden raakt — ORM-swap, frameworkversie-update, beveiligingsfix over een monorepo — en laat dynamische workflows het werk verdelen over parallelle subagents binnen één sessie. De +4,9 punt SWE-bench Pro-sprong en de vier keer lagere fouten bij codebeoordeling zijn wat deze soort run oplevert.

De 1M-token onderzoeksrun die daadwerkelijk samenhangt

Deponeer een contractconcept van 200 pagina's, drie voorstellen van concurrenten en de juridische adviezen van vorig kwartaal in het venster, en vraag vervolgens aan Opus 4.8 om elke clausule te markeren die strenger is dan de markt. GraphWalks bij 1M die van 40,3% naar 68,1% springen, maakt dit soort cross-document synthese nieuw betrouwbaar.

De agent-orchestrator die niet liegt over zijn werk

Gebruik 4.8 als de planner die een verzoek in tien stappen opdeelt, elk naar goedkopere sub-agents stuurt en het resultaat rapporteert. Het 0%-percentage voor het kritiekloos rapporteren van gebrekkige resultaten, gecombineerd met de tienvoudige daling in overmoed, is de reden waarom productieteams 4.8 gebruiken wanneer het zelfrapport van de agent betrouwbaar moet zijn.

De latentiegevoelige flow die uiteindelijk uitkomt in de snelle modus

De snelle modus met 2,5x snelheid kostte vroeger drie keer zoveel als nu ($10/$50 per 1M versus de vorige tier). Voor interactieve copiloten, on-call samenvatters, of elke stap waarbij de 'wall-clock' latentie de ervaring domineert, is de snelle modus 4.8 nu de standaardkeuze in de Claude-familie.

Wanneer Claude Opus 4.8 overslaan

Sla Opus 4.8 over voor routinematig werk met grote volumes, waar Sonnet 4.6 dezelfde kwaliteitsstandaard haalt tegen een fractie van de kosten, voor latency-kritieke chatantwoorden waar Kimi K2.7 Code veel sneller is, voor agentic terminal coding waar GPT-5.5 nog steeds Terminal-Bench 2.1 leidt (78,2% versus 74,6% van 4.8), en voor pijplijnen die onbetrouwbare invoer zonder sandboxing verwerken — de robuustheid van 4.8 tegen prompt-injectie is iets zwakker dan die van 4.7.

Claude Opus 4.8 versus andere modellen

Claude Opus 4.8 vs GPT-5.5

Opus 4.8 leidt op zes van de zeven cellen in de vergelijkingsset van Anthropic, met de grootste verschillen op SWE-bench Pro (69,2% vs 58,6%) en OSWorld-Verified (83,4% vs 78,7%). GPT-5.5 behoudt de leiding op Terminal-Bench 2.1 (78,2% vs 74,6%). Kies 4.8 voor cross-file codering en computergebruik-agents; kies GPT-5.5 specifiek wanneer terminal-gedreven werk domineert.

Claude Opus 4.8 vs Gemini 3.1 Pro

Opus 4.8 leidt met ruime marges op SWE-bench Pro (+15.0) en OSWorld-Verified (+7.2). De twee modellen blijven binnen de ruis op verzadigde wetenschappelijke benchmarks zoals GPQA Diamond. Standaard naar 4.8 voor agentisch werk; overweeg Gemini specifiek wanneer je Google's toolintegratieverhaal nodig hebt.

Veelgestelde vragen

Hoe verhoudt de prijs van Opus 4.8 zich tot 4.7?

Reguliere prijzen zijn identiek: $5 per 1M invoertokens, $25 per 1M uitvoertokens, $0,50 per 1M gecachte invoer. De verandering is de snelle modus, nu $10 / $50 per 1M tokens met 2,5× snelheid — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen.

Wat zijn dynamische workflows?

Een nieuwe mogelijkheid waarmee Opus 4.8 een taak kan plannen en vervolgens honderden parallelle subagenten binnen één sessie kan uitvoeren. Anthropic positioneert dit als de weg naar codebase-brede migraties over honderdduizenden regels code in één agentrun.

Welke inspanningsniveaus ondersteunt Opus 4.8?

Drie niveaus: hoog (de nieuwe standaard), extra (xhigh in Claude Code) en max. Hogere instellingen besteden meer tokens aan redeneren voordat ze een antwoord produceren; lagere instellingen geven de voorkeur aan snelheid en efficiëntie van de snelheidslimiet.

Ondersteunt Opus 4.8 prompt caching?

Ja. Gecachte invoer wordt gefactureerd tegen $0,50 per 1M tokens, een korting van 10× op het gecachte gedeelte. De Berichten API accepteert nu ook systeeminvoer midden in een gesprek zonder de cache te verbreken.

Alternatieven

Beschikbaarheid van Claude Opus 4.8 op Okou.

Claude Opus 4.8 wordt niet meer aangeboden op Okou. Bekijk Claude Opus 5.5 voor een momenteel ondersteund alternatief. Deze pagina bewaart historische modelinformatie, geen actuele Okou-prijzen.