Claude Opus 4.8: historische modelreferentie
1M tokens · Text / Vision / Code · Prompt cache
Okou draait Claude Opus 4.8 niet langer. Deze pagina wordt bewaard als referentie voor de specificaties, prijzen en benchmarks. Gebruik Claude Opus 5.5 voor hetzelfde soort werk.
Zie Claude Opus 5.5Claude Opus 4.8 is Anthropic's vlaggenschiprelease op 28 mei 2026, een directe upgrade naar Opus 4.7 voor dezelfde catalogusprijs van $5/$25. Het behaalt de hoogste SWE-bench Pro (69,2%), OSWorld-Verified (83,4%), MCP-Atlas (82,2%) en Humanity's Last Exam (57,9% met tools) scores die Anthropic ooit heeft geleverd, en is het eerste model dat 10% doorbreekt op de juridische-agent all-pass standaard.
De twee structurele veranderingen die het vermelden waard zijn, zijn dynamische workflows (plan een taak, verdeel deze over honderden parallelle subagents in één sessie) en een prijsverlaging voor de snelle modus naar 2,5× snelheid voor $10/$50 per 1M tokens — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. Inspanningsniveaus worden uitgebreid naar hoog (standaard), extra en maximaal. Anthropic zelf omschrijft de release als een "bescheiden maar tastbare verbetering" in plaats van een sprong.
Wat is Claude Opus 4.8?
28 mei 2026
Onafhankelijke metingen (LLM Stats, VentureBeat, Vellum) bevestigen de relatieve rangschikking ten opzichte van 4.7 en concurrenten: 4.8 wint op elke cel van Anthropic's gepubliceerde vergelijkingsset, behalve Terminal-Bench 2.1, waar GPT-5.5 nog steeds leidt (78,2% versus 74,6% van 4.8). De sprong van 4.7 naar 4.8 op SWE-bench Pro is +4,9 punten; op USAMO 2026 is het +27,4; op de nieuwe 1M-token GraphWalks long-context F1 is het +27,8. Beschouw absolute scores als richtinggevend — SWE-bench Verified nadert verzadiging bij alle grensmodellen.
Wat is opmerkelijk aan Claude Opus 4.8
Koparchitectuur en functionaliteiten.
Opus 4.8 behoudt het 1M-token contextvenster en 128K maximale output van Opus 4.7, gefactureerd tegen standaard invoerprijzen over het gehele venster. De inspanningscontrole breidt uit naar drie niveaus: hoog (de nieuwe standaard), extra (xhigh binnen Claude Code), en max. De Messages API accepteert nu systeeminvoer midden in een gesprek zonder prompt caching te onderbreken. Dynamische workflows laten Claude honderden parallelle subagenten plannen en verzenden in één sessie. De snelle modus draait met ~2,5× standaardsnelheid voor $10 / $50 per 1M tokens. Multimodale invoer over tekst, visie en code is ongewijzigd.
Specificaties in één oogopslag
Claude Opus 4.8 benchmarks
Door de leverancier gerapporteerde scores van Anthropic's Opus 4.8 systeemkaart, met vergelijkingen met Opus 4.7, GPT-5.5 en Gemini 3.1 Pro bij maximale inspanning en gemiddelden van 5 proeven. 4.8 leidt in zes van de zeven cellen die Anthropic publiceert; GPT-5.5 behoudt de leiding op Terminal-Bench 2.1. SWE-bench Verified nadert verzadiging over alle frontier-modellen heen — de moeilijkere SWE-bench Pro-set is het duurzamere signaal.
Claude Opus 4.8 prijzen
Historische lijstprijzen van de provider per miljoen tokens. Deze referentiewaarden zijn geen actuele Okou-kosten.
Hoe Claude Opus 4.8 zich in de praktijk gedraagt
Waargenomen gedrag van productieve agentruns.
Eerste poging codebewerkingen
Anthropic meldt dat Opus 4.8 ongeveer vier keer minder snel gebreken over het hoofd ziet dan 4.7 bij het controleren van code, en de +4.9 punt SWE-bench Pro sprong (69.2% vs 64.3%) ondersteunt dit op de moeilijkere, minder verzadigde codeerset. Kies 4.8 voor patches die netjes moeten worden toegepast over veel bestanden.
Lange-context herinnering
GraphWalks F1 bij 1M tokens springt van 40,3% naar 68,1% — de grootste enkele benchmarkwinst in de release. Het 1M-tokenvenster is nu daadwerkelijk bruikbaar aan de bovenkant van zijn bereik, niet alleen nominaal.
Eerlijkheid en overmoed
Anthropic rapporteert een meer dan tienvoudige vermindering van overmoed ten opzichte van 4.7, 0% bij het onkritisch rapporteren van gebrekkige resultaten (een primeur voor de Claude-familie), en een percentage van 3.7% bij het niet melden van belangrijke gebeurtenissen aan de gebruiker. De incidentie van misalignement is ~1.9, effectief gelijk aan Anthropic's best afgestemde Mythos Preview.
Snelheid en snelle modus
De standaardsnelheid is vergelijkbaar met Opus 4.7. De prijswijziging is het belangrijkste nieuws: de snelle modus met 2,5x snelheid kost $10 / $50 per 1M tokens, drie keer goedkoper dan de snelle modus op eerdere Claude-modellen. De moeite waard om te gebruiken voor orkestratie stappen waar wandkloklatentie van belang is.
Prompt-injectie waarschuwing
De systeemkaart van Anthropic merkt op dat 4.8 iets minder robuust is tegen agentische promptinjectie dan 4.7 — Gray Swan red-teaming toont een aanvalssuccespercentage van ~9,6% versus 6,0% op 4.7. Teams die 4.8 gebruiken in pijplijnen die onbetrouwbare invoer verwerken, moeten hun sandboxing-aanpak herzien.
Beste agenttaken voor Claude Opus 4.8
De codebase-brede migratie die vroeger een sprint nodig had
Geef Opus 4.8 een migratie die een paar honderd bestanden raakt — ORM-swap, frameworkversie-update, beveiligingsfix over een monorepo — en laat dynamische workflows het werk verdelen over parallelle subagents binnen één sessie. De +4,9 punt SWE-bench Pro-sprong en de vier keer lagere fouten bij codebeoordeling zijn wat deze soort run oplevert.
De 1M-token onderzoeksrun die daadwerkelijk samenhangt
Deponeer een contractconcept van 200 pagina's, drie voorstellen van concurrenten en de juridische adviezen van vorig kwartaal in het venster, en vraag vervolgens aan Opus 4.8 om elke clausule te markeren die strenger is dan de markt. GraphWalks bij 1M die van 40,3% naar 68,1% springen, maakt dit soort cross-document synthese nieuw betrouwbaar.
De agent-orchestrator die niet liegt over zijn werk
Gebruik 4.8 als de planner die een verzoek in tien stappen opdeelt, elk naar goedkopere sub-agents stuurt en het resultaat rapporteert. Het 0%-percentage voor het kritiekloos rapporteren van gebrekkige resultaten, gecombineerd met de tienvoudige daling in overmoed, is de reden waarom productieteams 4.8 gebruiken wanneer het zelfrapport van de agent betrouwbaar moet zijn.
De latentiegevoelige flow die uiteindelijk uitkomt in de snelle modus
De snelle modus met 2,5x snelheid kostte vroeger drie keer zoveel als nu ($10/$50 per 1M versus de vorige tier). Voor interactieve copiloten, on-call samenvatters, of elke stap waarbij de 'wall-clock' latentie de ervaring domineert, is de snelle modus 4.8 nu de standaardkeuze in de Claude-familie.
Wanneer Claude Opus 4.8 overslaan
Sla Opus 4.8 over voor routinematig werk met grote volumes, waar Sonnet 4.6 dezelfde kwaliteitsstandaard haalt tegen een fractie van de kosten, voor latency-kritieke chatantwoorden waar Kimi K2.7 Code veel sneller is, voor agentic terminal coding waar GPT-5.5 nog steeds Terminal-Bench 2.1 leidt (78,2% versus 74,6% van 4.8), en voor pijplijnen die onbetrouwbare invoer zonder sandboxing verwerken — de robuustheid van 4.8 tegen prompt-injectie is iets zwakker dan die van 4.7.
Claude Opus 4.8 versus andere modellen
Claude Opus 4.8 vs GPT-5.5
Opus 4.8 leidt op zes van de zeven cellen in de vergelijkingsset van Anthropic, met de grootste verschillen op SWE-bench Pro (69,2% vs 58,6%) en OSWorld-Verified (83,4% vs 78,7%). GPT-5.5 behoudt de leiding op Terminal-Bench 2.1 (78,2% vs 74,6%). Kies 4.8 voor cross-file codering en computergebruik-agents; kies GPT-5.5 specifiek wanneer terminal-gedreven werk domineert.
Claude Opus 4.8 vs Gemini 3.1 Pro
Opus 4.8 leidt met ruime marges op SWE-bench Pro (+15.0) en OSWorld-Verified (+7.2). De twee modellen blijven binnen de ruis op verzadigde wetenschappelijke benchmarks zoals GPQA Diamond. Standaard naar 4.8 voor agentisch werk; overweeg Gemini specifiek wanneer je Google's toolintegratieverhaal nodig hebt.
Veelgestelde vragen
Hoe verhoudt de prijs van Opus 4.8 zich tot 4.7?
Reguliere prijzen zijn identiek: $5 per 1M invoertokens, $25 per 1M uitvoertokens, $0,50 per 1M gecachte invoer. De verandering is de snelle modus, nu $10 / $50 per 1M tokens met 2,5× snelheid — drie keer goedkoper dan de snelle modus op eerdere Claude-modellen.
Wat zijn dynamische workflows?
Een nieuwe mogelijkheid waarmee Opus 4.8 een taak kan plannen en vervolgens honderden parallelle subagenten binnen één sessie kan uitvoeren. Anthropic positioneert dit als de weg naar codebase-brede migraties over honderdduizenden regels code in één agentrun.
Welke inspanningsniveaus ondersteunt Opus 4.8?
Drie niveaus: hoog (de nieuwe standaard), extra (xhigh in Claude Code) en max. Hogere instellingen besteden meer tokens aan redeneren voordat ze een antwoord produceren; lagere instellingen geven de voorkeur aan snelheid en efficiëntie van de snelheidslimiet.
Ondersteunt Opus 4.8 prompt caching?
Ja. Gecachte invoer wordt gefactureerd tegen $0,50 per 1M tokens, een korting van 10× op het gecachte gedeelte. De Berichten API accepteert nu ook systeeminvoer midden in een gesprek zonder de cache te verbreken.
Alternatieven
Beschikbaarheid van Claude Opus 4.8 op Okou.
Claude Opus 4.8 wordt niet meer aangeboden op Okou. Bekijk Claude Opus 5.5 voor een momenteel ondersteund alternatief. Deze pagina bewaart historische modelinformatie, geen actuele Okou-prijzen.

