Claude Opus 4.8: referensi historis model
1M tokens · Text / Vision / Code · Prompt cache
Okou tidak lagi menjalankan Claude Opus 4.8. Halaman ini dipertahankan sebagai referensi spesifikasi, harga, dan benchmark-nya. Untuk pekerjaan serupa, gunakan Claude Opus 5.5.
Lihat Claude Opus 5.5Claude Opus 4.8 adalah rilisan flagship Anthropic pada 28 Mei 2026, peningkatan langsung atas Opus 4.7 pada harga daftar vendor $5/$25 yang sama. Ia membukukan skor SWE-bench Pro (69,2%), OSWorld-Verified (83,4%), MCP-Atlas (82,2%), dan Humanity's Last Exam (57,9% dengan tools) tertinggi yang pernah dirilis Anthropic, dan menjadi model pertama yang menembus 10% pada standar all-pass legal-agent.
Dua perubahan struktural yang patut diketahui adalah dynamic workflow (merencanakan sebuah pekerjaan, lalu menyebarkannya ke ratusan subagen paralel dalam satu sesi) dan pemangkasan harga fast mode menjadi kecepatan 2,5× pada $10/$50 per 1J token — tiga kali lebih murah daripada fast mode di model Claude sebelumnya. Tingkat effort meluas ke high (default), extra, dan max. Anthropic sendiri membingkai rilis ini sebagai "peningkatan yang sederhana tapi nyata" alih-alih sebuah lompatan.
Apa itu Claude Opus 4.8?
28 Mei 2026
Pembacaan independen (LLM Stats, VentureBeat, Vellum) mengukuhkan urutan relatif terhadap 4.7 dan kompetitor: 4.8 menang di setiap sel dari set perbandingan yang dipublikasikan Anthropic kecuali Terminal-Bench 2.1, di mana GPT-5.5 masih memimpin (78,2% vs 74,6% milik 4.8). Lompatan 4.7-ke-4.8 pada SWE-bench Pro adalah +4,9 poin; pada USAMO 2026 adalah +27,4; pada GraphWalks F1 konteks panjang 1J token yang baru adalah +27,8. Perlakukan skor absolut sebagai indikatif — SWE-bench Verified mendekati saturasi di seluruh model frontier.
Apa yang menonjol dari Claude Opus 4.8
Fitur arsitektur dan kapabilitas utama.
Opus 4.8 mempertahankan jendela konteks 1J token dan output maksimum 128K dari Opus 4.7, ditagih pada harga input standar di seluruh jendela. Kendali effort meluas ke tiga tingkat: high (default baru), extra (xhigh di dalam Claude Code), dan max. Messages API kini menerima entri system di tengah percakapan tanpa merusak prompt caching. Dynamic workflow membuat Claude bisa merencanakan dan mengirim ratusan subagen paralel dalam satu sesi. Fast mode berjalan pada ~2,5× kecepatan standar seharga $10 / $50 per 1J token. Input multimodal lintas teks, vision, dan kode tidak berubah.
Spesifikasi sekilas
Benchmark Claude Opus 4.8
Skor yang dilaporkan vendor dari system card Opus 4.8 milik Anthropic, dengan perbandingan terhadap Opus 4.7, GPT-5.5, dan Gemini 3.1 Pro pada effort max dan rata-rata 5 percobaan. 4.8 memimpin di enam dari tujuh sel yang dipublikasikan Anthropic; GPT-5.5 mempertahankan keunggulan pada Terminal-Bench 2.1. SWE-bench Verified mendekati saturasi di seluruh model frontier — set SWE-bench Pro yang lebih sulit adalah sinyal yang lebih tahan lama.
Harga Claude Opus 4.8
Harga historis penyedia per 1 juta token. Angka referensi ini bukan biaya Okou saat ini.
Bagaimana Claude Opus 4.8 berperilaku dalam praktik
Perilaku yang diamati dari eksekusi agen produksi.
Suntingan kode percobaan pertama
Anthropic melaporkan Opus 4.8 sekitar empat kali lebih kecil kemungkinannya dibanding 4.7 untuk melewatkan kelemahan saat meninjau kode, dan lompatan +4,9 poin SWE-bench Pro (69,2% vs 64,3%) mengukuhkan itu pada set coding yang lebih sulit dan kurang tersaturasi. Pilih 4.8 untuk patch yang harus terpasang bersih di banyak file.
Recall konteks panjang
GraphWalks F1 pada 1J token melonjak dari 40,3% menjadi 68,1% — peningkatan benchmark tunggal terbesar dalam rilis ini. Jendela 1J token kini benar-benar dapat digunakan pada ujung atas rentangnya, bukan sekadar nominal.
Kejujuran dan overconfidence
Anthropic melaporkan pengurangan overconfidence lebih dari sepuluh kali lipat dibanding 4.7, 0% pada pelaporan hasil cacat tanpa kritik (pertama bagi keluarga Claude), dan tingkat 3,7% pada kegagalan mengangkat peristiwa penting kepada pengguna. Insiden misalignment ~1,9, praktis setara dengan Mythos Preview yang paling selaras milik Anthropic.
Kecepatan dan fast mode
Kecepatan standar sebanding dengan Opus 4.7. Perubahan harga adalah sorotannya: fast mode pada kecepatan 2,5× berbiaya $10 / $50 per 1J token, tiga kali lebih murah daripada fast mode di model Claude sebelumnya. Layak digunakan untuk langkah orkestrasi di mana latensi wall-clock penting.
Catatan prompt-injection
System card Anthropic mencatat 4.8 sedikit kurang tangguh terhadap agentic prompt injection dibanding 4.7 — red-teaming Gray Swan menunjukkan tingkat keberhasilan serangan ~9,6% dibanding 6,0% pada 4.7. Tim yang menjalankan 4.8 dalam pipeline yang menangani input tepercaya rendah sebaiknya meninjau pendekatan sandboxing mereka.
Tugas agen terbaik untuk Claude Opus 4.8
Migrasi berskala codebase yang dulu butuh satu sprint
Serahkan ke Opus 4.8 sebuah migrasi yang menyentuh beberapa ratus file — ganti ORM, naikkan versi framework, perbaikan keamanan di seluruh monorepo — dan biarkan dynamic workflow menyebarkan pekerjaan ke subagen paralel dalam satu sesi. Lompatan +4,9 poin SWE-bench Pro dan pengurangan empat kali lipat pada kelemahan yang terlewat saat meninjau kode adalah yang terbayar pada eksekusi semacam ini.
Eksekusi riset 1J token yang benar-benar utuh
Masukkan draf kontrak 200 halaman, tiga proposal kompetitor, dan opini hukum kuartal lalu ke dalam jendela, lalu minta Opus 4.8 menandai setiap klausul yang lebih ketat dari standar pasar. GraphWalks pada 1J yang melonjak dari 40,3% menjadi 68,1% adalah yang membuat sintesis lintas dokumen semacam ini menjadi andal.
Orkestrator agen yang tidak berbohong soal pekerjaannya
Gunakan 4.8 sebagai perencana yang memecah sebuah permintaan menjadi sepuluh langkah, mengirim masing-masing ke sub-agen yang lebih murah, dan melaporkan hasilnya. Tingkat 0% pada pelaporan hasil cacat tanpa kritik, digabung dengan penurunan sepuluh kali lipat pada overconfidence, adalah alasan tim produksi memilih 4.8 saat self-report agen itu sendiri harus dapat dipercaya.
Alur sensitif-latensi yang akhirnya masuk akal di fast mode
Fast mode pada kecepatan 2,5× dulu berbiaya tiga kali lipat dari sekarang ($10/$50 per 1J vs tier sebelumnya). Untuk copilot interaktif, peringkas on-call, atau langkah apa pun di mana latensi wall-clock mendominasi pengalaman, fast-mode 4.8 kini menjadi pilihan default dalam keluarga Claude.
Kapan melewatkan Claude Opus 4.8
Lewatkan Opus 4.8 pada pekerjaan rutin bervolume tinggi di mana Sonnet 4.6 mencapai standar kualitas yang sama dengan biaya jauh lebih kecil, pada balasan chat kritis-latensi di mana Kimi K2.7 Code jauh lebih cepat, pada agentic terminal coding di mana GPT-5.5 masih memimpin Terminal-Bench 2.1 (78,2% vs 74,6% milik 4.8), dan pada pipeline yang mengonsumsi input tepercaya rendah tanpa sandboxing — ketangguhan prompt-injection 4.8 sedikit lebih lemah dibanding 4.7.
Claude Opus 4.8 vs model lain
Claude Opus 4.8 vs GPT-5.5
Opus 4.8 memimpin di enam dari tujuh sel pada set perbandingan Anthropic, dengan selisih terbesar pada SWE-bench Pro (69,2% vs 58,6%) dan OSWorld-Verified (83,4% vs 78,7%). GPT-5.5 mempertahankan keunggulan pada Terminal-Bench 2.1 (78,2% vs 74,6%). Pilih 4.8 untuk coding lintas-file dan agen computer-use; pilih GPT-5.5 secara khusus saat pekerjaan berbasis terminal mendominasi.
Claude Opus 4.8 vs Gemini 3.1 Pro
Opus 4.8 memimpin dengan margin lebar pada SWE-bench Pro (+15,0) dan OSWorld-Verified (+7,2). Kedua model tetap dalam rentang noise pada benchmark sains yang tersaturasi seperti GPQA Diamond. Default-kan ke 4.8 untuk pekerjaan agentik; pertimbangkan Gemini secara khusus saat Anda butuh kisah integrasi tool dari Google.
Pertanyaan yang sering diajukan
Bagaimana harga Opus 4.8 dibanding 4.7?
Harga reguler identik: $5 per 1J token input, $25 per 1J token output, $0,50 per 1J cached input. Perubahannya adalah fast mode, kini $10 / $50 per 1J token pada kecepatan 2,5× — tiga kali lebih murah daripada fast mode di model Claude sebelumnya.
Apa itu dynamic workflow?
Kapabilitas baru yang memungkinkan Opus 4.8 merencanakan sebuah tugas lalu menjalankan ratusan subagen paralel dalam satu sesi. Anthropic memposisikan ini sebagai jalan menuju migrasi berskala codebase di ratusan ribu baris kode dalam satu eksekusi agen.
Tingkat effort apa yang didukung Opus 4.8?
Tiga tingkat: high (default baru), extra (xhigh di Claude Code), dan max. Pengaturan yang lebih tinggi menghabiskan lebih banyak token untuk reasoning sebelum menghasilkan respons; pengaturan yang lebih rendah mengutamakan kecepatan dan efisiensi rate-limit.
Apakah Opus 4.8 mendukung prompt caching?
Ya. Cached input ditagih pada $0,50 per 1J token, diskon 10× pada porsi yang di-cache. Messages API kini juga menerima entri system di tengah percakapan tanpa merusak cache.
Alternatif
Ketersediaan Claude Opus 4.8 di Okou
Claude Opus 4.8 tidak lagi ditawarkan di Okou. Lihat Claude Opus 5.5 sebagai alternatif yang saat ini didukung. Halaman ini menyimpan informasi historis model, bukan harga Okou saat ini.

