← ทุกโมเดล

Claude Opus 4.8: ข้อมูลอ้างอิงโมเดลในอดีต

1M tokens · Text / Vision / Code · Prompt cache

Okou ไม่ได้รัน Claude Opus 4.8 อีกต่อไป หน้านี้เก็บไว้เป็นข้อมูลอ้างอิงสำหรับข้อมูลจำเพาะ ราคา และเกณฑ์มาตรฐาน สำหรับงานประเภทเดียวกัน ให้ใช้ Claude Opus 5.5

ดู Claude Opus 5.5

Claude Opus 4.8 คือรุ่นเรือธงของ Anthropic ที่เปิดตัวเมื่อวันที่ 28 พฤษภาคม 2026 ซึ่งเป็นการอัปเกรดโดยตรงจาก Opus 4.7 ในราคาตามรายการของผู้ขายที่ $5/$25 เท่าเดิม มันทำคะแนนสูงสุดใน SWE-bench Pro (69.2%), OSWorld-Verified (83.4%), MCP-Atlas (82.2%) และ Humanity's Last Exam (57.9% พร้อมเครื่องมือ) ที่ Anthropic เคยจัดส่งมา และเป็นโมเดลแรกที่ทำลาย 10% ในมาตรฐานการผ่านทั้งหมดของตัวแทนทางกฎหมาย

การเปลี่ยนแปลงโครงสร้างสองอย่างที่ควรทราบคือเวิร์กโฟลว์แบบไดนามิก (วางแผนงาน กระจายงานไปยังตัวแทนย่อยหลายร้อยตัวพร้อมกันในเซสชันเดียว) และการลดราคาโหมดเร็วเหลือ 2.5 เท่าของความเร็วที่ $10/$50 ต่อ 1 ล้านโทเค็น — ถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า ระดับความพยายามขยายเป็นสูง (ค่าเริ่มต้น), พิเศษ และสูงสุด Anthropic เองก็กล่าวถึงการเปิดตัวนี้ว่าเป็น "การปรับปรุงเล็กน้อยแต่จับต้องได้" มากกว่าที่จะเป็นการก้าวกระโดด

Claude Opus 4.8 คืออะไร?

28 พฤษภาคม 2026

การอ่านอิสระ (LLM Stats, VentureBeat, Vellum) ยืนยันลำดับสัมพัทธ์เทียบกับ 4.7 และคู่แข่ง: 4.8 ชนะในทุกเซลล์ของชุดการเปรียบเทียบที่เผยแพร่ของ Anthropic ยกเว้น Terminal-Bench 2.1 ซึ่ง GPT-5.5 ยังคงนำอยู่ (78.2% เทียบกับ 74.6% ของ 4.8) การกระโดดจาก 4.7 เป็น 4.8 บน SWE-bench Pro คือ +4.9 คะแนน; บน USAMO 2026 คือ +27.4; บน GraphWalks long-context F1 1M-token ใหม่คือ +27.8 ถือว่าคะแนนสัมบูรณ์เป็นทิศทาง — SWE-bench Verified กำลังเข้าใกล้ความอิ่มตัวในทุกโมเดลแนวหน้า

อะไรที่น่าสนใจเกี่ยวกับ Claude Opus 4.8

สถาปัตยกรรมหัวข้อข่าวและคุณสมบัติความสามารถ

Opus 4.8 ยังคงหน้าต่างบริบท 1M โทเค็นและเอาต์พุตสูงสุด 128K จาก Opus 4.7 โดยคิดค่าบริการตามราคาอินพุตมาตรฐานตลอดทั้งหน้าต่าง การควบคุมความพยายามขยายเป็นสามระดับ: สูง (ค่าเริ่มต้นใหม่), พิเศษ (xhigh ภายใน Claude Code) และสูงสุด Messages API ตอนนี้ยอมรับรายการระบบกลางการสนทนาโดยไม่ทำลายการแคชพรอมต์ เวิร์กโฟลว์แบบไดนามิกช่วยให้ Claude วางแผนและจัดส่งซับเอเจนต์แบบขนานหลายร้อยตัวในเซสชันเดียว โหมดเร็วทำงานที่ความเร็วประมาณ 2.5 เท่าของมาตรฐานในราคา 10 ดอลลาร์ / 50 ดอลลาร์ต่อ 1M โทเค็น อินพุตหลายรูปแบบทั้งข้อความ, วิสัยทัศน์ และโค้ดไม่เปลี่ยนแปลง

ข้อมูลจำเพาะโดยย่อ

ครอบครัวClaude รุ่นที่ 4
รูปแบบข้อความ, ภาพ, โค้ด
ภาษาภาษาอังกฤษเป็นหลัก หลายภาษา
การแคชพร้อมท์รองรับ (Anthropic)
หน้าต่างบริบท1M โทเค็น
เอาต์พุตสูงสุดสูงสุด 128K โทเค็น
ระดับความพยายามสูง (ค่าเริ่มต้น) / พิเศษ / สูงสุด
ราคาตามรายการของผู้ขายอินพุต $5 / เอาต์พุต $25 ต่อ 1M (โหมดเร็ว $10/$50, ความเร็ว 2.5 เท่า)

เกณฑ์มาตรฐาน Claude Opus 4.8

คะแนนที่ผู้ขายรายงานจากบัตรระบบ Opus 4.8 ของ Anthropic พร้อมการเปรียบเทียบกับ Opus 4.7, GPT-5.5 และ Gemini 3.1 Pro ที่ความพยายามสูงสุดและค่าเฉลี่ย 5 ครั้ง 4.8 นำในหกจากเจ็ดเซลล์ที่ Anthropic เผยแพร่ GPT-5.5 ยังคงนำใน Terminal-Bench 2.1 SWE-bench Verified กำลังเข้าสู่จุดอิ่มตัวในทุกโมเดลแนวหน้า — ชุด SWE-bench Pro ที่ยากกว่าเป็นสัญญาณที่ทนทานกว่า

SWE-bench Verifiedรายงานโดยผู้ขาย; เพิ่มขึ้นจาก 87.6% ของ Opus 4.7
88.6%
SWE-bench Proนำหน้าคู่แข่ง (4.7: 64.3%, GPT-5.5: 58.6%, Gemini 3.1 Pro: 54.2%)
69.2%
Terminal-Bench 2.1เพิ่มขึ้นจาก 4.7 ที่ 66.1% บน 2.0; GPT-5.5 นำอยู่ที่ 78.2%
74.6%
OSWorld-Verified (การใช้งานคอมพิวเตอร์)เป็นผู้นำในสาขา (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (ตัวแทนเบราว์เซอร์)รายงานผู้ขาย
84%
MCP-Atlasเพิ่มขึ้นจาก 77.3% ของ Opus 4.7
82.2%
BrowseComp (เอเจนต์เดี่ยว)เพิ่มขึ้นจาก 79.3% ของ Opus 4.7
84.3%
GraphWalks บริบท F1 แบบยาว (1M โทเค็น)เพิ่มขึ้นจาก 40.3% ของ Opus 4.7
68.1%
การสอบครั้งสุดท้ายของมนุษยชาติ (พร้อมเครื่องมือ)49.8% โดยไม่มีเครื่องมือ; เป็นผู้นำในสาขา
57.9%
GPQA Diamondแบบเรียบเทียบกับ 4.7 — อิ่มตัวในโมเดลแนวหน้า
~93%
USAMO 2026 (คณิตศาสตร์)เพิ่มขึ้นจาก 69.3% ของ Opus 4.7
96.7%
GDPval-AA (งานความรู้)นำหน้า (4.7: 1753, GPT-5.5: 1769)
1890 Elo
ตัวแทนการเงิน v2เป็นผู้นำในสาขา
53.9%
Legal-agent ผ่านทั้งหมดโมเดลแรกที่ทำลายมาตรฐานนี้
>10%

ราคา Claude Opus 4.8

ราคาเดิมที่ผู้ให้บริการประกาศต่อหนึ่งล้านโทเคน ตัวเลขนี้ใช้เพื่ออ้างอิง ไม่ใช่ค่าบริการปัจจุบันของ Okou

อินพุต$5.00
เอาต์พุต$25.00
อ่านแคช$0.50
เขียนแคช$6.25

Claude Opus 4.8 ทำงานอย่างไรในทางปฏิบัติ

พฤติกรรมที่สังเกตได้จากการทำงานของเอเจนต์การผลิต

การแก้ไขโค้ดครั้งแรก

Anthropic รายงานว่า Opus 4.8 มีโอกาสน้อยกว่า 4.7 ประมาณสี่เท่าที่จะมองข้ามข้อบกพร่องเมื่อตรวจสอบโค้ด และการกระโดด +4.9 จุดใน SWE-bench Pro (69.2% เทียบกับ 64.3%) สนับสนุนสิ่งนี้ในชุดการเขียนโค้ดที่ยากขึ้นและอิ่มตัวน้อยลง เลือก 4.8 สำหรับแพตช์ที่ต้องนำไปใช้อย่างสะอาดในหลายไฟล์

การเรียกคืนบริบทแบบยาว

GraphWalks F1 ที่ 1M โทเค็นกระโดดจาก 40.3% เป็น 68.1% — เป็นการเพิ่มขึ้นของเกณฑ์มาตรฐานเดียวที่ใหญ่ที่สุดในการเผยแพร่ หน้าต่าง 1M โทเค็นตอนนี้สามารถใช้งานได้จริงที่ปลายด้านบนของช่วง ไม่ใช่แค่ตามชื่อ

ความซื่อสัตย์และความมั่นใจเกินไป

Anthropic รายงานการลดความมั่นใจเกินจริงมากกว่าสิบเท่าเมื่อเทียบกับ 4.7, 0% ในการรายงานผลลัพธ์ที่บกพร่องโดยไม่วิพากษ์วิจารณ์ (เป็นครั้งแรกสำหรับตระกูล Claude) และอัตรา 3.7% ในการไม่แจ้งเหตุการณ์สำคัญให้ผู้ใช้ทราบ อุบัติการณ์ความไม่สอดคล้องกันอยู่ที่ประมาณ 1.9 ซึ่งเทียบเท่ากับ Mythos Preview ที่จัดเรียงได้ดีที่สุดของ Anthropic

ความเร็วและโหมดเร็ว

ความเร็วมาตรฐานเทียบเท่ากับ Opus 4.7 การเปลี่ยนแปลงราคาเป็นหัวข้อข่าว: โหมดเร็วที่ความเร็ว 2.5 เท่ามีค่าใช้จ่าย 10 ดอลลาร์ / 50 ดอลลาร์ต่อ 1 ล้านโทเค็น ซึ่งถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า คุ้มค่าที่จะใช้สำหรับขั้นตอนการประสานงานที่ความหน่วงของนาฬิกาจริงมีความสำคัญ

คำเตือนการแทรกพรอมต์

บัตรระบบของ Anthropic ระบุว่า 4.8 มีความทนทานต่อการฉีดพรอมต์ของเอเจนต์น้อยกว่า 4.7 เล็กน้อย — การทดสอบ Gray Swan แสดงอัตราความสำเร็จของการโจมตีประมาณ 9.6% เทียบกับ 6.0% ใน 4.7 ทีมที่ใช้ 4.8 ในไปป์ไลน์ที่จัดการอินพุตที่ไม่น่าเชื่อถือควรทบทวนแนวทางการแซนด์บ็อกซ์ของตน

งานตัวแทนที่ดีที่สุดสำหรับ Claude Opus 4.8

การย้ายข้อมูลขนาด codebase ที่เคยต้องใช้ sprint

มอบหมาย Opus 4.8 ให้กับการย้ายข้อมูลที่เกี่ยวข้องกับไฟล์หลายร้อยไฟล์ — การสลับ ORM, การอัปเดตเวอร์ชันเฟรมเวิร์ก, การแก้ไขความปลอดภัยทั่วทั้ง monorepo — และให้เวิร์กโฟลว์แบบไดนามิกกระจายงานไปยังตัวแทนย่อยแบบขนานภายในเซสชันเดียว การกระโดดของ SWE-bench Pro +4.9 จุด และการลดข้อผิดพลาดที่พลาดในการตรวจสอบโค้ดลงสี่เท่าคือสิ่งที่ได้รับจากการรันประเภทนี้

การรันการวิจัย 1M โทเค็นที่ยังคงทำงานร่วมกันได้จริง

วางร่างสัญญา 200 หน้า, ข้อเสนอคู่แข่งสามฉบับ, และความเห็นทางกฎหมายของไตรมาสที่แล้วลงในหน้าต่าง จากนั้นขอให้ Opus 4.8 ทำเครื่องหมายทุกข้อที่เข้มงวดกว่าตลาด GraphWalks ที่ 1M กระโดดจาก 40.3% เป็น 68.1% คือสิ่งที่ทำให้การสังเคราะห์ข้ามเอกสารประเภทนี้มีความน่าเชื่อถือใหม่

ผู้ประสานงานเอเจนต์ที่ไม่โกหกเกี่ยวกับงานของตน

ใช้ 4.8 เป็นผู้วางแผนที่แบ่งคำขอออกเป็นสิบขั้นตอน ส่งแต่ละขั้นตอนไปยังตัวแทนย่อยที่ถูกกว่า และรายงานผลลัพธ์ อัตรา 0% ในการรายงานผลลัพธ์ที่บกพร่องโดยไม่วิพากษ์วิจารณ์ ควบคู่ไปกับการลดความมั่นใจเกินเหตุลงสิบเท่า เป็นเหตุผลที่ทีมผลิตเลือกใช้ 4.8 เมื่อรายงานตนเองของตัวแทนต้องน่าเชื่อถือ

โฟลว์ที่ไวต่อความหน่วงที่ในที่สุดก็ทำงานได้ดีในโหมดเร็ว

โหมดเร็วที่ความเร็ว 2.5 เท่าเคยมีราคาแพงกว่าตอนนี้สามเท่า ($10/$50 ต่อ 1M เทียบกับระดับก่อนหน้า) สำหรับโคไพลอตแบบโต้ตอบ, สรุปข้อมูลตามคำขอ, หรือขั้นตอนใดๆ ที่เวลาแฝงของนาฬิกาจริงมีผลต่อประสบการณ์, โหมดเร็ว 4.8 เป็นตัวเลือกเริ่มต้นในตระกูล Claude แล้ว

เมื่อใดที่ควรข้าม Claude Opus 4.8

ข้าม Opus 4.8 สำหรับงานประจำที่มีปริมาณมาก ซึ่ง Sonnet 4.6 ให้คุณภาพเท่ากันในราคาที่ถูกกว่ามาก สำหรับการตอบกลับแชทที่สำคัญต่อความหน่วง ซึ่ง Kimi K2.7 Code เร็วกว่ามาก สำหรับการเขียนโค้ดเทอร์มินัลแบบ agentic ซึ่ง GPT-5.5 ยังคงนำ Terminal-Bench 2.1 (78.2% เทียบกับ 74.6% ของ 4.8) และสำหรับไปป์ไลน์ที่รับอินพุตที่ไม่น่าเชื่อถือโดยไม่มีแซนด์บ็อกซ์ — ความทนทานต่อการฉีดพรอมต์ของ 4.8 อ่อนแอกว่า 4.7 เล็กน้อย

Claude Opus 4.8 เทียบกับโมเดลอื่นๆ

Claude Opus 4.8 เทียบกับ GPT-5.5

Opus 4.8 เป็นผู้นำในหกจากเจ็ดเซลล์ในชุดเปรียบเทียบของ Anthropic โดยมีช่องว่างที่ใหญ่ที่สุดใน SWE-bench Pro (69.2% เทียบกับ 58.6%) และ OSWorld-Verified (83.4% เทียบกับ 78.7%) GPT-5.5 ยังคงเป็นผู้นำใน Terminal-Bench 2.1 (78.2% เทียบกับ 74.6%) เลือก 4.8 สำหรับการเขียนโค้ดข้ามไฟล์และตัวแทนที่ใช้คอมพิวเตอร์ เลือก GPT-5.5 โดยเฉพาะเมื่อการทำงานที่ขับเคลื่อนด้วยเทอร์มินัลเป็นหลัก

Claude Opus 4.8 เทียบกับ Gemini 3.1 Pro

Opus 4.8 นำหน้าอย่างกว้างขวางบน SWE-bench Pro (+15.0) และ OSWorld-Verified (+7.2) โมเดลทั้งสองยังคงอยู่ในระดับเสียงรบกวนบนเกณฑ์มาตรฐานทางวิทยาศาสตร์ที่อิ่มตัว เช่น GPQA Diamond ใช้ 4.8 เป็นค่าเริ่มต้นสำหรับงานของเอเจนต์ พิจารณา Gemini โดยเฉพาะเมื่อคุณต้องการการรวมเครื่องมือของ Google

คำถามที่พบบ่อย

ราคา Opus 4.8 เปรียบเทียบกับ 4.7 อย่างไร

ราคาปกติเหมือนกัน: $5 ต่อ 1M โทเค็นอินพุต, $25 ต่อ 1M โทเค็นเอาต์พุต, $0.50 ต่อ 1M อินพุตที่แคช การเปลี่ยนแปลงคือโหมดเร็ว ตอนนี้ $10 / $50 ต่อ 1M โทเค็นที่ความเร็ว 2.5 เท่า — ถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า

เวิร์กโฟลว์แบบไดนามิกคืออะไร

ความสามารถใหม่ที่ช่วยให้ Opus 4.8 วางแผนงานและรันซับเอเจนต์หลายร้อยตัวพร้อมกันภายในเซสชันเดียว Anthropic วางตำแหน่งสิ่งนี้เป็นเส้นทางสู่การย้ายข้อมูลขนาดโค้ดเบสข้ามโค้ดหลายแสนบรรทัดในการรันเอเจนต์ครั้งเดียว

Opus 4.8 รองรับระดับความพยายามใดบ้าง

สามระดับ: สูง (ค่าเริ่มต้นใหม่), พิเศษ (xhigh ใน Claude Code) และสูงสุด การตั้งค่าที่สูงขึ้นจะใช้โทเค็นมากขึ้นในการให้เหตุผลก่อนที่จะสร้างการตอบสนอง การตั้งค่าที่ต่ำกว่าจะเน้นความเร็วและประสิทธิภาพในการจำกัดอัตรา

Opus 4.8 รองรับการแคชพรอมต์หรือไม่?

ใช่ อินพุตที่แคชจะถูกเรียกเก็บเงินที่ $0.50 ต่อ 1M โทเค็น ซึ่งเป็นส่วนลด 10 เท่าสำหรับส่วนที่แคช API ตอนนี้ยังยอมรับรายการระบบกลางการสนทนาโดยไม่ทำให้แคชเสียหาย

ทางเลือก

ความพร้อมใช้งานของ Claude Opus 4.8 บน Okou

Okou ไม่ให้บริการ Claude Opus 4.8 แล้ว ดู Claude Opus 5.5 สำหรับทางเลือกที่รองรับในปัจจุบัน หน้านี้เก็บข้อมูลโมเดลในอดีต ไม่ใช่ราคาปัจจุบันของ Okou