← כל המודלים

Claude Opus 4.8: מידע היסטורי על המודל

1M tokens · Text / Vision / Code · Prompt cache

Okou אינו מריץ עוד את Claude Opus 4.8. דף זה נשמר כהפניה למפרטיו, תמחורו ובנצ'מרקים שלו. עבור אותו סוג עבודה, השתמש ב-Claude Opus 5.5.

ראה Claude Opus 5.5

Claude Opus 4.8 הוא מהדורת הדגל של Anthropic מ-28 במאי 2026, שדרוג ישיר ל-Opus 4.7 באותו מחיר מחירון של 5 דולר / 25 דולר. הוא מציג את הציונים הגבוהים ביותר ב-SWE-bench Pro (69.2%), OSWorld-Verified (83.4%), MCP-Atlas (82.2%), ו-Humanity's Last Exam (57.9% עם כלים) ש-Anthropic אי פעם שלחה, והוא המודל הראשון ששובר 10% בתקן המעבר המלא של סוכן משפטי.

שני השינויים המבניים ששווה לדעת עליהם הם זרימות עבודה דינמיות (תכנן עבודה, פזר אותה על פני מאות תת-סוכנים מקבילים בהפעלה אחת) והורדת מחיר במצב מהיר למהירות של פי 2.5 ב-10 דולר / 50 דולר למיליון אסימונים – פי שלושה זול יותר ממצב מהיר במודלים קודמים של Claude. רמות המאמץ מתרחבות לגבוה (ברירת מחדל), נוסף ומקסימלי. Anthropic עצמה מתארת את המהדורה כ"שיפור צנוע אך מוחשי" ולא כקפיצת מדרגה.

מה זה Claude Opus 4.8?

28 במאי 2026

קריאות בלתי תלויות (LLM Stats, VentureBeat, Vellum) מאששות את הסדר היחסי מול 4.7 ומתחרים: 4.8 מנצח בכל תא במערך ההשוואה שפורסם על ידי Anthropic למעט Terminal-Bench 2.1, שם GPT-5.5 עדיין מוביל (78.2% לעומת 74.6% של 4.8). הקפיצה מ-4.7 ל-4.8 ב-SWE-bench Pro היא +4.9 נקודות; ב-USAMO 2026 היא +27.4; ב-GraphWalks החדש עם 1M טוקנים ו-F1 בהקשר ארוך היא +27.8. יש להתייחס לציון המוחלט ככיווני — SWE-bench Verified מתקרב לרוויה בכל מודלי הקצה.

מה מיוחד ב-Claude Opus 4.8

ארכיטקטורת כותרות ותכונות יכולת.

Opus 4.8 שומר על חלון ההקשר של 1M אסימונים ועל פלט מקסימלי של 128K מ-Opus 4.7, מחויב בתמחור קלט סטנדרטי על פני כל החלון. בקרת המאמץ מתרחבת לשלוש רמות: גבוהה (ברירת המחדל החדשה), נוספת (xhigh בתוך Claude Code), ומקסימלית. ה-Messages API מקבל כעת ערכי מערכת באמצע שיחה מבלי לשבור את שמירת המטמון של ההנחיה. זרימות עבודה דינמיות מאפשרות ל-Claude לתכנן ולשלוח מאות סוכני משנה מקבילים בסשן יחיד. מצב מהיר פועל במהירות של כ-2.5× מהמהירות הסטנדרטית תמורת $10 / $50 ל-1M אסימונים. קלטים מולטימודליים על פני טקסט, ראייה וקוד נשארים ללא שינוי.

מפרטים במבט חטוף

משפחהדור 4 של Claude
אופנויותטקסט, ראייה, קוד
שפותאנגלית תחילה, רב לשוני
שמירת מטמון של הנחיותנתמך (Anthropic)
חלון הקשרמיליון טוקנים
פלט מקסימליעד 128K אסימונים
רמות מאמץגבוה (ברירת מחדל) / אקסטרה / מקסימום
מחיר מחירון ספק$5 קלט / $25 פלט ל-1M (מצב מהיר $10/$50, מהירות פי 2.5)

מדדי ביצועים של Claude Opus 4.8

ציונים שדווחו על ידי הספק מכרטיס המערכת Opus 4.8 של Anthropic, עם השוואות מול Opus 4.7, GPT-5.5 ו-Gemini 3.1 Pro במאמץ מרבי וממוצעים של 5 ניסיונות. 4.8 מוביל בשישה מתוך שבעה תאים ש-Anthropic מפרסם; GPT-5.5 שומר על ההובלה ב-Terminal-Bench 2.1. SWE-bench Verified מתקרב לרוויה בכל המודלים המובילים — סט SWE-bench Pro הקשה יותר הוא האות העמיד יותר.

SWE-bench מאומתמדווח על ידי הספק; עלייה מ-87.6% של Opus 4.7
88.6%
SWE-bench Proמוביל את התחום (4.7: 64.3%, GPT-5.5: 58.6%, Gemini 3.1 Pro: 54.2%)
69.2%
Terminal-Bench 2.1עלייה מ-66.1% של 4.7 ב-2.0; GPT-5.5 מוביל כאן עם 78.2%
74.6%
מאומת על ידי OSWorld (שימוש במחשב)מובילה בתחום (4.7: 82.8%, GPT-5.5: 78.7%)
83.4%
Online-Mind2Web (סוכן דפדפן)דווח על ידי ספק
84%
MCP-אטלסעלייה מ-77.3% של Opus 4.7
82.2%
BrowseComp (סוכן יחיד)עלייה מ-79.3% של Opus 4.7
84.3%
GraphWalks F1 בהקשר ארוך (1M אסימונים)עלייה מ-40.3% של Opus 4.7
68.1%
המבחן האחרון של האנושות (עם כלים)49.8% ללא כלים; מוביל את התחום
57.9%
GPQA Diamondשטוח לעומת 4.7 — רווי על פני מודלים חזיתיים
~93%
USAMO 2026 (מתמטיקה)עלייה מ-69.3% של Opus 4.7
96.7%
GDPval-AA (עבודת ידע)לידים (4.7: 1753, GPT-5.5: 1769)
1890 Elo
סוכן פיננסים v2מוביל את התחום
53.9%
מעבר מלא של סוכן משפטיהמודל הראשון ששבר את הסטנדרט הזה
>10%

תמחור Claude Opus 4.8

מחירי מחירון היסטוריים של הספק למיליון טוקנים. אלה נתוני ייחוס ולא חיובי Okou העדכניים.

קלט$5.00
פלט$25.00
קריאת מטמון$0.50
כתיבת מטמון$6.25

כיצד Claude Opus 4.8 מתנהג בפועל

התנהגות נצפית מהרצות סוכנים בייצור.

עריכות קוד בניסיון ראשון

Anthropic מדווח כי Opus 4.8 פחות נוטה פי ארבעה מ-4.7 להתעלם מפגמים בעת סקירת קוד, וקפיצת ה-+4.9 נקודות ב-SWE-bench Pro (69.2% לעומת 64.3%) מגבה זאת במערך הקידוד הקשה יותר והפחות רווי. בחרו ב-4.8 עבור תיקונים שחייבים לחול בצורה נקייה על פני קבצים רבים.

זיכרון בהקשר ארוך

GraphWalks F1 ב-1M אסימונים קופץ מ-40.3% ל-68.1% – הרווח הגדול ביותר בבנצ'מרק יחיד במהדורה. חלון ה-1M אסימונים כעת באמת שמיש בקצה העליון של טווחו, לא רק נומינלי.

כנות וביטחון יתר

Anthropic מדווח על הפחתה של יותר מפי עשרה בביטחון יתר לעומת 4.7, 0% בדיווח לא ביקורתי על תוצאות פגומות (ראשון למשפחת Claude), ושיעור של 3.7% של אי-העלאת אירועים חשובים למשתמש. שכיחות אי-התאמה היא ~1.9, כמעט זהה ל-Mythos Preview המיושר ביותר של Anthropic.

מהירות ומצב מהיר

מהירות סטנדרטית דומה ל-Opus 4.7. שינוי התמחור הוא הכותרת: מצב מהיר במהירות פי 2.5 עולה 10 דולר / 50 דולר למיליון אסימונים, זול פי שלושה ממצב מהיר במודלים קודמים של Claude. כדאי להשתמש בו לשלבי תזמור שבהם זמן השהיה בפועל חשוב.

אזהרת הזרקת פרומפטים

כרטיס המערכת של Anthropic מציין ש-4.8 פחות חזק במקצת להזרקת הנחיות סוכנותיות מ-4.7 — בדיקות אדומות של Gray Swan מראות שיעור הצלחה של ~9.6% לעומת 6.0% ב-4.7. צוותים המריצים 4.8 בצינורות המטפלים בקלט לא מהימן צריכים לבדוק את גישת ה-sandboxing שלהם.

משימות סוכן הטובות ביותר עבור Claude Opus 4.8

ההגירה בקנה מידה של בסיס קוד שפעם דרשה ספרינט

מסור ל-Opus 4.8 הגירה שנוגעת לכמה מאות קבצים — החלפת ORM, עדכון גרסת פריימוורק, תיקון אבטחה על פני מונורפו — ותן לזרימות עבודה דינמיות לפזר את העבודה לסוכני משנה מקבילים בתוך סשן אחד. קפיצת ה-+4.9 נקודות ב-SWE-bench Pro וההפחתה פי ארבעה בפגמים שהוחמצו בבדיקת קוד הם מה שמניב רווחים בריצה מסוג זה.

הפעלת המחקר של מיליון אסימונים שבאמת מחזיקה מעמד

הכנס טיוטת חוזה בת 200 עמודים, שלוש הצעות מתחרים וחוות דעת משפטיות מהרבעון האחרון לחלון, ואז בקש מ-Opus 4.8 לסמן כל סעיף הדוק יותר מהשוק. GraphWalks ב-1M קופץ מ-40.3% ל-68.1% הוא מה שהופך סוג זה של סינתזה בין מסמכים לאמין מחדש.

מתאם הסוכנים שאינו משקר לגבי עבודתו

השתמש ב-4.8 כמתכנן שמפרק בקשה לעשרה שלבים, שולח כל אחד לסוכני משנה זולים יותר, ומדווח על התוצאה. שיעור ה-0% בדיווח לא ביקורתי על תוצאות פגומות, בשילוב עם ירידה פי עשרה בביטחון יתר, היא הסיבה שצוותי ייצור פונים ל-4.8 כאשר הדיווח העצמי של הסוכן חייב להיות אמין.

הזרימה הרגישה להשהיה שסוף סוף מצליחה במצב מהיר

מצב מהיר במהירות 2.5× עלה בעבר פי שלושה ממה שהוא עולה כעת (10/50 דולר ל-1M לעומת הרמה הקודמת). עבור עוזרי קופילוט אינטראקטיביים, מסכמי כוננות, או כל שלב שבו זמן אחזור של שעון קיר שולט בחוויה, מצב מהיר 4.8 הוא כעת הבחירה המוגדרת כברירת מחדל במשפחת Claude.

מתי לדלג על Claude Opus 4.8

דלג על Opus 4.8 בעבודה שגרתית בנפח גבוה שבה Sonnet 4.6 מגיע לאותה רמת איכות בשבריר מהעלות, בתגובות צ'אט קריטיות לזמן אחזור שבהן Kimi K2.7 Code מהיר בהרבה, בקידוד מסוף סוכני שבו GPT-5.5 עדיין מוביל את Terminal-Bench 2.1 (78.2% לעומת 74.6% של 4.8), ובצינורות שקולטים קלט לא מהימן ללא ארגז חול — עמידות 4.8 להזרקת הנחיות חלשה במקצת מזו של 4.7.

Claude Opus 4.8 לעומת מודלים אחרים

Claude Opus 4.8 לעומת GPT-5.5

Opus 4.8 מוביל בשישה מתוך שבעה תאים במערך ההשוואה של Anthropic, עם הפערים הגדולים ביותר ב-SWE-bench Pro (69.2% לעומת 58.6%) וב-OSWorld-Verified (83.4% לעומת 78.7%). GPT-5.5 שומר על ההובלה ב-Terminal-Bench 2.1 (78.2% לעומת 74.6%). בחר ב-4.8 עבור קידוד חוצה קבצים וסוכני שימוש במחשב; בחר ב-GPT-5.5 במיוחד כאשר עבודה מונעת מסוף שולטת.

Claude Opus 4.8 לעומת ג'מיני 3.1 פרו

Opus 4.8 מוביל בפערים גדולים ב-SWE-bench Pro (+15.0) וב-OSWorld-Verified (+7.2). שני המודלים נשארים בטווח הרעש במבחני מדע רוויים כמו GPQA Diamond. ברירת מחדל ל-4.8 לעבודה סוכנית; שקול את Gemini במיוחד כאשר אתה זקוק לשילוב הכלים של Google.

שאלות נפוצות

איך תמחור Opus 4.8 משתווה ל-4.7?

התמחור הרגיל זהה: 5 דולר למיליון אסימוני קלט, 25 דולר למיליון אסימוני פלט, 0.50 דולר למיליון קלט שמור במטמון. השינוי הוא מצב מהיר, כעת 10 דולר / 50 דולר למיליון אסימונים במהירות של פי 2.5 – פי שלושה זול יותר ממצב מהיר במודלים קודמים של Claude.

מהם זרימות עבודה דינמיות?

יכולת חדשה המאפשרת ל-Opus 4.8 לתכנן משימה ולאחר מכן להריץ מאות תת-סוכנים מקבילים בתוך סשן יחיד. Anthropic ממקם זאת כדרך להעברות בקנה מידה של בסיס קוד על פני מאות אלפי שורות קוד בהרצת סוכן אחת.

אילו רמות מאמץ תומך Opus 4.8?

שלוש רמות: גבוהה (ברירת המחדל החדשה), נוספת (xhigh ב-Claude Code), ומקסימלית. הגדרות גבוהות יותר מוציאות יותר אסימונים על חשיבה לפני הפקת תגובה; הגדרות נמוכות יותר מעדיפות מהירות ויעילות הגבלת קצב.

האם Opus 4.8 תומך בשמירת מטמון של הנחיות?

כן. קלט שמור בחשבון ב-0.50$ למיליון טוקנים, הנחה של פי 10 על החלק השמור. ה-Messages API מקבל כעת גם ערכי מערכת באמצע שיחה מבלי לשבור את המטמון.

חלופות

זמינות Claude Opus 4.8 ב-Okou

Claude Opus 4.8 אינו מוצע עוד ב־Okou. ראו את Claude Opus 5.5 כחלופה שנתמכת כעת. עמוד זה שומר מידע היסטורי על המודל, ולא את מחירי Okou העדכניים.