
Anthropic משיקה את Claude Opus 5.5: זול ב-40% מהרצה של Opus 5
Anthropic הציגה את Claude Opus 5.5, המודל הראשון במשפחת Claude 5.5 החדשה. לדברי החברה הוא מגיע לרמה של Claude Fable 5.1 ברוב סוגי העבודה, אך עלות ההרצה שלו נמוכה ב-40% מזו של Opus 5.
Anthropic הציגה ב-22 בספטמבר את Claude Opus 5.5 — המודל הראשון במשפחת Claude 5.5 החדשה. לדברי החברה, הוא פועל ברמה של Claude Fable 5.1 ברוב סוגי העבודה, אך עלות ההרצה שלו נמוכה ב-40% מזו של Opus 5.
ביצועים ומחיר
לפי Anthropic, בודקים מוקדמים ראו קפיצות ביצועים גדולות במשימות מורכבות. בודק אחד השלים מיגרציית קוד בת 680,000 שורות בפחות מיום — עבודה שלפי החברה הייתה גוזלת מצוות מהנדסים שבועות. במשימה של קיצור זמני טעינה בכל עמוד באפליקציית ווב הצליח Opus 5.5 ב-39 מתוך 40 מקרים, בעוד Opus 5 ביצע שיפורים קטנים יותר ששינו גם את התנהגות האפליקציה.
קריאות מטמון, שלדברי החברה מהוות את רוב עלויות העבודה הסוכנתית והקידוד, עולות 0.20 דולר למיליון טוקנים — 60% פחות מ-Opus 5 — והפלט נוצר ביותר מ-30% מהר יותר. מצב מהיר במהירות של עד פי 2.5 זמין ב-Claude Code וב-Claude Platform במחיר של 8 דולר למיליון טוקני קלט ו-40 דולר למיליון טוקני פלט.
בנצ'מרקים ותוצאות לקוחות
ב-FrontierCode v1.1, שבוחן אם שינויי הקוד של סוכן היו מתקבלים, Opus 5.5 משיג 54.6% במאמץ ברירת המחדל — גבוה מכל מודל אחר ומעל התוצאה הגבוהה של GPT-6 Astra (53.3%), בכחמישית מעלות המשימה. ב-Terminal-Bench 4.0 הוא מנצח את Opus 5 במאמץ מקסימלי בכחמישית מהעלות, ומשתווה ל-GPT-6 Astra בכ-40% מהעלות. ב-GDPval-AA v2.1, הכולל עבודה אמיתית ב-44 מקצועות, הוא מגיע ל-1846 Elo.
גם לקוחות שמצטטת Anthropic מדווחים על שיפורים דומים. לפי Hebbia, Opus 5.5 כיסה 86.6% מקריטריונים פיננסיים של מומחים לעומת 60.3% ב-Opus 5, ו-Spotify מדווחת שהמודל השיג את איכות Opus 5 במשימות קידוד סוכנתיות בכמחצית מהצעדים, מהזמן ומטוקני הפלט.
בטיחות ואמצעי הגנה
לפי Anthropic, Opus 5.5 השיג את התוצאות הטובות ביותר עד כה בביקורת ההתנהגות האוטומטית שלהם, שבוחנת את Claude בכמעט 2,000 תרחישים, והוא המודל החזק ביותר שלהם ברוב מדדי היושר. בהערכה חדשה של שמירה בגבולות הוא ניסה לעקוף מגבלות כ-85% פחות מ-Opus 5 או Claude Mythos 5.1. בבנצ'מרק של חברת האבטחה Gray Swan הוא משתווה ל-Fable 5.1 בשיעור ההצלחה הנמוך ביותר של התקפות prompt injection מבין כל המודלים שנבדקו.
זהו מודל Opus הראשון שיוצא עם אמצעי הגנה דומים לאלה של Fable 5.1 בתחומי הסייבר, הביולוגיה והדיסטילציה; רוב משימות הסייבר מנותבות מחדש ל-Opus 4.8. המודל מגיע עם "חשיבה משומרת", אמצעי נגד דיסטילציה החל על חשבונות API שנוצרו ב-31 באוגוסט 2026 ואילך, והוא אינו זמין עוד עם מצב חשיבה כבוי.
זמינות
Claude Opus 5.5 זמין כעת ב-Amazon Web Services, ב-Google Cloud וב-Microsoft Azure; בפלטפורמת Claude מזהה המודל הוא claude-opus-5-5.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.