
Cerebras ו-OpenAI חושפות את Ultrafast Mode עבור GPT-5.6 Sol
Cerebras ו-OpenAI הציגו הצצה מוקדמת ל-Ultrafast Mode — שכבת שירות חדשה ב-OpenAI API, שבה GPT-5.6 Sol מפיק עד 750 אסימוני פלט בשנייה בלי פשרה באיכות.
Cerebras ו-OpenAI הציגו הצצה מוקדמת ל-Ultrafast Mode, שכבת שירות חדשה שתושק תחילה ב-OpenAI API ותופעל על ידי Cerebras. הגישה תיפתח תחילה לקבוצה נבחרת של לקוחות ותתרחב עם הזמן. במסגרת זו Cerebras מריצה את GPT-5.6 Sol ומספקת עד 750 אסימוני פלט בשנייה — לדברי החברות, בלי שום פשרה באיכות.
לשבור את הפשרה בין מהירות לאינטליגנציה
מפתחים נאלצו עד כה לבחור בין מהירות לאיכות: ככל שהמודלים גדלים, עולה עלות החישוב והעברת הנתונים והתגובות מאטות. לפי החברות, Sol במצב Ultrafast מבטל את הפשרה הזו. בהשוואה למהירויות שפרסמה Artificial Analysis, הוא מהיר פי 11 מ-Fable 5 ופי 5 מ-Opus 4.8 במצב Fast.
Humanity's Last Exam ביום עבודה אחד
Cerebras בחנה את המצב על Humanity's Last Exam — סט של 2,500 שאלות שרק מומחים ברמת דוקטורט נוטים לענות עליהן. GPT-5.6 Sol במצב Ultrafast ענה על כל 2,500 השאלות ב-11 שעות ו-11 דקות; Claude Fable 5 נזקק ל-78 שעות ו-27 דקות — יותר משלושה ימים של חישוב רצוף — לאותה רמת דיוק, כלומר איטי כמעט פי 7. הבחינות נערכו ב-10 ביולי (Sol Ultrafast עם Codex) וב-13–15 ביולי (Fable 5 עם Claude Code).
עבודה בעלת ערך כלכלי
בבנצ'מרק GDP-Val, הבוחן משימות ידע בעלות ערך כלכלי, השיג Ultrafast האצה מקצה לקצה של פי 5.6 בלי ירידה באיכות (מדידה ב-31 ביולי, reasoning בינוני בתוך Codex). OpenAI מציגה את GPT-5.6 Sol כמודל הטוב ביותר שלה עד כה לתצהירים משפטיים, מודלים פיננסיים ודוחות הנדסיים — עבודה שבה כל שנייה קובעת, וכשסוכנים נכנסים למסלול הקריטי המהירות הופכת לחשובה עוד יותר.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.