
סקירת M5 Ultra Mac Studio: קפיצת מדרגה בסוכני AI מקומיים
MacStories בחן ארבעה ימים את M5 Ultra Mac Studio עם 256 GB מול M3 Ultra ומחשב עם RTX 5090. לפי הסקירה, עיבוד הפרומפטים השתפר ב-150% בממוצע, מה שהופך סוכנים מקומיים למעשיים.
אתר MacStories פרסם סקירה של M5 Ultra Mac Studio, המחשב שבראש סדרת ה-Mac השולחניים של אפל. הכותב פדריקו ויטיצ'י בחן במשך ארבעה ימים את התצורה עם 256 GB בזיכרון, והשווה אותה לקודמו M3 Ultra עם 512 GB ולמחשב המשחקים האישי שלו עם RTX 5090. המסקנה: זהו ה-Mac הראשון שהופך עוזרי AI מקומיים למעשיים ולא לניסוי.
ארכיטקטורה חדשה במעטפת זהה
מבחוץ M5 Ultra זהה לדגם M3 Ultra שהוא מחליף, אך השבב חדש: אפל מחברת בטכנולוגיית UltraFusion שני שבבי M5 Max בעלי שני שבבי-בסיס למבנה בן ארבעה, לראשונה בחברה. ל-GPU יש 80 ליבות, וכל אחת מהן מחוברת ל-Neural Accelerator, עד פי 4.5 מכוח החישוב המרבי לשימושי AI לעומת M3 Ultra. הזיכרון המאוחד, שעליו נשענים מודלים מקומיים ב-MLX, עדיין מוצע בנפחים של 256 ו-512 GB, ורוחב הפס עלה מ-819 GB/s ל-1.2 TB/s, כלומר 50% יותר. דגם ה-512 GB צפוי בסוף אוקטובר.
הנתונים שנמדדו
בארבעה ימי בדיקות ב-macOS 27 עם oMLX 0.7.0.dev2 והמודל Qwen3.8-Flash-Next, עיבוד הפרומפט השתפר ב-150% בממוצע, בערך פי 2.5 לעומת המערכת הקודמת של הכותב: פרומפט של 16 אלף טוקנים נקרא בקצב של 2,887 טוקנים לשנייה לעומת 1,143 ב-M3 Ultra. קצב הייצור באותה השוואה היה גבוה בכ-70%, והגרפים מראים ירידה מ-91 ל-75 טוקנים לשנייה כשההקשר גדל מ-4K ל-256K. בפרומפט של 256K עם מטמון קר נדרשו ל-M3 Ultra כ-245 שניות עד הטוקן הנראה הראשון, ואילו ל-M5 Ultra 102 שניות. בשלוש בקשות במקביל (כ-6.5 אלף טוקנים כל אחת) הפיק המחשב החדש 81.5 טוקנים לשנייה בסך הכול, 23% יותר מאשר בבקשה בודדת, בעוד M3 Ultra הוסיף 4% בלבד.
RTX 5090 עדיין מוביל, אך עם מגבלות
הכרטיס של NVIDIA נשאר מהיר יותר כל עוד המודל נכנס לזיכרון שלו: בפרומפט של 6,000 טוקנים הוא קרא בקצב של כ-3,000 טוקנים לשנייה לעומת כ-1,700 ב-M5 Ultra, ושמר על יתרון של 25% בייצור הודות ל-1.79 TB/s מול 1.2 TB/s. התקרה שלו היא 32 GB של VRAM: עם מטמון קשב של 8 סיביות הוא סיים הקשרים ארוכים בקצב 49.6, 40.4 ו-30 טוקנים לשנייה ב-64K, 128K ו-256K, אך ברגע שנאלץ לשאול זיכרון מערכת דרך PCIe צנחו הקצבים ל-4.6, 2.9 ו-1.5. הכותב מוסיף כי המחשב גדול, רועש וחם בהרבה, בעוד מאוורר ה-Mac Studio אינו נשמע בעבודה רגילה עם מודלים מקומיים.
מדוע סוכנים מקומיים חשובים לכותב
העניין של ויטיצ'י מעשי. מערך המחקר שלו לסקירת iOS ו-iPadOS 27 של הקיץ התבסס על סוכנים שפעלו מסביב לשעון 99 ימים בפרויקט של 310 מסמכים, בעלות כוללת של 0 דולר — עומס שלדבריו היה יקר מדי דרך ממשקי ענן. את המודל המקומי הוא הפך לברירת המחדל שלו באפליקציית Open Minis ל-iOS. את הקוונטיזציה של 5 סיביות הוא מכנה נקודת האיזון בתצורת 256 GB.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.