
Qwen3.8-Max: 2.4 טריליון פרמטרים, משקולות פתוחות ורף חדש לקוד
צוות Qwen השיק את Qwen3.8-Max, המודל היכול ביותר של המשפחה — 2.4 טריליון פרמטרים, זמין כבר דרך ה-API של QwenCloud, והמשקולות הפתוחות הובטחו לשבוע הבא.
צוות Qwen השיק ב-3 באוגוסט 2026 את Qwen3.8-Max — המודל היכול ביותר במשפחה עד כה, והראשון מסדרת Qwen-Max שהמשקולות שלו ייפתחו. הוא מבוסס על התשתית הארכיטקטונית של Qwen 3.5, מגיע ל-2.4 טריליון פרמטרים (מהם 95 מיליארד פעילים) וזמין דרך ה-API של QwenCloud; המשקולות הפתוחות הובטחו לשבוע הבא.
קוד: ימים של עבודה אוטונומית
הצוות בחן את המודל בשלושה אתגרים שבהם את התוצאה היה צריך להרוויח בכתיבת קוד ובהרצתו, בלי שום עזרה אנושית. תחילה הוא התבקש ליצור מאפס את הפרויקט oh-my-cli ולבנות במשך יותר מ-10 ימים מערכת מתפתחת-מעצמה שמאחדת משוב משתמשים, שיטות מהקהילה ובדיקות עצמיות של המודל ללופ הנדסי אחד. נכון ל-30 ביולי 2026, אחרי כ-16 ימי פעילות אוטונומית מלאה, נצברו במאגר 265 קומיטים, 127 pull requests ו-151 issues.
במשימה השנייה קיבל המודל מאמר מחקרי — „Unified Data Selection for LLM Reasoning” — והתבקש לשחזר את הניסוי בקוד ואחר כך לשפר אותו. בכחמישה ימים (כ-125 שעות) הוא כתב כ-7,600 שורות קוד, ביצע יותר מ-1,100 פעולות והריץ 33 סבבי אימון על GPU, ושחזר את שש המסקנות המרכזיות של המאמר; שיטת בחירת הנתונים שלו עוקפת בחירה אקראית ב-7.7% ב-AIME24. לאחר מכן הוא הפעיל לופ שיפור עצמי, בחן 18 רעיונות בארבעה סבבים ופיתח שיטה שעוקפת את זו של המאמר ב-2.7 נקודות ב-AIME24 (52.29%).
במבחן השלישי התחרה המודל בתחרות חיה בפלטפורמת Tianchi של Alibaba Cloud, שבה השתתפו 526 צוותים אנושיים. במגבלת 24 שעות, לאורך 45 הגשות, עלתה רמת הדיוק שלו מ-0.60 ל-0.853, והוא גבר על 458 מ-526 הצוותים (87%).
עבודת יום ומשימות ארוכות טווח
הצוות מדגיש שהמודל מתפקד באופן דומה בהרנסים שונים (QwenWork, Claude Code, Codex, OpenClaw, Hermes) הודות להרחבה משותפת של סביבות RL ומשאבי חישוב. במבחנים הוא משיג 86.6 ב-Terminal Bench 2.1, 67.7 ב-SWE-bench Pro ו-93.0 ב-PaperBench — האחרון מעל Opus 4.8 (80.3), Fable5 (88.8) ו-GPT-5.6 Sol (90.5). במשימות ארוכות טווח הוביל Qwen3.8-Max באופן אוטונומי בלוק של תכנון שבב — מאיץ חומרה קריפטוגרפי GCD/RSA — מ-8,298 שערים ל-678, וצמצם את שטח השבב הפיזי מ-106×106 מיקרומטר ל-46×46 (צמצום של 81%). בסימולציית מסחר אלקטרוני בת 365 יום שהתחילה ב-100,000 ין, הוא סיים עם יתרה של 416,252 ין — תשואה של פי 4.16, ופער של 38% מעל הסגן, GLM 5.2.
מה זמין
את המודל אפשר כבר לקרוא דרך ה-API של QwenCloud, עם חלון הקשר של מיליון טוקנים ועד 65,536 טוקני פלט. המשקולות הפתוחות, לפי הצוות, יפורסמו בשבוע הבא — פעם ראשונה למודל בסדרת Qwen-Max. הצוות הציג גם את Qwen-MM-Plugins, ספריית הרחבות לסוכנים מולטימודליים לעיבוד תמונות ווידאו.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.