
Qwen3.8-2.4T-A95B: أول نموذج من فئة Qwen-Max بأوزان مفتوحة
نشر فريق Qwen نموذج Qwen3.8-2.4T-A95B، وهو نموذج خليط خبراء بثنائي 2.4 تريليون معامل، ويُعدّ أول مرة يُطرح فيها نظام من فئة Qwen-Max بأوزان مفتوحة مع نافذة سياق تبلغ 262 ألف رمز.
أول نموذج من فئة Max في إصدار مفتوح
نشر فريق Qwen نموذج Qwen3.8-2.4T-A95B على منصة Hugging Face، واصفًا إياه بأنه الجيل الأقدر حتى الآن في عائلة نماذج Qwen المفتوحة، وبأنه المرة الأولى التي يُطرح فيها نموذج من فئة Qwen-Max بشكل مفتوح. تُقدَّم الأوزان بصيغة Transformers وتتوافق مع منظومات التشغيل مثل vLLM وSGLang وTokenSpeed، وتذكر بطاقة النموذج رخصة باسم qwen3.8-max و55,519 عملية تنزيل خلال الشهر الماضي.
معماريًا، النموذج خليط من الخبراء: 2.4 تريليون معامل إجمالًا، منها 95 مليارًا نشطة، موزعة على 92 طبقة تضم 512 خبيرًا، يعمل لكل رمز عشرة خبراء موجَّهين وخبير مشترك واحد. تتناوب البنية بين كتل Gated DeltaNet وGated Attention، ودُرّب النموذج على التنبؤ متعدد الرموز. يبلغ طول السياق 262,144 رمزًا أصلاً، ويمكن توسيعه حتى 1,010,000.
نتائج الاختبارات القياسية
تضع المقارنة المنشورة نسخة Qwen3.8-Max المستضافة المبنية على هذه الأوزان في مواجهة Opus 4.8 وFable 5 وGPT-5.6 Sol (max). يسجّل النموذج 86.6 في Terminal Bench 2.1، و67.7 في SWE-bench Pro، و56.6 في DeepSWE 1.1، و93.0 في PaperBench. أما القدرات العامة فيُذكر فيها 92.6 في GPQA Diamond، و43.6 في HLE، و82.8 في IFBench، إضافة إلى 92.9 في اختبار الاسترجاع MRCR v2 بسياق 256 ألف رمز.
لكن التقدم ليس شاملًا: يبقى Fable 5 متقدمًا في SWE-bench Pro بنتيجة 80.0 مقابل 67.7، ويسجّل GPT-5.6 Sol (max) نتيجة 88.8 في Terminal Bench 2.1 مقابل 86.6 لـ Qwen.
نصّي فقط، والتفكير لا يُطفأ
النموذج المنشور نصّي فقط ويتطلب وضع التفكير في كل تفاعل: المدخلات متعددة الوسائط غير مدعومة، ولا يمكن تعطيل الاستدلال، لذا يبدأ كل رد باستدلال موضوع داخل وسوم think قبل المخرجات النهائية. يمكن ضبط عمق التفكير عبر المعامل reasoning_effort، بينما يحافظ preserve_thinking على سياق الاستدلال من الرسائل السابقة وهو مُفعّل افتراضيًا في جميع أحمال العمل. وللمهام الوكيلية توصي البطاقة بتخصيص ما يصل إلى 262,144 رمزًا للمخرجات الخاصة بالاستدلال و131,072 للرد النهائي.
اسم Max يخصّ النسخة المستضافة: يقول الفريق إن Qwen3.8-Max يضيف فوق الأوزان المفتوحة إدخالًا بصريًا، ووضعًا بلا تفكير، وسياقًا يبلغ مليون رمز افتراضيًا، وأدوات رسمية مدمجة.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.