Z.ai تطلق GLM-5.3: برمجة أقوى وقدرات سيبرانية ناشئة
وفقًا لـ Z.ai، يحافظ GLM-5.3 على النموذج الأساسي نفسه لـ GLM-5.2، وكل التحسن يأتي من توسيع التدريب اللاحق: قفزة بنسبة 50 بالمئة في البرمجة ونتائج متقدمة بين النماذج المفتوحة، مع قدرات سيبرانية نمت أسرع من المتوقع.
أطلقت Z.ai نموذجها الرئيسي الجديد GLM-5.3، حيث يأتي التحسّن كله مقارنةً بـ GLM-5.2 من التدريب اللاحق (post-training)؛ فالنموذج الأساسي لم يتغير. وتقول الشركة في إعلانها الصادر في 14 أغسطس 2026 إن التحديث يحسّن بشكل ملحوظ البرمجة المعقدة والمهام طويلة الأمد، بينما تطوّرت القدرات السيبرانية أسرع مما توقعه الفريق.
البرمجة: ريادة بين النماذج ذات الأوزان المفتوحة
تصف Z.ai نموذج GLM-5.3 بأنه الأقدر على البرمجة بين النماذج ذات الأوزان المفتوحة، بتحسّن بنسبة 50 بالمئة عن GLM-5.2 في اختبار Z.ai Code Bench الداخلي. في Terminal Bench 3.0 يسجّل النموذج 28.3 مقابل 4.6 لـ GLM-5.2، وفي Agents' Last Exam يسجّل 28.5 مقابل 23.8. وفي DeepSWE v1.1 ترتفع النتيجة من 46.2 إلى 66.9. لكن الفجوة مع النماذج المغلقة لم تُغلق في كل مكان: في Terminal Bench 3.0 يسجّل Fable 5 نحو 33.7 وGPT-5.6 Sol نحو 34.6.
وتبرز الشركة أيضًا كفاءة الرموز: عند أقصى مستوى للتفكير يصل GLM-5.3 إلى 34.5 بالمئة باستهلاك نحو 75 ألف رمز إخراج لكل مهمة، مقابل 23.4 بالمئة لـ GLM-5.2 عند 96 ألف رمز.
قدرات سيبرانية نشأت تلقائيًا
أُضيفت بيانات اكتشاف الثغرات إلى خليط التدريب أملًا في تحسين تحليل العيوب. وبحسب Z.ai، نمت القدرة أكثر من المتوقع: انتقل النموذج من رصد عيوب منفردة إلى التخطيط لسلاسل استغلال متعددة المراحل. وهو يسجّل 84.5 بالمئة في CyberGym، وهي أفضل نتيجة في هذا المعيار، متقدمًا على Mythos 5 (83.8) وGPT-5.6 Sol (83.6). وفي ExploitBench تضاعفت النتيجة أكثر من مرتين، من 24.4 إلى 54.4، غير أن Mythos 5 (78.0) وGPT-5.6 Sol (76.5) لا يزالان متقدمين بفارق كبير. وتلفت Z.ai إلى نمط واضح: كلما ارتفع موقع المعيار في سلسلة الاستغلال، كبر حجم القفزة، واتسعت الفجوة المتبقية مع النماذج المغلقة.
نتائج في مشاريع حقيقية وخطة الإصدار
بالعمل مع فرق أمنية في الصين، تقول الشركة إن نماذجها رصدت 2436 ثغرة في 269 مشروعًا مفتوح المصدر بعد مراجعة الخبراء وإزالة التكرار، بينها 1097 ثغرة مصنّفة حرجة أو عالية الخطورة. أقدم عيب يعود إلى عام 1981، وعاشت الثغرة في المتوسط 26.6 سنة قبل اكتشافها. ويوثّق Security Disclosure Ledger العام العملية: أُعلن 53 منها حتى الآن، فيما لا يزال 2383 تحت الحظر الإعلامي. وستُنشر أوزان النموذج بعد نحو أسبوعين من الإطلاق، بعد استكمال تقييم السلامة والتحصين.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.