شركة Z.ai تطلق نموذج GLM-5.3-Flash: ذكاء بمستوى الحدود بعُشر التكلفة

أطلقت مختبرات Z.ai الصينية نموذج GLM-5.3-Flash، وهو نموذج متعدد الوسائط بـ320 مليار معامل و18 مليارًا نشطًا فقط. يتفوق على GLM-5.2 بعُشر السعر ويقترب من Claude Opus 4.8 في البرمجة والوكلاء.
ما الذي حدث
في 26 أغسطس، أطلقت مختبرات Z.ai الصينية نموذج GLM-5.3-Flash، أول نموذج متعدد الوسائط أصلي في سلسلة GLM-5. يبلغ عدد معاملاته الإجمالي 320 مليارًا، لكن المعاملات النشطة لكل رمز لا تتجاوز 18 مليارًا. وهو يتفوق على سابقه GLM-5.2 في الاختبارات بعُشر السعر تقريبًا، ويقترب من Claude Opus 4.8 في مهام البرمجة والوكلاء.
معمارية لاستدلال منخفض التكلفة
يجمع النموذج بين الانتباه المتناثر (sparse) والانتباه الخطي (linear) في بنية هجينة، ويستخدم تقنية Manifold-Constrained Hyper-Connections (mHC) لتحسين كفاءة التوسّع. مقارنة بسلسلة GLM-4.5، انخفض عدد الطبقات إلى النصف تقريبًا (45 مقابل 92)، ما يبقي تكاليف التشغيل منخفضة حتى مع سياق يبلغ مليون رمز.
أرقام وتجربة صامتة
قبل الإطلاق عمل النموذج مجهول الهوية باسم «ox-alpha» على منصتي OpenCode وOpenRouter، وأصبح النموذج الأكثر شعبية في الأسبوع، مع تقديم كل هذه الحركة على شرائح ذكاء اصطناعي صينية. يسجّل 57 نقطة في مؤشر Artificial Analysis Intelligence Index v4.1.1 بتكلفة نحو 0.045 دولار للمهمة، ويصل إلى 63.4 مقابل 46.2 لـ GLM-5.2 في DeepSWE v1.1.
لماذا يهم ذلك
الفجوة بين النماذج الرائدة والاقتصادية تتقلص: أداء برمجة ووكلاء من الطراز الأول بجزء بسيط من التكلفة يغيّر ما يمكن أتمتته فعليًا.