العودة
Anthropic: يمكن لـ GLM-5.3 إنشاء أداة هجوم سيبراني بشكل مستقل
SiTech AI Team2 წთ. საკითხავი

Anthropic: يمكن لـ GLM-5.3 إنشاء أداة هجوم سيبراني بشكل مستقل

وفقًا لتقرير Frontier Red Team من Anthropic، فإن نموذج Zhipu AI المفتوح GLM-5.3 ينشئ بشكل مستقل أداة هجوم سيبراني كاملة، لكنه صدر بحماية ضعيفة. في الاختبارات أمكن تجاوز قيوده في 64% إلى 100% من الحالات.

نشر فريق Frontier Red Team التابع لـ Anthropic تقريرًا عن القدرات السيبرانية لنموذج Zhipu AI الجديد (خارج الصين — Z.ai)، GLM-5.3. ووفقًا للبحث، يستطيع النموذج إنشاء أداة هجوم سيبراني متكاملة بشكل مستقل تمامًا كما يفعل Claude Mythos Preview، لكنه صدر من دون آليات حماية مهمة. صدر Mythos Preview قبل خمسة أشهر فقط ضمن Project Glasswing، بوصول محدود.

ما الذي يستطيع GLM-5.3 فعله

في معيار ExploitBench، أنشأ GLM-5.3 استغلالًا كاملًا في 50 من أصل 410 محاولات، بينما فعل Claude Mythos Preview ذلك في 56. وفي معيار Binary Exploitation الداخلي، سيطر GLM-5.3 على تدفق التحكم في 4% من الحالات، وMythos Preview في 6%. أما النماذج الأقدم، مثل Claude Opus 4.6 وGLM-5.2، فلم تنجح في ذلك في أي حالة.

في اختبار بمشاركة بشرية، استخدم الباحث GLM-5.3 على نظام معزول. خلال يوم واحد وجد عدة ثغرات غير معروفة في محرك JavaScript للمتصفح وحوّلها إلى استغلالات عاملة. في الجلسة الثانية، بنى GLM-5.3-Flash استغلالًا لثغرة معروفة في Google Chrome (CVE-2026-11645)، مع تجاوز حماية pointer-authentication (PAC) على ARM64. تطلب ذلك 20 دقيقة من انتباه بشري و8 ساعات من عمل النموذج.

GLM-5.3-ის შესაძლებლობებისა და დაცვის გვერდის ავლის დიაგრამა

آليات الحماية تُتجاوز بسهولة

لدى GLM-5.3 حماية مدمجة ويرفض بوضوح الطلبات الضارة، لكن في اختبارات Anthropic جرى تجاوزه بسهولة. الأكثر فعالية هو "الاستئصال" (ablation)، وهي تقنية قياسية لتقليل حالات الرفض؛ ولأن النموذج مفتوح الأوزان، يمكن إزالة الرفض مع بقاء القدرات دون تغيير تقريبًا. أنفق فريق Anthropic على ذلك نحو 2,200 ساعة GPU و4,400 دولار. وانخفض معدل الرفض من أكثر من 90% إلى 3% (JailbreakBench)، و2% (HarmBench)، و12% (StrongREJECT).

يمكن التجاوز حتى من دون الاستئصال: عبر تعليمات مضللة توحي بأن النموذج وكيل red-team مستقل، يوافق GLM-5.3 على الطلب الضار في 64% من الحالات، ومع التعبئة المسبقة لرموز التفكير في 92%، ومع نسخة مستأصلة في 100%. وبالنسبة لنماذج Claude المحمية لا تعمل هذه الأساليب (0%).

ماذا يعني ذلك

اعترف مركز معايير وابتكار الذكاء الاصطناعي في NIST (CAISI) في 17 سبتمبر بأن GLM-5.3 هو "النموذج المفتوح الأوزان الأكثر قدرة سيبرانيًا"، وأشار إلى أنه متأخر عن frontier الأمريكي بنحو أربعة أشهر.

بحسب Anthropic، سيتيح GLM-5.3 للفاعلين الخبثاء استخدام الثغرات السيبرانية من دون قيود، بينما تساعد القدرات نفسها المدافعين. وترى الشركة أن المدافعين يجب أن يمتلكوا نماذج بمستوى مماثل على الأقل لمستوى الخصوم، وتدعو الحكومات إلى اختبار النماذج القوية بشكل مستقل.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.