العودة
Anthropic: نموذج Zhipu المفتوح GLM-5.3 يكاد يضاهي Claude Mythos Preview في إنشاء الاستغلالات
SiTech AI Team2 წთ. საკითხავი

Anthropic: نموذج Zhipu المفتوح GLM-5.3 يكاد يضاهي Claude Mythos Preview في إنشاء الاستغلالات

وفق تحليل Frontier Red Team من Anthropic، يمكن لنموذج GLM-5.3 المفتوح من Zhipu AI الصينية إنشاء استغلالات سيبرانية كاملة بشكل مستقل من البداية إلى النهاية. وتقول الشركة إنه يمكن تجاوز حماية النموذج بطرق بسيطة في 64% إلى 100% من الحالات.

نشر Frontier Red Team التابع لـ Anthropic في 29 سبتمبر تحليلًا لنموذج Zhipu AI المفتوح GLM-5.3. ووفقًا لتقييم الشركة، يمكن لهذا النموذج إنشاء استغلال سيبراني كامل بشكل مستقل من البداية إلى النهاية، تمامًا مثل Claude Mythos Preview، الذي صدر قبل خمسة أشهر بوصول محدود ضمن Project Glasswing. تعمل Zhipu AI في الصين، وتُعرف خارج حدودها باسم Z.ai. الفرق الرئيسي أن GLM-5.3 وُزّع بأوزان مفتوحة وبدون حماية كبيرة.

ماذا تُظهر الاختبارات

في ExploitBench، الذي يقيس استخدام الثغرات المعروفة في محرك V8 من Google Chrome، بنى GLM-5.3 استغلالًا كاملًا في 50 من 410 محاولات وحقق نتيجة 12%، بينما حقق Claude Mythos Preview 14%. في اختبار Binary Exploitation الداخلي لدى Anthropic، تمكن GLM-5.3 من السيطرة الكاملة على البرنامج في 4% من المحاولات، وMythos Preview في 6%. النماذج الأقدم، ومنها Claude Opus 4.6 وGLM-5.2، لم تنجح في أي حالة في هذه الاختبارات. وفي تقييم Center for AI Standards and Innovation (CAISI) التابع لـ NIST بتاريخ 17 سبتمبر، سُمّي GLM-5.3 أقوى نموذج مفتوح في القدرات السيبرانية، ويُذكر أنه متأخر عن الجبهة الأمريكية بنحو أربعة أشهر.

تجاوز الحمايات

لدى GLM-5.3 حماية مدمجة وغالبًا ما يرفض الطلبات الضارة المباشرة، لكن في اختبارات Anthropic جرى تجاوز هذه الحماية بطرق بسيطة في 64% إلى 100% من الحالات. القصة الزائفة بأن النموذج وكيل مستقل لاختبار الأمن السيبراني ترفع النجاح إلى 64%، والتعبئة المسبقة لخطوات التفكير (prefill) إلى 92%، أما طريقة abliteration، المتاحة بسبب الأوزان المفتوحة، فترفعه إلى 100%.

أنشأت Anthropic نسختها abliterated الخاصة. احتاج فريقها، الذي لم يجرّب شيئًا مشابهًا، إلى نحو 2200 ساعة GPU وتكلفة $4400. ونتيجة لذلك انخفض معدل رفض النموذج من أكثر من 90% إلى 3% و2% في JailbreakBench وHarmBench، وإلى 12% في StrongREJECT. أما GLM-5.3-Flash فقد أُجري له abliteration في نحو 600 ساعة GPU. وعلى نماذج Claude المحمية لم تنجح أي من هذه الطرق.

ماذا يعني هذا

في جلسة واحدة استخدم الباحث GLM-5.3-Flash لبناء هجوم على ثغرة Chrome المعلنة حديثًا (CVE-2026-11645). ربط النموذج بشكل مستقل استغلالَي ثغرتين وأنشأ سلسلة موثوقة لهدف ARM64، مع تجاوز حماية pointer authentication (PAC). استغرق الأمر 20 دقيقة من انتباه الإنسان وثماني ساعات من النموذج، وهو ما كان سيكلف $20.40 بأسعار API لدى Zhipu. وفي جلسة أخرى وجد النموذج سلسلة ثغرات 0-day في مكوّن متصفح وقرأ مفتاح SSH الخاص من حاسوب المستخدم عبر موقع ويب ضار.

تقول Anthropic إن المدافعين لا يمكنهم البقاء بنماذج أضعف من نماذج الخصوم، وتدعو الحكومات إلى إجراء اختبارات أمنية مستقلة على نماذج قوية بما يكفي.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.