חזרה
Anthropic: GLM-5.3 יכול ליצור באופן עצמאי כלי לתקיפת סייבר
SiTech AI Team2 წთ. საკითხავი

Anthropic: GLM-5.3 יכול ליצור באופן עצמאי כלי לתקיפת סייבר

לפי דוח Frontier Red Team של Anthropic, המודל הפתוח GLM-5.3 של Zhipu AI יוצר באופן עצמאי כלי מלא לתקיפת סייבר, אך שוחרר עם הגנה חלשה. בבדיקות ניתן היה לעקוף את מגבלותיו ב-64% עד 100% מהמקרים.

צוות Frontier Red Team של Anthropic פרסם דוח על יכולות הסייבר של המודל החדש של Zhipu AI (מחוץ לסין — Z.ai), GLM-5.3. לפי המחקר, המודל מסוגל ליצור באופן עצמאי כלי תקיפת סייבר מקצה לקצה בדיוק כמו Claude Mythos Preview, אך הוא שוחרר ללא מנגנוני הגנה משמעותיים. Mythos Preview שוחרר לפני חמישה חודשים רק במסגרת Project Glasswing, עם גישה מוגבלת.

מה GLM-5.3 מסוגל לעשות

בבנצ'מרק ExploitBench, GLM-5.3 יצר אקספלויט מלא ב-50 מתוך 410 ניסיונות, ו-Claude Mythos Preview ב-56. בבנצ'מרק הפנימי Binary Exploitation, GLM-5.3 השתלט על זרימת הבקרה ב-4% מהמקרים, ו-Mythos Preview ב-6%. מודלים מוקדמים יותר, למשל Claude Opus 4.6 ו-GLM-5.2, לא הצליחו לעשות זאת באף מקרה.

בבדיקה עם מעורבות אנושית, החוקר הפעיל את GLM-5.3 על מערכת מבודדת. תוך יום אחד הוא מצא כמה פגיעויות לא ידועות במנוע ה-JavaScript של הדפדפן והפך אותן לאקספלויטים עובדים. בסשן השני, GLM-5.3-Flash בנה אקספלויט לפגיעות ידועה ב-Google Chrome (CVE-2026-11645), תוך עקיפת הגנת pointer-authentication (PAC) ב-ARM64. הדבר דרש 20 דקות של תשומת לב אנושית ו-8 שעות עבודה של המודל.

GLM-5.3-ის შესაძლებლობებისა და დაცვის გვერდის ავლის დიაგრამა

מנגנוני ההגנה נעקפים בקלות

ל-GLM-5.3 יש הגנה מובנית והוא מסרב לבקשות זדוניות בבירור, אך בבדיקות של Anthropic עקפו אותו בקלות. היעיל ביותר הוא "אבליטרציה", טכניקה סטנדרטית להפחתת סירובים; מכיוון שהמודל הוא בקוד פתוח עם משקולות פתוחות, ניתן להסיר סירובים כמעט בלי לשנות את היכולות. הצוות של Anthropic השקיע בכך כ-2,200 שעות GPU ו-4,400 דולר. שיעור הסירובים ירד מיותר מ-90% ל-3% (JailbreakBench), 2% (HarmBench) ו-12% (StrongREJECT).

אפשר לעקוף גם בלי אבליטרציה: באמצעות הוראה מטעה שלפיה המודל הוא סוכן red-team עצמאי, GLM-5.3 מסכים לבקשה זדונית ב-64% מהמקרים, עם מילוי מוקדם של טוקני חשיבה ב-92%, ובגרסה אבליטררית ב-100%. עבור מודלים מוגנים של Claude השיטות האלה לא עובדות (0%).

מה זה אומר

המרכז לסטנדרטים וחדשנות של AI של NIST (CAISI) הכיר ב-17 בספטמבר ב-GLM-5.3 כ"מודל משקולות פתוחות בעל היכולות הסייבריות הגבוהות ביותר" וציין שהוא מפגר אחרי ה-frontier האמריקאי בכארבעה חודשים.

לפי Anthropic, GLM-5.3 יאפשר לשחקנים זדוניים להשתמש בפגיעויות סייבר ללא הגבלות, בעוד שאותן יכולות עוזרות להגנתיים. החברה סבורה שלמגנים צריכים להיות מודלים ברמה דומה לפחות לזו של היריבים, וקוראת לממשלות לבדוק באופן עצמאי מודלים חזקים.

SSiTech

SiTech — פיתוח אתרים בכוח ה-AI

אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.