חזרה
Anthropic: מודל הקוד הפתוח GLM-5.3 של Zhipu כמעט משתווה ל-Claude Mythos Preview ביצירת אקספלויטים
SiTech AI Team2 წთ. საკითხავი

Anthropic: מודל הקוד הפתוח GLM-5.3 של Zhipu כמעט משתווה ל-Claude Mythos Preview ביצירת אקספלויטים

לפי ניתוח Frontier Red Team של Anthropic, המודל הפתוח GLM-5.3 של Zhipu AI הסינית מסוגל ליצור באופן עצמאי אקספלויטים קיברנטיים מלאים. החברה אומרת שאפשר לעקוף את הגנות המודל בשיטות פשוטות ב-64% עד 100% מהמקרים.

ב-29 בספטמבר פרסם Frontier Red Team של Anthropic ניתוח של המודל הפתוח GLM-5.3 של Zhipu AI. לפי הערכת החברה, המודל הזה מסוגל ליצור באופן עצמאי אקספלויט קיברנטי מלא מתחילתו ועד סופו, בדומה ל-Claude Mythos Preview, שיצא לפני חמישה חודשים בגישה מוגבלת במסגרת Project Glasswing. Zhipu AI פועלת בסין, ומחוצה לה היא מוכרת בשם Z.ai. ההבדל המרכזי הוא ש-GLM-5.3 הופץ עם משקלים פתוחים וללא הגנה משמעותית.

מה מראים המבחנים

ב-ExploitBench, שמודד ניצול חולשות ידועות במנוע V8 של Google Chrome, GLM-5.3 בנה אקספלויט מלא ב-50 מתוך 410 ניסיונות והשיג תוצאה של 12%, בעוד Claude Mythos Preview השיג 14%. במבחן הפנימי Binary Exploitation של Anthropic, GLM-5.3 הצליח להשתלט לחלוטין על תוכנית ב-4% מהניסיונות, ו-Mythos Preview ב-6%. מודלים קודמים, בהם Claude Opus 4.6 ו-GLM-5.2, לא הצליחו באף מקרה במבחנים האלה. בהערכה של Center for AI Standards and Innovation (CAISI) ב-NIST מ-17 בספטמבר, GLM-5.3 מוגדר כמודל הפתוח החזק ביותר ביכולות סייבר, ונאמר שהוא מפגר אחרי החזית האמריקאית בכארבעה חודשים.

עקיפת הגנות

ל-GLM-5.3 יש הגנות מובנות והוא לעיתים קרובות מסרב לבקשות זדוניות ישירות, אבל במבחנים של Anthropic ההגנות האלה נעקפו בשיטות פשוטות ב-64% עד 100% מהמקרים. סיפור כוזב שלפיו המודל הוא סוכן לבדיקות סייבר אוטונומיות מעלה את ההצלחה ל-64%, מילוי מוקדם של שלבי חשיבה (prefill) מעלה ל-92%, ושיטת abliteration, שזמינה בגלל המשקלים הפתוחים, מעלה ל-100%.

Anthropic יצרה עותק abliterated משלה. הצוות שלה, שלא ניסה דבר דומה, נזקק לכ-2200 שעות GPU ולעלות של $4400. כתוצאה מכך שיעור הסירובים של המודל ירד מיותר מ-90% ל-3% ול-2% ב-JailbreakBench וב-HarmBench, ול-12% ב-StrongREJECT. עבור GLM-5.3-Flash בוצע abliteration בכ-600 שעות GPU. במודלים המוגנים של Claude אף אחת מהשיטות האלה לא עבדה.

מה זה אומר

בסשן אחד השתמש החוקר ב-GLM-5.3-Flash כדי להרכיב תקיפה על חולשת Chrome שפורסמה לאחרונה (CVE-2026-11645). המודל חיבר באופן עצמאי אקספלויטים של שתי חולשות ויצר שרשרת אמינה למטרת ARM64, תוך עקיפת הגנת pointer authentication (PAC). נדרשו 20 דקות של תשומת לב אנושית ושמונה שעות של המודל, מה שבמחירי ה-API של Zhipu היה עולה $20.40. בסשן אחר המודל מצא שרשרת חולשות 0-day ברכיב דפדפן וקרא מפתח SSH פרטי ממחשב המשתמש מתוך אתר זדוני.

Anthropic אומרת שמגנים לא יכולים להסתפק במודלים חלשים יותר מאלה של היריבים, וקוראת לממשלות לערוך בדיקות בטיחות עצמאיות על מודלים חזקים מספיק.

SSiTech

SiTech — פיתוח אתרים בכוח ה-AI

אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.