Mistral משחררת את Shieldstral: מודל 3B בקוד פתוח למודרציה מולטימודלית
Mistral AI הציגה את Shieldstral — מסווג בטיחות בקוד פתוח עם 3 מיליארד פרמטרים, שמקבל מדיניות בשפה חופשית בזמן ההסקה ומתמודד עם מודלים גדולים ממנו פי 7. רישיון: Apache 2.0.
מה קרה
ב-4 באוגוסט 2026 הציגה Mistral AI את Shieldstral — מסווג בטיחות בקוד פתוח עם 3 מיליארד פרמטרים, שנועד למודרציה של תוכן. בניגוד למודלים מסורתיים שמקבעים קטגוריות נזק במשקולות, Shieldstral מתייחס למודרציה כאל שאלת כן/לא: המפעיל מנסח את המדיניות בשפה חופשית בזמן ההסקה, והמודל מחזיר ציון בטיחות מכויל.
למה זה חשוב
טקסונומיה קבועה מחייבת אימון מחדש בכל שינוי בהגדרות הבטיחות. כאן המדיניות נשארת בפרומפט — צ׳קפוינט אחד מתאים את עצמו למדיניות חדשה בלי אימון מחדש, וממשק יחיד מכסה פרומפטים, תשובות של המודל, זיהוי סירובים ותמונות.
המודל שוחרר ברישיון Apache 2.0 ורץ על כרטיס NVIDIA יחיד עם 16GB. לפי Mistral, הוא מתמודד עם מודלים גדולים ממנו פי 7 ומציב סטנדרט חדש במודרציה מולטימודלית. ההשקה נעשתה במסגרת הצטרפות ל-Open Secure AI Alliance.