Mistral Shieldstral-ı buraxdı: Multimodal moderasiya üçün 3B açıq model
Mistral AI, inferens zamanı sadə dildə siyasət qəbul edən və özündən 7 dəfə böyük modellərlə rəqabət aparan 3 milyard parametrli açıq çəkili təhlükəsizlik təsnifatçısı Shieldstral-ı təqdim etdi. Lisenziya: Apache 2.0.
Nə oldu
4 avqust 2026-cı ildə Mistral AI məzmun moderasiyası üçün nəzərdə tutulmuş 3 milyard parametrli açıq çəkili təhlükəsizlik təsnifatçısı Shieldstral-ı təqdim etdi. Ənənəvi guardrail modellərindən fərqli olaraq Shieldstral moderasiyanı bəli/xeyr sual-cavab tapşırığı kimi qurur: siyasəti operator inferens zamanı sadə dildə yazır, model isə kalibrlənmiş təhlükəsizlik balı qaytarır.
Niyə vacibdir
Sabit zərər kateqoriyaları təhlükəsizlik təyinatları dəyişdikcə modelin yenidən öyrədilməsini tələb edir. Shieldstral-da siyasət promptda qalır — bir checkpoint yeni qaydalara yenidən öyrətmə olmadan uyğunlaşır və vahid interfeys promptları, model cavablarını, imtinanın aşkarlanmasını və şəkilləri əhatə edir.
Model Apache 2.0 lisenziyası ilə buraxılıb və tək 16GB NVIDIA GPU-da işləyir. Mistral-a görə Shieldstral özündən 7 dəfə böyük açıq modellərlə rəqabət aparır və multimodal moderasiyada yeni standart müəyyən edir.