Mistral, Shieldstral'ı Yayınladı: Çok Modlu Moderasyon İçin 3B Açık Model
Mistral AI, çıkarım anında düz dille politika alan ve kendinden 7 kat büyük modellerle yarışan 3 milyar parametreli açık ağırlıklı güvenlik sınıflandırıcısı Shieldstral'ı tanıttı. Lisans: Apache 2.0.
Ne oldu
4 Ağustos 2026'da Mistral AI, içerik moderasyonu için geliştirdiği 3 milyar parametreli açık ağırlıklı güvenlik sınıflandırıcısı Shieldstral'ı tanıttı. Geleneksel guardrail modellerinin aksine Shieldstral, moderasyonu ikili bir soru-cevap görevi olarak ele alıyor: politikayı operatör çıkarım anında düz dille yazıyor, model de kalibre edilmiş bir güvenlik puanı döndürüyor.
Neden önemli
Sabit zarar kategorileri, güvenlik tanımları her değiştiğinde yeniden eğitim gerektiriyor. Shieldstral'da politika istemde kalıyor; tek bir checkpoint yeni kurallara yeniden eğitim olmadan uyum sağlıyor ve tek arayüz istemleri, model yanıtlarını, ret tespitini ve görselleri kapsıyor.
Model Apache 2.0 lisansıyla yayınlandı ve tek bir 16GB NVIDIA GPU üzerinde çalışıyor. Mistral'a göre Shieldstral, kendinden 7 kat büyük açık modellerle yarışıyor ve çok modlu moderasyonda yeni bir standart belirliyor. Sürüm, Open Secure AI Alliance üyeliği kapsamında duyuruldu.