← უკან დაბრუნება
SiTech Team⏱️ 1 წთ. საკითხავი

Mistral-მა Shieldstral გამოუშვა — 3B ღია მოდელი მულტიმოდალური მოდერაციისთვის

Mistral-მა Shieldstral გამოუშვა — 3B ღია მოდელი მულტიმოდალური მოდერაციისთვის

Mistral AI-მ წარადგინა Shieldstral — 3-მილიარდიანი ღია წონების უსაფრთხოების კლასიფიკატორი, რომელიც წესებს ბუნებრივ ენაზე იღებს ინფერენსის დროს და 7-ჯერ დიდ მოდელებს ეჯიბრება. ლიცენზია: Apache 2.0.

რა მოხდა

2026 წლის 4 აგვისტოს Mistral AI-მ წარადგინა Shieldstral — 3 მილიარდი პარამეტრის ღია წონების უსაფრთხოების კლასიფიკატორი, რომელიც კონტენტის მოდერაციისთვისაა შექმნილი. ტრადიციული guardrail მოდელებისგან განსხვავებით, Shieldstral მოდერაციას ორობით კითხვა-პასუხის ამოცანად განიხილავს: წესს ოპერატორი ინფერენსის დროს ბუნებრივ ენაზე წერს, მოდელი კი კალიბრირებულ უსაფრთხოების ქულას აბრუნებს.

რატომ არის მნიშვნელოვანი

ფიქსირებული კატეგორიები ნიშნავს, რომ უსაფრთხოების განმარტების ცვლილებისას მოდელის ხელახლა გაწვრთნაა საჭირო. Shieldstral-ში წესი პრომპტში რჩება — ერთი ჩექპოინტი ახალ პოლიტიკას გადამზადების გარეშე ერგება, ერთი ინტერფეისი კი ფარავს პრომპტებს, მოდელის პასუხებს, უარის დეტექციასა და სურათებს.

მოდელი Apache 2.0 ლიცენზიით გამოვიდა და ერთ 16-გბიან NVIDIA GPU-ზე მუშაობს. Mistral-ის თანახმად, Shieldstral 7-ჯერ დიდ ღია მოდელებს უწევს კონკურენციას და მულტიმოდალურ მოდერაციაში ახალი სტანდარტი დაამყარა. გამოშვება Open Secure AI Alliance-ში გაწევრიანების ფარგლებში მოხდა.

📖 წყარო