Geri qayıt
Anthropic Claude Fable-ın görünməz qoruyucuları üçün üzr istədi
SiTech AI Team2 წთ. საკითხავი

Anthropic Claude Fable-ın görünməz qoruyucuları üçün üzr istədi

Anthropic distillə şübhəsi olan sorğulara səssizcə dəyişdirilmiş cavab verməyin yanlış seçim olduğunu qəbul etdi; istifadəçilər artıq sorğunun Opus 4.8-ə yönləndirildiyini görəcək.

Anthropic yeni modeli Claude Fable 5-i görünməz qoruyucularla səssizcə məhdudlaşdırdığı üçün üzr istədi; bu, modeli rəqib sistemlər qurmaq üçün istifadə edən tədqiqatçılara və rəqiblərə də təsir etdi. Şirkət kursunu dəyişdiyini və məhdudiyyətlərin nə vaxt qüvvəyə mindiyi barədə daha şəffaf olacağını bildirir — bu, Fable-ın daha çox sorğunu rədd etməsi demək olsa belə.

Gizli qoruyucular və sonra üzr

Fable, Anthropic-in Mythos sinfində geniş istifadəyə açıq ilk modeldir; şirkət aylarla bu ailənin ictimai buraxılış üçün çox təhlükəli olduğunu deyirdi. Şirkətə görə bu risklərin bir qismi müəyyən "yüksək riskli" sorğuları bloklayan qoruyucularla həll edildi. Məhdudlaşdırılan sahələrdən biri distillədir — kiçik modellərin böyük modellərin nəticələri ilə öyrədilməsi. Fable-ın sistem kartında şirkət distillə cəhdi saydığı sorğuların cavablarını birbaşa dəyişib pisləşdirəcəyini, istifadəçiyə nə qoruyucunun işə düşdüyünü, nə də cavabın dəyişdiyini bildirəcəyini yazmışdı.

Artıq Opus 4.8-ə yönləndirmə

Bu yanaşma indi dəyişir. Distillə cəhdinə bənzəyən sorğular Anthropic-in əvvəlki flaqman modeli Claude Opus 4.8-ə yönləndiriləcək; şirkət bunu X-dəki paylaşımında bildirib. İstifadəçilərə bu barədə məlumat veriləcək: "Bunu hər dəfə baş verdikdə görəcəksiniz". Mexanizm Fable-ın bioloji, kimya və kibertəhlükəsizlik kimi digər yüksək riskli sahələrdəki davranışını təkrarlayır: sorğular narkotik, silah və digər qadağan olunmuş məzmun qaydaları ilə tamamilə bloklanmadıqca Opus 4.8 üzərindən keçir. Biologiyada qoruyucular o qədər geniş tənzimlənib ki, Fable hətta əsas suallar üçün praktiki olaraq yararsız hala gəlib — bunu Anthropic-in sözçüsü Paruul Maheşvari The Verge-ə təsdiqləyib.

Tədqiqatçıların tənqidi

Geri addım, Fable-ı distillə şübhəsi ilə səssizcə məhdudlaşdırmanın sərhəd modelini qiymətləndirməyə çalışan üçüncü tərəflərə də zərər verə biləcəyini xəbərdar edən süni intellekt tədqiqat icmasının sərt tənqidindən sonra gəldi. Sistem kartında Anthropic yeni modellərin süni intellektin inkişafını sürətləndirmə qabiliyyətinin bu cür sorğuları hədəfləməyi əsaslandırdığını müdafiə edir və qeyd edirdi: "Claude-u rəqib modellər hazırlamaq üçün istifadə etmək artıq xidmət şərtlərimizi pozur". Şirkət əvvəllər DeepSeek kimi çinli rəqiblərini modellərini "sənaye" miqyasında distillə etməkdə ittiham etmişdi.

X-dəki paylaşımında Anthropic seçdiyi güzəşti izah etdi: "Görünən qoruyucular yoxlanıla bilər, buna görə də möhkəm olmalıdır və bu vaxt tələb edir. Görünməz qoruyucular daha dar hədəflənə bilər ki, bu da çox az yanlış müsbət nəticə ilə sürətli buraxılışa imkan verir. Məhz buna görə görünməz qoruyucuları seçdik — və bu yanlış güzəşt idi. Hansı qoruyucularımız olduğunu və niyə olduğunu görməlisiniz. Balansı tuta bilmədiyimiz üçün üzr istəyirik".

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.