العودة
Anthropic تعتذر عن ضوابط Claude Fable غير المرئية
SiTech AI Team2 წთ. საკითხავი

Anthropic تعتذر عن ضوابط Claude Fable غير المرئية

أقرّت Anthropic بأن تشويه الردود بصمت على طلبات يُشتبه في أنها تقطير كان مقايضة خاطئة، وقالت إن المستخدمين سيرون الآن عندما يُحال الاستعلام إلى Opus 4.8. جاء ذلك بعد انتقادات حادة من مجتمع أبحاث الذكاء الاصطناعي.

اعتذرت شركة Anthropic عن تقييد نموذجها الجديد Claude Fable 5 بصمت عبر ضوابط مخفية أثّرت أيضًا على الباحثين والمنافسين الذين كانوا يستخدمونه لبناء أنظمة منافسة. وتقول الشركة إنها تعكس مسارها وستكون أكثر شفافية بشأن موعد تفعيل القيود — حتى لو يعني ذلك رفض Fable لمزيد من الاستعلامات.

ضوابط مخفية ثم اعتذار

‏Fable هو أول نموذج متاح على نطاق واسع من فئة Mythos لدى Anthropic، وهي فئة ظلّت الشركة تحذّر لأشهر من أنها أخطر من أن تُطرح للعموم. وقالت الشركة إنها عالجت بعض تلك المخاطر بضوابط تمنع النموذج من الرد على استعلامات معيّنة «عالية الخطورة». ومن المجالات المقيّدة التقطير، وهو أسلوب لتدريب نماذج أصغر على مخرجات نماذج أكبر. وفي البطاقة النظامية لـ Fable ذكرت الشركة أنها ستتعامل مع ما ترجّح أنه محاولات تقطير بتغيير ردود النموذج وإضعافها مباشرة، دون إبلاغ المستخدمين بأن الضابط قد فُعِّل أو بأن ردودهم قد تغيّرت.

التحويل إلى Opus 4.8

هذا النهج يتغيّر الآن. فالاستعلامات التي تبدو محاولات تقطير ستُحوَّل إلى Claude Opus 4.8، النموذج الرائد السابق للشركة، وفق منشور على منصة X. وسيُبلَّغ المستخدمون بذلك: «سترون هذا في كل مرة يحدث فيها». ويعكس هذا الآلية المتبعة مع مجالات عالية الخطورة أخرى مثل الأحياء والكيمياء والأمن السيبراني، حيث تُمرَّر الاستعلامات عبر Opus 4.8 ما لم تُحجب كليًا بموجب قواعد أوسع تشمل المخدرات والأسلحة ومحتوى محظورًا آخر. وفي مجال الأحياء، ضُبطت الضوابط على نحو واسع لدرجة أن Fable غير قابل للاستخدام عمليًا حتى في الأسئلة الأساسية، وهو ما أقرّ به المتحدث باسم Anthropic باروول ماهيشواري لصحيفة The Verge.

انتقادات الباحثين

جاء التراجع بعد انتقادات حادة من مجتمع أبحاث الذكاء الاصطناعي، الذي حذّر من أن تقييد المستخدمين المشتبه في محاولتهم تقطير Fable بصمت قد يطال أيضًا أطرافًا ثالثة تحاول تقييم النموذج المتقدم. وفي البطاقة النظامية، رأت Anthropic أن قدرة النماذج الأحدث على تسريع تطوير الذكاء الاصطناعي تبرّر استهداف مثل هذه الطلبات، مشيرة إلى أن «استخدام Claude لتطوير نماذج منافسة يخالف بالفعل شروط الخدمة لدينا». وقد اتهمت الشركة سابقًا منافسين صينيين مثل DeepSeek بتقطير نماذجها على نطاق «صناعي».

وفي منشورها على X أوضحت Anthropic المقايضة التي اختارتها: «يمكن اختبار الضوابط المرئية، لذا يجب أن تكون متينة، وهذا يستغرق وقتًا. أما الضوابط غير المرئية فيمكن توجيهها بشكل أضيق، ما يسمح لنا بالإطلاق بسرعة وبعدد قليل جدًا من النتائج الإيجابية الخاطئة. اخترنا الضوابط غير المرئية لهذا السبب — وكانت تلك مقايضة خاطئة. ينبغي أن تكون لديكم رؤية واضحة للضوابط التي نطبّقها ولماذا. نأسف لأننا لم نحقق التوازن الصحيح».

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.