العودة
مهندس في Anthropic يشرح لماذا تراجعت جودة كتابة Claude رغم أن النموذج أصبح أذكى
SiTech AI Team2 წთ. საკითხავი

مهندس في Anthropic يشرح لماذا تراجعت جودة كتابة Claude رغم أن النموذج أصبح أذكى

شرح الباحث جاكسون كيرنيون من Anthropic، الذي يعمل على الضبط الدقيق لـ Claude، سبب تراجع جودة كتابة النماذج الأحدث: فهي مُحسَّنة للرياضيات والبرمجة، وتكتب النصوص لصالح نماذج ذكاء اصطناعي أخرى لا للبشر.

تحسّنت نماذج Anthropic كثيرًا في الرياضيات والبرمجة والاستدلال متعدد الخطوات، لكن جودة نصوصها لم ترتفع بالوتيرة نفسها، بل تراجعت في بعض الحالات. وقد قدّم جاكسون كيرنيون، وهو باحث في Anthropic يعمل على الضبط الدقيق (fine-tuning) لـ Claude، تفسيرًا لهذه الفجوة في سلسلة منشورات على منصة X.

تحسين من أجل الكود على حساب اللغة

يقول كيرنيون إن Opus 4.6 كان آخر نموذج من Anthropic يمكنه وصفه حقًا بأنه «نموذج كتابة» جيد. جزء من السبب متوقّع: فقد جرى تحسين الإصدارات الأحدث من أجل الرياضيات والكود. لكن هناك عامل ثانٍ أقل وضوحًا، إذ دُرِّبت النماذج أيضًا على إنتاج شروح تقنية موجّهة إلى نماذج ذكاء اصطناعي أخرى لا إلى البشر.

«جُرى تكييف النموذج مع سيكولوجيا نماذج اللغة»، كما يقول كيرنيون، مضيفًا أنه تعلّم الكتابة من أجل الآلات. ومن هنا، بحسب رأيه، تأتي تلك الصياغات الغريبة التي يسميها المستخدمون «Claudeish»: نص يبدو دقيقًا ومكثّفًا بالمعلومات، لكنه صعب القراءة على الإنسان.

الجمهور المستهدف: نماذج اللغة

يشبّه كيرنيون هذا الأثر بأشخاص يتواصلون أساسًا داخل مجموعة ضيقة واحدة: ينشأ لديهم أسلوب يعمل جيدًا في الداخل، لكن يصعب على الغرباء متابعته. ولدى نماذج اللغة ذاكرة عاملة أكبر بكثير من ذاكرة البشر، وهي تلتقط التفاصيل على مستوى أدقّ بكثير، لذلك يتشكّل أثناء التدريب أسلوب يناسب النماذج الأخرى، ويصل إلى القارئ البشري في صورة تدفّق معلومات مفرط الكثافة.

السبب في بنية المكافآت

يرى كيرنيون أن جذر المشكلة يكمن في بنية المكافآت في التعلّم المعزّز (reinforcement learning). بعض المكافآت تقيس مدى فهم نموذج ذكاء اصطناعي آخر للإجابة، وبعضها يقيس مدى فهم الإنسان لها. والتدريب المكثّف على الرياضيات والكود يرجّح كفة النوع الأول، وكلما زاد تدريب النموذج على ذلك، لزم على المطوّرين مقاومته بقوة أكبر عبر مكافأة الشروح البسيطة التي يستطيع الإنسان متابعتها.

يقول كيرنيون إن Anthropic وجدت توازنًا أفضل مع Opus 5.5، ويضيف أنه لم يكن راضيًا عن كتابة أي نموذج بهذا القدر منذ Opus 4.6. وهو لا يزعم أن النموذج الأحدث يتفوّق على سابقه. ويقول: «إنها مشكلة صعبة الحل، وسنواصل إجراء التحسينات».

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.