
مقال: التطوير بمساعدة نماذج اللغة يُطبّع الأعطال غير المفسَّرة
يتناول مقال على مدونة ihatethefuture.com فكرة أن التطوير المعجَّل بنماذج اللغة الكبيرة يُطبّع الأعطال التي لا يحاول أحد تفسيرها، ويجعل "أحياناً الأمور سيئة فحسب" نقطة النهاية المقبولة للتحقيق.
تصدّر مقال نُشر على مدونة ihatethefuture.com (اسم الكاتب المستعار: patrickxia) موقع Hacker News. ويرى الكاتب أن ثقافة تطوير البرمجيات المعجَّلة بنماذج اللغة الكبيرة (LLM) تُطبّع تدريجياً أعطالاً لا يحاول أحد تفسيرها.
"Stupid thing sucks"
يستهل المقال بصورتين من رسوم متحركة حيث تحاول شخصية عبور باب لا يُفتح. العائق ملموس تماماً: أولاً جثة في الطريق، ثم ذهب بقيمة تقارب مليار دولار. في المشهدين يتمتم الشخص المنزعج "stupid thing sucks" (أي "الشيء الغبي سيئ") ويمضي في طريقه. ويرفض الكاتب اعتبار هذا "نموذجاً معقولاً للأبواب": فالعطل كان له سبب محدد، لكن اللوم وقع على الشيء الخطأ.
Jev وعلامة "AI-powered"
ينتقل المقال بعدها إلى Jev، وهو نموذج ذكاء اصطناعي طورته TypeSafe AI ويعيد قيماً مُنمَّطة إلى جانب تقديرات احتمالية. ويصف الكاتب نقاط قوته بالسرعة والتكلفة: النموذج سريع ورخيص ويمكن البناء عليه بسرعة. لكن السؤال هو ما يحدث بعد البناء. نادراً ما يجري المشترون تقييمات (evals): يطرحون أسئلة غامضة على Jev ويحصلون على إجابات غامضة، ثم يضعون علامة "AI-powered". وعندما يتعطل المنطق في الطبقات الدنيا يصبح "حسناً، الذكاء الاصطناعي يخطئ" هو التفسير، بينما تُؤجَّل ميزانيات الأخطاء وأنماط الفشل ومجموعات الاختبار إلى وقت لاحق. أما معدل الفشل فيكتشفه المستخدمون بأنفسهم.
يستبق المقال الدفاع البديهي: Jev يعيد درجات ثقة. فماذا ستفعلون بها؟ لاتخاذ قرار معقول بناءً على درجة ثقة، تحتاجون إلى فهم مدى جودة معايرتها وإلى نموذج لتكلفة عدم اليقين. يقول الكاتب إن الناس يستخدمون درجات الثقة في أفضل الأحوال بطريقة "كارغو كالت"، أي تقليد أعمى بلا فهم، وفي أسوأ الأحوال كعذر لاستدعاء فشل: كأن إجابة "واثق بنسبة 73%" تمنح صاحبها ميزانية خطأ بنسبة 27%.
المسؤولية ونهاية التحقيق
حين يتعطل زر في موقع ما، تكون لدى المهندس عادةً صورة لما كان ينبغي أن يحدث: عقد انكسر، أو تعطل DNS، أو أطلق أحدهم نصاً برمجياً فيه أخطاء صياغية على مسار واحد، أو رمى معالج استثناءً غير متوقع. قد لا تتوفر صلاحية تنقيح استجابة HTTP 500 مجردة، لكن هناك من وظيفته فهم سبب عطل نقطة النهاية. غير أن تجربة كثير من المستخدمين أقرب إلى "الشيء الغبي سيئ".
الخوف الرئيسي في المقال ليس من أن التطوير المعجَّل بنماذج اللغة سيُنتج أعطالاً أكثر. سيحدث ذلك، وقد حدث بالفعل: فهذا جزء من ثمن البناء بطريقة جديدة. الخوف هو أن تتحول عبارة "أحياناً الأمور سيئة فحسب" شيئاً فشيئاً إلى نقطة النهاية المقبولة للتحقيق نفسه. ويرى الكاتب أن ذلك خسارة، لأن العمل المعجَّل بالذكاء الاصطناعي يمكنه أيضاً المساعدة في إصلاح هذه المشكلات: فمسارات ضمان الجودة الآلية لا تُكتب بسبب نقص وقت المهندسين، والتقييم نفسه الذي قد يستبدل Jev أو يبرر استخدامه "لا يبعد سوى بضعة أوامر نصية". وينتهي المقال باستعارته: نحن نبني أنظمة لا يبدو فيها المستخدم ولا الباني مهتماً بفحص ما إذا كانت هناك جثة خلف الباب.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.