GPT-5.6 Sol — نموذج OpenAI الذي درب نموذج Luna الأصغر بشكل ذاتي
نموذج GPT-5.6 Sol من OpenAI قام بشكل مستقل بتدريب نموذج Luna الأصغر — وهي مهمة كانت تتطلب سابقًا فريقًا من كبار الباحثين.
أعلنت OpenAI أن نموذجها الرئيسي الجديد GPT-5.6 Sol قام بشكل مستقل بإجراء التدريب اللاحق للنموذج الأصغر Luna. بعد التدريب المسبق الأولي لـ Luna، قام Sol بتحسينه للمهارات والسلوكيات المحددة بمفرده.
ما هو GPT-5.6 Sol بالضبط؟
اسم "Sol" — اختصار لـ "Systems Optimization Learner" — يرمز إلى التحول من نموذج يستجيب ببساطة إلى نموذج يمكنه توجيه عملية تحسينه. Sol ليس مجرد نموذج أذكى — إنه نموذج يمكنه تحسين النماذج الأخرى.
كيف عمل التدريب اللاحق المستقل؟
الأمر الأكثر إثارة للدهشة هو "توجيه غير محدد إلى حد ما" استخدمه الباحث. تضمنت التعليمات:
- العثور على تكوينات التدريب الصحيحة
- اختيار وحدات معالجة الرسوميات المناسبة
- تشغيل برنامج التدريب النصي
- التحقق من أن كل شيء يعمل بشكل صحيح
آلية التقييم الداخلي
بنيت OpenAI مجموعة تقييم داخلية بناءً على مهام بحثية حقيقية في الذكاء الاصطناعي. تشمل هذه المهام تصحيح أخطاء أنظمة البحث، تحسين النوى (kernels) ووصفات التدريب، تشغيل تجارب التعلم الآلي، وتحسين نموذج آخر.