العودة
OpenAI تكشف وتوقف حملة تقطير منسقة
SiTech AI Team2 წთ. საკითხავი

OpenAI تكشف وتوقف حملة تقطير منسقة

أعلنت OpenAI أنها كشفت وأوقفت حملة منسقة كان هدفها استخلاص التفكير المحمي من نماذجها. وتنسب الشركة الجزء الأكبر من النشاط إلى أشخاص مرتبطين بـ Moonshot AI.

أعلنت OpenAI أنها كشفت وأوقفت حملة منسقة كان هدفها استخلاص التفكير المحمي من نماذجها. وقالت الشركة إن أول نشاط رُصد في الأسبوع الأول من يوليو. وتحمل هذه الإجراءات علامات تقطير النموذج، أي الاستخدام غير المصرح به لمخرجات نموذج أو تفكيره لتدريب نموذج آخر.

ما الذي لاحظته OpenAI

بحسب التحقيق، حاول المشغلون استخلاص التفكير المحمي بطرق جديدة. ومن بينها نسخ التفكير المشفر الموجود في محادثة واحدة، وطلب النموذج في محادثة أخرى بفك تشفير المحتوى المخفي وإعادة كتابته. وأبلغ باحثون مستقلون في الأمن الشركة، عبر الإفصاح المسؤول، بثغرات مشابهة تتعلق بالانتقال بين النماذج وضغط المحادثات. وتحققت OpenAI من استنتاجاتهم وأكدت أن مسارات الهجوم الموصوفة حقيقية.

بدأ النشاط في 1 يوليو وكان منخفضًا في البداية. وفي 24 و25 يوليو رُصدت ذرى عالية الحجم: 16 000 طلب استخدم النمط المقابل للاستخلاص من أكثر من 4 000 مستخدم. وكشف تحقيق لاحق نشاط أنماط أوامر مرتبطة ضمن مجموعة تضم أكثر من 15 000 مستخدم؛ وتمكنت من إيقافه بالكامل بحلول 28 يوليو.

إلى من تنسب OpenAI النشاط

بحسب تقييم الشركة، ليس واضحًا ما إذا كان جميع المشغلين قد جاءوا من فاعل واحد. وتنسب OpenAI الجزء الأكبر من النشاط إلى أشخاص مرتبطين بـ Moonshot AI، مطوّر Kimi.

لماذا هذا مهم

وفقًا لبيان OpenAI، لم يكسر المشغلون التشفير، ولم يخترقوا قاعدة البيانات، ولم يحصلوا على وصول مباشر إلى المحادثات المحفوظة. وبدلًا من ذلك، استخدموا التفاعل مع النموذج بحيث يصف التفكير المحمي بشكل مرئي للطالب. وتشير الشركة إلى أن هذا الخطر لا يخص OpenAI وحدها، وأن تقنية مماثلة قد تُستخدم مع أنظمة AI متقدمة أخرى. وقد يُستخدم التفكير المستخلص لتدريب نموذج آخر من دون القيود التي يمتلكها النموذج الأصلي. والأرقام تصف المحاولات فقط، وليس بالضرورة عمليات استخلاص ناجحة.

كيف استجابت الشركة

أوقفت OpenAI الحملة عبر مزيج من إنفاذ الحسابات والضوابط التقنية والتنسيق مع الشركاء: حظرت أو قيدت الحسابات الاحتيالية، وعززت ضوابط التسجيل والبنية التحتية، ووسعت المراقبة. كما أُغلق المسار الذي كان يتيح إعادة استخدام واستعادة التفكير المشفر لمستخدم آخر، وأُضيفت فحوصات توقف المخرجات المتدفقة التي تحمل خطر كشف التفكير. وتم نشر النتائج عبر Frontier Model Forum وقنوات تبادل المعلومات الحكومية. وفي المستقبل ستعزز الشركة ثلاثة اتجاهات: الحماية التقنية، واكتشاف الحملات المنسقة، وتبادل المعلومات بين القطاع والسلطات.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.