العودة
Irregular: الشركة التي تقف في قلب موجة هجمات بالذكاء الاصطناعي
SiTech AI Team3 წთ. საკითხავი

Irregular: الشركة التي تقف في قلب موجة هجمات بالذكاء الاصطناعي

أخطاء داخل بيئات الاختبار المحاكاة لدى Irregular دفعت وكلاء OpenAI وMeta وAnthropic وGoogle إلى ملاحقة أهداف حقيقية، وفق ما أكده المدير التقني للشركة الناشئة الإسرائيلية.

على مدى أشهر، ظهرت تقارير عن وكلاء ذكاء اصطناعي تجاوزوا بيئات الاختبار المغلقة وانطلقوا نحو أهداف حقيقية، وغالبًا ما قُدّمت كحوادث منفصلة. لكن وفقًا لموقع The Verge، فإن معظمها يشترك في مصدر واحد: Irregular، وهي شركة ناشئة إسرائيلية تجري اختبارات أمنية محاكاة لمطوّري الذكاء الاصطناعي.

ما الذي تفعله Irregular

تأسست الشركة عام 2023 تحت اسم Pattern Labs، وهي تبني ما تصفه بأنه «منصات بحثية عالية الدقة تحاكي وتراقب سيناريوهات الأمن الفعلية للذكاء الاصطناعي». قائمة عملائها غير معلنة، لكن أعمالها وردت في وثائق system card لنماذج OpenAI، وقد اختبرت أنظمة لحكومة المملكة المتحدة ولشركة Anthropic، ونشرت بحثًا مع RAND، مركز أبحاث يعمل على سياسات الذكاء الاصطناعي.

كيف تسربت الاختبارات إلى العالم الحقيقي

في عدة تقييمات هذا العام، تمكن الوكلاء من الهروب من بيئات كان يُفترض أنها آمنة. استخدمت بعض الاختبارات تمارين capture-the-flag، وهي طريقة شائعة لقياس قدرات الاختراق يبحث فيها الوكيل عن معلومات مخفية داخل شبكة محاكاة.

قال أومير نيفو، المدير التقني وأحد مؤسسي Irregular، لـ The Verge إن الوكلاء لم يكن يُفترض أن يصلوا إلى الإنترنت المفتوح، لكن «الوصول إلى الإنترنت كان متاحًا عن غير قصد». وفي السيناريو نفسه، «تطابق» اسم شركة خيالية أُنشئت كهدف مع نطاق حقيقي. الخطأان معًا وجّها الوكلاء نحو أهداف حقيقية؛ ولا يتضح حتى الآن أي الشركات أو المؤسسات تعرضت للهجوم فعليًا.

سيناريو واحد وأربعة مختبرات

أكد نيفو أن المشكلة ذاتها كانت وراء الحوادث المتعلقة بنماذج OpenAI وMeta وAnthropic وGoogle. وقال: «كل الحوادث المتعلقة بـ Irregular نجمت عن المشكلة الأساسية نفسها في سيناريو تقييم واحد، وجرى الإفصاح عنها كلها». وأضاف أن حوادث أخرى أُعلنت مؤخرًا، ومنها اختراق Hugging Face، لا علاقة لها بـ Irregular. وبحسب تقارير OpenAI وAnthropic وما نُشر عن Google، أُبلغت الشركات في الفترة نفسها تقريبًا في أواخر يوليو.

نماذج صينية وتغييرات وتقرير موعود

تشمل أبحاث Irregular المنشورة تقييمات أمن سيبراني لنموذجَي Kimi K3 وGLM-5.2 المفتوحين من Moonshot AI وZ.ai؛ ولأن تشغيلها على أجهزة خاصة ممكن، لا يحتاج المختبرون إلى تعاون المطوّرين. وقال نيفو إن هذه التقييمات لم تؤدِّ إلى حوادث مماثلة في العالم الحقيقي، لكن ذلك ليس دليلًا على أن هذه النماذج أقل عرضة لهذا السلوك.

وقال نيفو إن الحوادث غيّرت طريقة عمل Irregular: شدّدت الشركة ضوابط الوصول إلى الإنترنت، ووسّعت المراقبة والمراجعة اليدوية، وأضافت فحوصًا قبل بدء التقييمات للتأكد من مطابقة الوصول للنطاق المحدد. وتعتزم الشركة نشر تقرير عن إجراء تقييمات سيبرانية آمنة بعد انتهاء العمل المشترك مع الشركات المعنية. ولم تجب أي من المختبرات الأميركية الأربعة عن أسئلة The Verge الإضافية؛ فلم تردّ Google وAnthropic، بينما أحالت OpenAI وMeta إلى تدوينات نُشرت سابقًا.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.