العودة →
SiTech Team⏱️ 1 წთ. საკითხავი

Claude Opus 5 يحل مشكلة prompt injection — أكبر ثغرة أمنية في وكلاء AI

Claude Opus 5 يحل مشكلة prompt injection — أكبر ثغرة أمنية في وكلاء AI

نموذج Opus 5 من Anthropic خفض نجاح هجمات prompt injection إلى 0% في وكلاء المتصفح — اختراق كبير في أمان AI.

Prompt Injection — كعب أخيل لوكلاء AI

كانت حقن التعليمات (prompt injection) أكبر تحدٍ أمني لوكلاء AI. طريقة الهجوم بسيطة: يخفي المهاجمون تعليمات ضارة في نص صفحة الويب التي يقرأها وكيل AI. اعترفت OpenAI في ديسمبر 2024 بأن prompt injection قد لا يُحل بالكامل أبدًا.

آلية الحماية المزدوجة لـ Opus 5

طبق باحثو Anthropic في Opus 5 وضع Auto Mode — نظام حماية ثنائي الطبقات. الطبقة الأولى تفحص البيانات الواردة بحثًا عن تعليمات مخفية قبل المعالجة. الطبقة الثانية تمنع الإجراءات الخطيرة قبل التنفيذ. يجب على المهاجم اختراق كلتا الطبقتين في وقت واحد.

نتائج الاختبار — نسبة نجاح صفرية

في 129 سيناريو اختبار، حقق Opus 5 نسبة نجاح 0% لهجمات prompt injection. في معيار Gray Swan IPI، كانت نسبة نجاح المهاجم على Opus 5 فقط 2.0%، وMythos 5 بنسبة 2.6%، وFable 5 بنسبة 2.8%. هذا إنجاز تاريخي في أمان AI.

📖 المصدر