العودة
كيف تعمل العلامة المائية لنصوص الذكاء الاصطناعي على مستوى الرموز
SiTech AI Team3 წთ. საკითხავი

كيف تعمل العلامة المائية لنصوص الذكاء الاصطناعي على مستوى الرموز

بدأت أنثروبيك وسم مخرجات كلود النصية وفق قانون الذكاء الاصطناعي الأوروبي. العلامة تسكن اختيار الرموز لا البيانات الوصفية، وهكذا يعمل الكشف وكيف تضمر الإشارة عند إعادة الصياغة.

في 11 أغسطس 2026 أكدت أنثروبيك أن كلود سيبدأ بتضمين علامات مائية قابلة للقراءة آلياً في النص الذي يولّده. والمادة 50 من قانون الذكاء الاصطناعي الأوروبي، التي تُلزم المزوّدين بجعل النص أو الصورة أو الصوت أو الفيديو الاصطناعي قابلاً للكشف الآلي، دخلت حيز التنفيذ قبل تسعة أيام، في 2 أغسطس.

العلامة المائية في النص ليست شعاراً ولا وسمة في البيانات الوصفية. إنها تعمل على مستوى الرموز، داخل النموذج نفسه، لحظة اختيار الكلمات. لا يُضاف شيء إلى النص ولا تُخفى أحرف، لذا تبقى العلامة غير مرئية للقارئ وغير قابلة للكشف دون مفتاح تعمية مطابق.

لماذا الآن

تنطبق المادة 50(2) على المزوّدين الذين يخدمون السوق الأوروبية، وقد تصل العقوبات إلى 15 مليون يورو أو 3% من الإيرادات السنوية العالمية. في يوليو 2026 وقّعت نحو 190 مؤسسة — بينها أنثروبيك وغوغل وأوبن إيه آي وميتا ومايكروسوفت — مدونة السلوك الأوروبية لشفافية المحتوى المولّد بالذكاء الاصطناعي؛ وعلى النماذج التي كانت في السوق قبل 2 أغسطس الامتثال حتى 2 ديسمبر 2026.

التغطية غير متساوية. يعمل SynthID-Text داخل جيميني منذ 2024. وتبدأ أنثروبيك بوسم نماذج كلود الصادرة في 2 أغسطس 2026 أو بعده، أما أوبن إيه آي، التي تضع على الصور والصوت إشارات منشأ مثل بيانات C2PA، فأبطأ في النص؛ وميتا تضع علامات على الصور فقط.

ماذا يعني «على مستوى الرموز»

الرمز ليس دائماً كلمة كاملة؛ قد يكون جزءاً من كلمة أو علامة ترقيم أو حتى مسافة. في كل خطوة ينتج النموذج توزيعاً احتمالياً للرموز التالية ويسحب منه باستخدام مولّد أرقام عشوائية اعتباطي، ولهذا قد يعطي الطلب نفسه نتيجتين مختلفتين.

العلامة المائية تغيّر مصدر العشوائية: مفتاح تعمية سري، مع الرموز السابقة، يحدد أي مرشح سيُختار. تبدو النتيجة عشوائية للقارئ، لكن من يملك المفتاح نفسه يستطيع اختبار ما إذا كانت سلسلة الاختيارات متسقة إحصائياً مع ما كان المفتاح سينتجه. وعلامة كلود نسخة من SynthID-Text، التي نشرتها Google DeepMind في Nature في أكتوبر 2024؛ تُقيَّم الرموز المرشحة بدوال شبه عشوائية وتتنافس في جولات، ويكشف الفحص النتيجة بإعادة تشغيل التقييم.

هل يضرّ بالشيفرة والكتابة التقنية

أقل مما يُتوقع عادة. حجم الإشارة المتاح في رمز ما يتناسب مع عدد الخيارات الجيدة المتقاربة في تلك النقطة. وحين يوجد رمز تالٍ صحيح بوضوح — «2 + 2 =» ثم «4»، أو سطر شيفرة لا يحفظ صياغته إلا رمز واحد — لا شيء للتأثير فيه، فلا تُطبَّق الإشارة. وتقول أنثروبيك إن الشيفرة تحمل عادةً إشارة مائية أقل من النثر، ولم تجد تجربة غوغل على 20 مليون رد فرقاً ذا دلالة في رضا المستخدمين.

تبقى مقايضات: في المقاطع القصيرة والنصوص شديدة الوقائعية يضعف الكشف، وإعادة الكتابة أو الصياغة أو الترجمة الثقيلة قد تمحو الإشارة — التعديلات الخفيفة عادةً لا. وإذا كنت تستدعي واجهة كلود أو جيميني اليوم، فبعض مخرجاتك موسوم وبعضها لا بحسب النموذج وتاريخ إطلاقه، ولا توجد علامة مؤكدة على نصوص أوبن إيه آي. وإذا كانت خطوط معالجتك تعيد الصياغة، فتذكّر أن هذه الخطوة قد تُضعف العلامة، وهذا مهم عندما تتوقف التزاماتك التنظيمية على بقائها لاحقاً.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.