العودة
وثائق رُفع عنها الحجب: باحث في مايكروسوفت يصف جمع الأخبار بأنه «أكبر سرقة للعمل في تاريخ البشرية»
SiTech AI Team3 წთ. საკითხავი

وثائق رُفع عنها الحجب: باحث في مايكروسوفت يصف جمع الأخبار بأنه «أكبر سرقة للعمل في تاريخ البشرية»

وثائق رُفع عنها الحجب في دعوى The New York Times ضد OpenAI وMicrosoft تكشف أن باحثًا في مايكروسوفت وصف تدريب الذكاء الاصطناعي بـ«السرقة»، وأن Copilot خفّض النقرات إلى The Times بنسبة تصل إلى 93%.

تكشف أوراق قضائية رُفع عنها الحجب في دعوى حقوق النشر التي أقامتها The New York Times ضد OpenAI وMicrosoft أن باحثًا بارزًا في Microsoft وصف في مذكرة داخلية ممارسات تدريب الذكاء الاصطناعي لدى الشركتين بأنها «سرقة»، بينما رأت قيادة OpenAI نفسها في روبوتات الدردشة تهديدًا وجوديًا للناشرين الذين دُرِّبت نماذجها على أعمالهم.

ماذا تقول الوثائق

تستشهد الوثائق بمذكرة داخلية من يناير 2023 كتبها Brent Hecht، مدير العلوم التطبيقية في Microsoft، وصف فيها جمع المحتوى الإخباري بأنه «سرقة مذهلة بأبعاد غير مسبوقة» و«أكبر سرقة للعمل في تاريخ البشرية». ويصف عرض قدّمه Hecht في يناير 2024 «حلقة هلاك» (doom loop) داخلية: فبحسب بيانات Microsoft نفسها، خفّض محرك الإجابات Copilot معدلات النقر إلى نطاق The Times بما يصل إلى 93% مقارنة ببحث Bing التقليدي، وهي نسبة يقول المستند إنها «تضر بأداء نماذجنا وبالويب بأكمله في الوقت نفسه».

ويحذّر مستند آخر من Microsoft من «خطر حقيقي» بأن الذكاء الاصطناعي التوليدي قد «يعطّل بشكل كبير توظيف الأشخاص أنفسهم الذين أنتجوا البيانات التي دُرِّب عليها النموذج الأساسي». وكتب Nick Turley، رئيس ChatGPT في OpenAI، في مراسلات داخلية أن الناشرين يواجهون «تهديدًا وجوديًا» من منتجات «تحل محل الأصل إلى حد كبير» و«ستحل محله أكثر فأكثر كلما تحسّنت». ووصف رئيس OpenAI، Greg Brockman، النماذج بأنها «ممتازة في الأخبار».

حجم النسخ والجدران المدفوعة

بحسب الوثائق، تحتوي مجموعات بيانات التدريب المتوسط (mid-training) في OpenAI وحدها على أكثر من 91,692 نسخة من أعمال نشرتها The Times وDaily News وCenter for Investigative Reporting، فيما ضمّت مجموعة مبنية على Common Crawl أكثر من مليوني مستند من nytimes.com وحده. أما البيانات التي جُمعت في إطار «Project Mango» فقد احتوت على ما لا يقل عن 160,903 عمل فريد للناشرين.

كما تصف الدعوى خططًا لتجاوز الجدران المدفوعة دون كشف. فعندما أخبر باحث OpenAI، Nick Ryder، بروكمان بوجود «اختراق لتجاوز جدار الاشتراك في nytimes»، رد Brockman: «ah nice». وقال المدير التنفيذي لـMicrosoft، Satya Nadella، في إفادة هذا العام إن «كل ما هو خلف جدار مدفوع يجب أن يحصل على ترخيص من أي شخص يريد استخدامه… للتأسيس أو للتدريب»، وأضاف أنه كان سيطلب من OpenAI إعادة تدريب نماذجها لو علم ببيانات من خلف الجدران المدفوعة.

لماذا يهم ذلك

تضعف هذه الاعترافات أركان دفاع OpenAI عن «الاستخدام العادل» (fair use)، الذي يشترط ألا يحل الاستخدام محل العمل الأصلي ولا يلحق الضرر بسوقه. وقد مالت المحاكم حتى الآن إلى شركات الذكاء الاصطناعي. لكن الحذر مطلوب: فمعظم المادة الجديدة تأتي من مذكرة The Times نفسها لا من الأدلة الأصلية التي ما زالت مختومة، والاقتباسات معروضة دون سياقها الأصلي. ولم تستجب OpenAI وMicrosoft لطلبات التعليق.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.