
გასაჯაროებული ფაილები: Microsoft-ის მკვლევარი AI-ის წვრთნას „შრომის ყველაზე დიდ ქურდობას“ უწოდებს
გასაჯაროებული სასამართლო დოკუმენტების მიხედვით, Microsoft-ის მკვლევარმა AI-ის წვრთნას „ქურდობა“ უწოდა, OpenAI-ის ხელმძღვანელობა კი ჩატბოტებს გამომცემლებისთვის არსებობის საფრთხედ მიიჩნევდა. Copilot-მა The Times-ზე გადასვლები 93%-მდე შეამცირა.
სექტემბერში გასაჯაროებული სასამართლო დოკუმენტების მიხედვით, Microsoft-ის მაღალი რანგის მკვლევარმა AI-ის მონაცემებით წვრთნას შიდა მემორანდუმში „ქურდობა“ უწოდა, OpenAI-ის ხელმძღვანელობა კი ჩატბოტებს გამომცემლებისთვის არსებობის საფრთხედ მიიჩნევდა. საუბარია სამი წლის წინ დაწყებულ სარჩელზე.
რას ამბობენ გასაჯაროებული დოკუმენტები
ფაილებში მოყვანილია Microsoft-ის გამოყენებითი მეცნიერების დირექტორის, Brent Hecht-ის 2023 წლის იანვრის შიდა მემორანდუმი, სადაც ის საინფორმაციო მასალის სქრაპინგს „წარმოუდგენელი მასშტაბის საოცარ ქურდობას“ და „ადამიანის ისტორიაში შრომის ყველაზე დიდ ქურდობას“ უწოდებს. მისივე 2024 წლის იანვრის პრეზენტაციაში აღწერილია შიდა „doom loop“ (დამღუპველი მარყუჟი): Microsoft-ის საკუთარი მონაცემებით, Copilot-ის საპასუხო ძრავმა The New York Times-ის დომენზე გადასვლები ჩვეულებრივ Bing-ის ძიებასთან შედარებით 93%-მდე შეამცირა. დოკუმენტის თანახმად, ეს „ჩვენი მოდელების და მთელი ვების მუშაობას ერთდროულად აზიანებს“.
Microsoft-ის სხვა დოკუმენტი აფრთხილებს „რეალური რისკის“ შესახებ, რომ გენერაციულმა AI-მ შესაძლოა „მნიშვნელოვნად დააზიანოს იმ ადამიანების დასაქმება, რომლებმაც შექმნეს მონაცემები, რომლებზეც საბაზისო მოდელი გაწვრთნა“. OpenAI-ის ChatGPT-ის ხელმძღვანელმა Nick Turley-მ შიდა მიმოწერაში დაწერა, რომ გამომცემლებისთვის ასეთი პროდუქტები „არსებობისთვის საფრთხეა“, ისინი „ძირითადად ორიგინალს ანაცვლებენ“ და „რაც უფრო უკეთესები გახდებიან, მით უფრო მეტად ჩაანაცვლებენ“. OpenAI-ის პრეზიდენტმა Greg Brockman-მა მოდელებს „შესანიშნავი ახალი ამბებისთვის“ უწოდა.
კოპირების მასშტაბი და paywall-ები
დოკუმენტების თანახმად, მხოლოდ OpenAI-ის mid-training მონაცემთა ნაკრებები შეიცავს The New York Times-ის, Daily News-ისა და Center for Investigative Reporting-ის მასალების 91 692-ზე მეტ ეგზემპლარს; Common Crawl-ზე დაფუძნებულ ნაკრებში კი მხოლოდ nytimes.com-იდან 2 მილიონზე მეტი დოკუმენტი მოხვდა. „Project Mango“-ს ფარგლებში აწყობილ მონაცემებში გამომცემლების მინიმუმ 160 903 უნიკალური ნაწარმოებია.
სასამართლო მასალა ასევე აღწერს ფასიანი კედლების ფარულად ავლის გეგმებს. როცა OpenAI-ის მკვლევარმა Nick Ryder-მა Brockman-ს აცნობა „nytimes-ის paywall-ის გვერდის ავლის ხრიკის“ შესახებ, პასუხი იყო: „ah nice“. Microsoft-ის CEO Satya Nadella-მ წელს მოწმის ჩვენებაზე თქვა, რომ „ყველაფერი, რაც paywall-ის მიღმაა, უნდა დაალიცენზიროს ყველამ, ვისაც მისი გამოყენება… საფუძვლად ან წვრთნისთვის სურს“, და აღნიშნა, რომ OpenAI-ს მოდელების ხელახლა გაწვრთნას მოსთხოვდა, ამის შესახებ რომ სცოდნოდა.
რატომ არის ეს მნიშვნელოვანი
ეს ციტატები OpenAI-ის „სამართლიანი გამოყენების“ (fair use) დაცვას ასუსტებს: კანონი მოითხოვს, რომ გამოყენება ორიგინალს არ ჩაანაცვლებდეს და მის ბაზარს არ აზიანებდეს. სასამართლოები აქამდე ძირითადად AI-კომპანიების მხარეს იყვნენ. თუმცა სიფრთხილე საჭიროა: მასალის დიდი ნაწილი The New York Times-ის საკუთარი არგუმენტებიდან მოდის, არა დახურული მტკიცებულებებიდან. OpenAI-მ და Microsoft-მა TechCrunch-ის კომენტარის თხოვნას არ უპასუხეს.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.