Geri Dön
Açığa çıkan belgeler: Microsoft araştırmacısı haber kazımayı "tarihteki en büyük emek hırsızlığı" olarak niteledi
SiTech AI Team2 წთ. საკითხავი

Açığa çıkan belgeler: Microsoft araştırmacısı haber kazımayı "tarihteki en büyük emek hırsızlığı" olarak niteledi

The New York Times'ın OpenAI ve Microsoft'a açtığı davada açığa çıkan belgeler, bir Microsoft yöneticisinin yapay zeka eğitimini 'hırsızlık' olarak nitelediğini ve Copilot'un The Times'a tıklamaları %93'e kadar düşürdüğünü gösteriyor.

The New York Times'ın OpenAI ve Microsoft'a karşı açtığı telif davasında gizliliği kaldırılan yeni belgeler, Microsoft'ta üst düzey bir araştırmacının şirketlerin yapay zeka eğitim uygulamalarını iç yazışmada "hırsızlık" olarak nitelediğini, OpenAI yönetiminin ise sohbet botlarını modelleri eğiten yayıncılar için varoluşsal bir tehdit gördüğünü ortaya koyuyor.

Belgelerde ne var

Belgelerde Microsoft'un uygulamalı bilim direktörü Brent Hecht'in Ocak 2023 tarihli iç notuna yer veriliyor: Hecht haber kazımayı "eşi görülmemiş boyutta şaşırtıcı bir hırsızlık" ve "insanlık tarihinin en büyük emek hırsızlığı" olarak tanımlıyor. Hecht'in Ocak 2024'te yazdığı sunum ise şirket içi bir "doom loop"tan söz ediyor: Microsoft'un kendi verilerine göre Copilot yanıt motoru, The Times alan adına tıklama oranlarını geleneksel Bing aramasına kıyasla %93'e varan oranda düşürdü; belge bunun "hem modellerimizin performansına hem de tüm web'e aynı anda zarar verdiğini" söylüyor.

Başka bir Microsoft belgesi, üretken yapay zekanın "temel modelin eğitildiği verileri üreten insanların istihdamını ciddi biçimde bozabileceğine" dair "gerçek bir risk" uyarısı yapıyor. OpenAI'ın ChatGPT başkanı Nick Turley iç yazışmada yayıncıların "varoluşsal bir tehdit"le karşı karşıya olduğunu, bu ürünlerin "büyük ölçüde ikame edici" olduğunu ve "iyileştikçe daha da ikame edici hale geleceğini" yazıyor. OpenAI Başkanı Greg Brockman ise modeller için "haberlerde mükemmel" ifadesini kullanıyor.

Kopyalamanın ölçeği ve ödeme duvarları

Belgelere göre yalnızca OpenAI'ın ara eğitim veri setleri, The Times, Daily News ve Center for Investigative Reporting tarafından yayımlanan eserlerin 91.692'den fazla kopyasını içeriyor; Common Crawl kaynaklı bir veri setinde ise sadece nytimes.com'dan 2 milyondan fazla belge var. "Project Mango" kapsamında derlenen veriler, haber yayıncılarına ait en az 160.903 benzersiz eseri barındırıyor.

Dilekçede ayrıca ödeme duvarlarını fark edilmeden aşma planları anlatılıyor. OpenAI araştırmacısı Nick Ryder, Brockman'a "nytimes paywall'ını aşmak için bir hack" bulduğunu söylediğinde Brockman "ah nice" yanıtını veriyor. Microsoft CEO'su Satya Nadella ise bu yıl verdiği ifadede "ödeme duvarı arkasındaki her şey, onu zeminleme ya da eğitim için kullanmak isteyen herkes tarafından lisanslanmalı" dedi ve ödeme duvarı arkasındaki verilerden haberdar olsaydı OpenAI'dan modellerini yeniden eğitmesini isteyeceğini belirtti.

Neden önemli

Bu açıklamalar, OpenAI'ın "adil kullanım" (fair use) savunmasının dayanaklarını zayıflatıyor: doktrin, kullanımın orijinal eserin yerine geçmemesini ve pazarına zarar vermemesini şart koşuyor. Mahkemeler şimdiye kadar yapay zeka şirketlerine daha yakın durdu. Yine de temkinli olmak gerekiyor: yeni materyalin büyük bölümü hâlâ mühürlü olan asıl delillerden değil, The Times'ın kendi dilekçesinden geliyor. OpenAI ve Microsoft yorum taleplerine yanıt vermedi.

SSiTech

SiTech — AI destekli web geliştirme

Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.