New York Times'in OpenAI ve Microsoft'a acigi urun hakki davasinda yeni acilmamis belgeler, yapay zeka sirketlerinin egitim uygulamalarinin ozel olarak hirsizlik oldugunu kabul ettiklerini ve urunlerinin yayinlar icin varoluhsal bir tehdit olusturdugunu ortaya koyuyor.

Hirsizlik Itirafi

Klage belgelerine gore, ust duzey bir Microsoft yoneticisi, sirketlerin egitim uygulamalarini hirsizlik olarak tanimladi ve OpenAI yonetimi modellerinin calismalari yetistiren yayinlari ve gazeteciler icin varoluhsal bir tehdit olusturdugunu soyledi.

Itiraflar, uc yillik davadaki yeni acilmamis materyalden geliyor. Dava, New York Times'in sirketlerin icerigi uzerine uretimci yapay zeka modelleri egiterek telif hakkini ihlal ettigini one suruyordu. Yargiclar genel olarak yapay zeka sirketlerinin adil kullanim argumanlarina elverisli olsa da, bu yeni dahili belgeler bu savunmaya dogrudan karsi cikiyor.

Doom Loop

Microsoft'in kendi verileri, Copilot cevap motorunun New York Times'in tiklanma oranlarini geleneksel Bing aramasina kiyasla %93'e kadar dusurdugunu gosterdi. Dahili bir Microsoft sunumu, dususu, modellerimizin ve ayni zamanda tum web'in performansini zarara ugratacak bir doom loop olarak tanimladi.

Sunum sunu belirtiyor: Bir urunun kendi onemli tedarikcilerinin ekonomik temellerini tehdit etmesi son derece alisilmadik bir durumdur, ancak bu, LLM isimiz icin icerik tedarik zinciri konusunda yarattigimiz durumdur.

Microsoft CEO'su Satya Nadella, yagin altinda her seyin lisanslanmasi gerektigini ve OpenAI'in bezahli icerikleri kazidigini ogrenseydi, OpenAI'in modellerini yeniden egitmesini talep etme hakkini kullanacagini soyledi.

Yayinlar Icin Varoluhsal Tehdit

OpenAI'in baskiNick Turley, dahili iletisimde yayinlarin sohbet robotu gibi urunlerden varoluhsal bir tehdit gordugunu ve bunlarin buyuk olcude ikame edici oldugunu ve daha iyi hale geldikce daha da ikame edici olacagini yazdi.

OpenAI baskani Greg Brockman modelleri haberler konusunda mukemmel olarak tanimladi. Nadella, sohbet robotlariyla konusmanin bilgileri dogrudan yapay zeka platformunda saglamanin yerine gectigini yeminle onayladi.

Kopyalamanin Olcegi

Belgeler, OpenAI'in orta egitim veri setlerinin tek basina 91.692'den fazla NYT, Daily News ve Center for Investigative Reporting yayini icerdigi ilk kez ortaya koyuyor. Common Crawl tabanli bir veri seti yalnizca nytimes.com'dan 2 milyondan fazla belge iceriyordu.

Sirketlerin en az 160.903 benzersiz eser kopyasi iceren Project Mango egitim veri setini nasil olusturduklari Detayli olarak anlatiliyor. OpenAI, tum GPT-3 egitim veri setini Microsoft'a verdi.

Paywall Atlatma ve Telif Hakkini Silme

Belgeler, OpenAI arastirmacisi Nick Ryder'ın Brockman'a NYT bezahli duvarini atlatmak icin bir hack anlattiginda Brockman'in ah nice diye cevap verdigini gosteriyor.

OpenAI calisanlarinin orantısız olarak kazınmış haber iceriklerine dayanan WebText ve WebText2 gibi egitim veri setleri olusturduklari iddia ediliyor.

En damalayici olan, bulgularin, model kullanici cikti telif hakki notlari istemedikleri icin, egitim verilerinden telif hakki notlarini bilerek cikarmaya yonelik cabalari anlatmasidir.

Gercek Istihdam Riski

Bir Microsoft belgesinde, uretimci yapay zekanin, temel modelin egitildigi verileri uretenlerin istihdamini onemli olcude bozme riski oldugu belirtiliyor.

Yapay zeka sirketlerinin telif hakki korumali materyali yasal olarak kullanip kullanamayacagi sorusunun acik bir cevabi yok. Bu ayin basinda Trump yonetimi, OpenAI'in telif hakki korumali materyal kullanimini destekleyen bir bildiri verdi.

OpenAI ve Microsoft yorum isteklerine cevap vermedi.