OpenAI’ya korsan kitapla eğitim suçlaması

Authors Guild, OpenAI’ın LibGen’den kitap indirdiğini ve Books1/Books2 adlarıyla gizlediğini iddia ederek kısmi hüküm talep etti. Microsoft da hedefte.

OpenAI’ya korsan kitapla eğitim suçlaması

Yapay zekâ modellerinin hangi verilerle eitildiği tartışması, Authors Guild’in OpenAI ve Microsoft’a karşı yürttüğ davada yeni bir aamaya geçti. Lonca, mahkemeye sunduu son başvuruda OpenAI’n baz yazarların eserlerini izinsiz kullandğını ve bu içeriklerin torrent üzerinden, korsan kaynaklardan alındığnın şirket iinde bilindiğini öne sürdü.

Dava nereden geliyor?

Authors Guild davayı ilk olarak 2023’te açmıştı. Şimdi New York’taki Yargıç Sidney Stein’dan, esas duruşma başlamadan önce kısmi hüküm niteliğinde bir karar isteniyor. Davacılara gre eserlerin eğitim amacıyla kullanılması izin alınmadan gerçekleşti; bu nedenle “adil kullanım” (fair use) kalkanı altına girmemeli.

Yapay zekâ eğitiminde telifli metinlerin kullanımına dair mahkemelerde farklı yorumlar var. Bu dosyadaki asıl ayrım ise iddialara göre verilerin “meşru” kanallardan değil, korsan bir arşivden çekilmiş olması. Lonca, yalnızca eğitimin deil, verilerin elde edilme biçiminin de ayrı bir ihlal oluşturduğunu savunuyor.

LibGen iddiası ve Books1 / Books2 isimleri

Başvurudaki en dikkat çekici noktalardan biri, OpenAI’ın kitapları Library Genesis (LibGen) adlı korsan içerik platformundan bilinçli indirdiği yönünde. Davacılar, şirketin ardndan kaynağın izini yumuşatmaya çalıştığını ileri sürüyor: “Libgen1” ve “Libgen2” koleksiyonlarının, GPT-3’ü tanıtan belgelerde daha nötr görünen “Books1” ve “Books2” adlarıyla anldığ iddia ediliyor.

Authors Guild ayrıca bu veri kümelerinin hukuki kaygılar nedeniyle 2022’de silindiğini öne sürdü. Başvuruya göre OpenAI çalışanları, daha önce de söz konusu kaynakların hukuki risk taşıyabileceğinin farkındaydı.

George R.R. Martin paylaşımı dosyada

Dosyada OpenAI çalşanı Tarun Gogineni’nin geçmiş sosyal medya paylaşımlarına da yer verildi. Lonca, bunları irketin yalnzca eserleri eğitim verisi olarak kullanmadığı, aynı zamanda yazarların yerine yapay zekâ üretimini koyma hedefi taşıdığı iddiasına dayanak gsteriyor. Gogineni, araştırma hedeflerinden birinin George R.R. Martin’in A Song of Ice and Fire serisinin henüz yazılmamış iki kitabını tamamlamak olduğunu söylemiş; Martin seriyi bitiremezse GPT-5’in kalan kitapları yazabilecek kapasitede olduğunu öne sürmüştü.

Microsoft neden hedefte?

Authors Guild, Microsoft’un da dolayl sorumluluk taşıması gerektiğini savunuyor. Gerekçe olarak eğitimin üzerindeki denetim imkânı ve OpenAI teknolojilerinden ticari kazanç elde edilmesi gösteriliyor.

OpenAI iddialara dorudan yanıt vermiş değil. Şirketin karşı başvurusunda eğitim yöntemlerinin adil kullanım kapsamında olduu savunuluyor; yapay zekâ çıktılarının yazar eserlerini birebir kopyalamasının nadiren gerçekleştiği belirtiliyor.

Sektör için ne anlama geliyor?

Bu dava, “model eğitimi fair use midir?” sorusunun ötesine geçiyor. Mahkeme korsan kaynaktan indirme iddiasını ciddiye alırsa, yalnızca çıktı benzerliği değil veri tedarik zinciri de yarg konusuna dönüşebilir. Yayıncılar ve yazar örgütleri için bu, eğitim veri setlerinin kökenini şeffaflaştırma baskısını artırır; model üreticileri için ise lisansl veri ve temizleme süreçlerinin maliyetini ykseltebilir.

Sonuç olarak Authors Guild’in hamlesi, yapay zekâ şirketlerinin “nasıl öğrendikleri” kadar “nereden öğrendikleri”ni de mahkeme salonuna taşıyor. Karar çıkana kadar iddialar ispatlanmış değil; fakat tartışmanın odağı net: korsan arşivlerden beslenen eğitim, adil kullanım savunmasını zorlaştırabilir.

Yazar

Burak

SanalData teknoloji haberleri yazarı.

Yorum yaz