Microsoft'tan Çarpıcı İtiraf: 'Yapay Zeka Eğitimi Hırsızlık'
New York Times'ın üç yıl önce OpenAI ve Microsoft'a karşı açtığı telif hakkı davasında, yeni sansürsüz belgeler ortaya çıktı. Bu belgeler, Microsoft'un üst düzey bir yöneticisinin şirketin yapay zeka eğitim uygulamalarını özel olarak 'hırsızlık' olarak tanımladığını gösteriyor. Ayrıca OpenAI yönetiminin, yapay zeka modellerinin kendilerini eğiten yayıncılar ve gazeteciler için 'varoluşsal bir tehdit' oluşturduğunu kabul ettiği belirtiliyor.
Mahkeme dosyasına göre, şirketler söz konusu içerikleri ödeme duvarlarını fark edilmeden aşarak elde etmiş, kitlesel veri kazıma yoluyla eğitim veri setleri oluşturmuş ve eğitim verilerinden telif hakkı bildirimlerini kasten çıkarmış. Ancak bu yeni bilgilerin çoğunun New York Times'ın kendi özetinden geldiğini, temel kanıtların hala mühürlü olduğunu belirtmekte fayda var.
Yapay Zeka ve Telif Hakkı: Adil Kullanım Tartışması
Yapay zeka şirketlerinin telif hakkıyla korunan materyalleri eğitim için kullanıp kullanamayacağı sorusu net bir yanıta sahip değil. Ancak hakimler şimdiye kadar yapay zeka şirketlerinin eğitimin 'adil kullanım' oluşturduğu yönündeki argümanlarına büyük ölçüde olumlu bakmış durumda. Bu yasal kural, parodi, haber raporlama veya eleştiri gibi belirli durumlarda telif hakkıyla korunan eserlerin izinsiz kullanılmasına olanak tanıyor. Bu ayın başlarında Trump yönetimi, OpenAI'nin LLM'lerini eğitmek için telif hakkıyla korunan materyalleri lisanssız kullanmasını savunan bir dilekçe sunmuştu.
Ancak yeni ortaya çıkan itiraflardan bazıları, özellikle adil kullanım kuralının orijinal eserin pazarına zarar vermeme şartı göz önüne alındığında, OpenAI'nin savunmasına ters düşüyor. Örneğin, Microsoft'un kendi verileri, Copilot 'cevap motorunun' New York Times alan adına tıklama oranlarını geleneksel Bing aramasına kıyasla %93'e varan oranda düşürdüğünü gösteriyor. Microsoft Uygulamalı Bilim Direktörü Brent Hecht'in Ocak 2024'te yazdığı bir iç sunum, bu düşüşü 'kıyamet döngüsü' olarak tanımlıyor ve bunun 'aynı anda hem modellerimizin performansına hem de tüm internete zarar vereceğini' belirtiyor.
Yöneticilerden Dikkat Çeken İfadeler
Microsoft CEO'su Satya Nadella, bu yılki bir ifadesinde, 'ödeme duvarı arkasındaki herhangi bir şeyin, onu kullanmak isteyen herkes tarafından lisanslanması gerektiğini' söylemiş ve OpenAI'nin ödeme duvarı arkasındaki bilgileri kazıyıp eğittiğinden haberdar olsaydı, 'OpenAI'nin modellerini yeniden eğitmesini talep etme hakkını kullanacağını' açıkça belirtmişti.
Diğer itiraflar da adil kullanım testinin farklı sütunlarına darbe vuruyor: OpenAI'nin ChatGPT Başkanı Nick Turley, iç iletişimde yayıncıların sohbet robotu gibi ürünlerden 'varoluşsal bir tehdit' ile karşı karşıya olduğunu, bu ürünlerin 'büyük ölçüde ikame edici' olduğunu ve 'daha iyi hale geldikçe daha da ikame edici olacaklarını' yazmış. OpenAI Başkanı Greg Brockman ise modelleri 'haber konusunda mükemmel' olarak tanımlamış. Nadella da bu yıl yeminli ifadesinde, sohbet robotlarıyla konuşmanın 'bilgiyi web sitesinde AI platformunda hemen sunarak, alttaki kaynağa gitme ihtiyacını ortadan kaldırdığını' kabul etmişti.
Microsoft'un kendi yaptigi ise ne olacak peki? Bing'i besleyen verileri nerden topladiklarini sormak lazim. Bunlar birbirine girmeden once dusunmeliydi.
Microsoft'un kendi de aynı verileri kullanıyor, şimdi mi akıllarına geldi bu. OpenAI'ye ortak olduklarına göre ikiyüzlülük kokuyor bu açıklama.
adamlar kendi ürünlerini besleyen veriyi toplayınca hırsızlık olmuyor ama işlerine gelince hırsızlık diyorlar. iki yüzlülüğün bu kadarı pes