Ana içeriğe geç
Yapay Zeka

Yapay zeka şirketleri eski kitapları satın alıp taradıktan sonra imha ediyor

Öne çıkanlar

  • Şirketler, hızlı tarama yapabilmek için satın aldıkları basılı kitapların sırtlarını keserek sayfaları parçaladı.
  • Amazon ve Anthropic'in de dahil olduğu yapay zeka geliştiricileri veri toplamak için bu yöntemi kullandı.
  • Uygulama, yapay zekanın kendi ürettiği verilerle eğitilmesi sonucu kalitesinin düşmesini engellemeyi amaçlıyor.

Yapay zeka şirketleri, büyük dil modellerini eğitmek amacıyla eski ve nadir basılı kitapları toplu olarak satın alıp taradıktan sonra imha etmeye başladı. İnternetteki yapay zeka üretimi içeriğin artmasıyla ortaya çıkan veri kirliliği, şirketleri insan eliyle yazılmış eski basılı kaynaklara yöneltti.

404 Media muhabiri Emanuel Maiberg tarafından yapılan araştırma, aralarında Amazon ve Anthropic'in de bulunduğu şirketlerin uyguladığı yöntemi ortaya çıkardı. Sahaflardan toplanan ve dijital kopyası bulunmayan niş kitaplar, Las Vegas'taki özel tarama tesislerine gönderildi. Bu tesislerde yüksek hızlı tarama yapabilmek için kitapların sırtları kesildi, sayfalar tek tek tarandıktan sonra atığa dönüştürüldü.

Uzmanlar, modellerin kendi ürettikleri verilerle eğitilmesi sonucu oluşan model çöküşü (model collapse) riskini engellemek için bu yönteme başvurulduğunu belirtti. Şirketler, internetteki mevcut tüm veriyi tükettikleri için telif veya içerik açısından henüz yapay zeka ile kirlenmemiş eski fiziksel kitapları veri kaynağı olarak kullanıyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.