Yapay Zekâ Şirketleri Eski Basılı Kitapların Peşinde
Üretken yapay zekâ teknolojilerinin hızla gelişmesiyle birlikte, yapay zekâ şirketlerinin eğitim verisi arayışı da farklı bir boyuta taşındı. Yapay zekâ tarafından üretilmiş metinlerden uzak, tamamen insan emeğiyle kaleme alınmış içeriklere ihtiyaç duyan teknoloji firmaları, rotalarını eski basılı kitaplara çevirdi.
Bu alandaki dikkat çekici girişimlerden biri olan ISBNdb, kütüphaneler, sahaflar, kitapçılar ve ikinci el kitap satıcıları aracılığıyla yapay zekâ şirketlerine büyük ölçekli fiziksel kitap tedariki sağlıyor. Şirket, 1.000 kitaptan başlayıp 1 milyon kitaba kadar ulaşabilen toplu alımları koordine edebildiğini belirtiyor.
“En Değerli Yapay Zekâ Verisi Kitap Raflarında”
Dünyanın en büyük kitap veritabanlarından birine sahip olduğunu ifade eden ISBNdb, internetten toplanan veriler yerine basılı kitapların çok daha güvenilir bir bilgi kaynağı sunduğunu savunuyor. Şirketin internet sitesinde yer alan açıklamada, “Dünyanın en iyi yapay zekâ eğitim verileri bir kitap rafında duruyor. Kitaplar, hiçbir internet taramasının kopyalayamayacağı ölçüde yapılandırılmış, editörlük sürecinden geçmiş, uzmanlar tarafından doğrulanmış ve alanında yetkin insan bilgisini içeriyor.” ifadelerine yer veriliyor.
2022 Öncesi Kitaplar Tercih Ediliyor
ISBNdb’nin özellikle 2022 yılından önce yayımlanan kitaplara odaklanmasının önemli bir nedeni bulunuyor. Üretken yapay zekâ araçlarının yaygınlaşmasından önce basılan eserlerin, yapay zekâ tarafından üretilmiş içeriklerle “kirlenmemiş” olduğu kabul ediliyor.
Uzmanlar, yapay zekâ sistemlerinin yine yapay zekâ tarafından oluşturulmuş metinlerle eğitilmesinin zaman içinde modellerin performansını düşürebileceğini ve “model çökmesi” (model collapse) olarak adlandırılan bir soruna yol açabileceğini belirtiyor. ISBNdb ise bu riski azaltmanın en güvenilir yollarından birinin, yapay zekâ öncesi döneme ait basılı eserlerden oluşan veri setleri olduğunu vurguluyor.
Şirket, yaptığı açıklamada, “2022 öncesinde yayımlanan fiziksel kitaplar, modern yapay zekâ kaynaklı veri kirlenmesinden yapısal olarak arındırılmış durumdadır.” değerlendirmesinde bulunuyor.
Büyük Veri Setleri ve Gizlilik Ön Planda
ISBNdb, geniş kitap kataloğunu kaynak bulma hizmetleriyle birleştirerek yapay zekâ şirketlerinin aynı eserleri tekrar satın almasının önüne geçmeyi ve daha çeşitli veri kümeleri oluşturmasını hedefliyor.
Şirket ayrıca gizliliğe de büyük önem verdiğini belirtiyor. Yapılan açıklamaya göre tüm satın alma süreçleri gizlilik sözleşmeleriyle korunuyor; alıcı şirketlerin kimlikleri, satın alma stratejileri ve veri toplama hedefleri üçüncü kişilerle paylaşılmıyor.
Yapay zekâ sektöründe veri kalitesinin giderek daha kritik hâle gelmesi, yıllardır raflarda bekleyen basılı kitapları yeniden stratejik bir kaynak konumuna getirirken, kütüphaneler ve ikinci el kitap piyasası da bu yeni talebin önemli aktörleri arasında yer almaya başladı.
