Gönüllü arşivciler 1.800 nadir kitabı yapay zeka ile dijitalleştirdi
Öne çıkanlar
- Ekip, giriş seviyesi iki fotoğraf makinesiyle 902 bin deklanşör tetikleyerek 526 bin çift sayfalık çekim yaptı.
- Photoshop düzenlemeleri etiket verisine dönüştürülerek sayfa hizalama ve temizleme için özel bir sinir ağı eğitildi.
- Dijitalleştirilen 1.800 nadir Urduca eser ZFS havuzunda arşivlenerek Internet Archive'a yüklendi.
Pakistanlı üç arkadaş, Urduca dilinde basılmış ve birçoğu taş baskı olan 1.800 nadir eseri korumak amacıyla kurdukları Ibteda Digital Library projesini tamamladı. Bütçesiz yürütülen on yıllık çalışmada ekip, Nikon D5300 ve D3300 model giriş seviyesi kameralarla toplam 902 bin deklanşör basımı gerçekleştirerek 526 bin çift sayfalık fotoğraf çekti.
Fiziksel çekimlerin ardından ortaya çıkan devasa görsel arşivinin işlenmesi için özel bir makine öğrenmesi iş akışı geliştirildi. Nastaliq yazı tipindeki karmaşık harf yapıları, sayfa kenarı notları ve sayfa eğrilikleri nedeniyle standart bilgisayarlı görü yöntemleri yetersiz kalınca, Photoshop'ta yapılan manuel düzenlemeler etiket verisi olarak kullanılarak özel bir sinir ağı eğitildi.
Her yeni kitap için sadece on kalibrasyon kırpması gerektiren sistem; kenar boşluklarını düzeltiyor, lekeleri temizliyor ve cilt gölgelerini ayıklıyor. Dijitalleştirilen tüm külliyat, BLAKE3 sağlama toplamlarıyla doğrulanarak ZFS depolama havuzunda arşivlendi ve Internet Archive üzerinde erişime açıldı.
Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.