Ana içeriğe geç
Programlama

Kopyalanamayan belgeleri metne dönüştüren OCR It yayımlandı

Öne çıkanlar

  • Optik karakter tanıma işlemleri yerel Tesseract motoruyla tamamen çevrimdışı çalışıyor.
  • Eklenti, belirlenen koordinatlar üzerinden otomatik sayfa çevirerek yüzlerce sayfayı sıralı metne dönüştürüyor.
  • Varsayılan 3 dil modeline ek olarak 100'den fazla dil paketi sonradan yüklenebiliyor.

Geliştirici Thiago Tigaz, web tarayıcılarında kopyalama korumalı veya taranmış belgelerden metin çıkarmayı sağlayan açık kaynaklı Chrome eklentisi OCR It'i kullanıma sundu. Araç, kullanıcıların ekran üzerinde belirlediği belirli bir alanı tek tuşla veya otomatik döngüyle yakalayarak yerel Tesseract motoru üzerinden metne dönüştürüyor.

Eklenti, görüntü işleme ve optik karakter tanıma işlemlerinin tamamını cihaz üzerinde çevrimdışı gerçekleştiriyor. Bu sayede hiçbir veri, API anahtarı gerektirmeden veya harici sunuculara aktarılmadan işleniyor. Sistem, iframe ve Shadow DOM içeren karmaşık belge görüntüleyicilerinde dahi sayfa ilerleme kontrollerini tespit ederek otomatik sayfa çevirme ve okuma sürecini yürütebiliyor.

Elde edilen metinler sayfa sıralaması korunarak dışa aktarılıyor ve doğrudan yapay zeka modellerine beslenebilecek TXT formatında kaydedilebiliyor. Varsayılan olarak İngilizce, Portekizce ve İspanyolca dillerini içeren eklentiye, Tesseract veri setleri eklenerek 100'den fazla dil desteği kazandırılabiliyor.

Kaynak

Bu özet yapay zekâ ile hazırlanmıştır; ayrıntılar ve doğrulama için orijinal kaynağa başvurun.