OCR ile PDF Metin Tanıma
Metin tanıma tamamen tarayıcınızda yapılır; dosyanız cihazınızdan çıkmaz.
- ✓Dosyalar yüklenmez
- ✓Limit yok
- ✓Kayıt yok
- ✓Filigran yok
OCR PDF nasıl yapılır?
- 1Taranmış PDF dosyanızı seçin ve belgenin dilini belirleyin.
- 2"Metni tanı" düğmesine tıklayın; sayfalar tek tek tarayıcınızda işlenir.
- 3Aranabilir, metni seçilebilen PDF'yi indirin.
Neden pdfdots?
Dosyalarınız sizde kalır
Tüm işlemler tarayıcınızda yapılır. Kimlik, diploma veya sözleşme gibi belgeler hiçbir sunucuya gönderilmez.
Limit yok
Dosya sayısı, boyut veya günlük kullanım sınırı yok. Ne kadar gerekiyorsa o kadar kullanın.
Kayıt ve filigran yok
Hesap açmanız gerekmez, çıktılarınıza logo veya filigran eklenmez.
Hızlı ve her cihazda
Yükleme/indirme beklemesi olmadan çalışır; bilgisayarda, telefonda ve tablette tarayıcıdan kullanılır.
OCR ile taranmış PDF nasıl aranabilir hale gelir?
Tarayıcıdan veya telefon kamerasından oluşturulan PDF'ler aslında sayfa fotoğraflarıdır: içindeki metni arayamaz, seçemez ya da kopyalayamazsınız. OCR (optik karakter tanıma) sayfadaki harfleri tanır ve görüntünün arkasına görünmez bir metin katmanı ekler. Sayfa aynı görünür, ancak artık Ctrl+F ile arama yapabilir, metni kopyalayabilir ve belgeyi arşivlerde bulunabilir hale getirebilirsiniz.
pdfdots bu işlemi açık kaynaklı Tesseract motoruyla tamamen tarayıcınızda yapar; dosyanız hiçbir sunucuya yüklenmez. Yalnızca seçtiğiniz dilin tanıma modeli (yaklaşık 10-20 MB) ilk kullanımda bir kez indirilir. Türkçe, İngilizce, İspanyolca, Portekizce, Almanca ve Fransızca desteklenir; doğru dili seçmek ç, ğ, ş gibi harflerin doğru tanınması için önemlidir.
Doğruluk tarama kalitesine bağlıdır: net, düz ve yeterli çözünürlükteki sayfalar en iyi sonucu verir; el yazısı güvenilir şekilde tanınmaz. Sayfalar yaklaşık 200 DPI'da yeniden oluşturulduğu için çıktı dosyası orijinalden büyük olabilir; gerekirse PDF Sıkıştır aracıyla küçültebilirsiniz. İşlem sayfa başına birkaç saniye sürer, bu yüzden uzun belgelerde sabırlı olun.
Bizim görüşümüz
OCR aracını, taranmış bir sözleşmede ya da eski bir tapu fotokopisinde belirli bir ifadeyi aramak veya metni kopyalamak istediğimizde kullanıyoruz; tarama yalnızca bir görüntü olduğu için bu olmadan arama yapılamıyor.
Belge dilini doğru seçmek en önemli ayar: Türkçe belgede Türkçe'yi seçmek ç, ğ, ı, ş gibi harflerin doğru tanınmasını sağlıyor. Dil modeli bir kez indiriliyor, dosyanız ise cihazınızda kalıyor.
Gördüğümüz tuzak, düşük çözünürlükte ya da eğik taranmış sayfalarda tanıma kalitesinin belirgin şekilde düşmesi; mümkünse yeniden 300 DPI ile tarıyoruz. Metni düzenlemek için ardından PDF'den Word'e aracını kullanabilirsiniz.
İlgili araçlar
Sıkça sorulan sorular
Dosyam sunucuya yükleniyor mu?+
Hayır. OCR tamamen tarayıcınızda çalışır; yalnızca dil modeli bir kez indirilir.
Hangi diller destekleniyor?+
Türkçe, İngilizce, İspanyolca, Portekizce, Almanca ve Fransızca.
El yazısını tanıyor mu?+
El yazısı güvenilir şekilde tanınmaz; OCR en iyi basılı metinde çalışır.
Çıktı dosyası neden daha büyük?+
Sayfalar yaklaşık 200 DPI'da yeniden oluşturulur; PDF Sıkıştır ile küçültebilirsiniz.
Ne kadar sürer?+
Sayfa başına birkaç saniye; uzun belgelerde süre uzar.
Ücretli mi?+
Hayır, kayıt gerektirmeden tamamen ücretsizdir.