PDF OCR

Taranmış sayfaları aranabilir ve seçilebilir yapın.

Dosyalarınızı buraya sürükleyip bırakın

Desteklenen: PDF, JPG, PNG

Dosyalar gizli olarak işlenir ve otomatik olarak kaldırılır. Arayüz önizlemesi - işleme henüz etkinleştirilmedi.

Hakkında PDF OCR

Optik karakter tanıma taramanızdaki metni okur ve PDF OCR ile görüntünün altına görünmez bir metin katmanı ekler; böylece belge orijinali gibi görünmeye devam ederken içinde arama yapabilir, kopyalayabilir ve dizinleyebilirsiniz.

  • Onlarca dil
  • Orijinal sayfa görünümünü korur
  • Kopyalama, arama ve dizinlemeyi sağlar

Nasıl yapılır pdf ocr

  1. 1

    Taramayı yükleyin

    Belge fotoğrafları da çalışır.

  2. 2

    Dili seçin

    Doğru dil seçildiğinde tanıma doğruluğu belirgin biçimde artar.

  3. 3

    İndirin

    Görünümü aynı kalır ama metin artık aranabilir.

Pratik bir rehber: pdf ocr

OCR'ın taramanıza aslında ne kattığı

Taranmış bir sayfa yalnızca metnin bir resmidir, bu yüzden bir bilgisayar kelimeleri değil pikselleri görür ve ondan arama yapamaz veya kopyalayamaz. OCR o resmi okur, harfleri tanır ve bunları doğrudan resmin altına konumlandırılmış görünmez bir katmana yazar. Sayfa hâlâ tam olarak orijinal tarama gibi görünür, ama artık bir cümle seçebilir, bir arama çalıştırabilir, bir paragraf kopyalayabilir ve arama motorlarının ve belge sistemlerinin içeriği dizinlemesine izin verebilirsiniz. Görünür görünümle ilgili hiçbir şey değişmez; değer tamamen altta gizlice akan, düz bir görüntüyü kullanışlı bir belgeye çeviren aranabilir katmandadır.

En doğru tanımayı elde etmek

Doğruluk, girdi kalitesini yakından izler. Makul çözünürlükte, dik ve odakta temiz bir tarama neredeyse kusursuz okunurken, karanlık bir telefon fotoğrafı, çarpık bir sayfa veya soluk bir faks karakterleri düşürür. En çok iki ayar yardımcı olur: doğru dili veya dilleri seçin ki tanıyıcı hangi alfabeyi ve aksanları beklemesi gerektiğini bilsin ve başlamadan önce sayfanın düz olduğundan emin olun. Tarama eğri veya taneli ise, eğikliği gidermek ve kaynağı önce iyileştirmek herhangi bir OCR seçeneğinden daha çok işe yarar. Soluk veya olağandışı yazı tipleri ve el yazısı en zor durumlar olarak kalır, bu yüzden kritik her şeyi gözden geçirin.

OCR'ın diğer araçlarla uyumu

OCR, çoğu zaman bir tarama üzerinde diğer görevleri mümkün kılan etkinleştirici adımdır. Bir metin katmanı var olduğunda, temiz metni çıkarabilir, belgeyi düz bir resim yerine gerçek düzenlenebilir içerikle Word'e veya Excel'e dönüştürebilir ya da bir ekstre yığınını her sayfada basılı müşteri adına göre bölebilirsiniz; bunların hepsi çalışmak için okunabilir metne ihtiyaç duyar. Sıra önemlidir: önce eğikliği giderin ve taramayı temizleyin, sonra OCR yapın ve yalnızca ondan sonra sıkıştırın ki tanıma en keskin resimler üzerinde çalışsın ve aranabilir katman son, daha küçük dosyaya kadar hayatta kalsın.

Sık sorulan sorular

Bir PDF'in gerçekten OCR'a ihtiyacı olup olmadığını nasıl anlarım?
Sayfadaki bir kelimeyi seçmeyi veya aramayı deneyin. Hiçbir şey vurgulanmıyor ve arama bir şey bulamıyorsa, sayfa bir resimdir ve OCR gerekir. Metin normal seçiliyorsa, zaten dijitaldir ve OCR hiçbir şey katmaz, bu yüzden atlayabilirsiniz.
Belgem iki dili karıştırıyor. OCR bununla başa çıkabilir mi?
Evet. Tanıyıcının aynı sayfada her iki alfabeyi ve özel karakterleri beklemesi için birden fazla dil seçebilirsiniz; bu, aksanlı harfler ve Latin dışı yazılar için önemlidir. İki dilli bir sayfada yalnızca bir dil seçmek, diğer dildeki kelimeleri bozma eğilimindedir.
OCR dosyayı büyütür mü?
Biraz. Mevcut resmin altına görünmez bir metin katmanı ekler, böylece sayfa görüntüsü değişmez ve yalnızca tanınan metin eklenir ki bu küçüktür. Boyut bir endişeyse, OCR'dan önce değil sonra sıkıştırın.
OCR eğri bir taramayı düzeltir veya temizler mi?
Hayır, OCR yalnızca okur ve bir metin katmanı ekler; görüntüyü düzeltmez. Eğik veya çarpık bir tarama doğruluğu düşürür, bu yüzden önce eğiklik giderme çalıştırın ve sayfanın dik olduğundan emin olun; o zaman OCR onu çok daha doğru okur.