Metne Göre PDF Ayırma

Bir metin her değiştiğinde yeni bir dosya başlatın.

Dosyalarınızı buraya sürükleyip bırakın

Desteklenen: PDF

Dosyalar gizli olarak işlenir ve otomatik olarak kaldırılır. Arayüz önizlemesi - işleme henüz etkinleştirilmedi.

Hakkında Metne Göre PDF Ayırma

Ekstre ve fatura yığınları için idealdir: müşteri adının veya fatura numarasının bulunduğu alanı işaretleyin, metne göre PDF ayırma o değer her değiştiğinde yeni bir belge başlatsın.

  • Otomatik fatura ve bordro ayırma
  • Dosyaları algılanan metne göre adlandırır
  • Yüzlerce belgeyi işler

Nasıl yapılır metne göre pdf ayırma

  1. 1

    Yığını yükleyin

    Birçok belgeyi barındıran tek uzun bir PDF.

  2. 2

    Metin alanını seçin

    Her belgeyi tanımlayan değerin üzerine bir kutu çizin.

  3. 3

    Otomatik bölün

    Değerdeki her değişiklik yeni bir dosya başlatır.

Pratik bir rehber: metne göre pdf ayırma

Bir ekstre veya fatura dizisini ayırmak

Bu araç, bir sistemin binlerce ekstreyi tek bir devasa PDF olarak dışa aktardığı ve bunun ardından müşteri başına tek dosya hâline getirilmesi gereken an için vardır. Alıcıya göre değişen alanın, tipik olarak hesap numarası veya adın üzerine bir kutu çizin ve her değişiklik yeni bir belge başlatsın. Temiz bir sonucun anahtarı, her belgeye gerçekten özgü olan ve ilk sayfasında güvenilir biçimde görünen bir değer seçmektir. Yürüyen bir tarih veya bir sayfa numarası yanlış yerlerde bölerdi, bu yüzden bir insanın iki ekstreyi ayırt etmek için kullanacağı tanımlayıcıyı seçin; makine de aynı mantığı izleyecektir.

Çıktıyı sayfadan adlandırmak

Yalnızca yığını kesmenin ötesinde, algılanan metin ortaya çıkan her dosyayı adlandırabilir; böylece bir ekstre dizisi anonim parça numaraları yerine müşteri adları veya hesap numaraları olarak çıkar. Bu, yönetilemez bir yığını hemen arayıp yönlendirebileceğiniz bir sete dönüştürür. Tüm yığını çalıştırmadan önce küçük bir örneği bölün ve dosya adlarını kontrol edin, çünkü fazladan bir kelime veya başıboş bir karakter yakalayan bir seçim kutusu bunu her ada taşır. Kutuyu önce birkaç sayfada ayarlamak, sonradan yüzlerce dosyayı yeniden adlandırmaktan çok daha hızlıdır ve aynı zamanda bölme noktalarının doğru düştüğünü de doğrular.

Metnin okunabilir olması için taramaları hazırlamak

Metne göre bölme, belgenin gerçek, seçilebilir metin içermesine bağlıdır; dijital olarak üretilen ekstre ve faturalarda bu zaten vardır. Taranmış kâğıtta yoktur, bu yüzden bir tarama yığını önce OCR aracından geçmelidir ki okunabilir bir metin katmanı eklensin; onsuz seçim kutusu karşılaştıracak bir şey bulamaz ve bölme başarısız olur. OCR'dan sonra, tanımlayıcı değerin temiz biçimde tanındığını doğrulayın, çünkü lekeli veya düşük çözünürlüklü bir tarama karakterleri yanlış okuyup bir belgenin yanlış yerde bölünmesine veya hiç bölünmemesine yol açabilir. Bir sayfa gerçekten değerden yoksunsa, atılmak yerine önceki belgeye eklenir, böylece hiçbir şey kaybolmaz.

Sık sorulan sorular

Araç, bir belgenin nerede bitip diğerinin nerede başladığını nasıl bilir?
Her belgeyi tanımlayan değerin, örneğin bir hesap numarası veya müşteri adının üzerine bir kutu çizersiniz ve o kutunun içindeki metin her değiştiğinde yeni bir dosya başlar. O değer tutarlı olduğu ve her belgenin ilk sayfasında tekrarlandığı sürece yığın otomatik bölünür.
Tanımlayıcı metin bazı sayfalarda biraz farklı bir yerdeyse ne olur?
Küçük kaymaların da içine düşmesi için seçim kutusunu metinden biraz daha büyük çizin. Konum belgeler arasında çok değişiyorsa algılama ıskalayabilir, bu yüzden en iyi, düzenin sabit olduğu bir ekstre veya bordro dizisi gibi aynı şablondan üretilen yığınlarda çalışır.
Her faturanın birkaç sayfa olduğu faturaları bölebilir mi?
Evet. Yeni bir dosya yalnızca izlenen değer değiştiğinde başladığından, aynı fatura numarasını paylaşan tüm sayfalar birlikte kalır ve bölme, numaranın bir sonraki faturanınki hâline geldiği noktaya düşer. Çok sayfalı belgeler tam olarak bu aracın yapıldığı iştir.
Tek bir dosyadan kaç belge çıkarabilirim?
Sabit bir üst sınır yoktur; araç büyük yığınlar için tasarlanmıştır ve tek bir uzun PDF'ten rutin olarak yüzlerce ekstre veya faturayı ayırır. Daha büyük dosyaların metin için taranması biraz daha uzun sürer ve her şey oturum için işlenip ardından otomatik olarak silinir.