Podziel PDF według tekstu

Zaczynaj nowy plik za każdym razem, gdy zmienia się fragment tekstu.

Przeciągnij i upuść pliki tutaj

Obsługiwane: PDF

Pliki są przetwarzane prywatnie i automatycznie usuwane. Podgląd interfejsu - przetwarzanie nie jest jeszcze włączone.

O narzędziu Podziel PDF według tekstu

Idealne dla serii wyciągów i partii faktur: zaznacz obszar, w którym znajduje się nazwa klienta lub numer faktury, a nowy dokument będzie zaczynał się przy każdej zmianie tej wartości.

  • Automatyczny podział faktur i list płac
  • Nazywa pliki na podstawie wykrytego tekstu
  • Obsługuje setki dokumentów

Jak to zrobić podziel pdf według tekstu

  1. 1

    Wgraj partię

    Jeden długi PDF zawierający wiele dokumentów.

  2. 2

    Zaznacz obszar tekstu

    Narysuj ramkę wokół wartości, która identyfikuje każdy dokument.

  3. 3

    Podziel automatycznie

    Każda zmiana wartości rozpoczyna nowy plik.

Praktyczny przewodnik po podziel pdf według tekstu

Rozbijanie serii wyciągów lub faktur

To narzędzie istnieje na moment, gdy system eksportuje tysiące wyciągów jako jeden ogromny plik PDF, który potem musi stać się jednym plikiem na klienta. Narysuj ramkę nad polem zmieniającym się dla każdego odbiorcy, zwykle numerem konta lub nazwiskiem, a każda zmiana rozpoczyna świeży dokument. Kluczem do czystego wyniku jest wybranie wartości naprawdę unikalnej dla każdego dokumentu i pojawiającej się niezawodnie na jego pierwszej stronie. Bieżąca data lub numer strony dzieliłyby w złych miejscach, więc wybierz identyfikator, którego człowiek użyłby, by odróżnić dwa wyciągi, a maszyna pójdzie tą samą logiką.

Nazywanie wyniku na podstawie strony

Poza samym cięciem partii wykryty tekst może nazwać każdy powstały plik, więc seria wyciągów wychodzi jako nazwiska klientów lub numery kont, a nie anonimowe numery części. Zamienia to niezarządzalny stos w zestaw, który możesz od razu przeszukiwać i kierować dalej. Przed uruchomieniem pełnej partii podziel małą próbkę i sprawdź nazwy plików, bo ramka zaznaczenia łapiąca dodatkowe słowo lub zbłąkany znak przeniesie je do każdej nazwy. Dopasowanie ramki na kilku stronach najpierw jest znacznie szybsze niż zmiana nazw setek plików po fakcie i zarazem potwierdza, że punkty podziału wypadają poprawnie.

Przygotowanie skanów, by tekst był czytelny

Podział według tekstu wymaga, aby dokument zawierał prawdziwy, zaznaczalny tekst, który cyfrowo generowane wyciągi i faktury już mają. Zeskanowany papier go nie ma, więc partia skanów musi najpierw przejść przez narzędzie OCR, aby dodać czytelną warstwę tekstową; bez niej ramka zaznaczenia nie znajduje nic do porównania i podział zawodzi. Po OCR potwierdź, że wartość identyfikująca jest rozpoznawana czysto, bo rozmazany lub niskiej rozdzielczości skan może błędnie odczytać znaki i sprawić, że dokument podzieli się w złym miejscu lub wcale. Gdy strona naprawdę nie ma tej wartości, jest dołączana do poprzedniego dokumentu, a nie porzucana, więc nic nie ginie.

Najczęściej zadawane pytania

Skąd narzędzie wie, gdzie kończy się jeden dokument, a zaczyna następny?
Rysujesz ramkę nad wartością, która identyfikuje każdy dokument, jak numer konta lub nazwa klienta, a nowy plik zaczyna się za każdym razem, gdy tekst w tej ramce się zmienia. Dopóki ta wartość jest spójna i powtarza się na pierwszej stronie każdego dokumentu, partia dzieli się automatycznie.
Co, jeśli tekst identyfikujący jest na niektórych stronach w nieco innym miejscu?
Narysuj ramkę zaznaczenia nieco większą niż tekst, żeby drobne przesunięcia wciąż w nią wpadały. Jeśli pozycja waha się drastycznie między dokumentami, wykrywanie może chybić, więc działa najlepiej na partiach z tego samego szablonu, jak seria wyciągów lub pasków wypłat o stałym układzie.
Czy potrafi dzielić faktury, gdy każda faktura ma po kilka stron?
Tak. Ponieważ nowy plik zaczyna się dopiero, gdy śledzona wartość się zmienia, wszystkie strony z jednym numerem faktury zostają razem, a podział wypada w miejscu, gdzie numer staje się numerem następnej faktury. Dokumenty wielostronicowe to dokładnie to, do czego to narzędzie zostało zbudowane.
Ile dokumentów mogę wydzielić z jednego pliku?
Nie ma sztywnego limitu; narzędzie jest projektowane pod duże partie i rutynowo rozdziela setki wyciągów lub faktur z jednego długiego pliku PDF. Większe pliki skanuje się w poszukiwaniu tekstu nieco dłużej, a wszystko jest przetwarzane na czas sesji, a potem automatycznie usuwane.