OCR PDF

Rendez les pages scannées consultables et sélectionnables.

Glissez-déposez vos fichiers ici

Pris en charge : PDF, JPG, PNG

Les fichiers sont traités de manière privée et supprimés automatiquement. Aperçu de l'interface - le traitement n'est pas encore activé.

À propos OCR PDF

L'OCR PDF lit le texte de vos scans et ajoute une couche de texte invisible sous l'image, pour que vous puissiez rechercher, copier et indexer le document tout en gardant son apparence d'origine.

  • Des dizaines de langues
  • Conserve l'apparence d'origine de la page
  • Permet la copie, la recherche et l'indexation

Comment faire ocr pdf

  1. 1

    Importez le scan

    Les photos de documents fonctionnent aussi.

  2. 2

    Choisissez la langue

    La précision de reconnaissance s'améliore beaucoup avec la bonne langue.

  3. 3

    Téléchargez

    L'aspect est identique, mais le texte est désormais consultable.

Un guide pratique pour ocr pdf

Ce que l'OCR ajoute réellement à votre scan

Une page numérisée n'est qu'une image de texte : un ordinateur y voit des pixels, pas des mots, et ne peut ni y rechercher ni y copier. L'OCR lit cette image, reconnaît les lettres et les écrit dans une couche invisible positionnée juste sous l'image. La page ressemble toujours exactement au scan d'origine, mais vous pouvez désormais sélectionner une phrase, lancer une recherche, copier un paragraphe, et laisser moteurs de recherche et systèmes documentaires indexer le contenu. Rien de l'apparence visible ne change ; toute la valeur réside dans la couche consultable qui circule dessous, transformant discrètement une image plate en document utilisable.

Obtenir la reconnaissance la plus précise

La précision suit de près la qualité d'entrée. Un scan propre à une résolution correcte, droit et net, se lit presque parfaitement, tandis qu'une photo de téléphone sombre, une page de travers ou un fax pâle fera tomber des caractères. Deux réglages aident le plus : choisir la bonne langue, ou les bonnes langues, pour que le moteur sache quel alphabet et quels accents attendre, et s'assurer que la page est droite avant de commencer. Si le scan est de travers ou grenu, le redresser et améliorer la source d'abord rapporte plus que n'importe quelle option d'OCR. Les polices pâles ou inhabituelles et l'écriture manuscrite restent les cas les plus durs : relisez donc tout ce qui est critique.

Où l'OCR s'insère avec les autres outils

L'OCR est souvent l'étape qui rend possibles d'autres tâches sur un scan. Une fois qu'une couche de texte existe, vous pouvez extraire un texte propre, convertir le document en Word ou Excel avec du vrai contenu modifiable plutôt qu'une image plate, ou diviser un lot de relevés par le nom du client imprimé sur chaque page, autant d'opérations qui exigent un texte lisible. L'ordre compte : redressez et nettoyez le scan d'abord, puis lancez l'OCR, et compressez seulement ensuite, pour que la reconnaissance travaille sur les images les plus nettes et que la couche consultable survive dans le fichier final, plus petit.

Questions fréquemment posées

Comment savoir si un PDF a réellement besoin d'OCR ?
Essayez de sélectionner ou de rechercher un mot sur la page. Si rien ne se met en évidence et que la recherche ne trouve rien, la page est une image et a besoin d'OCR. Si le texte se sélectionne normalement, il est déjà numérique et l'OCR n'ajouterait rien : vous pouvez donc le sauter.
Mon document mélange deux langues. L'OCR peut-il le gérer ?
Oui. Vous pouvez sélectionner plusieurs langues pour que le moteur de reconnaissance s'attende aux deux alphabets et aux caractères spéciaux sur la même page, ce qui compte pour les lettres accentuées et les écritures non latines. Ne choisir qu'une langue sur une page bilingue tend à brouiller les mots de l'autre.
L'OCR agrandit-il le fichier ?
Légèrement. Il ajoute une couche de texte invisible sous l'image existante : l'image de la page est donc inchangée et seul le texte reconnu s'ajoute, ce qui est peu. Si la taille vous préoccupe, compressez après l'OCR plutôt qu'avant.
L'OCR va-t-il redresser ou nettoyer un scan de travers ?
Non, l'OCR ne fait que lire et ajouter une couche de texte ; il ne corrige pas l'image. Un scan incliné ou de travers réduit la précision : lancez donc le redressement d'abord et assurez-vous que la page est droite, puis l'OCR en lit bien davantage correctement.