PPDF Shape
Tutoriels

Comment extraire le texte d'un scan avec l'OCR

Rendez enfin cherchable et copiable le contenu d'un document papier numérisé.

Le problème des scans

Un document photographié ou scanné n'est qu'une image aux yeux de l'ordinateur : impossible de sélectionner, copier ou rechercher un mot dans son contenu, même s'il est parfaitement lisible à l'œil.

Ce que fait l'OCR

La reconnaissance optique de caractères (OCR) analyse l'image de chaque page et identifie les lettres et mots qu'elle contient, pour en produire un texte brut exploitable.

Étape par étape

Chargez votre PDF scanné sur la page OCR, choisissez la langue principale du document pour une meilleure précision, lancez la reconnaissance, puis téléchargez le texte extrait.

Obtenir un bon résultat

Un scan net, bien droit et suffisamment contrasté donne une reconnaissance nettement plus fiable qu'une photo floue ou prise de travers.

FAQ

Toutes les langues sont-elles prises en charge ?

L'outil prend en charge le français, l'anglais et l'espagnol ; choisissez celle qui correspond au document pour de meilleurs résultats.

Le texte reconnu est-il fidèle à 100% ?

La précision dépend fortement de la qualité du scan ; relisez toujours le résultat, surtout pour un document important.