Un PDF scanné n'est qu'une image de la page. Votre ordinateur voit des pixels, pas des mots — impossible donc de sélectionner le texte, de copier une citation ou de trouver une phrase avec Ctrl+F. La solution, c'est l'OCR (reconnaissance optique de caractères) : un logiciel lit l'image, reconnaît les lettres et ajoute une couche de texte invisible sous le scan. La page a l'air identique, mais elle est désormais cherchable et sélectionnable.
Comment faire
Ouvrez l'outil OCR, déposez votre PDF scanné et choisissez la langue du document (ce choix compte : l'OCR est bien plus précis quand il sait quel alphabet et quel dictionnaire attendre). L'outil traite chaque page et renvoie un nouveau PDF avec une couche de texte cherchable intégrée.
Tout se passe sur nos serveurs, et le fichier est supprimé deux heures plus tard — sans compte, sans filigrane.
Conseils pour un résultat propre
Scannez à 300 DPI si possible — en dessous, les lettres se brouillent les unes dans les autres. Gardez les pages bien droites : une forte inclinaison nuit à la reconnaissance. Et gardez à l'esprit que l'OCR fait de son mieux avec des images imparfaites : l'écriture manuscrite, les polices stylisées et les photocopies pâles ne donneront jamais un résultat parfait.