VélinPDF
Police, taille et couleur : celles du texte voisin — réglables une fois le texte posé

Reconnaître le texte d’un PDF (OCR)

Un scan n’est qu’une image : rien ne s’y cherche, rien ne s’y copie. La reconnaissance de caractères ajoute une couche de texte sous l’image — l’aspect ne change pas, mais le document devient cherchable.

Gratuit · 100 % local — rien n’est envoyé
  1. 1Ouvrez votre PDF scanné.
  2. 2Lancez la reconnaissance et choisissez la langue.
  3. 3Téléchargez le PDF devenu cherchable.

Comment reconnaître le texte d’un PDF scanné

Un document numérisé n’est qu’une photographie de page : rien ne s’y cherche, rien ne s’y copie, et un moteur de recherche n’y voit que du gris. La reconnaissance optique de caractères lit l’image et pose dessous une couche de texte invisible : l’aspect du scan ne change pas d’un pixel, mais le document devient cherchable, sélectionnable et copiable, et il peut ensuite être converti en Word ou en Excel. Ouvrez le PDF, choisissez la langue du document, lancez la reconnaissance, et téléchargez. Ce qui est rare ici : tout est calculé dans votre navigateur, moteur compris — un dossier médical, un bulletin de paie ou un acte notarié n’a pas à être confié à un service en ligne pour devenir lisible. La reconnaissance demande quelques secondes par page, et dépend de la netteté du scan.

Quelles langues, et quelle fiabilité

Six langues sont embarquées, dont le français avec ses accents et ses ligatures ; elles sont téléchargées une seule fois, à la première utilisation, puis gardées pour les suivantes. Aucune reconnaissance n’est fiable à cent pour cent : une page nette et droite, numérisée à 300 points par pouce, donne un texte presque parfait ; une photo prise de travers, une écriture manuscrite ou un tampon en travers du texte donnent des erreurs. Le texte reconnu se relit et se corrige ensuite dans l’éditeur, comme n’importe quel texte.

Questions fréquentes

L’OCR est-il fait sur un serveur ?

Non — c’est rare, et c’est tout l’intérêt : le moteur de reconnaissance s’exécute dans votre navigateur. Un document confidentiel scanné ne part nulle part.

Quelles langues sont reconnues ?

Le français, l’anglais, l’espagnol, l’allemand, l’italien et le portugais — et un mode français + anglais pour les documents mêlés. Le modèle de la langue choisie se télécharge au premier usage, puis reste sur l’appareil.

L’aspect du scan est-il modifié ?

Non. L’image reste telle quelle ; le texte reconnu est posé dessous, invisible, uniquement pour la recherche et la copie.

Combien de temps prend la reconnaissance ?

Quelques secondes par page sur un ordinateur récent, davantage sur un téléphone : tout le calcul se fait chez vous, sans file d’attente ni quota.

Le texte reconnu est-il fiable à cent pour cent ?

Non, et aucun moteur ne l’est : un scan net et droit donne d’excellents résultats, une photocopie penchée ou tramée beaucoup moins. Le texte reconnu sert à chercher et à copier ; relisez-le avant de vous en servir comme d’une source.

Document — les autres outils

Voir les 42 outils