Outil PDF

OCR PDF et image en texte

OCR PDF : transformez un PDF numérisé ou une image en texte en français, anglais, espagnol, allemand, arabe ou ourdou, ou créez un PDF consultable.

Aperçu de la page

Aucun PDF chargé

Choisissez un PDF pour afficher l'aperçu des pages.

Votre fichier ne quitte jamais votre appareil.

En quelques étapes

Comment ça marche

  1. 01

    Choisissez un PDF numérisé ou une image JPG, PNG ou WebP, puis cochez la ou les langues du document.

  2. 02

    Choisissez texte brut ou PDF consultable et lancez l'OCR ; les pages sont traitées une par une.

  3. 03

    Copiez ou téléchargez le texte reconnu, ou téléchargez le PDF consultable.

Bon à savoir

Questions fréquentes

Quelles langues sont disponibles ?

Anglais, français, espagnol, allemand, arabe et ourdou, seuls ou combinés (par exemple arabe et anglais). Les données de chaque langue sont téléchargées une seule fois, à la première utilisation : environ 2,95 Mo pour l'anglais, 0,71 Mo pour le français, 2,10 Mo pour l'espagnol, 1,33 Mo pour l'allemand, 1,66 Mo pour l'arabe et 1,02 Mo pour l'ourdou, plus environ 1,5 Mo pour le moteur.

L'OCR envoie-t-il mon document en ligne ?

Non. Votre document est traité dans votre navigateur. Le moteur OCR et les données de langue choisies sont téléchargés depuis ce site, et votre document ne fait jamais partie de ces requêtes.

Qu'est-ce qu'un PDF consultable ?

Il conserve l'image de la page et ajoute une couche de texte invisible reconnue par OCR, pour que le texte puisse être sélectionné et recherché. La reconnaissance peut comporter des erreurs.

Pourquoi un avertissement s'affiche-t-il sur téléphone et tablette ?

Le moteur et les données de langue choisies nécessitent un téléchargement unique d'environ 2 à 5 Mo, et la reconnaissance consomme aussi de la mémoire et de la batterie. Une connexion stable et un appareil disposant de mémoire libre sont recommandés.

L'OCR reconnaît-il l'écriture manuscrite ?

Les modèles choisis sont conçus pour le texte imprimé. L'écriture manuscrite, un faible contraste, une page inclinée ou des polices inhabituelles réduisent la précision.

Quelle est la précision de l'OCR en arabe et en ourdou ?

Elle dépend beaucoup de la numérisation. Un texte naskh imprimé, net, droit et en haute résolution donne de bons résultats ; le nastaliq, utilisé dans la plupart des textes ourdous imprimés, les petits caractères et les numérisations inclinées ou en basse résolution produisent davantage d'erreurs. Vérifiez toujours le résultat avant de vous y fier.