OCR PDF : créer un PDF consultable
Transformez un document numérisé en PDF à texte sélectionnable ; français, anglais, espagnol et russe pris en charge, jusqu’à 10 pages. Vos fichiers restent dans votre navigateur.
Fichiers de reconnaissance ≈ 26 Mo à la première utilisation, plus les données de langue.
Texte reconnu
Cet outil vous a-t-il été utile ?
Essayer un exemple
Télécharger l’exempleGardez la langue Français sélectionnée. Téléchargez le PDF et cherchez FACTURE, 148,50, Lefèvre, LIVRAISON et 2048. Les deux pages doivent ressembler à l’exemple, avec un texte que vous pouvez sélectionner et copier ; les accents et la cédille sont conservés.
À quoi s’attendre
Chaque page est reconnue comme une image, dans l’ordre. La reconnaissance en anglais, en russe et en mode mixte est disponible. L’OCR peut mal lire les lettres, les chiffres, les colonnes et les tableaux : vérifiez le résultat. Cela crée un nouveau PDF à partir d’images de pages et d’une couche de texte invisible. La taille et la rotation visibles des pages sont conservées ; les formulaires, liens, signets, pièces jointes et signatures numériques ne le sont pas. Le texte existant est reconnu de nouveau ; la qualité des images est limitée par la résolution de rendu.
Les pages sont rendues jusqu’à 4 mégapixels chacune. Le chargement et chaque étape de traitement disposent de 90 secondes au maximum ; l’ensemble de la tâche s’arrête au bout de 10 minutes. Les pages vierges sont signalées dans le texte. Aucun téléchargement n’est proposé si le traitement échoue ou si aucun texte n’est reconnu.
PDF protégé ?Déverrouillez-le d’abord avec son mot de passe.
Lors de la première exécution, des fichiers du convertisseur peuvent être téléchargés, ce qui prend un moment. En cas d’échec, vérifiez votre connexion ou essayez un fichier plus petit. « Annuler » arrête le traitement en cours ; vous pouvez choisir un autre fichier et réessayer.
Licences et code source des moteurs
Un guide pratique
Rendez enfin un scan consultable.
- Choisissez un PDF numérisé de 10 pages et 10 MiB au maximum.
- Sélectionnez le français, l’anglais, l’espagnol ou le russe et lancez la reconnaissance.
- Cherchez un mot connu dans le résultat pour confirmer que la couche de texte fonctionne.
Essayez cet exemple
Lancez la reconnaissance d’un formulaire scolaire numérisé de 3 pages en français ; la recherche d’un nom imprimé en page 2 doit le mettre en évidence dans le PDF obtenu.
Avant de commencer : La reconnaissance ne prend en charge que le français, l’anglais, l’espagnol et le russe, et se limite à 10 pages et 10 MiB ; l’écriture manuscrite ou les très petits caractères peuvent échapper à la reconnaissance.