Vos fichiers restent sur votre appareil

Les fichiers sont traités dans votre navigateur et ne sont pas envoyés sur nos serveurs. Le site peut télécharger des moteurs de traitement et envoyer des événements d’utilisation ou de retour sans le contenu des fichiers.

Comment nous traitons vos données →

OCR PDF : créer un PDF consultable

Transformez un document numérisé en PDF à texte sélectionnable ; français, anglais, espagnol et russe pris en charge, jusqu’à 10 pages. Vos fichiers restent dans votre navigateur.

Fichiers de reconnaissance ≈ 26 Mo à la première utilisation, plus les données de langue.

PDF · jusqu’à 10 MiB, 10 pages. Texte jusqu’à 1 MiB ; PDF consultable jusqu’à 30 MiB.

Texte reconnu

Essayer un exemple

Télécharger l’exemple

Gardez la langue Français sélectionnée. Téléchargez le PDF et cherchez FACTURE, 148,50, Lefèvre, LIVRAISON et 2048. Les deux pages doivent ressembler à l’exemple, avec un texte que vous pouvez sélectionner et copier ; les accents et la cédille sont conservés.

À quoi s’attendre

Chaque page est reconnue comme une image, dans l’ordre. La reconnaissance en anglais, en russe et en mode mixte est disponible. L’OCR peut mal lire les lettres, les chiffres, les colonnes et les tableaux : vérifiez le résultat. Cela crée un nouveau PDF à partir d’images de pages et d’une couche de texte invisible. La taille et la rotation visibles des pages sont conservées ; les formulaires, liens, signets, pièces jointes et signatures numériques ne le sont pas. Le texte existant est reconnu de nouveau ; la qualité des images est limitée par la résolution de rendu.

Les pages sont rendues jusqu’à 4 mégapixels chacune. Le chargement et chaque étape de traitement disposent de 90 secondes au maximum ; l’ensemble de la tâche s’arrête au bout de 10 minutes. Les pages vierges sont signalées dans le texte. Aucun téléchargement n’est proposé si le traitement échoue ou si aucun texte n’est reconnu.

PDF protégé ?Déverrouillez-le d’abord avec son mot de passe.

Lors de la première exécution, des fichiers du convertisseur peuvent être téléchargés, ce qui prend un moment. En cas d’échec, vérifiez votre connexion ou essayez un fichier plus petit. « Annuler » arrête le traitement en cours ; vous pouvez choisir un autre fichier et réessayer.

Licences et code source des moteurs

Un guide pratique

Rendez enfin un scan consultable.

  1. Choisissez un PDF numérisé de 10 pages et 10 MiB au maximum.
  2. Sélectionnez le français, l’anglais, l’espagnol ou le russe et lancez la reconnaissance.
  3. Cherchez un mot connu dans le résultat pour confirmer que la couche de texte fonctionne.

Essayez cet exemple

Lancez la reconnaissance d’un formulaire scolaire numérisé de 3 pages en français ; la recherche d’un nom imprimé en page 2 doit le mettre en évidence dans le PDF obtenu.

Avant de commencer : La reconnaissance ne prend en charge que le français, l’anglais, l’espagnol et le russe, et se limite à 10 pages et 10 MiB ; l’écriture manuscrite ou les très petits caractères peuvent échapper à la reconnaissance.