OCR PDF
Rendez un PDF scanné consultable avec une couche de texte invisible, sans modifier l’image des pages. Recherchez, sélectionnez et copiez le texte.
Votre fichier est importé via une connexion sécurisée et traité sur notre serveur. L'original est supprimé juste après le traitement, le résultat au bout de 1 heure (24 heures dans votre compte).
Importez jusqu’à 10 PDF à la fois, les mêmes paramètres s’appliquent à tous. Les images JPG et PNG ne sont pas acceptées directement.
Sélectionnez jusqu’à trois langues parmi les 11 disponibles : anglais, espagnol, portugais, italien, français, allemand, polonais, russe, turc, tchèque et néerlandais. Par défaut, la langue de la page et l’anglais sont choisis. Une langue du document non sélectionnée peut rendre le texte illisible.
Vous pouvez tourner les pages scannées de côté ou à l’envers et redresser les pages inclinées. Par défaut, seules les pages scannées sont traitées, celles qui contiennent déjà du texte restent inchangées. Une nouvelle reconnaissance peut remplacer une ancienne couche OCR, mais le redressement n’est alors pas disponible.
Lancez l’OCR pour obtenir un PDF consultable, dont le texte peut être recherché, sélectionné et copié. Vous pouvez aussi enregistrer le texte en TXT. Plusieurs résultats peuvent être téléchargés dans une archive ZIP.
L’OCR prend environ 2 à 10 secondes par page, selon la qualité du scan. L’écriture manuscrite et les tableaux complexes ne sont pas reconnus de façon fiable.
Sans compte, un PDF peut peser jusqu’à 50 Mo et compter 20 pages au maximum, deux traitements simultanés sont autorisés. Avec un compte, les limites passent à 100 Mo, 100 pages par fichier et quatre traitements simultanés.
L’inscription est facultative et aucun filigrane n’est ajouté. Le fichier est transmis par HTTPS, traité sur le serveur, puis supprimé après traitement. Les résultats sont conservés une heure sans compte et 24 heures avec un compte.
Pour traiter un PDF protégé, saisissez son mot de passe. Il n’est pas stocké et le résultat est enregistré sans mot de passe. La reconnaissance d’un PDF portant une signature numérique invalide celle-ci.
FAQ
Comment vérifier si l’OCR a reconnu le texte ?
Après le traitement, le résultat indique le nombre de mots reconnus et le nombre de pages concernées. Un aperçu du texte de la première page est également proposé. Si peu de mots apparaissent, vérifiez les langues sélectionnées et la netteté du scan.
Que faire si toutes les pages du PDF contiennent déjà du texte ?
Aucun texte ne sera reconnu si toutes les pages ont déjà du texte. Pour remplacer une ancienne couche OCR, demandez une nouvelle reconnaissance. Les pages qui contiennent du vrai texte ne sont pas transformées en images.
Le mot de passe d’un PDF protégé est-il conservé ?
Non. Le mot de passe est nécessaire pour traiter le fichier, mais il n’est utilisé que pour ce traitement et n’est pas stocké. Le PDF obtenu est sans mot de passe.
Puis-je récupérer mes résultats plus tard ?
Sans compte, les résultats sont disponibles pendant une heure. Avec un compte, ils restent téléchargeables pendant 24 heures depuis l’historique de traitement. Cet historique conserve les noms et tailles de fichiers ainsi que les paramètres, mais pas les documents, le texte reconnu ni les mots de passe.