Skip to content
freeonlinefileconvert

OCR PDF

Ajoutez une couche de texte invisible à un PDF scanné pour pouvoir y chercher des mots et copier son texte, sans changer l’aspect d’aucune page.

ou déposez-le ici · jusqu’à 50 Mo, gratuitement

Fichiers plus volumineux ? Pro convertit des fichiers jusqu’à 500 Mo

Cela dépasse la version gratuite

Vous pouvez quand même le faire : convertissez maintenant et payez 1,99 € seulement si vous voulez télécharger le résultat.

La version gratuite accepte des fichiers jusqu’à 50 Mo et jusqu’à 20 fichiers à la fois.

Gratuit · Sans inscription · Sans filigrane · Vos fichiers ne quittent jamais votre appareil

OCR PDF en 3 étapes

  1. Sélectionnez votre PDF scanné ou déposez-le dans le cadre.
  2. Choisissez la langue du texte (et une deuxième si le document en mélange deux), puis cliquez sur Lancer l’OCR.
  3. Téléchargez le PDF cherchable, ou tout le texte reconnu dans un fichier TXT.

Comment l’OCR transforme un scan en PDF cherchable

Une page scannée n’est qu’une photo du papier : impossible d’y chercher un mot, de sélectionner une phrase ou de copier un montant. L’OCR (reconnaissance optique de caractères) lit les lettres de cette image et les ajoute à la page sous forme de couche de texte invisible, placée exactement sur chaque mot. La page garde le même aspect, mais Ctrl+F trouve désormais les mots, vous pouvez surligner et copier du texte dans Acrobat, Aperçu, Chrome ou Edge, et Windows, macOS, Google Drive ou votre GED peuvent indexer le fichier.

Le texte est reconnu sur votre appareil par Tesseract, un moteur d’OCR open source. Chaque page est lue jusqu’à 300 ppp ; les pages qui contiennent déjà du texte restent telles quelles et celles scannées de travers ou à l’envers sont remises dans le bon sens. Les meilleurs résultats s’obtiennent avec du texte imprimé et net : courriers, factures, contrats, livres et formulaires. L’écriture manuscrite, les très petits caractères, les pages pâlies et les photos prises en biais donnent plus d’erreurs, et les tableaux ressortent en texte, pas en cellules. La première fois que vous utilisez une langue, son modèle de lecture (1 à 3 Mo) est téléchargé depuis ce site et conservé dans votre navigateur.

Questions fréquentes

Mon PDF change-t-il d’aspect après l’OCR ?

Non. Les pages, images et dessins d’origine ne sont ni modifiés ni recompressés. L’OCR ajoute seulement une couche de texte invisible sur chaque page : le fichier a le même aspect et ne grossit que de quelques kilo-octets par page. Les pages scannées de travers sont remises droites pour être plus lisibles.

Quelles langues peut-il lire ?

Vingt-quatre : français, anglais, espagnol, allemand, italien, portugais, néerlandais, polonais, turc, indonésien, vietnamien, japonais, chinois simplifié et traditionnel, coréen, russe, ukrainien, arabe, hindi, catalan, tchèque, grec, roumain et suédois. Vous pouvez en choisir deux à la fois pour un document qui mélange les langues, comme le français et l’anglais.

Quelle est la précision de la reconnaissance ?

Sur un scan propre de texte imprimé, presque tous les mots sont justes : dans nos tests sur des scans de bureau à 200 ppp, plus de 98 % des caractères ont été bien lus. L’écriture manuscrite, les polices minuscules ou décoratives, les scans flous et les fonds colorés réduisent la précision : vérifiez les noms et les chiffres importants.

Combien de temps prend l’OCR ?

Quelques secondes par page sur un ordinateur récent et environ deux fois plus sur un téléphone, plus un court téléchargement du modèle de langue la première fois. Un scan de 20 pages prend en général d’une à trois minutes. Laissez l’onglet ouvert pendant le traitement ; les pages qui ont déjà du texte sont ignorées.

Puis-je obtenir le texte dans un fichier TXT ?

Oui. À côté du PDF cherchable, vous pouvez télécharger tout le texte reconnu dans un fichier TXT, page par page, prêt à coller dans Word, Google Docs ou un e-mail. Pour les photos et les captures d’écran, utilisez notre outil Image en texte, qui fonctionne de la même façon.

Mon PDF est-il envoyé sur un serveur ?

Non. Les pages sont lues par un moteur d’OCR qui tourne dans votre navigateur, sur votre propre appareil : contrats, courriers médicaux et pièces d’identité ne nous sont jamais envoyés ni stockés nulle part. Seuls le moteur d’OCR et le modèle de langue sont téléchargés depuis ce site, une seule fois, et gardés dans votre navigateur.

Outils similaires

Vous êtes parmi les premiers

FreeOnlineFileConvert vient d’ouvrir. Créez dès maintenant un compte gratuit et rejoignez notre liste Family & Friends : tout le forfait Pro, gratuit à vie.

Pro0 €6,99 €
Rejoindre gratuitement