OCR PDF : reconnaissance de texte

Rendez un PDF scanné consultable et sélectionnable. Tout se passe dans votre navigateur, aucun fichier n'est envoyé.

  • Aucun envoi de fichier
  • Aucune limite
  • Sans inscription
  • Sans filigrane

Comment OCR PDF

  1. 1Déposez votre PDF scanné et choisissez la langue du document.
  2. 2Cliquez sur « Lancer l'OCR » : le texte est reconnu page par page dans votre navigateur.
  3. 3Téléchargez le PDF, désormais consultable et copiable.

Pourquoi pdfdots ?

Confidentialité totale

Vos PDF sont traités sur votre appareil. Aucun fichier n'est envoyé sur un serveur, donc personne d'autre ne peut les lire.

Rapide, sans file d'attente

Pas de téléversement ni de téléchargement depuis un serveur : le résultat arrive en quelques secondes, même sur de gros fichiers.

Gratuit et sans limite

Aucun quota quotidien, aucune taille maximale imposée, aucun compte à créer et aucun filigrane ajouté à vos documents.

Partout, sur tout appareil

Fonctionne dans n'importe quel navigateur moderne : Windows, Mac, Linux, Android ou iPhone, sans rien installer.

Comment rendre un PDF scanné consultable avec l'OCR

Un PDF scanné n'est qu'une suite d'images : impossible d'y rechercher un mot, de copier une phrase ou de le faire lire par un logiciel d'accessibilité. La reconnaissance optique de caractères (OCR) analyse chaque page, identifie le texte et l'ajoute sous forme de couche invisible, placée exactement sous l'image. Le document garde son apparence d'origine, mais devient consultable et sélectionnable.

L'OCR s'exécute entièrement dans votre navigateur grâce à Tesseract, un moteur de reconnaissance libre. Votre fichier n'est jamais envoyé sur un serveur : seul le modèle de la langue choisie (environ 10 à 20 Mo) est téléchargé une fois, puis réutilisé. Langues disponibles : anglais, turc, espagnol, portugais, allemand et français.

La précision dépend surtout de la qualité du scan : une page nette, droite et bien contrastée donne d'excellents résultats, alors qu'une photo floue ou penchée en donne de moins bons. L'écriture manuscrite n'est pas reconnue de façon fiable. Les pages sont re-rendues à environ 200 DPI, le fichier final peut donc être plus lourd que l'original : passez-le ensuite dans Compresser PDF si besoin.

Le traitement prend quelques secondes par page, et donc plus de temps sur les longs documents. Gardez l'onglet ouvert pendant l'opération. Une fois le texte reconnu, vous pouvez aussi convertir le PDF en Word ou en Excel.

Notre avis

Nous lançons l'OCR sur un document scanné dans lequel nous devons chercher un mot : un bail de plusieurs pages, un contrat d'assurance, un ancien relevé dont nous voulons copier un numéro de référence sans le retaper.

Nous choisissons toujours la langue du document dans la liste, car la reconnaissance des accents français est bien meilleure avec le bon modèle. Le modèle est téléchargé une fois, puis tout se fait sur votre appareil, ce qui prend un peu de temps sur un long fichier.

Le piège : un scan flou, penché ou en basse résolution donne un texte truffé d'erreurs. Mieux vaut rescanner correctement que corriger ensuite. Et une fois le texte reconnu, si vous devez le modifier en profondeur, enchaînez avec PDF en Word.

Outils associés

Questions fréquentes

Mon fichier est-il envoyé sur un serveur ?+

Non. L'OCR s'exécute dans votre navigateur ; seul le modèle de langue (~10 à 20 Mo) est téléchargé une fois.

Quelles langues sont prises en charge ?+

Anglais, turc, espagnol, portugais, allemand et français.

L'écriture manuscrite est-elle reconnue ?+

Pas de façon fiable : l'OCR fonctionne surtout avec du texte imprimé.

Pourquoi le fichier obtenu est-il plus lourd ?+

Les pages sont re-rendues à environ 200 DPI. Utilisez Compresser PDF pour réduire la taille.

Combien de temps cela prend-il ?+

Quelques secondes par page ; un long document peut prendre plusieurs minutes.

Est-ce gratuit ?+

Oui, gratuit et sans inscription.