Skip to content
Choose language
Free

OCR PDF

Ajoutez une couche de texte invisible pour qu'un PDF numérisé devienne cherchable.

Drop a PDF, or click to browse

Free: up to 15 MB · 100 pages

OCR adds an invisible text layer so the PDF becomes searchable. Best on scanned documents — works on regular PDFs too. Free: up to 10 pages. Pro: up to 50 pages.

À propos de cet outil

L'OCR — Optical Character Recognition — ajoute une couche de texte invisible à un PDF numérisé pour que le document devienne cherchable et puisse être copié-collé. Les images de la page restent intactes, le fichier semble donc identique à l'original ; seules les données textuelles sous-jacentes changent. Nous prenons en charge la reconnaissance en anglais, en français, en allemand et en espagnol, choisie au moment du téléchargement pour que le moteur puisse utiliser le bon dictionnaire de langue.

L'OCR est particulièrement utile sur les documents numérisés — scans d'appareils photo pour des contrats, scans de photocopieurs pour des formalités, photographies de pages de texte. Cela fonctionne aussi sur les PDF classiques, mais n'ajoute pas grand-chose : un PDF exporté depuis Word ou un navigateur contient déjà du vrai texte que l'OS peut indexer, donc l'OCR ne trouve rien de nouveau à faire. Le Free tier traite jusqu'à 10 pages par téléchargement ; Pro augmente cela à 50. Les limites de pages existent car l'OCR est significativement plus gourmand en CPU que les autres opérations sur ce site.

Comment ça marche

  1. Déposez votre PDF numérisé

    Faites glisser un PDF numérisé sur la zone de téléchargement ou cliquez pour en choisir un. Il est envoyé par HTTPS pour traitement et n'est pas intentionnellement conservé après la requête.

  2. Choisissez la langue

    Choisissez la langue qui correspond au document — anglais, français, allemand ou espagnol. Choisir la mauvaise langue fait chuter fortement la précision.

  3. Cliquez sur Extraire le texte

    Nous exécutons la passe de reconnaissance sur chaque page et ajoutons le texte reconnu comme une couche invisible sous chaque image.

  4. Téléchargez le PDF cherchable

    Enregistrez le résultat localement. Le fichier semble identique à avant, mais vous pouvez maintenant y rechercher, sélectionner et copier du texte.

Quand l’utiliser

  • Rendre une pile de contrats numérisés cherchable pour que vous puissiez trouver des clauses par mot-clé au lieu de lire chaque page.
  • Indexer des reçus et des factures numérisés pour que les outils de comptabilité et les barres de recherche puissent en extraire le texte.
  • Convertir des documents photographiés en une archive cherchable — vieilles lettres, notes manuscrites (lorsque l'écriture est claire), anciens documents administratifs.
  • Préparer des PDF numérisés pour la recherche par mot-clé dans les systèmes de gestion documentaire qui ne font pas d'OCR par eux-mêmes.
  • Réutiliser des passages de texte de rapports numérisés sans les retaper à la main — copiez-les plutôt à partir du PDF cherchable.
  • Améliorer l'accessibilité : les lecteurs d'écran peuvent lire le texte d'un PDF soumis à l'OCR ; les scans bruts ne leur donnent rien à lire.

Questions fréquentes

Que signifie OCR ?
OCR signifie Optical Character Recognition (reconnaissance optique de caractères). C'est le processus consistant à examiner une image de texte — comme une page numérisée ou une photo d'un document — et à la transformer en caractères de texte réels qu'un ordinateur peut lire. Une fois qu'un PDF a été soumis à l'OCR, vous pouvez y effectuer des recherches, en copier du texte, et les lecteurs d'écran peuvent le lire.
Le PDF aura-t-il l'air différent après l'OCR ?
Non. Le rendu visuel est préservé exactement : les images de la page sont intactes. Nous ajoutons une couche de texte invisible sous l'image pour que le document soit cherchable et sélectionnable, mais chaque pixel que vous voyez reste identique au scan d'origine.
Quelles langues sont prises en charge ?
Anglais, français, allemand et espagnol. Choisissez la langue qui correspond au texte dominant sur la page lorsque vous téléchargez — la précision chute fortement si la langue est mauvaise, car le moteur utilise des dictionnaires spécifiques à la langue pour décider entre des caractères d'apparence similaire.
Pourquoi la limite de pages est-elle de 10 en gratuit / 50 en Pro ?
L'OCR est très gourmand en CPU — reconnaître chaque glyphe sur chaque page nécessite significativement plus de calcul qu'une simple réécriture de PDF. Les limites de pages empêchent un seul téléchargement de monopoliser le serveur et de ralentir les choses pour tous les autres. Si vous avez un document plus long, divisez-le d'abord et appliquez l'OCR à la section pertinente.
L'OCR fonctionnera-t-il sur une capture d'écran de téléphone d'une page de texte ?
Généralement oui, si la photo est claire, nette et bien éclairée. Les clichés flous, les ombres fortes ou les angles extrêmes produisent des résultats nettement moins bons — les lettres sont mal lues, les mots sont joints ou séparés, et la précision peut chuter en dessous du seuil d'utilité. Pour de meilleurs résultats, numérisez ou photographiez de face avec un éclairage uniforme.
Pourquoi l'OCR ne semble-t-il pas faire grand-chose sur mon PDF classique ?
Parce qu'un PDF classique — exporté depuis Word, un navigateur ou un outil de conception — contient déjà le texte sous forme de texte. Vous pouvez déjà y faire des recherches et copier. L'OCR est destiné aux documents dont le texte n'existe que sous forme d'images, comme un scan d'un contrat papier ou une photo d'un reçu. Sur un PDF normal, l'opération est essentiellement sans effet.