OCR PDF gratuit en ligne : Rendre un scan recherchable
PDF Toucan editorial team · Dernière mise à jour : 20 septembre 2026 · 8 min de lecture

Un OCR PDF gratuit en ligne rend un scan recherchable en lisant les caractères visibles sur chaque page et en ajoutant une couche de texte au document. Choisissez les bonnes langues, corrigez l’inclinaison ou l’orientation si nécessaire, puis testez le PDF obtenu avec Ctrl+F ou Cmd+F avant de le convertir en Word.
Pourquoi un PDF scanné n’est-il pas recherchable ?
Un PDF issu d’un scanner ou d’une photo contient souvent une image par page, et non du texte informatique. À l’écran, une lettre numérisée ressemble à un document normal. Pour le lecteur PDF, elle n’est pourtant composée que de pixels : une recherche ne trouve aucun mot, la sélection encadre une zone entière et la copie ne fournit pas de texte exploitable.
L’OCR, ou reconnaissance optique de caractères, analyse les formes visibles dans l’image. Il associe ces formes à des lettres, chiffres et signes de ponctuation, puis ajoute une couche de texte au PDF, positionnée sur les mots de la page. L’apparence du scan est conservée, mais vous pouvez ensuite :
- rechercher un nom, une date, un montant ou une référence ;
- sélectionner et copier une phrase ;
- exploiter plus facilement le contenu dans un autre document.
Le résultat dépend toutefois de la source. Un imprimé net, bien contrasté et numérisé droit donnera généralement de meilleurs résultats qu’une photocopie pâle, une photo prise de biais, une page avec tampons ou une écriture manuscrite. L’OCR est une aide à la lecture et à la recherche, pas une garantie de transcription parfaite.
Comment faire un OCR PDF gratuit en ligne ?
Avec l’outil OCR PDF, vous pouvez rendre un ou plusieurs scans recherchables. PDF Toucan ne demande pas de compte, n’ajoute pas de filigrane et n’impose pas de limite quotidienne sur ses outils dans le navigateur ; la publicité finance le service.
- Ouvrez l’outil, puis cliquez sur « Sélectionner des fichiers PDF ».
- Choisissez le ou les documents. Vous pouvez également déposer un fichier n’importe où sur la page ou le coller.
- Dans « Langue du document », sélectionnez au moins une langue présente dans le PDF.
- Ouvrez « Plus d’options » si vous souhaitez choisir les pages à analyser ou appliquer des corrections.
- Cliquez sur « Reconnaître le texte ».
- Attendez le message « Texte reconnu ! », puis téléchargez le PDF recherchable.
Plusieurs PDF peuvent être ajoutés dans la même opération : chaque fichier est traité séparément. La reconnaissance peut prendre quelques minutes sur un document long ; laissez l’onglet ouvert jusqu’à la disponibilité du résultat.
Comme cette opération est effectuée sur des serveurs, le fichier est envoyé par HTTPS vers des serveurs situés dans l’Union européenne. Il est traité en mémoire, sans écriture sur disque ni stockage, puis supprimé dès le téléchargement du résultat, et au plus tard après 10 minutes. Si un document ne doit jamais quitter votre appareil, utilisez plutôt un logiciel OCR hors ligne.
Quelles langues sélectionner pour l’OCR d’un PDF ?
Le choix de la langue aide le moteur à interpréter les accents, les formes de mots et les alphabets attendus. Pour une facture, un courrier ou un contrat français, sélectionnez français. Pour un document bilingue, sélectionnez uniquement les langues réellement présentes.
L’outil prend en charge 30 langues et plusieurs systèmes d’écriture, dont les écritures latine, cyrillique, grecque, arabe, hébraïque, devanagari, thaïe, chinoise, japonaise et coréenne. Vous pouvez combiner jusqu’à cinq langues dans une même reconnaissance.
N’ajoutez pas des langues « au cas où ». Des langues supplémentaires ralentissent le traitement et peuvent compliquer la reconnaissance de caractères ambigus. Une règle simple consiste à retenir les langues du texte courant, pas celles d’un nom propre isolé ou d’une marque.
| Type de document | Langues à choisir |
|---|---|
| Lettre, facture ou dossier français | Français |
| Contrat français-anglais | Français et anglais |
| Notice en français, allemand et italien | Français, allemand et italien |
| Archive française avec quelques termes étrangers | Français, en général |
Comment redresser des pages inclinées ou mal orientées ?
Des lignes penchées et des pages tournées de côté réduisent la précision de l’OCR. Les corrections de page sont à régler avant de lancer la reconnaissance.
- Activez « Redresser les pages inclinées » si les lignes du scan penchent légèrement. Cette correction facilite la lecture des lignes par le moteur OCR.
- Activez « Corriger automatiquement l’orientation » si certaines pages sont à l’envers ou pivotées sur le côté.
- Pour un scan ordinaire, conservez « Scanner les pages sans texte », l’option recommandée.
- Lancez ensuite le traitement avec « Reconnaître le texte ».
L’option recommandée ne traite que les pages sans texte : les pages déjà numériques, avec du texte sélectionnable, sont laissées intactes. C’est utile pour un PDF mixte, par exemple un courrier créé sur ordinateur suivi de pièces justificatives numérisées.
Le redressement n’est pas disponible lorsque vous sélectionnez « Reconnaître à nouveau le texte existant ». Pour une archive importante, commencez si possible par un fichier court ou quelques pages représentatives. Les tableaux, colonnes, formulaires, cachets et pages très annotées demandent souvent une vérification plus attentive.
Faut-il reconnaître de nouveau le texte existant ou traiter chaque page comme une image ?
Les options d’analyse n’ont pas les mêmes conséquences. Commencez normalement par le mode recommandé, puis choisissez un mode plus radical seulement si la couche de texte existante est manifestement mauvaise.
| Option | Effet | Cas conseillé | Limite |
|---|---|---|---|
| Scanner les pages sans texte | Reconnaît les pages-images et conserve les pages déjà textuelles | Cas général et PDF mixtes | Ne corrige pas un ancien OCR erroné |
| Reconnaître à nouveau le texte existant | Supprime le texte mal reconnu et relit les pages | Recherche ou copie incohérente | Le redressement est indisponible |
| Traiter chaque page comme une image | Repart de zéro pour chaque page | Couche texte inutilisable | Supprime l’ancien texte sélectionnable et les liens |
Choisissez « Reconnaître à nouveau le texte existant » lorsqu’un PDF possède déjà une couche OCR, mais que la recherche échoue ou que le texte copié est incompréhensible. Utilisez « Traiter chaque page comme une image » seulement si nécessaire : cette option transforme toutes les pages en images avant reconnaissance et fait perdre les liens ainsi que le texte sélectionnable existant.
Attention aux documents signés numériquement : l’ajout d’une couche OCR modifie le PDF. La signature numérique n’est donc plus valide après le traitement. Conservez l’original signé intact et utilisez la version recherchable comme copie de travail.
Comment vérifier que le texte OCR est fiable et rechercher un mot ?
Le message de fin confirme que la reconnaissance est terminée, mais pas que chaque caractère est exact. Vérifiez le document avant de l’archiver, de le partager ou de réutiliser des informations importantes.
- Ouvrez le PDF recherchable téléchargé dans votre lecteur habituel.
- Lancez une recherche avec Ctrl+F sous Windows ou Linux, ou Cmd+F sur Mac.
- Testez un élément bien visible : nom propre, date, montant, numéro de facture ou référence.
- Répétez le test au début, au milieu et vers la fin du fichier.
- Sélectionnez une courte phrase, copiez-la dans un éditeur de texte et comparez-la au scan.
Examinez particulièrement les accents, les chiffres et les caractères proches visuellement, comme 0 et O, 1 et l, ou 5 et S. Vérifiez aussi les adresses, identifiants, montants et dates.
Si le résultat est insuffisant, contrôlez d’abord les langues choisies. Relancez ensuite la reconnaissance avec le redressement ou la correction d’orientation si nécessaire. Un scan flou, sombre, peu contrasté ou fortement compressé peut néanmoins conserver des erreurs inévitables.
Comment convertir ensuite le PDF OCR en Word ?
L’ordre des opérations est essentiel pour obtenir un document modifiable.
- Réalisez d’abord l’OCR et téléchargez le PDF recherchable.
- Ouvrez l’outil PDF en Word.
- Cliquez sur « Sélectionner des fichiers PDF » et choisissez le PDF déjà traité par OCR.
- Cliquez sur « Convertir en Word ».
- Téléchargez le document Word, puis ouvrez le fichier DOCX pour le contrôler.
Ne convertissez pas directement un scan brut en espérant récupérer des paragraphes éditables. Dans l’outil PDF en Word, les pages scannées sans couche de texte sont ajoutées au document Word sous forme d’images. L’OCR doit donc précéder la conversion.
Même après l’OCR, relisez la mise en page dans Word, surtout pour les tableaux, colonnes, notes de bas de page et formulaires. Si le PDF est volumineux à cause de ses images, l’outil compress peut être utile après vos vérifications.
FAQ
L’OCR modifie-t-il l’apparence de mon PDF scanné ?
En général, l’image de la page reste la même. L’OCR ajoute une couche de texte permettant la recherche et la copie. En revanche, une page peut être redressée ou réorientée si vous avez activé ces corrections avant le traitement.
Puis-je rechercher un mot dans un PDF après reconnaissance de texte ?
Oui. Ouvrez le PDF obtenu, puis utilisez Ctrl+F sous Windows ou Linux, ou Cmd+F sur Mac. Cherchez un nom, une date ou une référence visible dans le scan. Si rien n’est trouvé, vérifiez les langues sélectionnées et la qualité du document source.
Combien de langues puis-je choisir pour un même PDF ?
Vous pouvez combiner jusqu’à cinq langues lors d’une même reconnaissance. Choisissez seulement celles qui apparaissent réellement dans le document, par exemple français et anglais pour un contrat bilingue. Des langues inutiles ralentissent le traitement et peuvent dégrader certains résultats.
Pourquoi le texte OCR comporte-t-il des erreurs ?
La précision dépend de la netteté, du contraste, de l’orientation, des langues choisies et de la mise en page. Les photos inclinées, manuscrits, photocopies répétées, tampons et tableaux complexes sont plus difficiles à lire. Contrôlez toujours les informations importantes manuellement.
Un PDF signé conserve-t-il sa signature après OCR ?
Non. La reconnaissance ajoute une couche de texte et modifie le contenu du PDF, ce qui invalide la signature numérique. Gardez l’original signé sans modification afin de préserver sa vérifiabilité. Utilisez le PDF OCR uniquement comme copie de travail recherchable.
