Convertissez des documents numérisés en PDF consultables. Recherchez le contenu de vos scans, documents et PDF à l'aide de mots-clés, de chiffres, de noms, etc.
ou déposez, collez ou choisissez depuis le cloud
Ce que l'app fait avec votre fichier avant que vous ne téléchargiez quoi que ce soit.
La numérisation de vos documents et la gestion d'un bureau numérique ne sont pas seulement bénéfiques pour l'environnement, elles vous font aussi gagner beaucoup de temps que vous passeriez à chercher dans de nombreux dossiers. Cependant, de nombreux scans ne contiennent que des images des documents numérisés. Ceux-ci ne peuvent pas être recherchés, sauf par le nom du fichier.
En rendant un scan consultable, une couche de texte supplémentaire est ajoutée à l'image numérisée, créant ainsi un PDF hybride. Cette couche de texte vous permet de rechercher des mots-clés, des montants et autres nombres, des noms ou des sujets à l'intérieur du PDF.
Un PDF interrogeable ressemble donc exactement au scan dont il vient. Les pages, les tampons et l'écriture manuscrite restent en place. La différence se trouve en dessous, où une couche de vrais caractères attend votre lecteur, votre ordinateur et votre gestionnaire de documents.
Extension de fichier : .pdf, type MIME : application/pdf
PDF sur WikipédiaCette app prend un PDF et renvoie un PDF. Rien dans l'apparence du document ne change. Les pages gardent leur taille, les scans gardent leurs marques, et une couche cachée de texte reconnu est écrite derrière.
C'est ce qui la distingue des apps qui extraient le texte d'un fichier. Celles-ci vous donnent les mots dans un fichier texte brut et laissent la mise en page de côté. Celle-ci laisse la mise en page intacte, vous gardez donc un document que vous pouvez transmettre, imprimer ou signer, et qui se recherche aussi comme un fichier texte.
Le fichier à télécharger doit être un PDF. Si vous avez une photo ou un fichier image, les apps JPG to PDF et PNG to PDF créent le PDF pour vous et exécutent la même reconnaissance de texte pendant ce processus.
La reconnaissance de texte lit une page à partir d'un modèle de la langue attendue, donc indiquer cette langue est la chose la plus utile que vous puissiez faire pour le résultat. Le paramètre se trouve à côté de l'outil de téléchargement et c'est le seul choix que l'app vous demande de faire.
Elle accepte plus d'une langue à la fois. Un contrat avec une page de garde en anglais et une annexe en allemand se lit mieux avec les deux sélectionnées, tout comme un scan qui mélange un alphabet latin avec de l'arabe, du cyrillique ou du chinois.
La liste contient 124 langues sources, dont l'arabe, l'hindi, le thaï, le vietnamien, le chinois simplifié et traditionnel, et les formes cyrilliques de l'azerbaïdjanais, du serbe et de l'ouzbek. L'anglais est sélectionné par défaut si vous ne changez rien.
La reconnaissance de texte ne lit pas chaque page avec la même qualité. Voici ce à quoi vous attendre avec le fichier que vous avez.
| Le PDF que vous avez | Peut-il être rendu interrogeable | Que faire |
|---|---|---|
| Un simple scan de pages imprimées | Oui | Téléchargez-le et choisissez la langue du document. C'est le type de fichier pour lequel l'app est conçue. |
| Une page photographiée avec un téléphone | En général | Les ombres, les angles et une reliure courbée nuisent à la précision. Photographiez à plat et avec une lumière uniforme lorsque c'est possible. |
| Une copie pâle, un fax ou de l'écriture manuscrite | Partiellement | L'impression et l'écriture manuscrite ne posent pas le même problème. Attendez-vous à des manques et relisez le résultat avant de vous y fier. |
| Un PDF dont vous pouvez déjà sélectionner le texte | Rien à ajouter | Il est déjà interrogeable. Utilisez PDF to Text si vous voulez les mots dans un fichier séparé. |
| Un PDF protégé par mot de passe ou endommagé | Non | L'app ne peut pas l'ouvrir. Retirez la protection ou réparez d'abord le fichier, puis téléchargez-le à nouveau. |
| Un fichier image JPG, PNG ou autre | Pas ici | JPG en PDF et PNG en PDF créent le PDF et exécutent la même reconnaissance. |
La qualité de reconnaissance suit la qualité du scan. Une page de travers, une faible résolution ou une ombre sur le papier nuisent à la précision, il vaut donc la peine de relire le résultat avant d'archiver le document.
Un scan et un PDF interrogeable ont le même aspect à l'écran. Voici trois choses que seul l'un des deux peut faire.
La commande de recherche de tout lecteur PDF va directement au mot que vous avez tapé. Sur un bail de 90 pages, c'est la différence entre une recherche et un après-midi.
La recherche sur le poste de travail et la plupart des services cloud lisent la couche de texte à l'intérieur d'un PDF. Un PDF interrogeable apparaît dans les résultats en fonction de ce qui y est écrit, et pas seulement de son nom de fichier.
Faire glisser votre curseur sur un scan ne fait rien, car il n'y a rien à sélectionner. Un PDF interrogeable vous permet de sélectionner un paragraphe et de le coller dans un e-mail ou une note.
Les papiers que vous scannez et les documents que vous convertissez peuvent être personnels. Voici exactement comment les vôtres sont traités.
Chaque téléversement et chaque téléchargement utilisent une connexion chiffrée, de sorte que vos fichiers ne peuvent pas être lus pendant le transfert.
La reconnaissance de texte est entièrement automatisée. Personne ne lit vos scans ou documents, et rien n'est partagé avec des tiers.
Seul ce qui est nécessaire à la conversion est traité. Vos fichiers ne sont jamais utilisés pour entraîner des modèles d'IA.
Téléchargez le PDF que vous voulez rendre interrogeable. Les pages scannées et les pages photographiées fonctionnent toutes les deux.
Choisissez la langue du document dans la liste (facultatif).
Cliquez sur "Start". Après un court instant, votre document sera prêt.
Un PDF interrogeable est une numérisation avec une couche de texte réel derrière. Les pages ressemblent toujours exactement au papier d'origine, mais les mots en dessous peuvent être recherchés, sélectionnés et copiés. On l'appelle aussi PDF hybride, car il contient l'image et le texte dans un seul fichier.
Téléchargez le PDF ci-dessus, choisissez la langue du document et cliquez sur Démarrer. La reconnaissance de texte lit les pages, écrit ce qu'elle trouve dans une couche cachée et vous renvoie le PDF. Plusieurs PDF peuvent être traités en même temps, et chacun revient séparément.
Oui. Rendre un PDF interrogeable est gratuit, sans inscription et sans crédits. Un abonnement n'est utile que pour des documents très volumineux et de longues séries.
Non. Si vous pouvez faire glisser votre curseur sur une ligne et que les mots se surlignent, le PDF contient déjà une couche de texte et est déjà interrogeable. Le relancer ici n'apporte rien. Si vous voulez les mots dans un fichier séparé, utilisez plutôt l'application PDF vers Texte.
Il lit 124 langues source, dont l'arabe, l'hindi, le thaï, le vietnamien, le chinois simplifié et traditionnel, et les variantes cyrilliques de l'azerbaïdjanais, du serbe et de l'ouzbek. Sélectionnez toutes les langues présentes dans le document, car une page mixte se lit mieux lorsqu'elles sont toutes indiquées.
La qualité de reconnaissance dépend de la qualité de la numérisation. Une page de travers, une faible résolution, une ombre sur le papier ou une photo prise à la main réduisent la précision, et l'écriture manuscrite est encore plus difficile à lire que l'imprimé. Numérisez à plat à 300 dpi lorsque c'est possible, et définissez la langue du document avant de commencer.
Pas avec cette application. Elle ajoute une couche de texte au lieu d'en supprimer une. Rendre un PDF non interrogeable signifie aplatir chaque page en image, ce qui est l'opération inverse, et rien ici ne le fait.
Les envois et les téléchargements passent par une connexion chiffrée, le traitement a lieu au sein de l'Union européenne, et toute la chaîne est automatisée, de sorte que personne ne lit vos documents. Vos fichiers ne servent jamais à entraîner des modèles d'IA et vous conservez vos droits dessus.
Numérisez des textes importants à partir de documents et d'images scannés grâce à l'OCR (reconnaissance optique de caractères). Extrayez facilement du texte à partir d'images, en ligne.
Lire l'articleChacun de ces outils s'exécute dans le navigateur. Aucune installation, aucun compte, et la même reconnaissance de texte derrière.