Convertissez un PDF en texte dans votre navigateur et téléchargez un fichier TXT brut. La reconnaissance de texte est disponible quand vous en avez besoin, et désactivée quand ce n'est pas le cas.
ou déposez, collez ou choisissez depuis le cloud
Convertir un PDF en texte peut vouloir dire deux choses différentes, et ce convertisseur vous laisse choisir celle dont vous avez besoin. La plupart des PDF contiennent déjà de vrais caractères, il suffit donc d’en lire le texte. Un PDF scanné contient au contraire des images de pages, et ces caractères doivent être reconnus avant que quoi que ce soit puisse être extrait.
La reconnaissance de texte est désactivée par défaut, et c’est volontaire. Un PDF avec une vraie couche de texte se convertit plus vite et plus précisément sans OCR, car les mots sont copiés plutôt que déduits à partir d’une image. Activer la reconnaissance quand le fichier n’en a pas besoin ne peut que vous faire perdre en précision.
Vous pouvez savoir en une seconde de quel type de fichier il s’agit. Ouvrez le PDF dans un lecteur et faites glisser le curseur sur une ligne. Si les mots se surlignent, laissez l’OCR désactivé. Si rien ne se surligne, activez-la et choisissez la langue de votre document parmi les 124 langues sources prises en charge.
Extraire le texte d’un PDF transforme une page que vous ne pouvez que regarder en mots que vous pouvez utiliser. Le convertisseur écrit tout ce qu’il trouve dans un fichier texte brut, pour que vous puissiez copier une citation, coller un paragraphe dans un email ou rechercher tout le document avec la commande de recherche de n’importe quel éditeur.
Cela couvre les besoins les plus courants : extraire des références d’un article, récupérer des chiffres d’un rapport, ou transférer le corps d’un long document dans un outil d’édition de texte. Rien n’est retapé et rien n’est transcrit à la main.
Vous pouvez envoyer plusieurs PDF à la fois. Chaque fichier est converti séparément et revient sous forme de son propre fichier texte, avec le même réglage d’OCR et la même langue appliqués à tous. Aucun compte n’est nécessaire et aucune adresse email n’est demandée.
L'extension de fichier .txt est utilisée pour les fichiers texte simples. Ces fichiers contiennent des lignes de texte et peuvent être ouverts dans de nombreux éditeurs de texte sur différentes plates-formes et appareils. Le texte ne contient aucun formatage.
C’est tout l’intérêt de passer de PDF à TXT plutôt qu’à un format de document. Le fichier s’ouvre sur n’importe quel ordinateur et sur n’importe quel téléphone, ne nécessite aucune licence pour être lu et reste lisible longtemps après que le programme ayant produit l’original a été remplacé.
Extension de fichier : .txt, type MIME : text/plain
TXT sur WikipediaUn fichier texte brut contient des mots, pas des pages. Voici ce qui survit à la conversion, et ce qui ne survit pas.
| Depuis le PDF | Dans le fichier TXT |
|---|---|
| Mots et sauts de ligne | Conservés |
| Ordre de lecture | Conservé, de haut en bas |
| Gras, italique et polices | Perdus |
| Images, logos et graphiques | Perdus |
| Tableaux | Conservés comme texte, sans la grille |
| Pages multicolonnes | Refluxées en une seule colonne |
| En-têtes, pieds de page et numéros de page | Écrits avec le texte |
Un fichier texte brut contient les mots, pas la mise en page. Quand la mise en forme compte autant que les mots, l’outil PDF en Word est plus adapté.
Les mots d’un PDF sont bloqués dans une mise en page. Voici les cas où les extraire simplement vous fait gagner le plus de temps.
Les articles, rapports et livres sont partagés en PDF. Extrayez le texte une fois, puis collez les passages dont vous avez besoin dans vos notes au lieu de les retaper.
Un fichier texte s’ouvre dans n’importe quel éditeur, ce qui vous permet d’aller directement à un nom, une date ou un montant au lieu de lire page après page.
Les traducteurs, outils d’écriture, lecteurs d’écran et feuilles de calcul acceptent tous le texte brut. Le TXT est le format que presque tous lisent sans convertisseur.
Les PDF convertis sont souvent des contrats, des factures ou des correspondances privées. Voici exactement comment les vôtres sont traités.
Chaque téléversement et chaque téléchargement utilisent une connexion chiffrée, de sorte que vos fichiers ne peuvent pas être lus pendant le transfert.
Stored on servers with full-disk encryption, and backups are encrypted too.
La reconnaissance de texte est entièrement automatisée. Personne ne lit vos scans ou documents, et rien n'est partagé avec des tiers.
Téléchargez votre PDF.
Activez l’OCR si le PDF est un scan. Laissez-la désactivée quand le texte du fichier est déjà sélectionnable.
Sélectionnez la langue de votre document dans le menu (facultatif).
Cliquez sur "Démarrer" et attendez la fin de la conversion.
Oui. Convertir un PDF en texte est gratuit et ne nécessite pas de compte, et aucune adresse email n’est demandée. Téléversez le fichier, lancez la conversion et téléchargez le texte. Un abonnement ne compte que pour les fichiers très volumineux et les traitements plus longs.
Téléversez le PDF ci-dessus, laissez l’OCR désactivée si le texte du fichier est déjà sélectionnable, puis lancez la conversion. Le résultat est un fichier texte brut que vous pouvez télécharger et ouvrir dans n’importe quel éditeur. Rien n’a besoin d’être installé.
Si les mots se surlignent quand vous faites glisser le curseur, vous pouvez les copier directement depuis votre lecteur PDF. S’ils ne se surlignent pas, la page est une image et il n’y a rien à sélectionner. Convertir le PDF en texte règle ce problème, car le résultat est un fichier texte dans lequel vous pouvez copier librement.
C’est exactement ce que ce convertisseur produit. TXT est le format texte brut, donc le fichier que vous téléchargez porte l’extension .txt et le type de média text/plain. Il s’ouvre dans le Bloc-notes, TextEdit, n’importe quel éditeur de code et sur n’importe quel téléphone, sans logiciel supplémentaire.
Parce que la plupart des PDF n’en ont pas besoin. Un PDF avec une vraie couche de texte se convertit plus vite et plus précisément quand les mots sont copiés plutôt que reconnus à partir d’une image. Activez l’OCR uniquement quand les pages sont des scans ou des photos, et le sélecteur de langue apparaîtra avec.
Oui, avec l’OCR activée. La reconnaissance lit les caractères dans les images de pages et les écrit dans le fichier texte. Si vous convertissez surtout des scans, l’outil PDF scanné en texte est la voie la plus directe vers le même résultat.
Il reconnaît 124 langues sources. En plus des langues européennes, la liste couvre l’hindi, le bengali, le tamoul, l’ourdou, l’arabe, le thaï, le japonais, le coréen et le chinois, en écriture simplifiée et traditionnelle. Choisissez la langue dans laquelle votre document est écrit pour un meilleur résultat.
Oui. Ajoutez autant de PDF que nécessaire et ils seront convertis en une seule fois, chacun étant renvoyé sous forme de fichier texte distinct avec le même réglage OCR et la même langue appliqués.
Numérisez des textes importants à partir de documents et d'images scannés grâce à l'OCR (reconnaissance optique de caractères). Extrayez facilement du texte à partir d'images, en ligne.
Lire l'articleChacun de ces outils s'exécute dans le navigateur. Aucune installation, aucun compte, et la même reconnaissance de texte derrière.