Конвертируйте PDF в текст в браузере и скачивайте простой TXT-файл. Распознавание текста доступно, когда нужно, и выключено, когда нет.
или перетащите, вставьте или выберите из облака
Преобразование PDF в текст может означать две разные задачи, и этот конвертер позволяет выбрать нужный вариант. В большинстве PDF уже есть настоящий текстовый слой, поэтому текст нужно только считать. В отсканированном PDF вместо этого находятся изображения страниц, и символы на них нужно распознать, прежде чем их можно будет извлечь.
Распознавание текста по умолчанию выключено, и это сделано намеренно. PDF с настоящим текстовым слоем конвертируется быстрее и точнее без него, потому что слова копируются, а не вычисляются по изображению. Включение распознавания там, где файл в нем не нуждается, только снижает точность.
Определить тип файла можно за секунду. Откройте PDF в любой программе для чтения и проведите по строке мышью. Если слова подсвечиваются, оставьте переключатель OCR выключенным. Если нет, включите его и выберите язык из 124 поддерживаемых языков распознавания.
Извлечение текста из PDF превращает страницу, на которую можно только смотреть, в слова, которыми можно пользоваться. Конвертер записывает все найденное в простой текстовый файл, чтобы вы могли копировать цитаты, вставлять абзацы в письмо или искать по всему документу через поиск в любом редакторе.
Это покрывает обычные задачи: взять ссылки из статьи, цифры из отчета или перенести основную часть длинного документа в редактор. Ничего не набирается и не переписывается вручную.
Можно загрузить несколько PDF сразу. Каждый файл конвертируется отдельно и возвращается отдельным текстовым файлом с теми же настройками OCR и тем же языком для всех. Аккаунт не нужен, email не запрашивается.
Расширение .txt используется для простых текстовых файлов. Эти файлы содержат строки текста и могут быть открыты во многих текстовых редакторах на разных платформах и устройствах. Текст не содержит форматирования.
В этом и смысл преобразования PDF в TXT, а не в формат документа. Файл открывается на любом компьютере и телефоне, не требует лицензии для чтения и остается читаемым, даже когда программа, создавшая исходный документ, уже заменена.
Расширение файла: .txt, MIME-тип: text/plain
TXT в ВикипедииПростой текстовый файл хранит слова, а не страницы. Вот что сохраняется при конвертации, а что нет.
| В PDF | В файле TXT |
|---|---|
| Слова и разрывы строк | Сохраняются |
| Порядок чтения | Сохраняется, сверху вниз |
| Жирный шрифт, курсив и шрифты | Не сохраняются |
| Изображения, логотипы и диаграммы | Не сохраняются |
| Таблицы | Сохраняются как текст, без сетки |
| Многоколоночные страницы | Объединяются в одну колонку |
| Колонтитулы и номера страниц | Записываются вместе с текстом |
Простой текстовый файл переносит слова, а не макет. Когда оформление так же важно, как и текст, лучше подойдет приложение PDF в Word.
Слова в PDF закреплены в макете страницы. В этих случаях их простое извлечение экономит больше всего работы.
Статьи, отчеты и книги часто делятся в формате PDF. Один раз извлеките текст и вставляйте нужные фрагменты в заметки вместо повторного набора.
Текстовый файл открывается в любом редакторе, поэтому вы можете сразу перейти к нужному имени, дате или сумме вместо чтения страницы за страницей.
Переводчики, редакторы, экранные дикторы и таблицы работают с простым текстом. TXT это формат, который почти все они принимают без дополнительного конвертера.
PDF-файлы, которые пользователи конвертируют, часто являются договорами, счетами или личной перепиской. Вот как именно обрабатываются ваши файлы.
Каждая загрузка и скачивание выполняются по зашифрованному соединению, поэтому ваши файлы не могут быть прочитаны по пути.
Stored on servers with full-disk encryption, and backups are encrypted too.
Распознавание текста полностью автоматизировано. Никто не читает ваши сканы или документы, и ничего не передается третьим лицам.
Загрузите свой PDF.
Включите OCR, если PDF это скан. Оставьте его выключенным, когда текст в файле уже можно выделить.
Выберите язык документа в меню (необязательно).
Нажмите "Start" и дождитесь окончания конвертации.
Да. Конвертация PDF в текст бесплатна и не требует аккаунта, email не запрашивается. Загрузите файл, запустите конвертацию и скачайте текст. Тарифный план важен только для очень больших файлов и длинных пакетов.
Загрузите PDF выше, оставьте переключатель OCR выключенным, если текст в файле уже можно выделить, и запустите конвертацию. Результатом будет простой текстовый файл, который можно скачать и открыть в любом редакторе. Ничего устанавливать не нужно.
Если слова подсвечиваются при выделении, вы можете копировать их прямо из программы для чтения PDF. Если нет, страница является изображением и выделить нечего. Преобразование PDF в текст решает это, потому что результат это текстовый файл, из которого можно свободно копировать.
Именно такой файл и создает этот конвертер. TXT это формат простого текста, поэтому скачиваемый файл имеет расширение .txt и тип данных text/plain. Он открывается в Блокноте, TextEdit, любом кодовом редакторе и на любом телефоне без дополнительного ПО.
Потому что большинство PDF не нуждаются в нем. PDF с настоящим текстовым слоем конвертируется быстрее и точнее, когда слова копируются, а не распознаются с изображения. Включайте OCR только если страницы это сканы или фотографии, вместе с ним появится выбор языка.
Да, при включенном OCR. Распознавание считывает символы с изображений страниц и записывает их в текстовый файл. Если вы в основном конвертируете сканы, приложение для сканов PDF в текст это более прямой путь к тому же результату.
Он поддерживает распознавание 124 исходных языков. Помимо европейских, в список входят хинди, бенгальский, тамильский, урду, арабский, тайский, японский, корейский и китайский (упрощенный и традиционный). Для наилучшего результата выберите язык, на котором написан ваш документ.
Да. Добавьте столько PDF, сколько нужно, и они будут конвертированы за один раз, каждый будет сохранен как отдельный текстовый файл с теми же настройками OCR и тем же языком.
Оцифруйте важные тексты из отсканированных документов и изображений с помощью OCR (оптического распознавания символов). Легко извлекайте текст из изображений онлайн.
Читать статьюВсе эти операции выполняются в браузере. Никакой установки, никакого аккаунта и одно и то же распознавание текста за ними.