Сканированный документ в текст

Извлекайте текст из сканированных или сфотографированных документов.

Загрузите файл

или перетащите, вставьте или выберите из облака

Вставить URL Попробовать пример
Google Drive Dropbox OneDrive
100% бесплатно Не требуется установка Безопасно и конфиденциально
Реклама
Нам доверяют
eBay Booking.com University of Michigan Cornell University Columbia University
Оцените этот инструмент
0/5 · 0 голосов

Что вы получаете при преобразовании сканированного документа в текст

124 Языки документа, которые читает распознавание текста
10 Сканов за одну загрузку без аккаунта
TXT Обычный текст, который можно редактировать, искать и копировать
Бесплатно Без аккаунта, без установки, без кредитов

Сканированный документ в текст без перепечатки

Преобразование сканированного документа в текст означает одно: извлечь слова со страницы, которая является только картинкой. Сканер или камера телефона сохраняет бумагу как плоское изображение, поэтому буквы на нем это пиксели, а не символы. В таком файле ничего нельзя выделить, найти или исправить, пока страница не будет прочитана и не станет текстом.

Что такое OCR? Оптическое распознавание символов используется для определения букв, цифр и специальных символов в отсканированном документе или изображении. С помощью OCR-конвертера вы можете извлечь текст из таких файлов, чтобы изменить, отредактировать, распечатать или сохранить его.

Результатом становится текстовый файл. В нем сохраняются слова и переносы строк документа, но не оформление страницы. Для большинства задач это и есть цель: вам нужен был текст письма, цифры в форме или абзац, на который нужно ответить.

Несколько сканированных документов за один раз

Преобразование сканированного документа в текст выполняется сразу для нескольких файлов. Добавьте каждую страницу отчета или папку со сканированными письмами, и каждый файл будет конвертирован отдельно и вернется как отдельный текстовый файл. Без аккаунта вы можете отправить 10 сканов за одну загрузку.

Одной настройкой определяется качество распознавания, и это язык документа. Английский уже выбран, поэтому для английской страницы ничего менять не нужно. Для любого другого языка перед запуском выберите соответствующий язык из списка из 124 вариантов.

Фотографии документов здесь считаются сканами. Откройте эту страницу на телефоне, загрузите снимок из галереи, и к нему будет применено то же распознавание. Если телефон сохранил страницу как PDF, а не как изображение, лучше воспользоваться приложением, созданным для PDF‑сканов.

Преобразовать сканированный PDF в текст

Что такое файл TXT?

Расширение .txt используется для простых текстовых файлов. Эти файлы содержат строки текста и могут быть открыты во многих текстовых редакторах на разных платформах и устройствах. Текст не содержит форматирования.

Для документа, который изначально был на бумаге, обычный текст это самый удобный итоговый формат. Файл очень маленький, открывается на любом компьютере или телефоне без лицензии, а слова легко вставляются в электронное письмо, форму или инструмент перевода, не перенося с собой оформление исходной страницы.

Расширение файла: .txt, MIME-тип: text/plain

TXT в Википедии

Какие сканированные документы конвертируются без проблем

Распознавание текста может прочитать только то, что видно на скане. Вот как обычно выглядят самые частые варианты документов.

Документ Как он был получен Результат
Печатная страница 300 dpi Офисный сканер или МФУ Очень чистый результат. Такой документ распознать проще всего.
Многостраничный отчет Отдельный скан на страницу, загруженные вместе Каждая страница возвращается отдельным текстовым файлом, в порядке, в котором вы их добавляли.
Фото документа Камера телефона над листом бумаги Хороший результат, если страница ровная, заполняет кадр и на ней нет тени.
Форма или таблица Любой сканер или камера Текст будет распознан, а колонки нет. В обычном тексте нет структуры таблиц.
Бледная, наклоненная или написанная от руки страница Старая копия, криво поданный лист или текст ручкой Ненадежно. Это приложение не выпрямляет страницу, а рукописный текст не то, для чего создано распознавание.

Сканированный документ, который плохо читается, почти всегда страдает от проблем при сканировании. Повторное сканирование той же страницы, ровно и с разрешением 300 dpi, исправляет больше результатов, чем любые настройки на этой странице.

Когда сканированный документ нужно превратить в текст

Вот задачи, с которыми чаще всего приходят к этому конвертеру.

Вместо перепечатки

Вам прислали скан, а нужен текст, а не картинка. Преобразуйте сканированный документ в текст, и абзацы будут готовы к вставке в ответ, форму или отчет.

Документы на другом языке

Распознавание поддерживает 124 языка документов, поэтому скан на индонезийском, арабском, хинди или японском вернется текстом, который можно сразу вставить в переводчик или строку поиска.

Полка документов за один раз

Отсканируйте стопку, загрузите изображения вместе, и каждый документ вернется отдельным текстовым файлом. Ничего устанавливать не нужно и аккаунт не требуется.

Что происходит с загруженными документами

Шифрование в обе стороны

Каждая загрузка и каждая выдача файла выполняются по зашифрованному соединению, поэтому документ нельзя прочитать по пути к конвертеру или обратно. Ссылка на готовый текстовый файл создается случайным образом и не может быть угадана.

Никто не читает ваши документы

Распознавание текста здесь полностью автоматизировано. Никто не читает, не открывает и не копирует присланные вами документы, ничего не отслеживается, а ваши файлы никогда не используются для обучения AI‑моделей.

Обработка в Европейском союзе

Преобразование выполняется на серверах, расположенных только в Европе, в рамках соглашения об обработке данных. Вместе с файлом обрабатываются только ваш IP‑адрес и дата и время, и только для предотвращения злоупотребления сервисом.

Документ остается вашим

Вы сохраняете авторские права и право собственности на отсканированный документ и на полученный текстовый файл. Конвертация файла здесь ничего никому не передает.

Как конвертировать отсканированный документ в текст?

1

Загрузить

Загрузите отсканированный документ.

2

Настроить

Выберите язык отсканированного документа в выпадающем списке (необязательно).

3

Преобразовать

Нажмите "Start" и через короткое время скачайте полученный текстовый файл.

Вопросы и ответы об отсканированном документе в текст

Этот конвертер отсканированных документов в текст бесплатный?

Да. Конвертация отсканированного документа в текст бесплатна на любом тарифе, не требует аккаунта и не расходует кредиты. Загрузите скан, нажмите «Старт» и скачайте текстовый файл. Платный тариф только увеличивает лимиты размера файла и пакетной обработки.

Как конвертировать отсканированный документ в текст?

Загрузите отсканированный документ выше, выберите язык, на котором он написан, затем нажмите «Старт». Конвертер распознает страницу и вернет текстовый файл, который можно открыть, искать по нему и редактировать в любом редакторе. Ничего устанавливать не нужно.

Могу ли я конвертировать несколько отсканированных документов одновременно?

Да. Добавьте до 10 сканов за одну загрузку без аккаунта. Каждый документ будет конвертирован отдельно и вернется как отдельный текстовый файл. Выбранный язык применяется ко всем.

Мой отсканированный документ в формате PDF. Можно использовать его здесь?

Скан в PDF лучше обработать в приложении scanned PDF to text app. Оно заточено под PDF-страницы и позволяет выбрать движок распознавания, что заметно на длинных документах. Во всем остальном оно работает так же.

Сколько языков понимает конвертер отсканированных документов в текст?

124 языка документов: от английского, индонезийского и испанского до арабского, хинди, японского и корейского. Выберите тот, который соответствует тексту на странице. Английский выбран по умолчанию, поэтому для документа на английском ничего менять не нужно.

Сохранит ли конвертация отсканированного документа в текст мое оформление?

Нет, и именно для этого служит текстовый файл. Передаются слова и разрывы строк; колонки, таблицы, колонтитулы и номера страниц нет, потому что в простом тексте нет страниц. Когда нужно сохранить оформление, используйте convert to Word app.

Местами текст распознался неверно. Что можно сделать?

Проверьте две вещи. Во-первых, совпадает ли выбранный язык с языком документа. Во-вторых, сам скан: бледная, наклоненная или низкого разрешения страница теряет символы, а это приложение не выпрямляет и не очищает страницу. Повторное сканирование с разрешением 300 dpi исправляет большую часть проблем.

Остаются ли приватными отсканированные документы, которые я загружаю?

Да. Они передаются по зашифрованному соединению и обрабатываются автоматически на серверах в Европейском союзе. Никто их не читает и не копирует, они никогда не используются для обучения моделей ИИ, а ссылка на скачивание случайная, поэтому ее невозможно угадать.

Подробнее о распознавании текста

Открытая книга на желтом столе в держателе сканера с заголовком статьи Save Valuable Text With OCR на странице
Инструкции

Сохраните важный текст с помощью OCR

Оцифруйте важные тексты из отсканированных документов и изображений с помощью OCR (оптического распознавания символов). Легко извлекайте текст из изображений онлайн.

Читать статью