Извлекайте текст из сканированных или сфотографированных документов.
или перетащите, вставьте или выберите из облака
Преобразование сканированного документа в текст означает одно: извлечь слова со страницы, которая является только картинкой. Сканер или камера телефона сохраняет бумагу как плоское изображение, поэтому буквы на нем это пиксели, а не символы. В таком файле ничего нельзя выделить, найти или исправить, пока страница не будет прочитана и не станет текстом.
Что такое OCR? Оптическое распознавание символов используется для определения букв, цифр и специальных символов в отсканированном документе или изображении. С помощью OCR-конвертера вы можете извлечь текст из таких файлов, чтобы изменить, отредактировать, распечатать или сохранить его.
Результатом становится текстовый файл. В нем сохраняются слова и переносы строк документа, но не оформление страницы. Для большинства задач это и есть цель: вам нужен был текст письма, цифры в форме или абзац, на который нужно ответить.
Преобразование сканированного документа в текст выполняется сразу для нескольких файлов. Добавьте каждую страницу отчета или папку со сканированными письмами, и каждый файл будет конвертирован отдельно и вернется как отдельный текстовый файл. Без аккаунта вы можете отправить 10 сканов за одну загрузку.
Одной настройкой определяется качество распознавания, и это язык документа. Английский уже выбран, поэтому для английской страницы ничего менять не нужно. Для любого другого языка перед запуском выберите соответствующий язык из списка из 124 вариантов.
Фотографии документов здесь считаются сканами. Откройте эту страницу на телефоне, загрузите снимок из галереи, и к нему будет применено то же распознавание. Если телефон сохранил страницу как PDF, а не как изображение, лучше воспользоваться приложением, созданным для PDF‑сканов.
Преобразовать сканированный PDF в текстРасширение .txt используется для простых текстовых файлов. Эти файлы содержат строки текста и могут быть открыты во многих текстовых редакторах на разных платформах и устройствах. Текст не содержит форматирования.
Для документа, который изначально был на бумаге, обычный текст это самый удобный итоговый формат. Файл очень маленький, открывается на любом компьютере или телефоне без лицензии, а слова легко вставляются в электронное письмо, форму или инструмент перевода, не перенося с собой оформление исходной страницы.
Расширение файла: .txt, MIME-тип: text/plain
TXT в ВикипедииРаспознавание текста может прочитать только то, что видно на скане. Вот как обычно выглядят самые частые варианты документов.
| Документ | Как он был получен | Результат |
|---|---|---|
| Печатная страница 300 dpi | Офисный сканер или МФУ | Очень чистый результат. Такой документ распознать проще всего. |
| Многостраничный отчет | Отдельный скан на страницу, загруженные вместе | Каждая страница возвращается отдельным текстовым файлом, в порядке, в котором вы их добавляли. |
| Фото документа | Камера телефона над листом бумаги | Хороший результат, если страница ровная, заполняет кадр и на ней нет тени. |
| Форма или таблица | Любой сканер или камера | Текст будет распознан, а колонки нет. В обычном тексте нет структуры таблиц. |
| Бледная, наклоненная или написанная от руки страница | Старая копия, криво поданный лист или текст ручкой | Ненадежно. Это приложение не выпрямляет страницу, а рукописный текст не то, для чего создано распознавание. |
Сканированный документ, который плохо читается, почти всегда страдает от проблем при сканировании. Повторное сканирование той же страницы, ровно и с разрешением 300 dpi, исправляет больше результатов, чем любые настройки на этой странице.
Вот задачи, с которыми чаще всего приходят к этому конвертеру.
Вам прислали скан, а нужен текст, а не картинка. Преобразуйте сканированный документ в текст, и абзацы будут готовы к вставке в ответ, форму или отчет.
Распознавание поддерживает 124 языка документов, поэтому скан на индонезийском, арабском, хинди или японском вернется текстом, который можно сразу вставить в переводчик или строку поиска.
Отсканируйте стопку, загрузите изображения вместе, и каждый документ вернется отдельным текстовым файлом. Ничего устанавливать не нужно и аккаунт не требуется.
Каждая загрузка и каждая выдача файла выполняются по зашифрованному соединению, поэтому документ нельзя прочитать по пути к конвертеру или обратно. Ссылка на готовый текстовый файл создается случайным образом и не может быть угадана.
Распознавание текста здесь полностью автоматизировано. Никто не читает, не открывает и не копирует присланные вами документы, ничего не отслеживается, а ваши файлы никогда не используются для обучения AI‑моделей.
Преобразование выполняется на серверах, расположенных только в Европе, в рамках соглашения об обработке данных. Вместе с файлом обрабатываются только ваш IP‑адрес и дата и время, и только для предотвращения злоупотребления сервисом.
Вы сохраняете авторские права и право собственности на отсканированный документ и на полученный текстовый файл. Конвертация файла здесь ничего никому не передает.
Загрузите отсканированный документ.
Выберите язык отсканированного документа в выпадающем списке (необязательно).
Нажмите "Start" и через короткое время скачайте полученный текстовый файл.
Да. Конвертация отсканированного документа в текст бесплатна на любом тарифе, не требует аккаунта и не расходует кредиты. Загрузите скан, нажмите «Старт» и скачайте текстовый файл. Платный тариф только увеличивает лимиты размера файла и пакетной обработки.
Загрузите отсканированный документ выше, выберите язык, на котором он написан, затем нажмите «Старт». Конвертер распознает страницу и вернет текстовый файл, который можно открыть, искать по нему и редактировать в любом редакторе. Ничего устанавливать не нужно.
Да. Добавьте до 10 сканов за одну загрузку без аккаунта. Каждый документ будет конвертирован отдельно и вернется как отдельный текстовый файл. Выбранный язык применяется ко всем.
Скан в PDF лучше обработать в приложении scanned PDF to text app. Оно заточено под PDF-страницы и позволяет выбрать движок распознавания, что заметно на длинных документах. Во всем остальном оно работает так же.
124 языка документов: от английского, индонезийского и испанского до арабского, хинди, японского и корейского. Выберите тот, который соответствует тексту на странице. Английский выбран по умолчанию, поэтому для документа на английском ничего менять не нужно.
Нет, и именно для этого служит текстовый файл. Передаются слова и разрывы строк; колонки, таблицы, колонтитулы и номера страниц нет, потому что в простом тексте нет страниц. Когда нужно сохранить оформление, используйте convert to Word app.
Проверьте две вещи. Во-первых, совпадает ли выбранный язык с языком документа. Во-вторых, сам скан: бледная, наклоненная или низкого разрешения страница теряет символы, а это приложение не выпрямляет и не очищает страницу. Повторное сканирование с разрешением 300 dpi исправляет большую часть проблем.
Да. Они передаются по зашифрованному соединению и обрабатываются автоматически на серверах в Европейском союзе. Никто их не читает и не копирует, они никогда не используются для обучения моделей ИИ, а ссылка на скачивание случайная, поэтому ее невозможно угадать.
Оцифруйте важные тексты из отсканированных документов и изображений с помощью OCR (оптического распознавания символов). Легко извлекайте текст из изображений онлайн.
Читать статьюВсе эти инструменты работают в браузере, используют одно и то же распознавание текста и не требуют установки.