Сканований документ в текст

Витягніть текст зі сканованих або сфотографованих документів.

Завантажте ваш файл

або перетягніть, вставте чи виберіть з хмарного сховища

Вставити URL Спробувати зразок
Google Drive Dropbox OneDrive
100% безкоштовно Без встановлення Безпечно й конфіденційно
Реклама
Нам довіряють
eBay Booking.com University of Michigan Cornell University Columbia University
Оцініть цей інструмент
0/5 · 0 голосів

Що ви отримуєте від перетворення сканованого документа на текст

124 Мови документа, які розпізнає текст
10 Сканів за одне завантаження без облікового запису
TXT Звичайний текст, який можна редагувати, шукати та копіювати
Безкоштовно Без облікового запису, без встановлення, без кредитів

Сканований документ у текст без передруку

Перетворення сканованого документа на текст означає одне: отримати слова зі сторінки, яка є лише зображенням. Сканер або камера телефона зберігає папір як плоске зображення, тому літери на ньому є пікселями, а не символами. У такому файлі нічого не можна виділити, знайти чи виправити, доки сторінку не буде прочитано та не записано як текст.

Що таке OCR? Оптичне розпізнавання символів використовується для ідентифікації літер, цифр або спеціальних символів у відсканованому документі чи зображенні. За допомогою OCR-конвертера ви можете витягти текст з таких файлів, щоб змінювати, редагувати, друкувати або зберігати його.

У результаті ви отримуєте текстовий файл. У ньому зберігаються слова та розриви рядків документа, але не його дизайн сторінки. Для більшості завдань у цьому й полягає суть: вам потрібен текст листа, цифри у формі або абзац, на який треба відповісти.

Кілька сканованих документів одночасно

Перетворення сканованого документа на текст працює відразу з кількома файлами. Додайте всі сторінки звіту або теку зі сканами листів, і кожен файл буде перетворено окремо та повернеться як свій власний текстовий файл. Без облікового запису ви можете надіслати 10 сканів за одне завантаження.

Один параметр визначає, наскільки добре працює розпізнавання, і це мова документа. Англійську вже вибрано, тож для англійської сторінки нічого змінювати не потрібно. Для інших мов виберіть відповідну мову зі списку з 124 перед початком.

Фотографії паперових документів тут також вважаються сканами. Відкрийте цю сторінку на телефоні, завантажте фото з галереї, і для нього запуститься те саме розпізнавання. Якщо телефон зберіг сторінку як PDF, а не як зображення, краще скористатися додатком, створеним для PDF-сканів.

Конвертувати сканований PDF у текст

Що таке файл TXT?

Розширення .txt використовується для файлів звичайного тексту. Такі файли містять рядки тексту й можуть відкриватися в багатьох текстових редакторах на різних платформах і пристроях. Текст не містить форматування.

Для документа, що почався на папері, звичайний текст це найзручніший кінцевий формат. Файл дуже маленький, відкривається на будь-якому комп'ютері чи телефоні без ліцензії, а слова легко вставити в лист, форму або інструмент перекладу, не тягнучи за собою вигляд оригінальної сторінки.

Розширення файлу: .txt, MIME-тип: text/plain

TXT на Вікіпедії

Які скановані документи перетворюються коректно

Розпізнавання тексту може прочитати лише те, що показано на скані. Ось як зазвичай виглядають найчастіші завантаження.

Документ Як його було отримано Що виходить у результаті
Надрукована сторінка з роздільною здатністю 300 dpi Офісний сканер або БФП Дуже чистий результат. Це найлегший для читання тип документа.
Багатосторінковий звіт Один скан на сторінку, завантажені разом Кожна сторінка повертається як окремий текстовий файл у тому порядку, у якому ви їх додали.
Фото документа Камера телефона, спрямована зверху на аркуш Хороший результат, якщо сторінка рівна, заповнює кадр і без тіней.
Форма або таблиця Будь-який сканер або камера Слова будуть розпізнані, але колонки ні. У звичайному тексті немає структури таблиці.
Бліда, перекошена або рукописна сторінка Стара копія, кривий подавач або ручка Ненадійно. Цей застосунок не вирівнює сторінку, а рукописний текст не є тим, для чого створено розпізнавання.

Сканований документ, який погано читається, майже завжди є проблемою захоплення зображення. Повторне сканування тієї ж сторінки рівно і з роздільною здатністю 300 dpi виправляє більше результатів, ніж будь-який параметр на цій сторінці.

Коли сканований документ має стати текстом

Ось завдання, з якими найчастіше використовують цей конвертер.

Замість передруку

Хтось надіслав вам скан, а вам потрібен текст, а не його зображення. Перетворіть сканований документ на текст, і абзаци будуть готові для вставки у відповідь, форму або звіт.

Документи іншою мовою

Розпізнавання охоплює 124 мови документів, тож скан індонезійською, арабською, гінді чи японською повернеться як текст, який можна одразу вставити в перекладач або поле пошуку.

Стос паперів за один раз

Проскануйте стос, завантажте зображення разом, і кожен документ повернеться як окремий текстовий файл. Нічого не потрібно встановлювати, і обліковий запис не потрібен.

Що відбувається з документами, які ви завантажуєте

Шифрування в обидва боки

Кожне завантаження та кожне вивантаження відбувається через зашифроване з'єднання, тому документ неможливо прочитати дорогою до конвертера чи назад. Посилання на готовий текстовий файл генерується випадково і його неможливо вгадати.

Ніхто не читає ваші документи

Розпізнавання тексту тут повністю автоматизоване. Ніхто не читає, не відкриває і не копіює надіслані вами документи, нічого не контролюється, а ваші файли ніколи не використовуються для навчання моделей ШІ.

Обробка в Європейському Союзі

Перетворення виконується на серверах, розташованих виключно в Європі, які працюють за угодою про обробку даних. Разом із файлом обробляються лише ваша IP-адреса, дата і час, і лише для запобігання зловживанню сервісом.

Документ залишається вашим

Авторські права та право власності на відсканований документ і створений з нього текстовий файл залишаються за вами. Конвертація файлу тут нічого нікому не передає.

Як конвертувати відсканований документ у текст?

1

Завантажити

Завантажте свій відсканований документ.

2

Налаштувати

Виберіть мову відсканованого документа у випадаючому меню (необов'язково).

3

Конвертувати

Натисніть "Start" і через нетривалий час завантажте перетворений текстовий файл.

Поширені запитання про конвертацію відсканованого документа в текст

Чи безкоштовний цей конвертер відсканованих документів у текст?

Так. Конвертація відсканованого документа в текст безкоштовна в усіх тарифах, не потребує облікового запису й не витрачає кредити. Завантажте скан, натисніть «Почати» та завантажте текстовий файл. Платний тариф лише збільшує ліміт розміру файлів і пакетної обробки.

Як конвертувати відсканований документ у текст?

Завантажте відсканований документ вище, виберіть мову, якою він написаний, потім натисніть «Почати». Конвертер зчитає сторінку та поверне текстовий файл, який можна відкривати, шукати в ньому й редагувати в будь-якому редакторі. Нічого не потрібно встановлювати.

Чи можу я конвертувати кілька відсканованих документів одночасно?

Так. Додайте 10 сканів за одне завантаження без облікового запису, і кожен документ буде конвертовано окремо та повернеться як окремий текстовий файл. Обрана вами мова застосовується до всіх.

Мій відсканований документ у форматі PDF. Чи можу я використати його тут?

PDF-скан краще обробити в застосунку scanned PDF to text app. Він працює зі сторінками PDF і дає змогу вибрати рушій розпізнавання, що має значення для довгих документів. В усьому іншому він працює так само.

Скількома мовами може читати конвертер відсканованих документів у текст?

124 мовами документів: від англійської, індонезійської та іспанської до арабської, гінді, японської та корейської. Виберіть ту, що відповідає тексту на сторінці. Англійська вибрана за замовчуванням, тому для англомовного документа нічого змінювати не потрібно.

Чи збереже конвертація відсканованого документа в текст моє форматування?

Ні, і саме для цього існує текстовий файл. Переносяться слова й розриви рядків; колонки, таблиці, колонтитули та номери сторінок ні, оскільки звичайний текст не має сторінок. Коли потрібно відновити форматування, скористайтеся застосунком convert to Word app.

Місцями текст розпізнано неправильно. Що я можу зробити?

Перевірте дві речі. По-перше, чи вибрана мова відповідає документу. По-друге, сам скан: бліда, перекошена або низької роздільної здатності сторінка втрачає символи, а цей застосунок не вирівнює та не очищає сторінку. Повторне сканування з роздільною здатністю 300 dpi зазвичай виправляє більшість проблем.

Чи приватні відскановані документи, які я завантажую?

Так. Вони передаються зашифрованим з'єднанням і обробляються автоматично на серверах у Європейському Союзі. Ніхто їх не читає й не копіює, вони ніколи не використовуються для навчання моделей штучного інтелекту, а посилання для завантаження є випадковим, тому його неможливо вгадати.

Докладніше про розпізнавання тексту

Відкрита книга на жовтому столі, в рамці тримача сканера, із заголовком статті "Save Valuable Text With OCR", надрукованим поперек сторінки
Як

Зберігайте цінний текст за допомогою OCR

Оцифровуйте важливі тексти зі сканованих документів та зображень за допомогою OCR (оптичного розпізнавання символів). Легко витягуйте текст із зображень онлайн.

Читати статтю