Витягніть текст зі сканованих або сфотографованих документів.
або перетягніть, вставте чи виберіть з хмарного сховища
Перетворення сканованого документа на текст означає одне: отримати слова зі сторінки, яка є лише зображенням. Сканер або камера телефона зберігає папір як плоске зображення, тому літери на ньому є пікселями, а не символами. У такому файлі нічого не можна виділити, знайти чи виправити, доки сторінку не буде прочитано та не записано як текст.
Що таке OCR? Оптичне розпізнавання символів використовується для ідентифікації літер, цифр або спеціальних символів у відсканованому документі чи зображенні. За допомогою OCR-конвертера ви можете витягти текст з таких файлів, щоб змінювати, редагувати, друкувати або зберігати його.
У результаті ви отримуєте текстовий файл. У ньому зберігаються слова та розриви рядків документа, але не його дизайн сторінки. Для більшості завдань у цьому й полягає суть: вам потрібен текст листа, цифри у формі або абзац, на який треба відповісти.
Перетворення сканованого документа на текст працює відразу з кількома файлами. Додайте всі сторінки звіту або теку зі сканами листів, і кожен файл буде перетворено окремо та повернеться як свій власний текстовий файл. Без облікового запису ви можете надіслати 10 сканів за одне завантаження.
Один параметр визначає, наскільки добре працює розпізнавання, і це мова документа. Англійську вже вибрано, тож для англійської сторінки нічого змінювати не потрібно. Для інших мов виберіть відповідну мову зі списку з 124 перед початком.
Фотографії паперових документів тут також вважаються сканами. Відкрийте цю сторінку на телефоні, завантажте фото з галереї, і для нього запуститься те саме розпізнавання. Якщо телефон зберіг сторінку як PDF, а не як зображення, краще скористатися додатком, створеним для PDF-сканів.
Конвертувати сканований PDF у текстРозширення .txt використовується для файлів звичайного тексту. Такі файли містять рядки тексту й можуть відкриватися в багатьох текстових редакторах на різних платформах і пристроях. Текст не містить форматування.
Для документа, що почався на папері, звичайний текст це найзручніший кінцевий формат. Файл дуже маленький, відкривається на будь-якому комп'ютері чи телефоні без ліцензії, а слова легко вставити в лист, форму або інструмент перекладу, не тягнучи за собою вигляд оригінальної сторінки.
Розширення файлу: .txt, MIME-тип: text/plain
TXT на ВікіпедіїРозпізнавання тексту може прочитати лише те, що показано на скані. Ось як зазвичай виглядають найчастіші завантаження.
| Документ | Як його було отримано | Що виходить у результаті |
|---|---|---|
| Надрукована сторінка з роздільною здатністю 300 dpi | Офісний сканер або БФП | Дуже чистий результат. Це найлегший для читання тип документа. |
| Багатосторінковий звіт | Один скан на сторінку, завантажені разом | Кожна сторінка повертається як окремий текстовий файл у тому порядку, у якому ви їх додали. |
| Фото документа | Камера телефона, спрямована зверху на аркуш | Хороший результат, якщо сторінка рівна, заповнює кадр і без тіней. |
| Форма або таблиця | Будь-який сканер або камера | Слова будуть розпізнані, але колонки ні. У звичайному тексті немає структури таблиці. |
| Бліда, перекошена або рукописна сторінка | Стара копія, кривий подавач або ручка | Ненадійно. Цей застосунок не вирівнює сторінку, а рукописний текст не є тим, для чого створено розпізнавання. |
Сканований документ, який погано читається, майже завжди є проблемою захоплення зображення. Повторне сканування тієї ж сторінки рівно і з роздільною здатністю 300 dpi виправляє більше результатів, ніж будь-який параметр на цій сторінці.
Ось завдання, з якими найчастіше використовують цей конвертер.
Хтось надіслав вам скан, а вам потрібен текст, а не його зображення. Перетворіть сканований документ на текст, і абзаци будуть готові для вставки у відповідь, форму або звіт.
Розпізнавання охоплює 124 мови документів, тож скан індонезійською, арабською, гінді чи японською повернеться як текст, який можна одразу вставити в перекладач або поле пошуку.
Проскануйте стос, завантажте зображення разом, і кожен документ повернеться як окремий текстовий файл. Нічого не потрібно встановлювати, і обліковий запис не потрібен.
Кожне завантаження та кожне вивантаження відбувається через зашифроване з'єднання, тому документ неможливо прочитати дорогою до конвертера чи назад. Посилання на готовий текстовий файл генерується випадково і його неможливо вгадати.
Розпізнавання тексту тут повністю автоматизоване. Ніхто не читає, не відкриває і не копіює надіслані вами документи, нічого не контролюється, а ваші файли ніколи не використовуються для навчання моделей ШІ.
Перетворення виконується на серверах, розташованих виключно в Європі, які працюють за угодою про обробку даних. Разом із файлом обробляються лише ваша IP-адреса, дата і час, і лише для запобігання зловживанню сервісом.
Авторські права та право власності на відсканований документ і створений з нього текстовий файл залишаються за вами. Конвертація файлу тут нічого нікому не передає.
Завантажте свій відсканований документ.
Виберіть мову відсканованого документа у випадаючому меню (необов'язково).
Натисніть "Start" і через нетривалий час завантажте перетворений текстовий файл.
Так. Конвертація відсканованого документа в текст безкоштовна в усіх тарифах, не потребує облікового запису й не витрачає кредити. Завантажте скан, натисніть «Почати» та завантажте текстовий файл. Платний тариф лише збільшує ліміт розміру файлів і пакетної обробки.
Завантажте відсканований документ вище, виберіть мову, якою він написаний, потім натисніть «Почати». Конвертер зчитає сторінку та поверне текстовий файл, який можна відкривати, шукати в ньому й редагувати в будь-якому редакторі. Нічого не потрібно встановлювати.
Так. Додайте 10 сканів за одне завантаження без облікового запису, і кожен документ буде конвертовано окремо та повернеться як окремий текстовий файл. Обрана вами мова застосовується до всіх.
PDF-скан краще обробити в застосунку scanned PDF to text app. Він працює зі сторінками PDF і дає змогу вибрати рушій розпізнавання, що має значення для довгих документів. В усьому іншому він працює так само.
124 мовами документів: від англійської, індонезійської та іспанської до арабської, гінді, японської та корейської. Виберіть ту, що відповідає тексту на сторінці. Англійська вибрана за замовчуванням, тому для англомовного документа нічого змінювати не потрібно.
Ні, і саме для цього існує текстовий файл. Переносяться слова й розриви рядків; колонки, таблиці, колонтитули та номери сторінок ні, оскільки звичайний текст не має сторінок. Коли потрібно відновити форматування, скористайтеся застосунком convert to Word app.
Перевірте дві речі. По-перше, чи вибрана мова відповідає документу. По-друге, сам скан: бліда, перекошена або низької роздільної здатності сторінка втрачає символи, а цей застосунок не вирівнює та не очищає сторінку. Повторне сканування з роздільною здатністю 300 dpi зазвичай виправляє більшість проблем.
Так. Вони передаються зашифрованим з'єднанням і обробляються автоматично на серверах у Європейському Союзі. Ніхто їх не читає й не копіює, вони ніколи не використовуються для навчання моделей штучного інтелекту, а посилання для завантаження є випадковим, тому його неможливо вгадати.
Оцифровуйте важливі тексти зі сканованих документів та зображень за допомогою OCR (оптичного розпізнавання символів). Легко витягуйте текст із зображень онлайн.
Читати статтюУсі ці інструменти працюють у браузері, з однаковим механізмом розпізнавання тексту та без встановлення.