Перетворюйте відскановані документи на придатні до пошуку PDF. Шукайте вміст ваших сканів, документів і PDF за ключовими словами, цифрами, іменами та іншим.
або перетягніть, вставте чи виберіть з хмарного сховища
Що застосунок робить з вашим файлом до того, як ви щось завантажите.
Оцифрування документів і перехід на цифровий офіс не тільки корисні для довкілля, а й економлять багато часу, який ви зазвичай витрачаєте на пошук у папках. Однак багато сканів містять лише зображення документів. У таких файлах можна шукати тільки за назвою.
Якщо зробити скан придатним для пошуку, до зображення додається додатковий текстовий шар, створюючи так званий гібридний PDF. Цей текстовий шар дає змогу шукати ключові слова, суми та інші числа, імена або теми всередині PDF.
Тому зчитуваний PDF виглядає точно як скан, з якого його створено. Сторінки, штампи й рукописний текст залишаються на місці. Різниця під ними: прихований шар справжніх символів, готових до читання користувачем, комп'ютером і системою керування документами.
Розширення файлу: .pdf, MIME-тип: application/pdf
PDF у ВікіпедіїЦей застосунок приймає PDF і віддає PDF. Зовнішній вигляд документа не змінюється. Сторінки зберігають свій розмір, скани зберігають свої позначки, а позаду них записується прихований шар розпізнаного тексту.
Це відрізняє його від застосунків, які просто витягують текст із файлу. Ті віддають вам слова в текстовому файлі й втрачають макет. Тут макет залишається як є, тож ви зберігаєте документ, який можна передати далі, роздрукувати чи підписати, і при цьому він шукається, як текстовий файл.
Для завантаження потрібен PDF. Якщо у вас фотографія чи інший графічний файл, застосунки JPG to PDF та PNG to PDF створять для вас PDF і паралельно виконають те саме розпізнавання тексту.
Розпізнавання тексту читає сторінку, спираючись на модель очікуваної мови, тому вказати цю мову - найкорисніше, що можна зробити для результату. Це налаштування розташоване поруч із завантаженням файлів, і це єдиний вибір, який застосунок просить вас зробити.
Воно може працювати з кількома мовами одночасно. Договір з титульною сторінкою англійською і додатком німецькою найкраще читається при виборі обох, так само як і скан, що поєднує латиницю з арабським, кириличним чи китайським письмом.
Список містить 124 мови оригіналу, зокрема арабську, гінді, тайську, в'єтнамську, китайську (спрощену й традиційну), а також кириличні форми азербайджанської, сербської й узбецької. Якщо ви нічого не змінюєте, за замовчуванням вибрано англійську.
Розпізнавання тексту не однаково добре читає всі сторінки. Ось чого варто очікувати від вашого файлу.
| Ваш PDF | Чи можна зробити його зчитуваним | Що робити |
|---|---|---|
| Плоский скан друкованих сторінок | Так | Завантажте його й виберіть мову документа. Саме під такий файл створено цей застосунок. |
| Сторінка, сфотографована телефоном | Здебільшого так | Тіні, кут зйомки й вигнутий корінець знижують точність. По можливості фотографуйте рівно й при рівномірному освітленні. |
| Бліда копія, факс або рукописний текст | Частково | Друкований текст і рукопис - це різні задачі. Очікуйте прогалин і перегляньте результат, перш ніж покладатися на нього. |
| PDF, у якому текст уже можна виділяти | Нічого додавати | Він уже зчитуваний. Якщо вам потрібні лише слова в окремому файлі, скористайтеся PDF to Text. |
| PDF із паролем або пошкоджений PDF | Ні | Застосунок не може його відкрити. Спершу зніміть захист або відновіть файл, а тоді завантажте його ще раз. |
| JPG, PNG чи інший графічний файл | Не тут | JPG to PDF та PNG to PDF створюють PDF і запускають те саме розпізнавання. |
Якість розпізнавання залежить від якості скану. Перекошена сторінка, низька роздільна здатність або тінь на аркуші зменшують точність, тому варто перечитати результат, перш ніж відкладати документ у архів.
Скан і зчитуваний PDF виглядають на екрані однаково. Ось три речі, які вміє лише один із них.
Команда пошуку в будь-якому PDF‑читачі одразу переходить до введеного вами слова. У договорі на 90 сторінок це різниця між пошуком і витраченим днем.
Пошук на комп'ютері та більшість хмарних дисків читають текстовий шар у PDF. Зчитуваний PDF з'являється в результатах за тим, що в ньому написано, а не лише за назвою файлу.
Перетягування курсору по скану нічого не дає, бо там нічого виділяти. У зчитуваному PDF ви можете вибрати абзац і вставити його в лист або нотатку.
Документи, які ви скануєте й конвертуєте, можуть бути особистими. Ось як саме ми з ними працюємо.
Кожне завантаження та завантаження назад відбувається через зашифроване з’єднання, тому ваші файли не можна прочитати під час передачі.
Розпізнавання тексту повністю автоматизоване. Ніхто не читає ваші скани чи документи, і нічого не передається третім сторонам.
Опрацьовується лише те, що потрібно для конвертації. Ваші файли ніколи не використовуються для навчання моделей ШІ.
Завантажте PDF, який хочете зробити зчитуваним. Підійдуть як відскановані, так і сфотографовані сторінки.
Виберіть мову документа зі списку (необов'язково).
Натисніть "Start". Через короткий час документ буде готовий.
Придатний до пошуку PDF - це скан із шаром реального тексту під ним. Сторінки виглядають так само, як паперові оригінали, але слова під зображенням можна шукати, виділяти та копіювати. Такий файл також називають гібридним PDF, оскільки він містить і зображення, і текст в одному файлі.
Завантажте PDF вище, виберіть мову документа та натисніть 'Почати'. Розпізнавання тексту зчитає сторінки, запише знайдений текст у прихований шар і поверне вам PDF. Ви можете завантажити кілька PDF одночасно, і кожен повернеться окремим файлом.
Так. Створення придатного до пошуку PDF безкоштовне, не потребує реєстрації й не витрачає кредити. Тарифний план важливий лише для дуже великих документів і довгих пакетів.
Ні. Якщо ви можете провести курсором по рядку, і слова підсвічуються, PDF уже містить текстовий шар і є придатним до пошуку. Запускати його ще раз немає сенсу. Якщо вам потрібні слова в окремому файлі, скористайтеся замість цього застосунком PDF to Text.
Сервіс підтримує 124 мови, зокрема арабську, гінді, тайську, вʼєтнамську, китайську (спрощену й традиційну), а також кириличні варіанти азербайджанської, сербської та узбецької. Вибирайте всі мови, які є в документі, оскільки сторінки зі змішаними мовами найкраще розпізнаються, коли зазначено їх усі.
Якість розпізнавання залежить від якості скану. Нахилена сторінка, низька роздільна здатність, тінь на папері або фото з рук знижують точність, а рукописний текст складніше розпізнати, ніж друкований. Якщо можливо, скануйте пласко з роздільною здатністю 300 dpi і перед стартом задайте мову документа.
Не в цьому застосунку. Він додає текстовий шар, а не видаляє його. Щоб зробити PDF непридатним до пошуку, потрібно перетворити кожну сторінку назад у зображення, тобто виконати протилежну дію, а цей сервіс цього не робить.
Завантаження та вивантаження відбуваються через зашифроване зʼєднання, обробка здійснюється в сертифікованих дата-центрах у межах Європейського Союзу, а весь процес автоматизований, тому ніхто не читає ваші документи. Ваші файли ніколи не використовуються для навчання моделей ШІ, і ви зберігаєте всі права на них.
Оцифровуйте важливі тексти зі сканованих документів та зображень за допомогою OCR (оптичного розпізнавання символів). Легко витягуйте текст із зображень онлайн.
Читати статтюУсе це працює в браузері. Без встановлення, без облікового запису й з однаковим розпізнаванням тексту за цим.