Створюйте придатні до пошуку PDF онлайн

Перетворюйте відскановані документи на придатні до пошуку PDF. Шукайте вміст ваших сканів, документів і PDF за ключовими словами, цифрами, іменами та іншим.

Завантажте ваш файл

або перетягніть, вставте чи виберіть з хмарного сховища

Вставити URL Спробувати зразок
Google Drive Dropbox OneDrive
100% безкоштовно Без встановлення Безпечно й конфіденційно
Реклама
Нам довіряють
eBay Booking.com University of Michigan Cornell University Columbia University
Оцініть цей інструмент
0/5 · 0 голосів

Ознайомлення зі «зчитуваним» PDF

Що застосунок робить з вашим файлом до того, як ви щось завантажите.

124 мови оригіналу, які читає розпізнавання тексту
PDF ви завантажуєте PDF, а отримуєте PDF із текстовим шаром
1 налаштування для вибору: мова вашого документа
0 використано кредитів. Застосунок безкоштовний і не потребує акаунта

Для чого потрібні PDF з можливістю пошуку?

Оцифрування документів і перехід на цифровий офіс не тільки корисні для довкілля, а й економлять багато часу, який ви зазвичай витрачаєте на пошук у папках. Однак багато сканів містять лише зображення документів. У таких файлах можна шукати тільки за назвою.

Якщо зробити скан придатним для пошуку, до зображення додається додатковий текстовий шар, створюючи так званий гібридний PDF. Цей текстовий шар дає змогу шукати ключові слова, суми та інші числа, імена або теми всередині PDF.

Тому зчитуваний PDF виглядає точно як скан, з якого його створено. Сторінки, штампи й рукописний текст залишаються на місці. Різниця під ними: прихований шар справжніх символів, готових до читання користувачем, комп'ютером і системою керування документами.

Розширення файлу: .pdf, MIME-тип: application/pdf

PDF у Вікіпедії

PDF на вхід, PDF на вихід: що змінюється, а що ні

Цей застосунок приймає PDF і віддає PDF. Зовнішній вигляд документа не змінюється. Сторінки зберігають свій розмір, скани зберігають свої позначки, а позаду них записується прихований шар розпізнаного тексту.

Це відрізняє його від застосунків, які просто витягують текст із файлу. Ті віддають вам слова в текстовому файлі й втрачають макет. Тут макет залишається як є, тож ви зберігаєте документ, який можна передати далі, роздрукувати чи підписати, і при цьому він шукається, як текстовий файл.

Для завантаження потрібен PDF. Якщо у вас фотографія чи інший графічний файл, застосунки JPG to PDF та PNG to PDF створять для вас PDF і паралельно виконають те саме розпізнавання тексту.

Перед початком задайте мову документа

Розпізнавання тексту читає сторінку, спираючись на модель очікуваної мови, тому вказати цю мову - найкорисніше, що можна зробити для результату. Це налаштування розташоване поруч із завантаженням файлів, і це єдиний вибір, який застосунок просить вас зробити.

Воно може працювати з кількома мовами одночасно. Договір з титульною сторінкою англійською і додатком німецькою найкраще читається при виборі обох, так само як і скан, що поєднує латиницю з арабським, кириличним чи китайським письмом.

Список містить 124 мови оригіналу, зокрема арабську, гінді, тайську, в'єтнамську, китайську (спрощену й традиційну), а також кириличні форми азербайджанської, сербської й узбецької. Якщо ви нічого не змінюєте, за замовчуванням вибрано англійську.

Які PDF можна зробити зчитуваними

Розпізнавання тексту не однаково добре читає всі сторінки. Ось чого варто очікувати від вашого файлу.

Ваш PDF Чи можна зробити його зчитуваним Що робити
Плоский скан друкованих сторінок Так Завантажте його й виберіть мову документа. Саме під такий файл створено цей застосунок.
Сторінка, сфотографована телефоном Здебільшого так Тіні, кут зйомки й вигнутий корінець знижують точність. По можливості фотографуйте рівно й при рівномірному освітленні.
Бліда копія, факс або рукописний текст Частково Друкований текст і рукопис - це різні задачі. Очікуйте прогалин і перегляньте результат, перш ніж покладатися на нього.
PDF, у якому текст уже можна виділяти Нічого додавати Він уже зчитуваний. Якщо вам потрібні лише слова в окремому файлі, скористайтеся PDF to Text.
PDF із паролем або пошкоджений PDF Ні Застосунок не може його відкрити. Спершу зніміть захист або відновіть файл, а тоді завантажте його ще раз.
JPG, PNG чи інший графічний файл Не тут JPG to PDF та PNG to PDF створюють PDF і запускають те саме розпізнавання.

Якість розпізнавання залежить від якості скану. Перекошена сторінка, низька роздільна здатність або тінь на аркуші зменшують точність, тому варто перечитати результат, перш ніж відкладати документ у архів.

Що дає зчитуваний PDF

Скан і зчитуваний PDF виглядають на екрані однаково. Ось три речі, які вміє лише один із них.

Знайти один пункт у великому договорі

Команда пошуку в будь-якому PDF‑читачі одразу переходить до введеного вами слова. У договорі на 90 сторінок це різниця між пошуком і витраченим днем.

Дозволити комп'ютеру індексувати файл

Пошук на комп'ютері та більшість хмарних дисків читають текстовий шар у PDF. Зчитуваний PDF з'являється в результатах за тим, що в ньому написано, а не лише за назвою файлу.

Копіювати цитату, а не передруковувати її

Перетягування курсору по скану нічого не дає, бо там нічого виділяти. У зчитуваному PDF ви можете вибрати абзац і вставити його в лист або нотатку.

Захист ваших даних

Документи, які ви скануєте й конвертуєте, можуть бути особистими. Ось як саме ми з ними працюємо.

Шифрування TLS

Кожне завантаження та завантаження назад відбувається через зашифроване з’єднання, тому ваші файли не можна прочитати під час передачі.

Без доступу людей

Розпізнавання тексту повністю автоматизоване. Ніхто не читає ваші скани чи документи, і нічого не передається третім сторонам.

Відповідаємо GDPR

Опрацьовується лише те, що потрібно для конвертації. Ваші файли ніколи не використовуються для навчання моделей ШІ.

Як зробити текст у PDF придатним для пошуку

1

Завантажити

Завантажте PDF, який хочете зробити зчитуваним. Підійдуть як відскановані, так і сфотографовані сторінки.

2

Вибрати

Виберіть мову документа зі списку (необов'язково).

3

Почати

Натисніть "Start". Через короткий час документ буде готовий.

Поширені запитання про зчитуваний PDF

Що таке придатний до пошуку PDF?

Придатний до пошуку PDF - це скан із шаром реального тексту під ним. Сторінки виглядають так само, як паперові оригінали, але слова під зображенням можна шукати, виділяти та копіювати. Такий файл також називають гібридним PDF, оскільки він містить і зображення, і текст в одному файлі.

Як зробити PDF придатним до пошуку?

Завантажте PDF вище, виберіть мову документа та натисніть 'Почати'. Розпізнавання тексту зчитає сторінки, запише знайдений текст у прихований шар і поверне вам PDF. Ви можете завантажити кілька PDF одночасно, і кожен повернеться окремим файлом.

Чи безкоштовно робити PDF придатним до пошуку?

Так. Створення придатного до пошуку PDF безкоштовне, не потребує реєстрації й не витрачає кредити. Тарифний план важливий лише для дуже великих документів і довгих пакетів.

У моєму PDF уже можна виділяти текст. Це все ще потрібно?

Ні. Якщо ви можете провести курсором по рядку, і слова підсвічуються, PDF уже містить текстовий шар і є придатним до пошуку. Запускати його ще раз немає сенсу. Якщо вам потрібні слова в окремому файлі, скористайтеся замість цього застосунком PDF to Text.

Якими мовами може читати розпізнавання тексту?

Сервіс підтримує 124 мови, зокрема арабську, гінді, тайську, вʼєтнамську, китайську (спрощену й традиційну), а також кириличні варіанти азербайджанської, сербської та узбецької. Вибирайте всі мови, які є в документі, оскільки сторінки зі змішаними мовами найкраще розпізнаються, коли зазначено їх усі.

Чому частина тексту в моєму придатному до пошуку PDF неправильна?

Якість розпізнавання залежить від якості скану. Нахилена сторінка, низька роздільна здатність, тінь на папері або фото з рук знижують точність, а рукописний текст складніше розпізнати, ніж друкований. Якщо можливо, скануйте пласко з роздільною здатністю 300 dpi і перед стартом задайте мову документа.

Як зробити PDF непридатним до пошуку?

Не в цьому застосунку. Він додає текстовий шар, а не видаляє його. Щоб зробити PDF непридатним до пошуку, потрібно перетворити кожну сторінку назад у зображення, тобто виконати протилежну дію, а цей сервіс цього не робить.

Чи є мої документи конфіденційними?

Завантаження та вивантаження відбуваються через зашифроване зʼєднання, обробка здійснюється в сертифікованих дата-центрах у межах Європейського Союзу, а весь процес автоматизований, тому ніхто не читає ваші документи. Ваші файли ніколи не використовуються для навчання моделей ШІ, і ви зберігаєте всі права на них.

Докладніше про розпізнавання тексту

Відкрита книга на жовтому столі, в рамці тримача сканера, із заголовком статті "Save Valuable Text With OCR", надрукованим поперек сторінки
Як

Зберігайте цінний текст за допомогою OCR

Оцифровуйте важливі тексти зі сканованих документів та зображень за допомогою OCR (оптичного розпізнавання символів). Легко витягуйте текст із зображень онлайн.

Читати статтю