Konwerter PDF na tekst z OCR

Konwertuj PDF na tekst w przeglądarce i pobierz zwykły plik TXT. Rozpoznawanie tekstu jest dostępne, gdy go potrzebujesz, i wyłączone, gdy nie jest potrzebne.

Prześlij plik

lub upuść, wklej albo wybierz z chmury

Wklej URL Wypróbuj przykładowy plik
Google Drive Dropbox OneDrive
W 100% za darmo Bez instalacji Bezpieczne i prywatne
Reklama
Zaufali nam
eBay Booking.com University of Michigan Cornell University Columbia University
Oceń to narzędzie
0/5 · 0 głosów

PDF na tekst z OCR lub bez

Konwersja PDF na tekst może oznaczać dwa różne zadania, a ten konwerter pozwala wybrać to, którego potrzebujesz. Większość plików PDF zawiera już prawdziwe znaki, więc tekst trzeba tylko odczytać. Zeskanowany PDF zamiast tego zawiera obrazy stron i znaki muszą zostać rozpoznane, zanim cokolwiek da się wyodrębnić.

Rozpoznawanie tekstu jest domyślnie wyłączone i jest to zamierzone. PDF z prawdziwą warstwą tekstową konwertuje się szybciej i dokładniej bez niej, ponieważ słowa są kopiowane, a nie odczytywane z obrazu. Włączenie rozpoznawania, gdy plik go nie potrzebuje, może jedynie obniżyć dokładność.

Rodzaj pliku poznasz w sekundę. Otwórz PDF w dowolnej przeglądarce i przeciągnij po wierszu. Jeśli słowa się podświetlają, zostaw przełącznik OCR wyłączony. Jeśli nic się nie podświetla, włącz go i wybierz język dokumentu z 124 języków obsługiwanych przez rozpoznawanie.

Wyodrębnij tekst z PDF bez przepisywania słowa

Wyodrębnienie tekstu z PDF zmienia stronę, na którą możesz tylko patrzeć, w słowa, z których możesz korzystać. Konwerter zapisuje wszystko, co znajdzie, do pliku czystego tekstu, abyś mógł skopiować cytat, wkleić akapit do e‑maila lub przeszukać cały dokument poleceniem znajdź w dowolnym edytorze.

To obejmuje zadania, o których zwykle się myśli: wyciąganie odnośników z artykułu, liczb ze sprawozdania lub przenoszenie treści długiego dokumentu do narzędzia do pisania. Nic nie jest przepisywane ani ręcznie transkrybowane.

Możesz przesłać kilka plików PDF naraz. Każdy plik jest konwertowany osobno i wraca jako własny plik tekstowy, z tym samym ustawieniem OCR i tym samym językiem zastosowanym do wszystkich. Nie jest wymagane konto ani adres e‑mail.

Czym jest plik TXT?

Rozszerzenie .txt jest używane dla plików z czystym tekstem. Takie pliki zawierają wiersze tekstu i można je otworzyć w wielu edytorach tekstu na różnych platformach i urządzeniach. Tekst nie zawiera żadnego formatowania.

Na tym polega przejście z PDF na TXT zamiast na format dokumentu. Plik otwiera się na każdym komputerze i telefonie, nie wymaga licencji do odczytu i pozostaje czytelny długo po tym, jak program, w którym powstał oryginał, zostanie zastąpiony.

Rozszerzenie pliku: .txt, typ MIME: text/plain

TXT w Wikipedii

PDF na TXT: co zachowuje plik tekstowy

Plik czystego tekstu przechowuje słowa, nie strony. Oto co przetrwa konwersję, a co nie.

Z pliku PDF W pliku TXT
Słowa i podziały wierszy Zachowane
Kolejność czytania Zachowana, od góry do dołu
Pogrubienie, kursywa i czcionki Usunięte
Obrazy, logotypy i wykresy Usunięte
Tabele Zachowane jako tekst, bez siatki
Strony wielokolumnowe Przelane do jednej kolumny
Nagłówki, stopki i numery stron Zapisane razem z tekstem

Plik czystego tekstu przenosi słowa, a nie układ. Gdy formatowanie jest równie ważne jak treść, lepiej sprawdzi się aplikacja PDF na Word.

Kiedy konwersja PDF na tekst jest właściwym wyborem

Słowa w PDF są zamknięte w układzie strony. To sytuacje, w których ich proste wyodrębnienie oszczędza najwięcej pracy.

Cytowanie i badania

Artykuły, raporty i książki są udostępniane jako PDF. Raz wyodrębnij tekst i wklejaj potrzebne fragmenty do notatek zamiast przepisywać je ponownie.

Przeszukiwanie długiego dokumentu

Plik tekstowy otwiera się w każdym edytorze, więc możesz od razu przejść do nazwiska, daty lub kwoty zamiast czytać strona po stronie.

Przekazywanie tekstu do innego narzędzia

Tłumacze, narzędzia do pisania, czytniki ekranu i arkusze kalkulacyjne przyjmują czysty tekst. TXT to format, który prawie wszystkie z nich obsługują bez dodatkowego konwertera.

Twoje dane, chronione

PDF-y, które użytkownicy konwertują, to często umowy, faktury lub prywatna korespondencja. Oto dokładnie, jak traktujemy Twoje pliki.

Szyfrowanie TLS

Każde wysłanie i pobranie pliku odbywa się po zaszyfrowanym połączeniu, więc Twoje pliki nie mogą zostać odczytane w trakcie transmisji.

Centra danych ISO 27001

Przetwarzanie odbywa się w certyfikowanych centrach danych na terenie Unii Europejskiej.

Brak dostępu dla ludzi

Rozpoznawanie tekstu jest w pełni zautomatyzowane. Nikt nie czyta Twoich skanów ani dokumentów i nic nie jest udostępniane podmiotom trzecim.

Jak przekonwertować PDF na tekst?

1

Prześlij

Prześlij swój plik PDF.

2

Wybierz

Włącz OCR, jeśli PDF jest skanem. Zostaw wyłączony, gdy tekst w pliku jest już zaznaczalny.

3

Dostosuj

Z menu wybierz język dokumentu (opcjonalnie).

4

Konwertuj

Kliknij "Start" i poczekaj na zakończenie konwersji.

PDF na tekst: FAQ

Czy ten konwerter PDF na tekst jest darmowy?

Tak. Konwersja PDF na tekst jest darmowa i nie wymaga konta, a adres e‑mail nie jest potrzebny. Prześlij plik, uruchom konwersję i pobierz tekst. Plan ma znaczenie tylko przy bardzo dużych plikach i dłuższych partiach.

Jak przekonwertować PDF na tekst?

Prześlij powyżej plik PDF, zostaw przełącznik OCR wyłączony, jeśli tekst w pliku jest już zaznaczalny, i uruchom konwersję. Wynikiem jest plik czystego tekstu, który możesz pobrać i otworzyć w dowolnym edytorze. Nic nie trzeba instalować.

Jak skopiować tekst z PDF?

Jeśli słowa się podświetlają, gdy przeciągasz po nich, możesz skopiować je bezpośrednio z czytnika PDF. Jeśli nie, strona jest obrazem i nie ma czego zaznaczyć. Konwersja PDF na tekst rozwiązuje to, ponieważ wynik to plik tekstowy, z którego możesz swobodnie kopiować.

Czy mogę też przekonwertować PDF na TXT?

Właśnie taki format zapisuje ten konwerter. TXT to format czystego tekstu, więc pobrany plik ma rozszerzenie .txt i typ MIME text/plain. Otwiera się w Notatniku, TextEdit, dowolnym edytorze kodu i na każdym telefonie, bez dodatkowego oprogramowania.

Dlaczego OCR jest domyślnie wyłączony?

Ponieważ większość plików PDF go nie potrzebuje. PDF z prawdziwą warstwą tekstową konwertuje się szybciej i dokładniej, gdy słowa są kopiowane, a nie rozpoznawane z obrazu. Włącz OCR tylko wtedy, gdy strony są skanami lub fotografiami, a wraz z nim pojawi się wybór języka.

Czy ten konwerter PDF na tekst działa na zeskanowanym PDF?

Tak, jeśli włączysz OCR. Rozpoznawanie odczytuje znaki z obrazów stron i zapisuje je do pliku tekstowego. Jeśli większość tego, co konwertujesz, to skany, aplikacja skanowany PDF na tekst jest prostszą drogą do tego samego wyniku.

Jakie języki może odczytać moduł rozpoznawania tekstu?

Rozpoznaje 124 języki wejściowe. Oprócz języków europejskich lista obejmuje hindi, bengalski, tamil, urdu, arabski, tajski, japoński, koreański oraz chiński w wersji uproszczonej i tradycyjnej. Wybierz język, w którym napisano dokument, aby uzyskać najlepszy wynik.

Czy mogę przekonwertować kilka plików PDF na tekst jednocześnie?

Tak. Dodaj tyle plików PDF, ile potrzebujesz, a zostaną one przekonwertowane za jednym razem. Każdy z nich zostanie zwrócony jako osobny plik tekstowy z tym samym ustawieniem OCR i tym samym językiem.

Więcej o rozpoznawaniu tekstu

Otwarta książka na żółtym biurku, w ramkach skanera, z tytułem artykułu Save Valuable Text With OCR wydrukowanym na stronie
Jak

Zapisz cenny tekst dzięki OCR

Cyfryzuj cenne teksty ze skanów dokumentów i obrazów za pomocą OCR (Optical Character Recognition). Łatwo wyodrębnij tekst z obrazów online.

Przeczytaj artykuł