Ubah PDF ke teks di browser Anda dan unduh sebagai file TXT biasa. Pengenalan teks tersedia saat Anda membutuhkannya, dan nonaktif saat tidak.
atau jatuhkan, tempel, atau pilih dari cloud
Mengonversi PDF ke teks bisa berarti dua jenis tugas, dan konverter ini membiarkan Anda memilih yang Anda perlukan. Sebagian besar PDF sudah berisi karakter asli, jadi teks hanya perlu dibaca. PDF hasil pemindaian justru berisi gambar halaman, sehingga karakter harus dikenali dulu sebelum bisa diekstrak.
Pengenalan teks dimatikan secara bawaan, dan itu memang disengaja. PDF dengan lapisan teks asli akan dikonversi lebih cepat dan lebih akurat tanpa OCR, karena kata-kata disalin, bukan diambil dari gambar. Menyalakan OCR saat file tidak membutuhkannya hanya akan mengurangi akurasi.
Anda bisa mengetahui jenis file yang Anda punya dalam sedetik. Buka PDF di pembaca apa pun dan seret kursor di sepanjang satu baris. Jika kata-kata tersorot, biarkan pengalih OCR tetap mati. Jika tidak ada yang tersorot, nyalakan OCR dan pilih dokumen Anda dari 124 bahasa sumber yang didukung pengenalan.
Mengekstrak teks dari PDF mengubah halaman yang hanya bisa Anda lihat menjadi kata-kata yang bisa Anda gunakan. Konverter menuliskan semua yang ditemukannya ke dalam file teks polos, sehingga Anda bisa menyalin kutipan, menempelkan paragraf ke email, atau mencari seluruh dokumen dengan perintah cari di editor apa pun.
Itu mencakup tugas yang biasanya orang maksud: mengambil referensi dari makalah, menyalin angka dari laporan, atau memindahkan isi dokumen panjang ke alat tulis. Tidak ada yang diketik ulang dan tidak ada yang ditranskripsi manual.
Beberapa PDF bisa dimasukkan sekaligus. Setiap file dikonversi sendiri-sendiri dan kembali sebagai file teksnya masing-masing, dengan pengaturan OCR dan bahasa yang sama diterapkan ke semuanya. Tidak perlu akun dan tidak diminta alamat email.
Ekstensi file .txt digunakan untuk file teks biasa. File ini berisi teks dalam beberapa baris dan dapat dibuka di berbagai editor teks di berbagai platform dan perangkat. Teksnya tidak mengandung format apa pun.
Itu inti dari mengubah PDF ke TXT, bukan ke format dokumen. File dapat dibuka di komputer dan ponsel apa pun, tidak butuh lisensi untuk dibaca, dan tetap bisa dibaca lama setelah program yang membuat aslinya diganti.
Ekstensi file: .txt, tipe MIME: text/plain
TXT di WikipediaFile teks polos menyimpan kata-kata, bukan halaman. Ini yang bertahan dari konversi dan yang tidak.
| Dari PDF | Dalam file TXT |
|---|---|
| Kata dan jeda baris | Dipertahankan |
| Urutan baca | Dipertahankan, dari atas ke bawah |
| Tebal, miring, dan font | Dihapus |
| Gambar, logo, dan bagan | Dihapus |
| Tabel | Dipertahankan sebagai teks, tanpa kisi |
| Halaman multi-kolom | Dijadikan satu kolom |
| Header, footer, dan nomor halaman | Dituliskan bersama teks |
File teks polos membawa kata-katanya, bukan tata letaknya. Jika pemformatan sama pentingnya dengan kata-kata, aplikasi PDF ke Word lebih cocok.
Kata-kata dalam PDF terkunci dalam tata letak halaman. Berikut situasi di mana mengeluarkannya dalam bentuk polos menghemat banyak pekerjaan.
Makalah, laporan, dan buku dibagikan sebagai PDF. Ekstrak teks sekali saja dan tempel bagian yang Anda perlukan ke catatan, alih-alih mengetiknya ulang.
File teks dapat dibuka di editor apa pun, sehingga Anda bisa langsung lompat ke nama, tanggal, atau angka tertentu tanpa membaca halaman demi halaman.
Penerjemah, alat tulis, pembaca layar, dan spreadsheet semuanya menerima teks polos. TXT adalah format yang hampir semuanya terima tanpa konverter.
PDF yang dikonversi pengguna sering kali berupa kontrak, faktur, atau korespondensi pribadi. Berikut cara dokumen Anda diproses.
Setiap unggahan dan unduhan menggunakan koneksi terenkripsi, sehingga file Anda tidak dapat dibaca selama transit.
Pemrosesan berlangsung di pusat data tersertifikasi di dalam Uni Eropa.
Pengenalan teks sepenuhnya otomatis. Tidak ada yang membaca hasil pindai atau dokumen Anda, dan tidak ada yang dibagikan kepada pihak ketiga.
Unggah PDF Anda.
Nyalakan OCR jika PDF adalah hasil pemindaian. Biarkan mati jika teks di dalam file sudah bisa dipilih.
Pilih bahasa dokumen Anda dari menu. (opsional)
Klik "Mulai" dan tunggu hingga konversi selesai.
Ya. Mengonversi PDF ke teks gratis dan tidak memerlukan akun, dan tidak diminta alamat email. Unggah file, mulai konversi, lalu unduh teksnya. Paket hanya dibutuhkan untuk file yang sangat besar dan batch yang lebih panjang.
Unggah PDF di atas, biarkan pengalih OCR mati jika teks di dalam file sudah bisa dipilih, lalu mulai konversi. Hasilnya adalah file teks polos yang bisa Anda unduh dan buka di editor apa pun. Tidak perlu menginstal apa pun.
Jika kata-kata tersorot saat Anda menyeret kursor di atasnya, Anda bisa menyalinnya langsung dari pembaca PDF Anda. Jika tidak, halamannya adalah gambar dan tidak ada yang bisa dipilih. Mengonversi PDF ke teks menyelesaikan hal itu, karena outputnya adalah file teks yang bebas Anda salin.
Itulah yang persis ditulis konverter ini. TXT adalah format teks polos, jadi file yang Anda unduh berakhiran .txt dan bertipe media text/plain. File dapat dibuka di Notepad, TextEdit, editor kode apa pun, dan ponsel apa pun tanpa perangkat lunak tambahan.
Karena sebagian besar PDF tidak membutuhkannya. PDF dengan lapisan teks asli akan dikonversi lebih cepat dan lebih akurat ketika kata-kata disalin, bukan dikenali dari gambar. Nyalakan OCR hanya saat halaman berupa hasil pemindaian atau foto, dan pemilih bahasa akan muncul bersamanya.
Ya, dengan OCR dinyalakan. Pengenalan akan membaca karakter dari gambar halaman dan menuliskannya ke file teks. Jika sebagian besar yang Anda konversi adalah hasil pemindaian, aplikasi PDF hasil pemindaian ke teks adalah jalur yang lebih langsung ke hasil yang sama.
OCR mengenali 124 bahasa sumber. Selain bahasa Eropa, daftarnya mencakup Hindi, Bengali, Tamil, Urdu, Arab, Thai, Jepang, Korea, dan Cina dalam bentuk sederhana maupun tradisional. Pilih bahasa yang digunakan dokumen Anda untuk hasil terbaik.
Ya. Tambahkan sebanyak mungkin PDF yang Anda perlukan dan semuanya akan dikonversi dalam satu proses, masing-masing dikembalikan sebagai file teks terpisah dengan pengaturan OCR dan bahasa yang sama.
Digitalisasi teks berharga dari dokumen hasil pemindaian dan gambar dengan OCR (Optical Character Recognition). Ekstrak teks dari gambar dengan mudah, secara online.
Baca artikelSemua ini berjalan di dalam browser. Tanpa instalasi, tanpa akun, dan dengan pengenalan teks yang sama di belakangnya.