Alat ini memungkinkan Anda mengonversi PDF hasil pemindaian menjadi teks yang dapat diedit. Bekerja dengan teks PDF hasil pemindaian, salin, edit, dan tambahkan konten dengan mudah.
atau jatuhkan, tempel, atau pilih dari cloud
Mengubah PDF hasil scan menjadi teks sebenarnya adalah dua tugas berbeda, dan konverter memungkinkan Anda memilih mana yang dijalankan. PDF yang sudah berisi karakter asli hanya perlu dibaca. PDF yang berisi gambar halaman harus dikenali dulu, karena belum ada teks di dalamnya.
Anda bisa membedakannya dalam sekejap. Buka file di pembaca mana pun dan coba pilih satu baris. Jika kata-katanya tersorot, PDF itu memiliki lapisan teks, jadi pilih Konversi dan teks akan keluar persis seperti aslinya. Jika tidak ada yang tersorot, atau seluruh halaman tersorot sebagai satu blok, itu adalah scan dan perlu pengenalan karakter optis.
Satu pilihan itu menjelaskan sebagian besar hasil mengecewakan yang orang dapatkan di tempat lain. Konverter yang selalu memakai satu jalur untuk setiap unggahan akan menghasilkan teks bersih untuk sebagian file dan halaman kosong untuk file lainnya, tanpa penjelasan. Memilih mesin sendiri menghilangkan tebakan.
Scan tidak akan membiarkan Anda menyeret kursor melintasi satu kalimat, karena tidak ada apa pun yang bisa dipilih. Mengekstrak teks dari PDF hasil scan menyelesaikan masalah itu: unggah file, jalankan konversi, dan Anda mendapatkan file teks biasa yang bisa Anda salin, tempel ke email, atau cari dengan perintah find di editor apa pun.
Outputnya adalah file .txt, sehingga bisa dibuka di komputer dan ponsel apa pun tanpa perangkat lunak khusus. File ini membawa kata-kata dan pemisah baris dan meninggalkan tata letak, yang merupakan kompromi tepat ketika yang Anda inginkan adalah kontennya, bukan salinan halamannya.
Beberapa scan bisa dimasukkan sekaligus. Setiap PDF dikonversi sendiri dan dikembalikan sebagai file teks masing-masing, dengan mesin dan pilihan bahasa yang sama diterapkan ke semuanya.
Ekstensi file .txt digunakan untuk file teks biasa. File ini berisi teks dalam beberapa baris dan dapat dibuka di berbagai editor teks di berbagai platform dan perangkat. Teksnya tidak mengandung format apa pun.
Itu sebabnya ini adalah tempat paling aman untuk menyimpan teks yang dipulihkan dari scan. Tidak ada bagian file yang bisa kedaluwarsa, tidak perlu lisensi untuk membukanya, dan kata-katanya tetap bisa dibaca lama setelah program yang membuat aslinya diganti.
Ekstensi file: .txt, tipe MIME: text/plain
TXT di WikipediaAda 5 cara membaca PDF hasil scan di sini, dan panel pengaturan memungkinkan Anda beralih di antaranya. Pilih yang sesuai dengan file di depan Anda.
| Mesin OCR | Pilih saat |
|---|---|
| Konversi | PDF sudah memiliki teks yang bisa dipilih. Tidak ada proses pengenalan, sehingga kata-kata keluar persis seperti ditulis. |
| OCR Standar | Scan bersih, lurus, dan tajam. Ini adalah jalur tercepat dari PDF hasil scan ke teks. |
| AI-OCR Lanjutan | Scan samar, beresolusi rendah, atau sedikit miring, dan mesin standar menghilangkan karakter. |
| AI-OCR+ Lanjutan | Halaman memiliki bayangan, pencahayaan tidak merata atau punggung buku melengkung, yang umum saat buku difoto. |
| OCR Foto | Teks difoto, bukan discan, misalnya papan tanda, label, atau layar. |
Konverter mengenali 124 bahasa sumber, termasuk bahasa Tionghoa sederhana dan tradisional dengan tata letak vertikal serta bentuk Kiril dari Azerbaijan, Serbia, dan Uzbek. Pilih semua bahasa yang muncul di file Anda.
Kata-kata dalam scan terkunci di dalam gambar. Dalam situasi berikut, mengeluarkannya akan menghemat banyak pekerjaan.
Faktur, kontrak, tanda terima, dan surat biasanya datang sebagai scan. Setelah teks diekstrak Anda bisa mencari jumlah, tanggal, atau nama alih-alih membaca setiap halaman.
Scan perpustakaan, artikel jurnal, dan halaman buku menjadi bisa dikutip. Ekstrak teks sekali dan tempelkan bagian yang Anda perlukan ke catatan Anda alih-alih mengetik ulang.
File lama sering disimpan sebagai scan panjang berisi banyak halaman. Unggah beberapa sekaligus dan konverter akan memproses semuanya dalam satu batch.
Kertas yang Anda scan dan dokumen yang Anda konversi bisa bersifat pribadi. Berikut penanganan file Anda secara tepat.
Setiap unggahan dan unduhan menggunakan koneksi terenkripsi, sehingga file Anda tidak dapat dibaca selama transit.
Pengenalan teks sepenuhnya otomatis. Tidak ada yang membaca hasil pindai atau dokumen Anda, dan tidak ada yang dibagikan kepada pihak ketiga.
Pemrosesan berlangsung di pusat data tersertifikasi di dalam Uni Eropa.
Unggah PDF hasil pemindaian Anda.
Pilih mesin OCR yang sesuai dengan file Anda. Gunakan Konversi jika teks di dalam PDF sudah bisa dipilih.
Pilih bahasa PDF Anda untuk hasil yang lebih baik (opsional).
Mulai konversi dan tunggu hingga unduhan Anda siap.
Ya. Mengonversi PDF hasil scan ke teks gratis dan tidak memerlukan akun. Unggah file, pilih mesin, dan unduh hasilnya. File hingga 100 MB tercakup dalam batas gratis, dan paket hanya diperlukan untuk file yang lebih besar dan batch yang lebih panjang.
Ya. OCR Standar adalah mesin gratis dan menangani scan biasa tanpa pendaftaran. 3 mesin AI lanjutan adalah peningkatan untuk halaman yang tidak dapat dibaca mesin standar, seperti salinan samar atau foto yang diambil dalam cahaya buruk.
Karena file berisi gambar halaman, bukan karakter. Scanner memotret kertas, sehingga setiap kata adalah pola piksel. Pengenalan karakter optis membaca piksel tersebut dan menulis karakter asli, yang membuat teks bisa dipilih, dicari, dan diedit.
Unggah PDF di atas, pilih mesin OCR dan mulai konversi. Hasilnya adalah file teks biasa yang bisa Anda buka di editor apa pun dan salin isinya. Menyalin langsung dari pembaca PDF hanya berfungsi setelah file memiliki lapisan teks.
Mesin ini mengenali 124 bahasa sumber, termasuk bahasa Tionghoa dalam bentuk sederhana dan tradisional dengan tata letak vertikal, serta varian Kiril dari Azerbaijan, Serbia, dan Uzbek. Pilih semua bahasa yang muncul di file, karena halaman campuran terbaca paling baik saat semuanya tercantum.
Tidak dari halaman ini, yang menulis file teks biasa. Halaman ini mempertahankan kata-kata dan menghilangkan tata letak. Untuk DOC atau DOCX dengan pemformatan, gunakan aplikasi Konversi ke Word, yang menjalankan pengenalan teks yang sama dan menulis dokumen Word.
Kualitas pengenalan mengikuti kualitas scan. Halaman miring, resolusi rendah, bayangan di kertas, atau foto yang diambil dengan tangan semuanya mengurangi akurasi. Coba Advanced AI-OCR untuk scan yang tidak sempurna dan Advanced AI-OCR+ untuk pencahayaan buruk, dan scan ulang di 300 dpi jika memungkinkan. File sumber yang diproteksi kata sandi atau rusak tidak akan bisa dikonversi sama sekali.
Ya. Unggah dan unduh melalui koneksi terenkripsi, pemrosesan berlangsung di pusat data bersertifikat di dalam Uni Eropa, dan seluruh alur diproses otomatis sehingga tidak ada yang membaca scan Anda. File Anda tidak pernah digunakan untuk melatih model AI dan Anda tetap memegang hak atasnya.
Digitalisasi teks berharga dari dokumen hasil pemindaian dan gambar dengan OCR (Optical Character Recognition). Ekstrak teks dari gambar dengan mudah, secara online.
Baca artikelSemua ini berjalan di dalam browser. Tanpa instalasi, tanpa akun, dan dengan pengenalan teks yang sama di belakangnya.