PDF hasil pemindaian ke teks

Alat ini memungkinkan Anda mengonversi PDF hasil pemindaian menjadi teks yang dapat diedit. Bekerja dengan teks PDF hasil pemindaian, salin, edit, dan tambahkan konten dengan mudah.

Unggah file Anda

atau jatuhkan, tempel, atau pilih dari cloud

Tempel URL Coba contoh
Google Drive Dropbox OneDrive
100% Gratis Tanpa instalasi Aman & privat
Iklan
Dipercaya oleh
eBay Booking.com University of Michigan Cornell University Columbia University
Beri penilaian untuk alat ini
0/5 · 0 suara

Kapan PDF hasil scan perlu OCR dan kapan tidak

Mengubah PDF hasil scan menjadi teks sebenarnya adalah dua tugas berbeda, dan konverter memungkinkan Anda memilih mana yang dijalankan. PDF yang sudah berisi karakter asli hanya perlu dibaca. PDF yang berisi gambar halaman harus dikenali dulu, karena belum ada teks di dalamnya.

Anda bisa membedakannya dalam sekejap. Buka file di pembaca mana pun dan coba pilih satu baris. Jika kata-katanya tersorot, PDF itu memiliki lapisan teks, jadi pilih Konversi dan teks akan keluar persis seperti aslinya. Jika tidak ada yang tersorot, atau seluruh halaman tersorot sebagai satu blok, itu adalah scan dan perlu pengenalan karakter optis.

Satu pilihan itu menjelaskan sebagian besar hasil mengecewakan yang orang dapatkan di tempat lain. Konverter yang selalu memakai satu jalur untuk setiap unggahan akan menghasilkan teks bersih untuk sebagian file dan halaman kosong untuk file lainnya, tanpa penjelasan. Memilih mesin sendiri menghilangkan tebakan.

Cara menyalin teks dari dokumen PDF hasil pemindaian

Scan tidak akan membiarkan Anda menyeret kursor melintasi satu kalimat, karena tidak ada apa pun yang bisa dipilih. Mengekstrak teks dari PDF hasil scan menyelesaikan masalah itu: unggah file, jalankan konversi, dan Anda mendapatkan file teks biasa yang bisa Anda salin, tempel ke email, atau cari dengan perintah find di editor apa pun.

Outputnya adalah file .txt, sehingga bisa dibuka di komputer dan ponsel apa pun tanpa perangkat lunak khusus. File ini membawa kata-kata dan pemisah baris dan meninggalkan tata letak, yang merupakan kompromi tepat ketika yang Anda inginkan adalah kontennya, bukan salinan halamannya.

Beberapa scan bisa dimasukkan sekaligus. Setiap PDF dikonversi sendiri dan dikembalikan sebagai file teks masing-masing, dengan mesin dan pilihan bahasa yang sama diterapkan ke semuanya.

Apa itu file TXT?

Ekstensi file .txt digunakan untuk file teks biasa. File ini berisi teks dalam beberapa baris dan dapat dibuka di berbagai editor teks di berbagai platform dan perangkat. Teksnya tidak mengandung format apa pun.

Itu sebabnya ini adalah tempat paling aman untuk menyimpan teks yang dipulihkan dari scan. Tidak ada bagian file yang bisa kedaluwarsa, tidak perlu lisensi untuk membukanya, dan kata-katanya tetap bisa dibaca lama setelah program yang membuat aslinya diganti.

Ekstensi file: .txt, tipe MIME: text/plain

TXT di Wikipedia

Mesin OCR mana yang harus dipilih

Ada 5 cara membaca PDF hasil scan di sini, dan panel pengaturan memungkinkan Anda beralih di antaranya. Pilih yang sesuai dengan file di depan Anda.

Mesin OCR Pilih saat
Konversi PDF sudah memiliki teks yang bisa dipilih. Tidak ada proses pengenalan, sehingga kata-kata keluar persis seperti ditulis.
OCR Standar Scan bersih, lurus, dan tajam. Ini adalah jalur tercepat dari PDF hasil scan ke teks.
AI-OCR Lanjutan Scan samar, beresolusi rendah, atau sedikit miring, dan mesin standar menghilangkan karakter.
AI-OCR+ Lanjutan Halaman memiliki bayangan, pencahayaan tidak merata atau punggung buku melengkung, yang umum saat buku difoto.
OCR Foto Teks difoto, bukan discan, misalnya papan tanda, label, atau layar.

Konverter mengenali 124 bahasa sumber, termasuk bahasa Tionghoa sederhana dan tradisional dengan tata letak vertikal serta bentuk Kiril dari Azerbaijan, Serbia, dan Uzbek. Pilih semua bahasa yang muncul di file Anda.

Alasan umum mengonversi PDF hasil scan ke teks

Kata-kata dalam scan terkunci di dalam gambar. Dalam situasi berikut, mengeluarkannya akan menghemat banyak pekerjaan.

Dokumen yang perlu Anda cari

Faktur, kontrak, tanda terima, dan surat biasanya datang sebagai scan. Setelah teks diekstrak Anda bisa mencari jumlah, tanggal, atau nama alih-alih membaca setiap halaman.

Bahan belajar dan riset

Scan perpustakaan, artikel jurnal, dan halaman buku menjadi bisa dikutip. Ekstrak teks sekali dan tempelkan bagian yang Anda perlukan ke catatan Anda alih-alih mengetik ulang.

Rekaman dan arsip

File lama sering disimpan sebagai scan panjang berisi banyak halaman. Unggah beberapa sekaligus dan konverter akan memproses semuanya dalam satu batch.

Data Anda, terlindungi

Kertas yang Anda scan dan dokumen yang Anda konversi bisa bersifat pribadi. Berikut penanganan file Anda secara tepat.

Enkripsi TLS

Setiap unggahan dan unduhan menggunakan koneksi terenkripsi, sehingga file Anda tidak dapat dibaca selama transit.

Tanpa akses manusia

Pengenalan teks sepenuhnya otomatis. Tidak ada yang membaca hasil pindai atau dokumen Anda, dan tidak ada yang dibagikan kepada pihak ketiga.

Pusat data ISO 27001

Pemrosesan berlangsung di pusat data tersertifikasi di dalam Uni Eropa.

Cara mengonversi PDF hasil pemindaian ke teks

1

Unggah

Unggah PDF hasil pemindaian Anda.

2

Pilih

Pilih mesin OCR yang sesuai dengan file Anda. Gunakan Konversi jika teks di dalam PDF sudah bisa dipilih.

3

Sesuaikan

Pilih bahasa PDF Anda untuk hasil yang lebih baik (opsional).

4

Konversi

Mulai konversi dan tunggu hingga unduhan Anda siap.

FAQ PDF hasil scan ke teks

Apakah konverter PDF hasil scan ke teks ini gratis?

Ya. Mengonversi PDF hasil scan ke teks gratis dan tidak memerlukan akun. Unggah file, pilih mesin, dan unduh hasilnya. File hingga 100 MB tercakup dalam batas gratis, dan paket hanya diperlukan untuk file yang lebih besar dan batch yang lebih panjang.

Bisakah saya melakukan OCR pada PDF secara gratis?

Ya. OCR Standar adalah mesin gratis dan menangani scan biasa tanpa pendaftaran. 3 mesin AI lanjutan adalah peningkatan untuk halaman yang tidak dapat dibaca mesin standar, seperti salinan samar atau foto yang diambil dalam cahaya buruk.

Mengapa PDF hasil scan saya memerlukan OCR untuk mengekstrak teks?

Karena file berisi gambar halaman, bukan karakter. Scanner memotret kertas, sehingga setiap kata adalah pola piksel. Pengenalan karakter optis membaca piksel tersebut dan menulis karakter asli, yang membuat teks bisa dipilih, dicari, dan diedit.

Bagaimana cara menyalin teks dari PDF hasil scan?

Unggah PDF di atas, pilih mesin OCR dan mulai konversi. Hasilnya adalah file teks biasa yang bisa Anda buka di editor apa pun dan salin isinya. Menyalin langsung dari pembaca PDF hanya berfungsi setelah file memiliki lapisan teks.

Bahasa apa saja yang dapat dibaca OCR?

Mesin ini mengenali 124 bahasa sumber, termasuk bahasa Tionghoa dalam bentuk sederhana dan tradisional dengan tata letak vertikal, serta varian Kiril dari Azerbaijan, Serbia, dan Uzbek. Pilih semua bahasa yang muncul di file, karena halaman campuran terbaca paling baik saat semuanya tercantum.

Bisakah saya mengonversi PDF hasil scan ke Word?

Tidak dari halaman ini, yang menulis file teks biasa. Halaman ini mempertahankan kata-kata dan menghilangkan tata letak. Untuk DOC atau DOCX dengan pemformatan, gunakan aplikasi Konversi ke Word, yang menjalankan pengenalan teks yang sama dan menulis dokumen Word.

Mengapa teks yang diekstrak keluar tidak benar?

Kualitas pengenalan mengikuti kualitas scan. Halaman miring, resolusi rendah, bayangan di kertas, atau foto yang diambil dengan tangan semuanya mengurangi akurasi. Coba Advanced AI-OCR untuk scan yang tidak sempurna dan Advanced AI-OCR+ untuk pencahayaan buruk, dan scan ulang di 300 dpi jika memungkinkan. File sumber yang diproteksi kata sandi atau rusak tidak akan bisa dikonversi sama sekali.

Apakah dokumen hasil scan saya bersifat pribadi?

Ya. Unggah dan unduh melalui koneksi terenkripsi, pemrosesan berlangsung di pusat data bersertifikat di dalam Uni Eropa, dan seluruh alur diproses otomatis sehingga tidak ada yang membaca scan Anda. File Anda tidak pernah digunakan untuk melatih model AI dan Anda tetap memegang hak atasnya.

Selengkapnya tentang pengenalan teks

Sebuah buku terbuka di atas meja kuning, dibingkai oleh penyangga scanner, dengan judul artikel Save Valuable Text With OCR tercetak di halaman
Cara

Simpan Teks Berharga Dengan OCR

Digitalisasi teks berharga dari dokumen hasil pemindaian dan gambar dengan OCR (Optical Character Recognition). Ekstrak teks dari gambar dengan mudah, secara online.

Baca artikel