PDF diimbas ke teks

Alat ini menukar PDF diimbas kepada teks boleh sunting supaya anda boleh menyalin, menyunting dan menambah kandungan dengan mudah.

Muat naik fail anda

atau lepaskan, tampal, atau pilih dari awan

Tampal URL Cuba sampel
Google Drive Dropbox OneDrive
100% Percuma Tiada pemasangan diperlukan Selamat & peribadi
Iklan
Dipercayai oleh
eBay Booking.com University of Michigan Cornell University Columbia University
Nilaikan alat ini
0/5 · 0 undi

Bila PDF imbasan perlukan OCR dan bila tidak

Menukar PDF imbasan kepada teks sebenarnya ialah dua kerja berbeza, dan penukar membenarkan anda memilih kerja mana yang dijalankan. PDF yang sudah mengandungi aksara sebenar hanya perlu dibaca. PDF yang hanya mengandungi imej halaman perlu dikenali dahulu, kerana belum ada teks di dalamnya.

Anda boleh membezakannya dengan cepat. Buka fail dalam mana-mana pembaca dan cuba pilih satu baris. Jika perkataan diserlahkan, PDF itu mempunyai lapisan teks, jadi pilih Tukar dan teks akan keluar tepat seperti ia ditulis. Jika tiada apa yang diserlahkan, atau satu halaman penuh diserlahkan sebagai satu blok, itu ialah imbasan dan ia memerlukan pengecaman aksara optik.

Pilihan tunggal itu menerangkan kebanyakan hasil mengecewakan yang pengguna alami di tempat lain. Penukar yang hanya menggunakan satu laluan untuk setiap muat naik akan mengembalikan teks bersih untuk sesetengah fail dan halaman kosong untuk yang lain, tanpa penjelasan. Memilih enjin sendiri menghapuskan tekaan.

Cara menyalin teks daripada dokumen PDF yang diimbas

Imbasan tidak membenarkan anda seret kursor merentasi ayat, kerana tiada apa yang boleh dipilih. Mengekstrak teks daripada PDF imbasan menyelesaikan masalah itu: muat naik fail, jalankan penukaran, dan anda akan mendapat fail teks biasa yang boleh anda salin, tampal ke dalam emel, atau cari dengan arahan cari dalam mana-mana editor.

Output ialah fail .txt, jadi ia boleh dibuka pada mana-mana komputer dan mana-mana telefon tanpa perisian khas. Ia mengekalkan perkataan dan pemisah baris dan meninggalkan tata letak, yang merupakan pertukaran yang betul apabila anda hanya mahukan kandungan dan bukannya salinan halaman.

Beberapa imbasan boleh dimuat naik serentak. Setiap PDF ditukar secara berasingan dan dikembalikan sebagai fail teks tersendiri, dengan enjin dan pilihan bahasa yang sama digunakan pada semuanya.

Apakah fail TXT?

Sambungan fail .txt digunakan untuk fail teks biasa. Fail ini mengandungi baris teks dan boleh dibuka dalam banyak penyunting teks pada pelbagai platform dan peranti. Teks tersebut tidak mengandungi sebarang pemformatan.

Sebab itu ia tempat paling selamat untuk meletakkan teks yang diperoleh daripada imbasan. Tiada apa tentang fail boleh lapuk, tiada lesen diperlukan untuk membukanya, dan perkataan kekal boleh dibaca lama selepas program yang menghasilkan asal digantikan.

Sambungan fail: .txt, jenis MIME: text/plain

TXT di Wikipedia

Enjin OCR mana yang patut dipilih

Terdapat 5 cara untuk membaca PDF imbasan di sini, dan panel tetapan membenarkan anda bertukar antara semuanya. Pilih yang sepadan dengan fail di hadapan anda.

Enjin OCR Pilih apabila
Tukar PDF sudah mempunyai teks yang boleh dipilih. Tiada pengecaman dijalankan, jadi perkataan keluar tepat seperti ia ditulis.
OCR Standard Imbasan bersih, lurus dan tajam. Ini ialah laluan terpantas daripada PDF imbasan kepada teks.
AI-OCR Lanjutan Imbasan pudar, resolusi rendah atau sedikit senget, dan enjin biasa tertinggal aksara.
AI-OCR+ Lanjutan Halaman mempunyai bayang, pencahayaan tidak sekata atau tulang belakang melengkung, yang biasa berlaku apabila buku diambil gambar.
OCR Foto Teks diambil gambar dan bukannya diimbas, contohnya papan tanda, label atau skrin.

Penukar ini mengenali 124 bahasa sumber, termasuk Cina ringkas dan tradisional dengan tata letak menegak dan aksara Cyrillic untuk bahasa Azerbaijan, Serbia dan Uzbek. Pilih setiap bahasa yang muncul dalam fail anda.

Sebab biasa menukar PDF imbasan kepada teks

Perkataan dalam imbasan terkunci di dalam imej. Ini situasi di mana mengeluarkannya menjimatkan paling banyak kerja.

Dokumen yang anda perlu cari

Invois, kontrak, resit dan surat biasanya diterima sebagai imbasan. Dengan teks diekstrak anda boleh mencari amaun, tarikh atau nama tanpa membaca setiap halaman.

Bahan kajian dan penyelidikan

Imbasan perpustakaan, artikel jurnal dan halaman buku menjadi boleh dipetik. Ekstrak teks sekali dan tampal petikan yang anda perlukan ke dalam nota dan bukannya menaip semula.

Rekod dan arkib

Fail lama selalunya disimpan sebagai imbasan panjang berbilang halaman. Muat naik beberapa fail sekali gus dan penukar akan memproses keseluruhan kelompok dalam satu sesi.

Data anda, dilindungi

Kertas yang anda imbas dan dokumen yang anda tukar boleh bersifat peribadi. Ini cara tepat bagaimana dokumen anda dikendalikan.

Penyulitan TLS

Setiap muat naik dan muat turun berjalan melalui sambungan yang disulitkan, jadi fail anda tidak boleh dibaca semasa dihantar.

Tiada capaian manusia

Pengecaman teks adalah sepenuhnya automatik. Tiada siapa membaca imbasan atau dokumen anda, dan tiada apa dikongsi dengan pihak ketiga.

Pusat data ISO 27001

Pemprosesan dijalankan di pusat data bertauliah dalam Kesatuan Eropah.

Cara menukar PDF diimbas kepada teks

1

Muat Naik

Muat naik PDF diimbas anda.

2

Pilih

Pilih enjin OCR yang sesuai dengan fail anda. Gunakan Tukar jika teks dalam PDF sudah boleh dipilih.

3

Laraskan

Pilih bahasa PDF anda untuk hasil yang lebih baik (pilihan).

4

Tukar

Mulakan penukaran dan tunggu sehingga muat turun anda sedia.

Soalan lazim PDF imbasan ke teks

Adakah penukar PDF imbasan ke teks ini percuma?

Ya. Menukar PDF imbasan kepada teks adalah percuma dan tidak memerlukan akaun. Muat naik fail, pilih enjin dan muat turun hasilnya. Fail sehingga 100 MB dilindungi had percuma, dan pelan hanya diperlukan untuk fail lebih besar dan kelompok lebih panjang.

Bolehkah saya buat OCR pada PDF secara percuma?

Ya. OCR Standard ialah enjin percuma dan ia mengendalikan imbasan biasa tanpa pendaftaran. 3 enjin AI lanjutan ialah naik taraf untuk halaman yang enjin standard tidak dapat baca, seperti salinan pudar atau foto yang diambil dalam cahaya malap.

Mengapa PDF imbasan saya memerlukan OCR untuk mengekstrak teks?

Kerana fail mengandungi imej halaman dan bukannya aksara. Pengimbas merakam gambar kertas, jadi setiap perkataan ialah corak piksel. Pengecaman aksara optik membaca piksel itu dan menulis aksara sebenar, yang menjadikan teks boleh dipilih, dicari dan disunting.

Bagaimana saya menyalin teks daripada PDF imbasan?

Muat naik PDF di atas, pilih enjin OCR dan mulakan penukaran. Hasilnya ialah fail teks biasa yang boleh anda buka dalam mana-mana editor dan salin daripadanya. Menyalin terus daripada pembaca PDF hanya berfungsi apabila fail sudah mempunyai lapisan teks.

Bahasa apa yang boleh dibaca oleh pengecaman teks?

Ia mengenali 124 bahasa sumber, termasuk bahasa Cina dalam bentuk ringkas dan tradisional dengan tata letak menegak, dan varian Cyrillic untuk bahasa Azerbaijan, Serbia dan Uzbek. Pilih setiap bahasa yang muncul dalam fail, kerana halaman bercampur dibaca paling baik apabila semuanya disenaraikan.

Bolehkah saya tukar PDF imbasan kepada Word?

Bukan dari halaman ini, yang menulis fail teks biasa. Ia mengekalkan perkataan dan membuang tata letak. Untuk DOC atau DOCX dengan pemformatan, gunakan aplikasi Tukar ke Word, yang menjalankan pengecaman teks yang sama dan menulis dokumen Word.

Mengapa teks yang diekstrak keluar salah?

Kualiti pengecaman bergantung pada kualiti imbasan. Halaman senget, resolusi rendah, bayang pada kertas atau foto yang diambil dengan tangan semuanya menjejaskan ketepatan. Cuba AI-OCR lanjutan untuk imbasan tidak sempurna dan AI-OCR+ lanjutan untuk pencahayaan buruk, dan imbas semula pada 300 dpi jika boleh. Fail sumber yang dilindungi kata laluan atau rosak tidak akan dapat ditukar langsung.

Adakah dokumen imbasan saya peribadi?

Ya. Muat naik dan muat turun dijalankan melalui sambungan disulitkan, pemprosesan berlaku di pusat data bertauliah dalam Kesatuan Eropah, dan keseluruhan rantaian dipersiapkan secara automatik, jadi tiada siapa membaca imbasan anda. Fail anda tidak pernah digunakan untuk melatih model AI dan anda mengekalkan hak ke atasnya.

Lebih lanjut tentang pengecaman teks

Sebuah buku terbuka di atas meja kuning, dibingkai oleh pengapit pengimbas, dengan tajuk artikel Save Valuable Text With OCR tercetak di seluruh halaman
Cara

Simpan Teks Berharga Dengan OCR

Digitalkan teks berharga daripada dokumen diimbas dan imej dengan OCR (Pengecaman Aksara Optik). Ekstrak teks daripada imej dengan mudah, dalam talian.

Baca artikel