Alat ini menukar PDF diimbas kepada teks boleh sunting supaya anda boleh menyalin, menyunting dan menambah kandungan dengan mudah.
atau lepaskan, tampal, atau pilih dari awan
Menukar PDF imbasan kepada teks sebenarnya ialah dua kerja berbeza, dan penukar membenarkan anda memilih kerja mana yang dijalankan. PDF yang sudah mengandungi aksara sebenar hanya perlu dibaca. PDF yang hanya mengandungi imej halaman perlu dikenali dahulu, kerana belum ada teks di dalamnya.
Anda boleh membezakannya dengan cepat. Buka fail dalam mana-mana pembaca dan cuba pilih satu baris. Jika perkataan diserlahkan, PDF itu mempunyai lapisan teks, jadi pilih Tukar dan teks akan keluar tepat seperti ia ditulis. Jika tiada apa yang diserlahkan, atau satu halaman penuh diserlahkan sebagai satu blok, itu ialah imbasan dan ia memerlukan pengecaman aksara optik.
Pilihan tunggal itu menerangkan kebanyakan hasil mengecewakan yang pengguna alami di tempat lain. Penukar yang hanya menggunakan satu laluan untuk setiap muat naik akan mengembalikan teks bersih untuk sesetengah fail dan halaman kosong untuk yang lain, tanpa penjelasan. Memilih enjin sendiri menghapuskan tekaan.
Imbasan tidak membenarkan anda seret kursor merentasi ayat, kerana tiada apa yang boleh dipilih. Mengekstrak teks daripada PDF imbasan menyelesaikan masalah itu: muat naik fail, jalankan penukaran, dan anda akan mendapat fail teks biasa yang boleh anda salin, tampal ke dalam emel, atau cari dengan arahan cari dalam mana-mana editor.
Output ialah fail .txt, jadi ia boleh dibuka pada mana-mana komputer dan mana-mana telefon tanpa perisian khas. Ia mengekalkan perkataan dan pemisah baris dan meninggalkan tata letak, yang merupakan pertukaran yang betul apabila anda hanya mahukan kandungan dan bukannya salinan halaman.
Beberapa imbasan boleh dimuat naik serentak. Setiap PDF ditukar secara berasingan dan dikembalikan sebagai fail teks tersendiri, dengan enjin dan pilihan bahasa yang sama digunakan pada semuanya.
Sambungan fail .txt digunakan untuk fail teks biasa. Fail ini mengandungi baris teks dan boleh dibuka dalam banyak penyunting teks pada pelbagai platform dan peranti. Teks tersebut tidak mengandungi sebarang pemformatan.
Sebab itu ia tempat paling selamat untuk meletakkan teks yang diperoleh daripada imbasan. Tiada apa tentang fail boleh lapuk, tiada lesen diperlukan untuk membukanya, dan perkataan kekal boleh dibaca lama selepas program yang menghasilkan asal digantikan.
Sambungan fail: .txt, jenis MIME: text/plain
TXT di WikipediaTerdapat 5 cara untuk membaca PDF imbasan di sini, dan panel tetapan membenarkan anda bertukar antara semuanya. Pilih yang sepadan dengan fail di hadapan anda.
| Enjin OCR | Pilih apabila |
|---|---|
| Tukar | PDF sudah mempunyai teks yang boleh dipilih. Tiada pengecaman dijalankan, jadi perkataan keluar tepat seperti ia ditulis. |
| OCR Standard | Imbasan bersih, lurus dan tajam. Ini ialah laluan terpantas daripada PDF imbasan kepada teks. |
| AI-OCR Lanjutan | Imbasan pudar, resolusi rendah atau sedikit senget, dan enjin biasa tertinggal aksara. |
| AI-OCR+ Lanjutan | Halaman mempunyai bayang, pencahayaan tidak sekata atau tulang belakang melengkung, yang biasa berlaku apabila buku diambil gambar. |
| OCR Foto | Teks diambil gambar dan bukannya diimbas, contohnya papan tanda, label atau skrin. |
Penukar ini mengenali 124 bahasa sumber, termasuk Cina ringkas dan tradisional dengan tata letak menegak dan aksara Cyrillic untuk bahasa Azerbaijan, Serbia dan Uzbek. Pilih setiap bahasa yang muncul dalam fail anda.
Perkataan dalam imbasan terkunci di dalam imej. Ini situasi di mana mengeluarkannya menjimatkan paling banyak kerja.
Invois, kontrak, resit dan surat biasanya diterima sebagai imbasan. Dengan teks diekstrak anda boleh mencari amaun, tarikh atau nama tanpa membaca setiap halaman.
Imbasan perpustakaan, artikel jurnal dan halaman buku menjadi boleh dipetik. Ekstrak teks sekali dan tampal petikan yang anda perlukan ke dalam nota dan bukannya menaip semula.
Fail lama selalunya disimpan sebagai imbasan panjang berbilang halaman. Muat naik beberapa fail sekali gus dan penukar akan memproses keseluruhan kelompok dalam satu sesi.
Kertas yang anda imbas dan dokumen yang anda tukar boleh bersifat peribadi. Ini cara tepat bagaimana dokumen anda dikendalikan.
Setiap muat naik dan muat turun berjalan melalui sambungan yang disulitkan, jadi fail anda tidak boleh dibaca semasa dihantar.
Pengecaman teks adalah sepenuhnya automatik. Tiada siapa membaca imbasan atau dokumen anda, dan tiada apa dikongsi dengan pihak ketiga.
Pemprosesan dijalankan di pusat data bertauliah dalam Kesatuan Eropah.
Muat naik PDF diimbas anda.
Pilih enjin OCR yang sesuai dengan fail anda. Gunakan Tukar jika teks dalam PDF sudah boleh dipilih.
Pilih bahasa PDF anda untuk hasil yang lebih baik (pilihan).
Mulakan penukaran dan tunggu sehingga muat turun anda sedia.
Ya. Menukar PDF imbasan kepada teks adalah percuma dan tidak memerlukan akaun. Muat naik fail, pilih enjin dan muat turun hasilnya. Fail sehingga 100 MB dilindungi had percuma, dan pelan hanya diperlukan untuk fail lebih besar dan kelompok lebih panjang.
Ya. OCR Standard ialah enjin percuma dan ia mengendalikan imbasan biasa tanpa pendaftaran. 3 enjin AI lanjutan ialah naik taraf untuk halaman yang enjin standard tidak dapat baca, seperti salinan pudar atau foto yang diambil dalam cahaya malap.
Kerana fail mengandungi imej halaman dan bukannya aksara. Pengimbas merakam gambar kertas, jadi setiap perkataan ialah corak piksel. Pengecaman aksara optik membaca piksel itu dan menulis aksara sebenar, yang menjadikan teks boleh dipilih, dicari dan disunting.
Muat naik PDF di atas, pilih enjin OCR dan mulakan penukaran. Hasilnya ialah fail teks biasa yang boleh anda buka dalam mana-mana editor dan salin daripadanya. Menyalin terus daripada pembaca PDF hanya berfungsi apabila fail sudah mempunyai lapisan teks.
Ia mengenali 124 bahasa sumber, termasuk bahasa Cina dalam bentuk ringkas dan tradisional dengan tata letak menegak, dan varian Cyrillic untuk bahasa Azerbaijan, Serbia dan Uzbek. Pilih setiap bahasa yang muncul dalam fail, kerana halaman bercampur dibaca paling baik apabila semuanya disenaraikan.
Bukan dari halaman ini, yang menulis fail teks biasa. Ia mengekalkan perkataan dan membuang tata letak. Untuk DOC atau DOCX dengan pemformatan, gunakan aplikasi Tukar ke Word, yang menjalankan pengecaman teks yang sama dan menulis dokumen Word.
Kualiti pengecaman bergantung pada kualiti imbasan. Halaman senget, resolusi rendah, bayang pada kertas atau foto yang diambil dengan tangan semuanya menjejaskan ketepatan. Cuba AI-OCR lanjutan untuk imbasan tidak sempurna dan AI-OCR+ lanjutan untuk pencahayaan buruk, dan imbas semula pada 300 dpi jika boleh. Fail sumber yang dilindungi kata laluan atau rosak tidak akan dapat ditukar langsung.
Ya. Muat naik dan muat turun dijalankan melalui sambungan disulitkan, pemprosesan berlaku di pusat data bertauliah dalam Kesatuan Eropah, dan keseluruhan rantaian dipersiapkan secara automatik, jadi tiada siapa membaca imbasan anda. Fail anda tidak pernah digunakan untuk melatih model AI dan anda mengekalkan hak ke atasnya.
Digitalkan teks berharga daripada dokumen diimbas dan imej dengan OCR (Pengecaman Aksara Optik). Ekstrak teks daripada imej dengan mudah, dalam talian.
Baca artikelSetiap satu daripadanya berjalan dalam pelayar. Tiada pemasangan, tiada akaun, dan pengecaman teks yang sama di sebaliknya.