เครื่องมือนี้จะแปลง PDF ที่สแกนเป็นข้อความที่แก้ไขได้ เพื่อให้คุณคัดลอก แก้ไข และเพิ่มเนื้อหาได้อย่างง่ายดาย
หรือวาง ลากไฟล์มาวาง หรือเลือกจากคลาวด์
การเปลี่ยน PDF ที่สแกนเป็นข้อความจริงๆ คือคนละงานกัน 2 แบบ และตัวแปลงให้คุณเลือกได้ว่าจะให้ทำงานแบบไหน PDF ที่มีตัวอักษรจริงอยู่แล้ว แค่ต้องอ่านออกมาเท่านั้น ส่วน PDF ที่เป็นเพียงรูปภาพของหน้าเอกสารต้องถูกจดจำอักษรก่อน เพราะยังไม่มีข้อความอยู่ข้างใน
คุณแยกสองแบบนี้ออกได้ภายในไม่กี่วินาที เปิดไฟล์ในโปรแกรมอ่านอะไรก็ได้แล้วลองลากเลือกหนึ่งบรรทัด ถ้าคำถูกไฮไลต์ แสดงว่า PDF นั้นมีชั้นข้อความ ให้เลือก Convert แล้วข้อความจะออกมาตรงตามที่เขียนไว้ ถ้าไม่มีอะไรถูกไฮไลต์ หรือทั้งหน้าถูกเลือกเป็นก้อนเดียว แสดงว่าเป็นไฟล์สแกนและต้องใช้การรู้จำตัวอักษร (OCR)
ตัวเลือกเดียวนี้อธิบายได้เกือบทั้งหมดว่าทำไมหลายคนถึงได้ผลลัพธ์ที่น่าผิดหวังจากที่อื่น ตัวแปลงที่ใช้เส้นทางเดียวกับทุกไฟล์ที่อัปโหลด จะให้ข้อความสะอาดกับบางไฟล์ และหน้าเปล่ากับไฟล์อื่น โดยไม่อธิบายอะไรเลย การเลือกเอ็นจินด้วยตัวคุณเองช่วยตัดความไม่แน่นอนออกไป
ไฟล์สแกนจะไม่ให้คุณลากเคอร์เซอร์ข้ามประโยคได้ เพราะไม่มีอะไรให้เลือก การดึงข้อความจาก PDF ที่สแกนแล้วช่วยแก้ปัญหานี้: อัปโหลดไฟล์ รันการแปลง แล้วคุณจะได้ไฟล์ข้อความธรรมดาที่ใช้คัดลอก วางในอีเมล หรือค้นหาด้วยคำสั่ง Find ในเอดิเตอร์ไหนก็ได้
ผลลัพธ์คือไฟล์ .txt จึงเปิดได้บนคอมพิวเตอร์และโทรศัพท์ทุกรุ่นโดยไม่ต้องใช้ซอฟต์แวร์พิเศษ มันเก็บเฉพาะคำและการขึ้นบรรทัดใหม่ไว้ และทิ้งเลย์เอาต์ไป ซึ่งเป็นการแลกเปลี่ยนที่เหมาะสมเมื่อคุณต้องการเนื้อหา ไม่ใช่สำเนาหน้าเอกสาร
คุณสามารถส่งไฟล์สแกนหลายไฟล์พร้อมกันได้ PDF แต่ละไฟล์จะถูกแปลงแยกกันและได้ไฟล์ข้อความของตัวเอง โดยใช้อเอ็นจินเดียวกันและการตั้งค่าภาษาเดียวกันกับทุกไฟล์
ส่วนขยายไฟล์ .txt ใช้สำหรับไฟล์ข้อความธรรมดา ไฟล์เหล่านี้ประกอบด้วยบรรทัดข้อความ และสามารถเปิดได้ด้วยโปรแกรมแก้ไขข้อความจำนวนมากบนแพลตฟอร์มและอุปกรณ์ต่างๆ ข้อความจะไม่มีการจัดรูปแบบใดๆ
นั่นคือเหตุผลว่าทำไมมันถึงเป็นที่ที่ปลอดภัยที่สุดในการเก็บข้อความที่กู้มาจากไฟล์สแกน ไม่มีอะไรในไฟล์ที่จะล้าสมัย เปิดได้โดยไม่ต้องใช้ไลเซนส์ และข้อความยังคงอ่านได้ชัดเจนแม้โปรแกรมที่ใช้สร้างไฟล์ต้นฉบับจะถูกแทนที่ไปแล้ว
นามสกุลไฟล์: .txt, MIME type: text/plain
ไฟล์ TXT บนวิกิพีเดียที่นี่มี 5 วิธีในการอ่าน PDF ที่สแกนไว้ และแผงการตั้งค่าจะให้คุณสลับระหว่างวิธีเหล่านี้ เลือกแบบที่ตรงกับไฟล์ที่คุณมีอยู่ตรงหน้า
| เอ็นจิน OCR | เลือกใช้เมื่อ |
|---|---|
| แปลง | PDF มีข้อความที่เลือกได้อยู่แล้ว จะไม่มีการจดจำอักษรเกิดขึ้น ดังนั้นคำจึงออกมาตรงตามที่เขียนไว้ |
| OCR มาตรฐาน | ไฟล์สแกนคมชัด ตรง และภาพชัดเจน นี่คือเส้นทางที่เร็วที่สุดจาก PDF สแกนสู่ข้อความ |
| AI-OCR ขั้นสูง | ไฟล์สแกนจาง ความละเอียดต่ำ หรือเอียงเล็กน้อย และเอ็นจินมาตรฐานทำตัวอักษรหล่นหาย |
| AI-OCR ขั้นสูง+ | หน้ากระดาษมีเงา แสงไม่สม่ำเสมอ หรือสันหนังสือโค้ง ซึ่งพบได้บ่อยเมื่อถ่ายภาพหนังสือ |
| OCR จากภาพถ่าย | ข้อความถูกถ่ายภาพแทนที่จะสแกน เช่น ป้ายฉลากฉลากสินค้า หรือภาพหน้าจอ |
ตัวแปลงรองรับภาษาต้นทาง 124 ภาษา รวมถึงภาษาจีนตัวย่อและตัวเต็มที่จัดหน้าตัวอักษรแนวตั้ง และภาษาอาเซอร์ไบจาน เซอร์เบียน และอุซเบกที่ใช้ตัวอักษรซีริลลิก เลือกทุกภาษาที่ปรากฏในไฟล์ของคุณ
คำในไฟล์สแกนถูกล็อกอยู่ในรูปภาพ สถานการณ์ต่อไปนี้คือกรณีที่การดึงคำออกมาช่วยลดงานได้มากที่สุด
ใบแจ้งหนี้ สัญญา ใบเสร็จ และจดหมายมักจะมาเป็นไฟล์สแกน เมื่อดึงข้อความออกมาแล้ว คุณสามารถค้นหายอดเงิน วันที่ หรือชื่อ แทนการต้องอ่านทุกหน้า
ไฟล์สแกนจากห้องสมุด บทความวารสาร และหน้าหนังสือกลายเป็นข้อความที่อ้างอิงได้ ดึงข้อความออกมาครั้งเดียวแล้ววางส่วนที่ต้องการลงในบันทึกของคุณแทนการพิมพ์ใหม่
ไฟล์เก่ามักถูกเก็บเป็นไฟล์สแกนยาวหลายหน้า อัปโหลดหลายไฟล์พร้อมกันและตัวแปลงจะทำงานกับชุดไฟล์ทั้งหมดในครั้งเดียว
กระดาษที่คุณสแกนและเอกสารที่คุณแปลงอาจเป็นข้อมูลส่วนตัว ข้างล่างนี้คือวิธีการจัดการไฟล์ของคุณอย่างละเอียด
ทุกการอัปโหลดและดาวน์โหลดทำผ่านการเชื่อมต่อที่เข้ารหัส จึงไม่สามารถอ่านไฟล์ของคุณระหว่างส่งต่อได้
การรู้จำข้อความทำงานแบบอัตโนมัติทั้งหมด จะไม่มีใครอ่านสแกนหรือเอกสารของคุณ และจะไม่ถูกแชร์กับบุคคลที่สาม
การประมวลผลเกิดขึ้นในดาต้าเซ็นเตอร์ที่ได้รับการรับรองภายในสหภาพยุโรป
อัปโหลดไฟล์ PDF ที่สแกนของคุณ
เลือกเอ็นจิน OCR ที่เหมาะกับไฟล์ของคุณ ใช้ Convert ถ้าข้อความใน PDF สามารถเลือกได้อยู่แล้ว
เลือกภาษาของไฟล์ PDF ของคุณเพื่อผลลัพธ์ที่ดียิ่งขึ้น (ไม่บังคับ)
เริ่มการแปลงและรอจนกว่าลิงก์ดาวน์โหลดจะพร้อม
ใช้ได้ฟรี การแปลง PDF สแกนเป็นข้อความไม่คิดค่าใช้จ่ายและไม่ต้องมีบัญชี อัปโหลดไฟล์ เลือกเอ็นจิน และดาวน์โหลดผลลัพธ์ ไฟล์ขนาดไม่เกิน 100 MB อยู่ในขีดจำกัดแบบฟรี และจะต้องใช้แพ็กเกจเฉพาะเมื่อไฟล์ใหญ่กว่านี้หรือชุดงานยาวกว่านี้เท่านั้น
ได้ OCR มาตรฐานคือเอ็นจินที่ใช้ฟรีและจัดการไฟล์สแกนทั่วไปได้โดยไม่ต้องลงทะเบียน เอ็นจิน AI ขั้นสูงทั้ง 3 ตัวคือการอัปเกรดสำหรับหน้าที่เอ็นจินมาตรฐานอ่านไม่ออก เช่น สำเนาที่จางมากหรือรูปถ่ายในสภาพแสงไม่ดี
เพราะไฟล์เก็บภาพของหน้าเอกสารแทนที่จะเป็นตัวอักษร เครื่องสแกนถ่ายภาพกระดาษ ดังนั้นทุกคำจึงเป็นแค่ลายพิกเซล การรู้จำตัวอักษร (OCR) จะอ่านพิกเซลเหล่านั้นและเขียนออกมาเป็นตัวอักษรจริง ซึ่งทำให้ข้อความสามารถเลือก ค้นหา และแก้ไขได้
อัปโหลด PDF ด้านบน เลือกเอ็นจิน OCR และเริ่มการแปลง ผลลัพธ์คือไฟล์ข้อความธรรมดาที่คุณเปิดในเอดิเตอร์ใดก็ได้แล้วคัดลอกออกมาได้ การคัดลอกโดยตรงจากโปรแกรมอ่าน PDF จะทำได้ก็ต่อเมื่อไฟล์มีชั้นข้อความแล้วเท่านั้น
มันรู้จำภาษาต้นทางได้ 124 ภาษา รวมทั้งภาษาจีนทั้งแบบตัวย่อและตัวเต็มที่จัดหน้าตัวอักษรแนวตั้ง และรูปแบบตัวอักษรซีริลลิกของภาษาอาเซอร์ไบจาน เซอร์เบียน และอุซเบก เลือกทุกภาษาที่ปรากฏในไฟล์ เพราะหน้าที่มีหลายภาษาจะอ่านได้ดีที่สุดเมื่อระบุทุกภาษาที่ใช้
ทำไม่ได้จากหน้านี้ ซึ่งเขียนเป็นไฟล์ข้อความธรรมดา มันเก็บเฉพาะคำและทิ้งเลย์เอาต์ไป ถ้าต้องการไฟล์ DOC หรือ DOCX ที่มีการจัดรูปแบบ ให้ใช้ แอป Convert to Word ซึ่งใช้การรู้จำข้อความแบบเดียวกันและเขียนออกมาเป็นเอกสาร Word
คุณภาพการรู้จำขึ้นอยู่กับคุณภาพของไฟล์สแกน หน้าเอียง ความละเอียดต่ำ เงาบนกระดาษ หรือรูปถ่ายจากมือถือ ล้วนทำให้ความแม่นยำลดลง ลองใช้ Advanced AI-OCR สำหรับไฟล์สแกนที่ไม่สมบูรณ์ และ Advanced AI-OCR+ สำหรับสภาพแสงไม่ดี และสแกนใหม่ที่ 300 dpi หากเป็นไปได้ ไฟล์ต้นฉบับที่ถูกป้องกันด้วยรหัสผ่านหรือเสียหายจะไม่สามารถแปลงได้เลย
ใช่ การอัปโหลดและดาวน์โหลดทำผ่านการเชื่อมต่อที่เข้ารหัส การประมวลผลทำในดาต้าเซ็นเตอร์ที่ได้รับการรับรองภายในสหภาพยุโรป และทั้งกระบวนการเป็นระบบอัตโนมัติ ไม่มีใครอ่านไฟล์สแกนของคุณ ไฟล์ของคุณจะไม่ถูกนำไปใช้ฝึกโมเดล AI และคุณยังคงมีสิทธิ์ในไฟล์ของตนเอง
แปลงข้อความสำคัญจากเอกสารสแกนและรูปภาพให้เป็นดิจิทัลด้วย OCR (การรู้จำอักขระด้วยแสง) แยกข้อความออกจากรูปภาพได้อย่างง่ายดายบนออนไลน์
อ่านบทความทุกฟังก์ชันเหล่านี้ทำงานในเบราว์เซอร์ ไม่ต้องติดตั้ง ไม่ต้องมีบัญชี และใช้การรู้จำข้อความแบบเดียวกันเบื้องหลัง