Công cụ chuyển JPG sang PDF này có thể chạy OCR, để văn bản trong ảnh của bạn trở thành văn bản có thể chọn.
hoặc thả, dán, hoặc chọn từ đám mây
OCR là gì? Nhận dạng ký tự quang học (OCR) được dùng để nhận diện chữ cái, chữ số hoặc ký tự đặc biệt trong tài liệu hoặc hình ảnh đã quét. Sử dụng trình chuyển đổi OCR, bạn có thể trích xuất văn bản từ các tệp này để thay đổi, chỉnh sửa, in hoặc lưu lại.
Nếu không nhận dạng văn bản, một JPG bên trong PDF vẫn chỉ là một bức ảnh. Không có gì trong đó có thể được chọn, sao chép hoặc tìm thấy bằng tìm kiếm. OCR đọc các ký tự và lưu chúng trong PDF dưới dạng văn bản thực.
Nhận dạng văn bản đọc được 124 ngôn ngữ, từ tiếng Anh, Tây Ban Nha, Bồ Đào Nha đến tiếng Hindi, Ả Rập, Nga và Nhật. Hãy đặt ngôn ngữ cho trang của bạn để kết quả chính xác hơn rõ rệt.
Cầm trang giấy bằng một tay và chụp bằng tay kia thì trang hiếm khi vuông vức. Deskew tự động chỉnh thẳng bản scan hay ảnh bị nghiêng, giúp việc nhận dạng văn bản dễ hơn nhiều.
Một JPG chứa điểm ảnh, không phải ký tự. Đưa thẳng nó vào PDF thì trang trông vẫn đúng, nhưng máy tính vẫn chỉ thấy một bức ảnh: không từ nào có thể chọn, không trích dẫn nào có thể sao chép và tìm kiếm sẽ không ra gì.
Nhận dạng văn bản thay đổi điều đó. Nó đọc các hình dạng trong ảnh, xác định đó là ký tự nào và lưu chúng trong PDF bên cạnh bức ảnh. Trang trông y hệt bản gốc và các từ hoạt động như từ bình thường.
Bật tùy chọn OCR trước khi bắt đầu chuyển đổi. Nếu tắt, bạn sẽ nhận được một file PDF hoàn toàn ổn nhưng lại không thể đọc được bằng bất kỳ ô tìm kiếm nào mà bạn dán nó vào.
JPG và JPEG là cùng một định dạng ảnh nhưng có hai phần mở rộng tệp khác nhau. Các phiên bản Windows cũ không cho phép phần mở rộng tệp dài hơn ba ký tự nên dùng .jpg, trong khi hệ thống Mac và UNIX dùng .jpeg.
Mặc dù máy tính Windows giờ cũng hỗ trợ tệp với phần mở rộng dài hơn là .jpeg, phần mở rộng ba ký tự vẫn được dùng phổ biến hơn. Ngoài ký tự bổ sung trong phần mở rộng tệp, không có khác biệt thực sự nào giữa ảnh JPG và JPEG.
Cả hai đều được chấp nhận ở đây, và cả hai đều được chuyển sang PDF theo cùng một cách.
Phần mở rộng tệp: .jpg, loại MIME: image/jpeg
JPG trên WikipediaCác thiết lập mặc định xử lý tốt ảnh thông thường. Chỉ có công tắc OCR là thực sự cần bạn chú ý.
| Cài đặt | Chức năng | Khi nào nên thay đổi |
|---|---|---|
| Sử dụng OCR | Đọc văn bản trong ảnh và lưu vào PDF dưới dạng văn bản thực. | Hãy bật khi ảnh có chứa các từ bạn muốn giữ lại. |
| Ngôn ngữ | Cho công cụ nhận dạng văn bản biết bảng chữ cái và từ vựng cần mong đợi. Có sẵn 124 ngôn ngữ. | Đặt ngôn ngữ trùng với ngôn ngữ của văn bản trong ảnh. |
| Chỉnh thẳng | Tự động làm thẳng bản scan hoặc ảnh bị nghiêng. | Hãy bật cho mọi thứ được chụp bằng tay hoặc được đưa qua máy scan với góc lệch. |
| Phiên bản PDF | Ghi kết quả theo một chuẩn PDF cụ thể, từ 1.4 đến 2.0. | Giữ nguyên trừ khi hệ thống mà bạn gửi tệp yêu cầu một phiên bản nhất định. |
Gói miễn phí xử lý 3 tệp dung lượng tối đa 50 MB trong một lần chuyển đổi, và mỗi JPG sẽ được trả về dưới dạng một PDF riêng.
Ba công việc hàng ngày mà trọng tâm không phải bức ảnh, mà là các từ trong đó.
Nhiều máy scan và ứng dụng scan lưu trực tiếp thành JPG. Chuyển ảnh scan đó sang PDF với OCR sẽ cho bạn một tài liệu thay vì một thư mục đầy ảnh, và văn bản đi kèm theo đó.
Ảnh chụp hợp đồng, biểu mẫu hoặc một trang sách. Deskew làm vuông lại bức ảnh, nhận dạng văn bản đọc nội dung, và file PDF bạn nhận được có thể được tìm kiếm như bất kỳ tài liệu nào khác.
Hóa đơn, chứng từ và thư từ thường đến dưới dạng hình ảnh. Khi được chuyển sang PDF với văn bản đã được nhận dạng, chúng có thể được lưu một lần và tìm lại sau theo số tiền, tên hoặc số tham chiếu.
Tải ảnh JPG của bạn lên.
Hãy bật tùy chọn OCR để văn bản trong ảnh của bạn được nhận dạng.
Chọn ngôn ngữ của văn bản trong ảnh JPG. (tùy chọn)
Bật tính năng chỉnh nghiêng nếu ảnh của bạn bị lệch. (tùy chọn)
Bắt đầu chuyển đổi. Sau một lúc, bạn có thể tải xuống tệp PDF của mình.
Có. Chuyển JPG sang PDF với OCR là miễn phí và không cần tài khoản. Tải ảnh lên, bật OCR, nhấn Bắt đầu và tải PDF xuống. Gói thuê bao chỉ quan trọng với tệp lớn hơn và lô xử lý dài hơn.
Có, miễn là OCR được bật trước khi bạn bắt đầu. Nhận dạng văn bản ghi các từ vào PDF, nên chúng có thể được chọn, sao chép và tìm thấy bằng tìm kiếm. Khi tắt OCR, PDF chỉ chứa bức ảnh.
Tương tự, chỉ thêm một bước. Bật deskew và một trang được chụp lệch góc sẽ được làm thẳng trước, đúng với nhu cầu của hầu hết ảnh chụp bằng tay. Ảnh sắc nét, đủ sáng sẽ được đọc gần tốt như bản scan từ máy scan phẳng.
124 ngôn ngữ, từ tiếng Anh, Tây Ban Nha, Bồ Đào Nha đến tiếng Hindi, Ả Rập, Nga và Nhật. Hãy chọn ngôn ngữ mà trang của bạn được viết trước khi bắt đầu, vì nhận dạng sẽ chính xác hơn nhiều khi biết trước bảng chữ cái cần xử lý.
Có. Thêm bao nhiêu tệp bạn cần và tất cả sẽ được chuyển đổi trong một lần, mỗi tệp trả về thành một PDF riêng với cùng thiết lập. Gói miễn phí xử lý 3 tệp dung lượng tối đa 50 MB mỗi lần chuyển đổi.
Có. JPG và JPEG là cùng một định dạng với hai phần mở rộng tệp khác nhau, và cả hai đều được chấp nhận ở đây. Các định dạng ảnh phổ biến khác cũng hoạt động, nên TIF hoặc BMP của cùng một trang cũng được chuyển đổi tốt như vậy.
Hãy dùng một trong các ứng dụng PDF. Tạo PDF có thể tìm kiếm sẽ thêm văn bản đã nhận dạng vào file PDF bạn đã có, và PDF sang văn bản sẽ trích xuất chữ ra thành file văn bản thuần. Trang này dành cho tệp hình ảnh.
Ảnh được gửi qua kết nối mã hóa và được xử lý tự động trên các máy chủ ở châu Âu. Không ai đọc hoặc sao chép tệp của bạn, chúng không được dùng để huấn luyện mô hình AI, và liên kết tải xuống là ngẫu nhiên nên không thể đoán được.
Số hóa văn bản quan trọng từ tài liệu scan và hình ảnh với OCR (Nhận dạng ký tự quang học). Trích xuất văn bản từ hình ảnh dễ dàng, trực tuyến.
Đọc bài viếtMọi ứng dụng ở đây đều chạy trên trình duyệt, không cần cài đặt.