此 JPG 转 PDF 转换器可运行 OCR,将图片中的文字转换为可选中的文本。
或拖放、粘贴,或从云端选择
什么是 OCR?光学字符识别用于识别扫描文档或图像中的字母、数字或特殊字符。使用 OCR 转换器,你可以从这些文件中提取文本,以便进行修改、编辑、打印或保存。
如果不做文字识别,PDF 里的 JPG 仍然只是图片。里面的任何内容都不能被选择、复制或通过搜索找到。OCR 会读取字母,并将它们作为真实文本存储在 PDF 中。
文字识别支持 124 种语言,从英语、西班牙语、葡萄牙语到印地语、阿拉伯语、俄语和日语。将页面语言设为与文件一致,识别结果会明显更准确。
一只手拿纸、一只手拍照的页面从来不可能正对镜头。去斜功能会自动拉直倾斜的扫描件或照片,让文字识别的工作更轻松。
JPG 存的是像素,不是字母。直接放进 PDF 后页面看起来没问题,但计算机仍然只看到一张照片:无法选择文字、无法复制引文,搜索也找不到任何内容。
文字识别改变了这一点。它读取图像中的形状,判断这些形状对应的字母,并将结果与图片一起存入 PDF。页面视觉上与原件完全一致,但文字会像文字一样工作。
在开始转换之前请先打开 OCR 选项。若关闭它,你仍会得到一个看起来完全正常的 PDF,但对你之后粘贴到的任何搜索框来说,它都是不可读取的。
JPG 和 JPEG 是同一种图像格式,只是扩展名不同。旧版 Windows 不允许超过三个字符的扩展名,因此使用 .jpg,而 Mac 和 UNIX 系统则使用 .jpeg。
尽管现在 Windows 电脑也支持更长的 .jpeg 扩展名,但三个字符的扩展名使用更为广泛。除了扩展名多一个字符外,JPG 和 JPEG 图像没有实质性区别。
两种格式在这里都可以上传,转换为 PDF 的方式也完全相同。
文件扩展名:.jpg,MIME 类型:image/jpeg
维基百科上的 JPG默认设置适用于一般图片。真正需要你关注的只有 OCR 开关。
| 设置 | 作用 | 何时更改 |
|---|---|---|
| 使用 OCR | 读取图像中的文字,并将其作为真实文本存入 PDF。 | 只要图片中有你想保留的文字,就请打开它。 |
| 语言 | 告知文字识别应预期的字母表和词汇。支持 124 种语言。 | 将其设为图像中文字所使用的语言。 |
| 纠偏 | 自动拉直倾斜的扫描件或照片。 | 对于手持拍摄或以角度进纸到扫描仪的文件,请打开此选项。 |
| PDF 版本 | 将输出写入特定版本的 PDF 规范,从 1.4 到 2.0。 | 除非接收文件的系统明确要求某个版本,否则保持默认即可。 |
免费方案一次可转换 3 个文件,每个最大 50 MB,每个 JPG 会单独生成一个 PDF。
三个日常场景中,重点不在图片本身,而在里面的文字。
很多扫描仪和扫描应用会直接保存为 JPG。使用 OCR 将该扫描图像转换为 PDF,可以得到一个文档而不是一堆图片文件,并且连同其中的文字一起保存。
用手机拍下的合同、表格或书页。去斜会先把图像拉正,文字识别再进行读取,你得到的 PDF 就能像其他文档一样被搜索。
收据、发票和信件通常以图像形式出现。转换为 PDF 并识别文字后,你只需归档一次,之后就能通过金额、姓名或参考编号来查找它们。
上传你的 JPG 图像。
请打开 OCR 选项,以便识别图像中的文字。
选择 JPG 中所含文本的语言。(可选)
如果你的照片或图片不正,可以启用校正倾斜。(可选)
开始转换。稍等片刻后,你就可以下载 PDF 文档。
是的。将 JPG 通过 OCR 转为 PDF 是免费的,也不需要账户。上传图片,打开 OCR,点击“开始”,然后下载 PDF。只有在需要更大文件或更长批量时,订阅才有必要。
会,只要在开始前打开 OCR。文字识别会将文本写入 PDF,因此可以选择、复制,也能通过搜索找到。关闭 OCR 时,PDF 只包含图片。
处理方式相同,只多一步。开启去斜后,倾斜拍摄的页面会先被拉直,这正是手持拍照几乎总需要的。清晰、光线均匀的照片,其识别效果大致可与平板扫描件相当。
共 124 种,从英语、西班牙语、葡萄牙语到印地语、阿拉伯语、俄语和日语。开始前请选择与你页面内容相同的语言,因为在知道应期待哪种字母表时,识别会准确得多。
可以。添加任意数量的文件,它们会在一次操作中转换完成,每个文件都会以单独的 PDF 返回,并应用相同设置。免费方案每次转换最多 3 个文件,每个最大 50 MB。
可以。JPG 和 JPEG 是同一种格式,只是扩展名不同,两者在这里都可以上传。其他常见图像格式也同样适用,因此同一页面的 TIF 或 BMP 也能一样转换。
请改用 PDF 工具。“使 PDF 可搜索”会为已有 PDF 添加可识别文字,而“PDF 转文本”则会将其中的文字提取为纯文本文件。本页仅适用于图像文件。
文件通过加密连接传输,并在欧洲的服务器上自动处理。没有人会阅读或复制你的文件,它们不会被用于训练 AI 模型,下载链接是随机生成的,无法被猜出。