このJPGからPDFへのコンバーターはOCRを実行できるため、画像内のテキストを選択可能なテキストに変換できます。
または、ファイルをドロップ、貼り付けるか、クラウドから選択
OCR とは?光学式文字認識 (Optical Character Recognition) は、スキャンした文書や画像内の文字、数字、記号を識別するための技術です。OCR コンバーターを使うと、これらのファイルからテキストを抽出し、変更、編集、印刷、保存できるようになります。
文字認識を行わないと、PDF 内の JPG はあくまで画像のままです。中の内容は選択もコピーも検索もできません。OCR は文字を読み取り、それを PDF 内に本物のテキストとして保存します。
文字認識は英語、スペイン語、ポルトガル語からヒンディー語、アラビア語、ロシア語、日本語まで124言語を読み取ります。ページの言語を設定すると、結果の精度がはっきり向上します。
片手で紙を持ち、もう一方の手で撮影したページは、きれいな四角形にはなりません。デスキュー機能は斜めになったスキャンや写真を自動でまっすぐにし、文字認識がずっと行いやすくなります。
JPG には文字ではなくピクセルが入っています。そのまま PDF にしても見た目は正しく表示されますが、コンピュータからは写真としてしか認識されません。単語は選択できず、引用もコピーできず、検索にもヒットしません。
文字認識を使うと、この状況が変わります。画像の中の形を読み取り、それがどの文字かを判別し、画像の横に PDF 内のテキストとして保存します。ページの見た目は元のままで、中の単語はきちんと「文字」として扱われます。
変換を始める前に OCR オプションを有効にしてください。オフのままだと、見た目は問題なくても、将来どの検索ボックスに貼り付けても読み取れない PDF になってしまいます。
JPG と JPEG は、拡張子が違うだけで同じ画像形式です。古い Windows では3文字より長い拡張子が使えなかったため .jpg を使用し、Mac や UNIX システムでは .jpeg が使われていました。
現在のWindowsコンピュータでは長い.jpeg拡張子もサポートされていますが、3文字の拡張子の方が広く使われるようになりました。拡張子の文字数以外に、JPGとJPEG画像に実質的な違いはありません。
ここでは両方の形式を利用でき、どちらも同じ方法で PDF に変換されます。
ファイル拡張子: .jpg、MIME タイプ: image/jpeg
WikipediaのJPGについて通常の画像であれば、既定値のままで問題ありません。確認が必要なのは主に OCR スイッチだけです。
| 設定 | 機能 | 変更の目安 |
|---|---|---|
| OCR を使用 | 画像内の文字を読み取り、PDF に本物のテキストとして保存します。 | 画像の中に残したい文字があるときは、常にオンにしてください。 |
| 言語 | テキスト認識に、どの文字体系と言語を想定すべきかを伝えます。124の言語が利用できます。 | 画像内のテキストの言語に合わせて設定してください。 |
| 傾き補正 | 斜めになったスキャンや写真を自動的にまっすぐにします。 | 手に持って撮影した写真や、斜めにスキャンしたものにはオンにしてください。 |
| PDFバージョン | 出力を PDF 1.4 から 2.0 まで、特定の PDF 仕様に合わせて書き出します。 | 送付先のシステムから特定のバージョンを求められた場合以外は、そのまま変更しないでください。 |
無料プランでは、1回の変換で最大3ファイル、各50 MBまで扱え、各 JPG はそれぞれ個別の PDF として返されます。
日常の3つの作業で重要なのは画像そのものではなく、その中にある文字です。
多くのスキャナやスキャンアプリは、直接 JPG として保存します。そのスキャン画像を OCR 付きで PDF に変換すれば、画像ファイルのフォルダではなく1つの文書になり、文字情報も一緒に扱えます。
契約書やフォーム、本の1ページをスマホで撮影した画像です。デスキューで画像を四角く補正し、文字認識で内容を読み取れば、戻ってくる PDF は他の文書と同じように検索できます。
レシート、請求書、手紙は、画像として届くことがよくあります。OCR 付きで PDF に変換しておけば、一度ファイルしておくだけで、金額や名前、管理番号などで後から検索できます。
JPG画像をアップロードします。
画像内の文字を認識できるよう、OCR オプションをオンにしてください。
JPG内のテキストの言語を選択します。(任意)
写真や画像が傾いている場合は台形補正を有効にします。(任意)
変換を開始します。少し待つとPDF文書をダウンロードできます。
はい。OCR 付きで JPG から PDF への変換を行っても無料で、アカウント登録も不要です。画像をアップロードし、OCR をオンにして、開始を押し、PDF をダウンロードするだけです。大きなファイルや長いバッチ処理が必要な場合のみ、サブスクリプションが関係します。
はい。変換を始める前に OCR をオンにしていれば、文字認識がテキストを PDF に書き込むので、選択、コピー、検索ができるようになります。OCR をオフにすると、PDF には画像だけが含まれます。
基本的には同じで、1つ処理が追加されます。デスキューをオンにすると、斜めに撮影されたページが最初にまっすぐ補正されます。手に持って撮影した画像はほとんどがこの補正を必要とします。ピントが合い、均一に明るい写真であれば、フラットベッドスキャナとほぼ同じ精度で読み取れます。
英語、スペイン語、ポルトガル語からヒンディー語、アラビア語、ロシア語、日本語まで124言語です。変換前にページの言語を選択してください。使われている文字種が分かっている方が、認識精度は大きく向上します。
はい。必要なだけ追加すれば、一度に変換され、同じ設定が適用された個別の PDF として返されます。無料プランでは、1回の変換につき最大3ファイル、各50 MBまで扱えます。
はい。JPG と JPEG は拡張子が違うだけで同じ形式であり、どちらもここで利用できます。他の一般的な画像形式も対応しているので、同じページの TIF や BMP も問題なく変換できます。
PDF 用の別ツールを使ってください。「PDF を検索可能にする」は、既にある PDF に認識したテキストを追加でき、「PDF からテキスト」は文字だけをプレーンテキストファイルとして抽出します。このページは画像ファイル用です。
画像は暗号化された接続で送信され、ヨーロッパのサーバー上で自動処理されます。ファイルが閲覧・コピーされることはなく、AI モデルの学習にも使用されません。ダウンロードリンクはランダムに生成されるため、推測されることもありません。