スキャンしたPDFを、文字で検索・コピーできるようにする方法
スキャンした契約書や資料から、必要な言葉を探したい、文章をコピーしたい、というときの方法です。
スキャンしたPDFが検索できない理由
スキャナーやスマートフォンで作ったPDFは、ページ全体が1枚の写真のようなものです。人の目には文字に見えても、PDFの中に文字のデータがないため、検索やコピーができません。
文字認識(OCR)でできること
写真の中の文字を読み取り、見えない文字のデータとしてページに重ねます。見た目は元のスキャンのままで、PDFを開くアプリで検索したり、文字を選んでコピーしたりできるようになります。読み取った文章は、テキストファイルとしても保存できます。
読み取りはお使いの端末の中で行い、書類はどこにも送信しません。
手順
- 「文字認識(OCR)」を開き、スキャンしたPDFをドロップします。
- 「文書の言語」を選びます。日本語の書類なら「日本語と英語」のままで大丈夫です。
- 一部のページだけ読みたいときは、「ページ」に「1-3,5」のように入力します。
- 「実行」を押します。初回だけ、読み取り用のデータを読み込むため少し時間がかかります。
- できあがったPDFとテキストファイルをダウンロードし、PDFを開いて検索できるか確かめます。
うまく読み取るコツ
- スキャンするときは、ページをまっすぐ置き、明るく、画質の設定を高めにします。
- 横向きや逆さまのページは、先に「PDF回転」で向きを直します。
- 手書き、かすれた文字、とても小さい文字は誤りやすくなります。
- 読み取りは100%正確ではありません。大事な数字や名前は、読み取った文字を目で確認してください。
- 1回に読み取れるのは200ページまでです。続きは、ページを指定してもう一度実行します。
よくある質問
書類はサーバーに送られますか?
送られません。文字を読み取る仕組みも、このページの中で動きます。初回だけ読み取り用のデータをこのサイトから読み込み、以後は端末に保存されます。
1ページにどれくらい時間がかかりますか?
端末にもよりますが、2回目からは1ページ数秒ほどです。
黒塗りしたPDFも検索できるようになりますか?
黒塗りしたページは画像になるので、文字認識をかけると、黒塗りしていない部分の文字が検索できるようになります。「まとめて処理」で「黒塗り」と「文字認識(OCR)」をつなげると一度で済みます。
最終更新:2026-09-14