スキャンしたPDFの文章をコピーしたいのに、ページ全体しか選べないことがあります。紙を読み取ったPDFは、文字に見えても画像として保存されている場合があるためです。画像の文字をテキストへ変換する処理をOCR(光学文字認識)と呼びます。
文章だけを取り出すなら、外部送信が許可された資料でGoogleドライブを試す方法があります。PDFの見た目を残して検索したいなら、検索可能なPDFを作るOCR機能を選びます。どちらも認識後の文字は原本との照合が必要です。
文字の抜き出しと検索できるPDFを使い分ける
まず、欲しい出力を決めます。OCRができることと、元と同じレイアウトで編集できることは同じではありません。
| やりたいこと | 選ぶ出力と確認点 |
|---|---|
| 文章をコピーして再利用する | 認識したテキスト。抜け・誤字・読む順番を確認 |
| PDF内の言葉を検索する | 検索可能なPDF。文字情報の追加と検索を確認 |
| Wordで文章を編集する | DOCXへの書き出し。OCRに加え文書の配置も確認 |
| 表をExcelで集計する | 表の変換。文字認識に加え行・列・数値も確認 |
検索可能なPDFは、画像の見た目を残して文字情報を持たせる方法があります。検索・選択ができても、元の画像の文章を直接編集できるとは限りません。DOCXが目的ならPDFをWordに変換する方法、表の集計が目的ならPDFをExcelに変換する方法も確認してください。
既に一文字ずつ選べてコピーも正しくできるページは、必要な文字情報がある可能性があります。一つのPDFに画像ページと文字を選べるページが混在する場合もあるため、使いたいページで確認します。
OCRの前に原本とアップロードの可否を確認する
元のPDFは残し、作業用のコピーを使います。元のWord文書やテキストデータを入手できるなら、画像から認識し直すよりそのデータを利用する方法を先に検討してください。
- 文書を利用・コピーしてよいか確認する
- 向きが正しく、文字が欠けず、暗い影や強い傾きがないか見る
- 外部サービスへ送信してよい資料か確認する
- 必要な出力と日本語OCRに対応する方法を選ぶ
勤務先や顧客の資料、個人情報を含むPDFを、許可なくGoogleドライブなどへアップロードしないでください。暗号化や削除の案内があっても、外部送信が認められるとは限りません。送信できない資料は、所属先が認めた端末内処理などを選び、ソフト名だけでなく実際の処理先も確認します。
コピー・変更の制限やパスワードがある場合は、作成者へ利用可能なファイルを依頼してください。OCRや印刷し直しで保護を回避する方法は使わないようにします。制限と画像の切り分けはPDFの文字を編集できないときの対処法にまとめています。
GoogleドライブでスキャンPDFから文章を取り出す
パソコンのブラウザからGoogleドライブを使い、PDFをGoogleドキュメントで開く方法です。Googleアカウントと利用可能な保存容量が必要です。無料で試す候補ですが、外部送信の許可とアカウントの利用条件を先に確認します。
GoogleのPDFや写真をテキストへ変換する公式手順は、日本語に対応し、準備の目安としてファイルは2MB以下、文字の高さは10ピクセル以上を案内しています。これは認識の成功や精度を保証する数値ではありません。
- 送信してよいPDFを用意し、向きと画質を確認します。
- パソコンでGoogleドライブを開き、作業用のPDFをアップロードします。
- ドライブ上のPDFを右クリックし、「アプリで開く」→「Googleドキュメント」を選びます。
- 開いた文書内で、認識された文章を選択できるか確認します。表示された画像と文字情報を区別してください。
- 必要な文字をコピーし、原画像と照合してから利用先の文書へ保存します。
この方法は文章の抜き出し向けです。Googleは表・列・リスト・脚注などが検出されない可能性を案内しているため、元の表がそのまま編集可能な表になるとは考えないでください。二段組みは読む順番、表は各項目と数字の対応を確認します。
大きなPDFを目安に合わせるために強く圧縮すると、文字がつぶれることがあります。全ページを一度に送る前に、許可された範囲で必要なページを作業用コピーへ分けるか、別の対応方法を選んでください。変換後の文書や共有設定も、所属先の保存・削除ルールに沿って扱います。
AcrobatのOCRでPDF内の文字を検索できるようにする
PDF内の言葉を検索・選択したい場合は、OCR機能を利用できるデスクトップ版Acrobatで次の手順を確認します。無料Readerの閲覧機能と同じとは考えず、契約している対象版にOCRが含まれるかを確かめてください。
- 原本のバックアップを残し、スキャンPDFの作業用コピーを開きます。
- 「すべてのツール」→「スキャンとOCR」を開き、テキスト認識の「このファイル内」を選びます。
- 対象のページ範囲と言語を指定します。日本語資料では、内容に合う言語設定を確認してください。
- 必要な設定を確認して「テキスト認識」を実行します。
- 認識後のPDFを別名で保存し、開き直して検索・文字の選択・コピーを確認します。
Adobeのスキャン文書内のテキスト認識の説明では、OCRにより検索可能なテキストレイヤーが作成されます。画面名や設定は版で異なる場合があるので、利用環境のヘルプを確認してください。
確認には、原画像にある短い言葉を検索し、同じ場所の文章をコピーしてメモなどへ貼り付ける方法が使えます。見た目が正しい画像でも、追加された文字情報には誤字がある場合があります。検索に一度成功しただけで全文が正しいとは判断しないことが大切です。
認識できない文字は画像と出力を照合する
OCRが完了したら、出力した文章と元の画像を並べます。仕事に使う部分は全文を照合し、特に数字や固有名詞を見落とさないようにしてください。次の文字例は確認用の例で、特定ソフトの実測結果ではありません。
| 確認する場所 | 具体的な見方 |
|---|---|
| 本文と固有名詞 | 誤字・欠け・重複、人名や社名の文字を原画像と照合 |
| 数字と記号 | 0とO、1とl、小数点・マイナス・桁・単位の違いを確認 |
| 読む順番 | 段組み・見出し・注記が別の段落へ混ざっていないか確認 |
| 表の対応 | 行・列のずれにより項目と数字が入れ替わっていないか確認 |
| 保存した出力 | 開き直して文字を使え、必要なページが残っているか確認 |
文字がつぶれている場合
文字が小さすぎる、傾いている、影がある場合は、認識を繰り返す前に元の画像を見直します。可能なら元の紙を読み取り直す、正しい向きのデータを受け取るなど、入力を改善してください。解像度だけ上げても、既につぶれた文字の形が戻るとは限りません。
日本語や段組みがうまく読めない場合
言語設定のあるソフトは日本語に合っているか確認します。縦書き・手書き・複雑な表は、対応の有無と実際の出力を同じ資料で確かめてください。「日本語対応」だけでは、自分の文書を正しく認識できる証拠にはなりません。
読めない文字を文脈や生成AIで推測して原文として扱わないようにします。元データや作成者で確認し、確定できない部分は未確認として残してください。表や段組みの整形は、文字の正しさを確認してから行います。
OCRを繰り返すなら購入前に対象版を試す
一度の文字抜き出しが手持ちの機能で終わるなら、新しくPDF編集ソフトを買う必要はありません。頻繁にOCRを使う、検索可能なPDFを保存したい、外部送信を避けたい場合は、対応する専用ソフトを比較する意味があります。
購入前は、日本語OCR、欲しい出力形式、対応OS、処理先、試用版の保存・ページ数制限を確認します。価格だけで選ばず、個人情報を含まない用途に近い資料で、認識後の修正と保存・再読込まで試してください。有料でも誤認識がなくなるとは限りません。
必要なOCR機能と購入条件を確認したい方へ
買い切り型PDF編集ソフトの選び方|OCR・Excel変換・対応OSを購入前に確認で、対象版・OS・試用条件・更新費用を整理しています。リンク先にはアフィリエイト広告が含まれます。Windows専用の候補をMac向けとして選ばず、OCRで欲しい出力を作れる版か確認してください。
スキャンPDFの文字変換でよくある疑問
PDFを開くだけでOCRになりますか?
閲覧できることと文字情報があることは別です。使いたいページで文字を選択・コピー・検索できるかを確認し、画像しかない場合はOCRに対応する方法を使います。
OCR後はPDFの本文を自由に編集できますか?
検索用の文字情報を追加しただけでは、元の画像内の本文を編集できるとは限りません。文字の抜き出し、検索、PDF本文の編集を分け、目的に合う機能を選んでください。
手書きや縦書きも正確に変換できますか?
文書の状態と利用する機能によって結果は変わります。対応表示だけで判断せず、自分の用途に近い資料で認識と修正の量を確認します。読めない部分は推測で埋めないでください。
スマホでも同じ手順ですか?
この記事のGoogleドライブはパソコンのブラウザ、Acrobatはデスクトップ版の手順です。スマホアプリで使う場合は、その版のOCR・保存・無料範囲を別に確認してください。
公式情報の確認日:2026年10月12日。
