スキャンした PDF を Word に変換する方法(OCR ルート)
短い答え
スキャンした PDF を Word に変換するには、まず OCR が必要です。スキャンはページの写真であり、Word が必要とするのは実際のテキストだからです。スキャンを Google Drive にアップロードして Google ドキュメントで開くと(OCR は自動で実行されます)、それを Word ファイルとしてダウンロードできます。ざらついたスキャンでは誤字や不完全なレイアウトを想定してください。これは復元であって、コピーではありません。
Google Drive ルート(無料・インストール不要)
- スキャンした PDF を Google Drive にアップロードします。
- 右クリック → アプリで開く → Google ドキュメント。Drive が OCR を実行し、認識されたテキストを表示します。
- OCR の誤りを確認して修正します — 特に名前と数字。
- ファイル → ダウンロード → Word ドキュメント(.docx)。
これが標準の無料ルートで、Google の OCR はきれいな印刷テキストなら本当に優秀です。スキャンがぼやけていたり、傾いていたり、手書きだったりする場合は、ミスが発生する前提で校正の時間を組み込んでおきましょう。
スキャンにもっと手当てが必要なとき
Google の結果が使い物にならない場合、問題はたいていツールではなくスキャンのほうです:
- 300 DPI で再スキャン、平らにして十分な光で — セットアップはドキュメントのスキャンを参照。OCR の品質はスキャン時に決まります。悪いスキャンを救えるツールはありません。
- 複数カラムの文書(新聞、パンフレット)はカラム順に認識されるため、読み順がぐちゃぐちゃになるのを想定してください。
- 表はスプレッドシートの表ではなく、テキストのスープになります。本物の表が必要なら、Excel ルートも同様に荒いので、手で組み直したほうが速いことが多いです。
正直なところ
始める前に期待を調整しましょう:Word ファイルは素朴な文書のように見えます — 元のフォント、余白、レイアウトは OCR を生き延びません。編集できるのが目的であり、しかし複製ではありません。
そして、スキャンが正式なままであるべき文書(署名済みの契約書や証明書など)なら、絶対に編集しないでください。正式文書の OCR コピーは、あなたが望まない疑問を招くだけです。自由に改訂できる文書だけを変換しましょう。デジタル(非スキャン)PDF の変換はずっときれいです — PDF から Word へを参照。