FAQ › OCRとテキスト

PDFからテキストをコピーする方法(選択できないとき)

短い答え

PDFからテキストをコピーするには、マウスで選択します。テキストが反転したらCtrl/Cmd+Cでコピーして貼り付け。反転しない場合は、そのPDFはスキャン画像(OCRが必要です。詳しくはテキスト抽出を参照)か、コピー保護がかかっているかのどちらかです。どちらにせよ、たいていの場合テキストは復元できます。あと一手間かかるだけです。

コピーが失敗する2つの理由

  • PDFがスキャン画像である。 ページが写真になっていて、選択できるテキストが存在しません。解決策はOCRです。Google Driveの無料OCRで、スキャンが選択可能なテキストになります。
  • コピー保護。 ファイルに選択をブロックする権限ロックがかかっています。パスワードを知っているならロックを解除してから自由にコピーできます。知らない場合はロックは外れません。正直なところ、パスワードを持っていないなら、その内容をコピーすべきではないでしょう。

これで「PDFからテキストがコピーできない」という悩みの99%はカバーできます。

最速のコピー手順

  1. PDFを任意のビューアで開きます(ブラウザ、プレビュー、Acrobat)。
  2. テキストをドラッグで選択するか、Ctrl/Cmd+Aで全選択します。
  3. コピーして、ドキュメントやメール、メモに貼り付けます。

書式が崩れて貼り付く場合は、プレーンテキストエディタ(メモ帳、TextEdit)に貼り付けてみてください。Wordに直接貼り付けると、変なフォントや枠まで一緒についてくることがあります。

正直なところ

コピーは単純なレイアウトではうまくいきますが、複雑なレイアウトではうまくいきません:

  • 段組みページは列の順にコピーされます。A列のテキスト、次にB列という順番なので、2段組の記事は順番がバラバラの2つの段落として貼り付きます。予測可能で、イライラしますが、手で直せます。
  • は表としてではなく、値のごちゃ混ぜとしてコピーされます。表の構造が必要なら、コピーせずにExcelに変換しましょう。
  • ハイフンやリガチャが変な文字として貼り付くことがあります。フォントの問題で、あなたのせいではありません。

そして倫理的な話を、はっきり言います。コピー保護が存在するのは、誰かが設定したからです。パスワードを持っていないロックを回避するのは、生産性のテクニックではなく、作者が選んだ制限を破ることです。正当に手に入れた文書からは、自由にコピーしてください。

関連する質問