スキャンPDFでCtrl+Fが何も見つけない場合、画面上の文字は保存されたテキストではなくピクセルかもしれません。まず単語を1つ選択してみてください。個々の文字を選択できなければ、光学文字認識(OCR)が必要です。
見えている行に印を付けるだけで、検索やコピーは不要なら、PDFをハイライトする手順を使ってください。
手早い方法はPDFからMarkdownです。PDFCheckは既存のテキストレイヤーを先に読み、画像ページではAI OCRを利用できます。出力は抽出したMarkdownであり、元のPDFを変更したり、検索可能なテキストレイヤーを追加したりはしません。
30秒で診断
- 単語を1つ選択してコピーします。
- テキストエディターに貼り付け、正常な文字か確認します。
- 選択できなければ画像ページとしてOCRを使います。
- 一部のページだけ失敗する場合は、テキストとスキャンが混在しています。
PDF内検索が失敗する理由
スキャナーは各ページを写真として保存できます。PDF上では文字に見えても、検索、コピー、スクリーンリーダー、AIツールには画像しかありません。隠しテキストの文字コードやOCR結果が壊れている場合もあります。
| 症状 | 主な原因 | 対応 |
|---|---|---|
| 単語を選択できない | 画像のみのスキャン | OCRを実行 |
| 貼り付けると記号になる | 文字コードの破損 | 文字抽出後にOCRを試す |
| 一部だけ検索できる | 混在文書 | 該当ページをOCR |
目的に合った方法を選ぶ
- 文章を探す・コピーする:読めるテキストがあればPDFテキスト抽出を使います。
- スキャンや崩れた抽出:PDFからMarkdownを使い、出力内を検索します。
- PDF自体を検索可能にする:テキストレイヤーを追加できるOCRエディターを使います。Adobeのテキスト認識ガイドを参照してください。
- 破損・保護されたファイル:PDF Validatorで確認します。パスワードツールは権限がある場合だけ使用してください。
- 文書に質問する:PDF AIチャットを試します。
OCR結果を確認する
- 氏名、日付、金額、参照番号を確認します。
- 段組みや表の読み順を確認します。
- 正しい言語と、傾きがなくコントラストの高い画像を使います。
- 重要箇所は画像と照合します。AdobeのOCR修正ガイドも役立ちます。
検索可能でも正確とは限りません
OCR出力は下書きです。契約書、請求書、医療記録、法的証拠、引用は目視で照合し、原本を保存してください。
AIワークフロー向けPDFからMarkdownもご覧ください。