스캔 PDF에서 Ctrl+F가 아무것도 찾지 못한다면 보이는 글자가 저장된 텍스트가 아니라 픽셀일 수 있습니다. 먼저 단어 하나를 선택해 보세요. 개별 단어를 선택할 수 없다면 광학 문자 인식(OCR)이 필요할 가능성이 큽니다.
보이는 줄을 표시하기만 하고 검색하거나 복사할 필요가 없다면 PDF 강조 표시 절차를 사용하세요.
가장 빠른 방법은 PDF to Markdown입니다. PDFCheck는 기존 텍스트 레이어를 먼저 읽고 이미지 페이지에는 AI OCR을 사용할 수 있습니다. 추출된 Markdown을 반환하며 원본 PDF를 수정하거나 검색 가능한 텍스트 레이어를 추가하지는 않습니다.
30초 진단
- 단어 하나를 선택하고 복사합니다.
- 텍스트 편집기에 붙여 넣어 글자를 확인합니다.
- 선택할 수 없다면 이미지 페이지로 보고 OCR을 사용합니다.
- 일부 페이지만 실패하면 텍스트와 스캔 페이지가 섞인 문서입니다.
PDF 검색이 실패하는 이유
스캐너는 각 페이지를 사진으로 저장할 수 있습니다. PDF에는 글자가 보이지만 검색, 복사, 화면 읽기 프로그램, AI 도구에는 이미지만 존재합니다. 숨겨진 텍스트의 인코딩이나 OCR 결과가 손상된 경우도 있습니다.
| 증상 | 가능한 원인 | 해결 |
|---|---|---|
| 단어를 선택할 수 없음 | 이미지 전용 스캔 | OCR 실행 |
| 붙여 넣은 텍스트가 기호로 표시됨 | 문자 인코딩 손상 | 텍스트 추출 후 OCR 시도 |
| 일부 페이지만 검색됨 | 혼합 문서 | 해당 페이지에 OCR 적용 |
목적에 맞는 방법 선택
- 구절 찾기 또는 복사: 읽을 수 있는 텍스트가 있다면 PDF 텍스트 추출기를 사용합니다.
- 스캔 또는 정리되지 않은 추출: PDF to Markdown을 사용해 결과를 검색합니다.
- PDF 자체를 검색 가능하게 만들기: 텍스트 레이어를 추가하는 OCR 편집기를 사용합니다. Adobe의 텍스트 인식 안내서를 참고하세요.
- 손상 또는 보호된 파일: PDF Validator로 확인합니다. 암호 도구는 권한이 있을 때만 사용하세요.
- 문서에 질문: PDF AI 채팅을 사용합니다.
OCR 결과 검토
- 이름, 날짜, 금액, 참조 번호를 확인합니다.
- 단과 표의 읽기 순서를 점검합니다.
- 올바른 언어와 반듯하고 대비가 좋은 이미지를 사용합니다.
- 중요한 텍스트는 페이지 이미지와 비교합니다. Adobe의 OCR 오류 수정 안내서를 참고하세요.
검색 가능하다고 정확한 것은 아닙니다
OCR 출력은 초안입니다. 계약서, 청구서, 의료 기록, 법적 증거, 인용문은 육안으로 대조하고 원본을 보관하세요.
AI 워크플로용 PDF to Markdown도 확인하세요.