ZipSeek 가이드 전체

PDF와 OCR

Mac에서 PDF와 스캔 문서의 글자를 검색하는 방법

PDF의 원문 텍스트와 스캔 페이지 OCR을 한 번에 검색하고, 정확한 페이지나 이미지 영역으로 이동하세요.

게시 업데이트

겉보기에는 같은 PDF라도 검색 방식은 크게 다를 수 있습니다. 디지털로 만든 PDF에는 보통 선택 가능한 텍스트가 있지만, 스캔 PDF는 페이지 이미지뿐이라 일반적인 본문 검색으로는 글자를 찾을 수 없습니다. 두 형태가 섞인 PDF도 있습니다.

ZipSeek는 텍스트 레이어가 있으면 먼저 사용하고, 필요할 때 Mac의 로컬 OCR로 스캔 페이지와 삽입 이미지를 인식합니다. 결과에는 페이지 번호가 남고, 단어 좌표가 있으면 페이지 위의 실제 위치도 표시됩니다.

텍스트와 스캔을 한 번에 검색하기

PDF 한 개, 압축 파일 또는 문서 폴더를 선택하고 검색어를 입력합니다. 스캔이 섞여 있을 수 있다면 ‘이미지 속 텍스트’를 켜세요. 모든 PDF에 정상적인 텍스트 레이어가 있다면 OCR을 꺼서 추가 인식 시간을 줄일 수 있습니다.

텍스트 검색이 실패했다고 모든 페이지를 무조건 OCR하지는 않습니다. 쓸 수 있는 텍스트 레이어를 우선 사용하고, 텍스트가 없거나 중요한 이미지 문자가 있는 페이지만 후보로 처리합니다.

  • 문서가 많을수록 흔한 한 단어보다 짧고 구별되는 문구가 좋습니다.
  • 별도 이미지에도 답이 있을 수 있다면 이미지 형식도 선택합니다.
  • OCR 중에는 아래 상태 영역에서 문서 분석과 구분된 진행률을 볼 수 있습니다.

결과에서 바로 해당 페이지로

PDF 결과를 선택하면 오른쪽 미리 보기가 일치한 페이지로 이동합니다. 원문 텍스트는 본문에서 강조되고, OCR 결과는 인식 좌표를 페이지 위에 표시합니다. 이전·다음 버튼은 줄이 아니라 실제 일치 항목마다 이동합니다.

OCR은 픽셀을 해석하는 과정입니다. 낮은 해상도, 기울어진 스캔, 손글씨, 흐린 복사본, 특이한 글꼴, 빽빽한 표에서는 정확도가 떨어질 수 있으므로 중요한 내용은 원본 페이지로 확인해야 합니다.

OCR 처리는 Mac 안에서

문자 인식은 macOS Vision으로 기기 안에서 처리됩니다. 문서, 검색어, OCR 텍스트를 외부 AI 서비스에 보내지 않습니다. 재사용 가능한 결과는 용량 제한이 있는 로컬 캐시에 저장되고, 원본이 바뀌면 예전 내용은 다시 쓰지 않습니다.

텍스트가 있는 PDF 한 개만 찾는다면 미리보기의 Command-F면 충분합니다. ZipSeek는 같은 검색어를 여러 PDF, 이미지, Office 문서, 압축 파일에 걸쳐 찾을 때 더 유용합니다.