이미지 PDF 한글 변환 안 될 때 OCR 오류 원인별 해결법

스캔한 문서를 PDF로 저장했는데 텍스트 선택도 안 되고, OCR을 돌려도 한글이 제대로 추출되지 않는 문제로 막힌 분들이 많습니다. 원인은 생각보다 다양하며, 그에 맞는 접근법도 달라집니다. 이 글에서는 유형별 원인과 실질적인 해결 방법을 정리했습니다.

내 PDF, 왜 텍스트 선택이 안 될까?

PDF 내 텍스트를 드래그하거나 강조 표시할 수 없다면, 해당 파일은 이미지 형태로 저장된 스캔 PDF일 가능성이 높습니다. 이미지 PDF는 겉으로는 문서처럼 보이지만 실제로는 사진 한 장과 동일한 구조입니다.

이처럼 텍스트 편집이나 복사를 하고 싶지만 작업할 수 없는 PDF 파일은 이미지로 저장된 경우일 가능성이 높으며, 이 문제를 해결하려면 OCR 기능을 통해 PDF 콘텐츠를 편집 가능한 텍스트로 변환해야 합니다.

이미지 PDF인지 확인하는 방법은 간단합니다.

  • 마우스로 텍스트 드래그 시도 → 선택이 안 되면 이미지 PDF
  • Ctrl+A(전체 선택) 후 복사 → 내용이 붙여넣기 안 되면 이미지 PDF
  • 파일 용량이 같은 분량의 일반 PDF보다 훨씬 크면 이미지 PDF일 확률 높음

자주 발생하는 OCR 오류 유형 3가지

1. “렌더링 가능한 텍스트가 있습니다” 오류

Adobe Acrobat에서 OCR을 실행하면 이런 메시지가 뜨는 경우가 있습니다.

이 메시지는 PDF 문서에 편집 가능한 텍스트가 이미 포함되어 있을 때 표시됩니다. Acrobat은 렌더링 가능한 텍스트가 포함된 문서에 대해서는 OCR을 수행할 수 없습니다.

이 경우 직접 OCR을 실행하는 것이 아니라, PDF를 XPS 포맷으로 변환한 후 이를 다시 PDF로 변환하고 OCR을 인식하게 하는 방식으로 해결할 수 있습니다. Windows에서는 “Microsoft XPS Document Writer” 프린터로 인쇄하면 XPS 파일을 만들 수 있습니다.

2. “인식 서비스에 액세스할 수 없습니다” 오류

스캔한 페이지나 이미지에 OCR을 적용하려 할 때 시스템 메모리 부족, 불완전하거나 손상된 파일, 지원되지 않는 형식, 오래된 소프트웨어 또는 리소스 부족으로 OCR 서비스에 액세스하지 못할 수 있습니다.

이럴 때는 아래 순서로 시도합니다.

  • Acrobat을 완전히 종료 후 재실행
  • `C:\Program Files\Adobe\Acrobat DC\Acrobat\plug_ins\PaperCapture\iDRS15` 폴더 내 파일을 복사한 뒤, `PaperCapture` 및 `plug_ins` 폴더에 각각 붙여넣기 후 Acrobat 재시작
  • 위 방법으로도 해결이 안 되면 Adobe 공식 제공 Acrobat Cleaner로 완전 재설치

3. 한글 인식률이 낮거나 글자가 깨질 때

스캔 해상도가 문제일 수 있습니다. OCR 변환 시 모든 옵션에 72dpi 이상의 입력 해상도가 필요하며, 이 수치는 권장 기준입니다. 실제로 한글처럼 획이 복잡한 언어는 최소 300dpi 이상을 권장합니다.

스마트폰으로 스캔할 때는 기기를 흔들림 없이 고정해야 파일이 왜곡되거나 흐려질 위험을 줄일 수 있으며, 문서 스캐너나 모바일 앱 사용 시 조명이 충분하고 카메라 렌즈가 깨끗한지 확인해야 OCR이 더 정확하게 인식할 수 있습니다.

도구별 한글 OCR 변환 방법

Adobe Acrobat Pro

Acrobat을 실행한 후 스캔한 PDF 문서를 불러오고, 우측 하단의 [스캔 및 OCR] 기능을 선택하면 이미지 문자 인식을 통해 스캔한 이미지를 텍스트로 변환할 수 있습니다. 한글 인식에 가장 안정적인 도구이나 유료 플랜 필요합니다.

스캔 품질이 낮은 원본이라면 [모든 도구] → [스캔 및 OCR] → [스캔 파일 향상] → [향상] 클릭 → [카메라 이미지 향상]에서 종이 부분만 선택되도록 핸들을 조정하면 인식률을 높일 수 있습니다.

무료 온라인 도구 비교

직접 설치 없이 온라인에서 처리하고 싶다면 선택지가 여럿 있습니다.

  • Smallpdf OCR: 거의 모든 언어의 스캔 문서를 인식하고 변환할 수 있으며, OCR로 텍스트를 인식한 후 PDF를 검색 가능한 파일로 저장하거나 Word 문서로 변환 가능
  • iLovePDF: 무료로 PDF OCR 변환 지원, 한글 포함 다국어 인식
  • Soda PDF: 스캔 이미지를 복사·붙여넣기·편집 가능한 일반 텍스트로 변환하며, 변환된 PDF를 이메일로 바로 공유 가능

OCR 인식률을 높이는 핵심 체크리스트

OCR 인식 오류는 하나의 증상처럼 보여도 사용하는 스캔 장비, 파일의 저장 방식, 문서의 서식에 따라 오류의 형태가 달라집니다. 변환 전 아래 항목을 점검하면 실패 확률을 크게 줄일 수 있습니다.

  • 해상도 300dpi 이상으로 스캔 여부 확인
  • 문서가 기울어지지 않게 평평하게 스캔
  • 흑백 문서는 흑백 모드로, 컬러 문서는 컬러 모드로 스캔
  • 여백을 상하좌우 15mm 이상으로 유지하고 텍스트 박스가 페이지 안쪽에 정렬되어 있는지 확인
  • 표나 복잡한 레이아웃이 포함된 경우, 단순 텍스트 구조로 재구성 검토

함께 읽어보면 좋은 글