출처

개요

OCRmyPDF는 스캔한 PDF에 OCR 텍스트 레이어를 덧입혀 검색 가능한 PDF/A로 변환하는 명령줄 도구입니다. Tesseract OCR 엔진을 호출해 100개 이상 언어를 처리하며, 인식 텍스트를 이미지 아래층에 정확히 배치해 원본 레이아웃을 유지합니다. 다국어·대용량 문서 처리, 기울기 보정, 이미지 최적화, 병렬 처리를 지원하며, EasyOCR·Apple Vision·PaddleOCR로 교체할 수 있는 플러그인 인터페이스를 제공합니다.

핵심 기능

  • 검색 가능한 PDF/A 생성: 텍스트 레이어를 이미지 아래에 배치해 검색·복사 가능
  • 원본 보존: 해상도 유지, 가능한 경우 무손실로 OCR 정보 삽입
  • 이미지 최적화: 내부 이미지를 최적화해 출력 파일 크기 축소 가능
  • 전처리: 기울기 보정(deskew)·페이지 정리 등
  • 검증·확장성: 입력/출력 유효성 검사, 다중 CPU 코어 병렬 처리, 수천 페이지 규모 지원

왜 주목할 만한가

기존 무료 OCR 도구들이 텍스트 위치 어긋남, 다국어·악센트 처리 부족, 과도한 파일 크기 등 문제가 있어 직접 개발된 도구입니다. 로컬에서 처리하므로 사적 데이터가 외부로 유출되지 않는 점도 강점입니다.

참고

원문 보존 위치

원문 전체는 raw source: web-2026-07-02-pytorchkr-topic-11047-ocrmypdf-searchable-pdf-text-layer-clisource_url 및 HTML 원문과 함께 저장되어 있습니다.