OCR · 이미지/PDF를 텍스트로 작동 방식
OCR 도구는 스캔된 이미지나 이미지 기반 PDF를 복사, 검색, 편집 가능한 텍스트로 변환합니다. 브라우저 안에서 완전히 실행되는 tesseract.js를 사용합니다. 선택기에서 문서 언어를 선택하면 해당 언어 모델이 브라우저에 한 번 다운로드되고, 이후의 모든 인식 작업은 캐시된 모델로 오프라인에서 실행됩니다. 스캔된 파일은 변환 중 어떤 서버에도 전송되지 않습니다.
인식 정확도는 스캔 품질에 크게 의존합니다. 200 DPI 이상에서 깨끗하고 대비가 높게 스캔된 페이지, 배경 노이즈가 적고 페이지가 반듯하게 정렬된 경우가 최상의 결과를 냅니다. 흐릿하거나 저해상도이거나 심하게 압축된 JPEG, 단이 있거나 복잡한 레이아웃의 페이지, 손으로 쓴 텍스트는 모두 정확도를 떨어뜨립니다. 이 도구는 일반 텍스트 블록을 출력합니다. 표를 보존하거나 다단 레이아웃을 유지하는 구조화된 출력이 필요하다면 후처리가 필요합니다. 비뚤어진 스캔에 OCR을 실행하기 전에 PDF 기울기 보정 도구를 먼저 사용하면 인식률이 향상됩니다.