PDF에서 이미지 추출 작동 방식
PDF에서 이미지 추출은 PDF에 내장된 원본 래스터 이미지를 직접 꺼내 각각 별도의 PNG 파일로 저장합니다. 페이지가 어떻게 보이는지 스크린샷을 렌더링하는 것이 아니라, 문서에 배치된 실제 사진, 로고, 스캔 이미지를 저장된 해상도 그대로 복구합니다. 추출은 브라우저 안에서 pdf-lib로 이루어지며, 원본 PDF는 네트워크를 통해 전혀 이동하지 않습니다.
이것은 PDF 페이지를 이미지로 변환하는 것과 다릅니다. 페이지 변환은 선택한 DPI로 텍스트, 테두리, 배경을 포함한 전체 페이지 레이아웃을 단일 래스터 이미지로 렌더링합니다. 이미지 추출은 PDF의 내부 객체 그래프를 탐색해 각 이미지 리소스를 원래 상태 그대로 꺼내 원본 픽셀 크기와 색상 공간을 보존합니다. 페이지가 단일 전체 크기 사진으로 구성된 경우 페이지 크기 렌더링이 아닌 저장된 크기 그대로의 사진을 얻습니다. PDF에 내장 래스터 이미지가 없고 벡터 그래픽이나 텍스트만 있다면 도구는 추출할 것을 찾지 못합니다.