업로드 없음, 100% 로컬, 계정 없음

아티클

브라우저 PDF 도구 모음: 정리하고, 배치하고, 구조화하기

PDF 작업의 대부분은 세 가지 묶음으로 나뉩니다. 문서를 읽을 수 있게 만들기, 페이지를 지면에 배치하기, 그리고 문서에 붙은 데이터를 편집하기입니다. 이 사이트는 그 묶음들을 아우르는 작은 도구를 약 열한 개 제공하며, 모두 브라우저 탭 안에서 파일을 처리합니다. PDF는 기기를 떠나지 않은 채로 열리고, 바뀌고, 저장되므로, 같은 도구가 급여 명세서에도 기밀 계약서에도 똑같이 쓸모가 있습니다.

스캔을 정리하고 바로잡기

스캐너나 휴대폰 카메라에서 들어온 페이지는 보관할 가치가 생기기 전에 몇 가지 보정이 필요할 때가 많습니다. 회전 도구는 옆으로 또는 거꾸로 들어온 페이지를 90도 단위로 돌리며, 예전의 스캔 PDF 회전 안내를 대신합니다. 기울기 보정 도구는 살짝 비스듬히 놓인 글자를 똑바로 세우는데, 이후 문자 인식을 돌릴 계획이라면 중요합니다. 그레이스케일 도구는 색상 채널을 없애 파일을 줄이고, 평판 스캐너가 흰 종이에 더하는 옅은 색조를 제거합니다. 복구 도구는 자신의 한계에 솔직합니다. pdf-lib가 해석해 다시 저장할 수 있는 범위에서 손상된 PDF를 재구성하므로 다른 뷰어가 거부하는 파일을 많이 살려내지만, 애초에 파일에 기록된 적 없는 내용은 되살릴 수 없습니다. 열리지 않는 문서에 대한 첫 시도로 쓰되, 보장으로 여기지 마세요.

비뚤어지고 흐릿하게 스캔된 페이지와, 기울기 보정 및 그레이스케일 정리를 거쳐 반듯하고 읽기 쉬워진 동일한 페이지를 나란히 비교.

페이지 배치하기

문서가 읽을 수 있게 되면, 페이지가 종이 위에 어떻게 놓이는지를 바꿔야 할 수 있습니다. 자르기 도구는 여백을 다듬거나 페이지를 원하는 영역으로 잘라냅니다. 크기 조정 도구는 페이지 치수를 바꿔, 예컨대 US 레터에서 A4로 바꿔 다른 나라에서 문서가 올바르게 인쇄되게 합니다. N-up 도구는 여러 페이지를 한 장에 나란히 배치하며, 유인물이나 종이 절약에 편리합니다. 교대 합치기 도구는 두 파일을 페이지 단위로 끼워 넣는데, 이를 쓰는 가장 흔한 이유는 단면 스캐너로 한 양면 스캔입니다. 앞면을 한 파일로 스캔하고, 묶음을 뒤집어 뒷면을 두 번째 파일로 스캔한 뒤, 둘을 섞어 페이지를 원래 순서로 되돌립니다. 이 도구들은 어느 것도 글자를 래스터화하지 않으므로, 디지털로 만들어진 PDF는 레이아웃 변경 후에도 선택 가능한 텍스트를 유지합니다.

메타데이터와 구조

마지막 묶음은 페이지를 둘러싼 데이터입니다. 메타데이터 도구는 제목, 작성자, 주제, 키워드 필드를 읽고 다시 쓰며, 문서를 공유하기 전에 이를 비울 수 있게 해 주는데, 이는 작지만 실질적인 개인정보 보호 단계입니다. 책갈피 도구는 PDF 뷰어가 측면 패널에 보여 주는 클릭 가능한 개요를 만들어, 긴 보고서를 둘러보기 쉽게 합니다. HTML을 PDF로 바꾸는 도구는 반대 방향으로 작동해 붙여 넣은 마크업을 PDF로 바꾸지만, 분명한 단서가 있습니다. 결과를 페이지 이미지로 그려 내므로 출력물은 선택 가능한 텍스트가 아닙니다. PDF에서 실제로 글자를 빼내야 할 때는 서로 다른 두 갈래가 있습니다. 파일이 디지털로 만들어졌다면 pdf-to-text 도구가 내장된 텍스트를 직접 정확하게 읽습니다. 파일이 스캔이라면 읽을 텍스트가 없으므로 광학 문자 인식이 필요한데, 이는 그림에서 글자를 추측하므로 틀릴 수 있습니다. 자신이 어느 경우인지 알면 많은 혼란을 덜 수 있습니다.

PDF 내부 구조와 XREF 테이블

PDF 파일은 선형 문서가 아닙니다. 파일 끝의 상호 참조(XREF) 테이블로 연결된 개별 객체(딕셔너리, 배열, 스트림, 숫자 값)의 데이터베이스입니다. XREF 테이블은 각 객체 ID를 정확한 바이트 오프셋에 매핑합니다. 일부 데스크톱 편집기는 변경 사항을 증분 업데이트로 저장합니다. 즉 수정된 객체만 덮어쓰는 새 XREF 섹션을 파일 끝에 추가하고, 원본 바이트는 그 아래 그대로 남겨둡니다. pdf-lib로 구축된 브라우저 기반 도구는 다르게 동작합니다. 문서 전체를 메모리 안의 객체 그래프로 파싱한 다음, 요청된 변경을 적용하고(예를 들어 페이지의 Rotate 항목을 0에서 90으로 다시 씀), 전체 파일을 처음부터 새로운 단일 PDF로 다시 직렬화합니다. 이 전체 재작성 방식 때문에 도구가 실행되는 동안 문서 전체가 메모리에 들어가야 하며, 이것이 각 도구가 입력 파일 크기 상한을 두는 이유입니다. 파일의 어떤 부분도 서버로 업로드되지 않습니다.

PDF 파일의 구조: 헤더, 오브젝트, 바이트 오프셋으로 각 오브젝트를 색인하는 xref 테이블, 그리고 trailer.

스트림 압축과 PDF 복구 작동 방식

PDF의 페이지 내용(텍스트 그리기 명령, 벡터 경로, 래스터 이미지)은 거의 항상 FlateDecode(zlib)로 압축된 스트림 객체 안에 있습니다. PDF가 손상되면 일반적으로 손상된 XREF 테이블이나 잘린 압축 스트림이 문제입니다. 복구 도구는 손상된 XREF 테이블을 완전히 우회하고 원시 바이트 스트림을 선형 스캔하여 개별 객체를 감싸는 obj와 endobj 마커를 찾습니다. 해당 객체들을 추출하고 연관된 스트림 압축 해제를 시도하며 처음부터 새롭고 올바른 형식의 XREF 테이블을 구성합니다. 손상이 Flate 압축된 스트림 자체 내부에 있다면 해당 특정 객체의 데이터는 복구 불가능합니다. 문서 구조는 복원할 수 있지만 영향을 받은 페이지는 빈 페이지이거나 이미지가 없을 수 있습니다.

이 아티클의 도구

자주 묻는 질문

이 PDF 도구들이 제 파일을 서버로 업로드하나요?

아니요. 이 도구들은 모두 JavaScript와 WebAssembly를 사용해 브라우저 탭 안에서 PDF를 열고, 편집하고, 저장합니다. 파일은 디스크에서 페이지로 읽혀 들어오고 결과는 곧바로 다운로드로 쓰이므로, 네트워크 너머로 아무것도 전송되지 않습니다. 도구를 쓰는 동안 브라우저의 네트워크 패널을 열어 확인하거나, 페이지가 로드된 뒤 인터넷 연결을 끊고도 도구가 계속 작동하는지 지켜보면 됩니다.

복구 도구가 손상된 PDF를 무엇이든 고칠 수 있나요?

모든 파일은 아닙니다. 복구 도구는 문서를 다시 해석해 형식이 올바른 새 사본을 써내며, 이는 깨진 상호 참조 표와 PDF가 열리지 못하게 막는 여러 구조적 결함을 고칩니다. 진짜로 빠진 데이터를 지어내거나 강력한 암호화를 되돌릴 수는 없습니다. 빠른 첫 시도로 다루세요. 파일이 살아나면 끝이고, 그렇지 않더라도 잃은 것이 없으니 원본을 찾아보면 됩니다.