업로드 없음, 100% 로컬, 계정 없음

아티클

PDF에서 텍스트를 검게 칠하는 것이 흔히 실패하는 이유

문단 위에 그려진 검은 사각형은 텍스트가 사라진 것처럼 보이지만, 대부분의 PDF 편집기에서는 그렇지 않습니다. 가린 글자는 여전히 파일에 선택 가능한 문자로 저장되어 있습니다; 그 상자는 그 위에 놓인 새로운 도형일 뿐입니다. 페이지를 복사하거나, 검색하거나, 다른 뷰어에서 열면 '가려진' 문장이 다시 나타날 수 있습니다. 왜 그런 일이 일어나는지, 그리고 텍스트를 숨기는 대신 실제로 제거하는 가리기 방법을 알아봅니다.

위에 놓인 도형은 삭제가 아니다

PDF 페이지는 두 가지를 따로 유지합니다: 위치와 글꼴을 가진 각 문자인 텍스트 객체와, 추가하는 사각형, 하이라이트, 주석을 포함해 페이지에 배치되는 그리기 객체입니다. PDF 뷰어에서 검은 상자를 그리면 기존 텍스트 객체 위에 새로운 그리기 객체를 추가하는 것입니다. 그 상자가 시각적으로 글자를 덮으므로 이제 페이지는 가려진 것처럼 보입니다. 파일에게 아래에 있는 텍스트 객체를 제거하라고 지시하는 것은 아무것도 없으므로, 그것들은 같은 위치, 같은 내용으로 정확히 그대로 남아 있습니다.

두 레이어로 나뉜 PDF 페이지의 도해: 아래의 텍스트 객체와 그 위에 놓여 시각적으로 문자를 덮지만 삭제하지는 않는 그리기 객체 상자.

원래 텍스트가 다시 드러나는 방식

텍스트 객체가 파일을 떠난 적이 없으므로, 평범한 네 가지 동작이 이를 드러낼 수 있습니다: '검게 칠해진' 줄을 선택하고 복사하기, 문서 전체에서 텍스트 검색을 실행하기, 어떤 PDF-텍스트 변환 도구로든 원문 텍스트를 추출하기, 또는 텍스트 객체를 그리기 객체보다 다른 순서로 렌더링하는 뷰어에서 파일을 열기입니다. 이 중 어느 것도 특별한 기술이 필요하지 않습니다. 이는 공개적으로 한 번 이상 일어났습니다: 민감한 구절 위에 검은 상자를 넣어 공개된 PDF가 그 아래에 읽을 수 있고 복사할 수 있는 텍스트를 여전히 담고 있었던 것으로 드러났고, 그 실수는 숨겨지지 않고 뉴스가 되었습니다.

먼저 페이지를 이미지로 바꾸기

해결책은 가리기 후가 아니라 전에 텍스트 레이어를 제거하는 것입니다. PDF를 이미지로 같은 도구로 PDF 페이지를 순수 이미지로 변환한 다음, 이미지 영역 가리기로 그 이미지 위 민감한 영역에 그리세요. 그 시점에는 페이지에 텍스트 객체가 남아 있지 않고 픽셀만 있으므로, 상자는 복구할 수 있는 어떤 것 위에도 놓여 있지 않습니다. 이미지를 PDF로 가려진 이미지들을 PDF로 다시 조립하면, 이전에 민감했던 텍스트는 더 이상 존재하지 않고, 일부가 가려진 페이지의 그림만 있을 뿐입니다.

작업 흐름 도해: PDF 페이지를 이미지로 변환하고, 픽셀 위에 불투명한 상자로 가린 다음, 아래에 복구 가능한 텍스트가 없는 새 PDF로 다시 조립합니다.

이것이 포기하는 것

페이지를 래스터화하면 실제로 검색 가능한 텍스트가 정적인 그림으로 바뀌므로, 이후 가려진 페이지를 읽는 누구든 가려졌든 아니든 그 페이지의 텍스트를 더 이상 선택하거나 검색할 수 없습니다. 보호하려는 페이지에는 받아들일 만한 대가입니다: 대안인 텍스트 레이어를 그대로 두고 아무도 확인하지 않기를 바라는 것이 바로 이 글이 시작한 그 실수입니다. 같은 문서의 다른 페이지에 민감한 내용이 없다면 그대로 두고 필요한 페이지만 래스터화하면 됩니다.

단색 상자를 쓰고, 메타데이터도 확인하세요

텍스트에는 완전히 불투명한 검은색이나 단색 상자가 더 안전한 선택입니다; 흐림 필터는 흐림 정도가 약하면 크고 단순한 텍스트에 대해 때때로 거꾸로 복원될 수 있으므로, 문장보다는 얼굴이나 사진에 더 알맞습니다. 보이는 페이지를 가려도 파일의 메타데이터는 건드리지 않습니다: 작성자 이름, 소프트웨어 버전, 삽입된 사진의 GPS 좌표, 편집 이력은 페이지 내용과 별개로 유출될 수 있습니다. 이것이 문서에서 중요하다면 공유하기 전에 파일 자체의 메타데이터가 무엇을 드러내는지 확인하세요.

이 아티클의 도구

자주 묻는 질문

PDF 뷰어에서 검은 사각형을 그리면 실제로 아래에 있는 텍스트가 삭제되나요?

보통은 아닙니다. 도구에 밑에 있는 텍스트 객체를 제거하는 전용 가리기 기능이 없는 한, 도형을 그리는 것은 페이지 위에 레이어를 하나 추가할 뿐입니다. 원래 문자는 파일에 남아 있고 일반적인 도구로 선택하거나, 검색하거나, 추출할 수 있습니다.

민감한 텍스트를 흐리게 하는 것이 상자로 덮는 것보다 안전한가요?

텍스트에는 아닙니다. 크고 단순한 텍스트에 적용된 약한 흐림은 때때로 원래 문자를 추측할 수 있을 만큼 충분히 거꾸로 복원될 수 있습니다, 특히 짧은 단어나 숫자라면요. 단색의 완전히 불투명한 상자, 또는 먼저 래스터화해서 텍스트 레이어를 완전히 제거하는 것이 텍스트에는 더 안전한 선택입니다; 흐림은 얼굴이나 일반적인 사진 내용에 더 알맞습니다.

가리기 전에 PDF를 이미지로 변환하면 중요한 것을 잃나요?

변환하는 페이지가 순수한 그림이 되므로 그 페이지에서 텍스트를 선택하거나 검색하는 능력을 잃습니다. 적극적으로 가리려는 페이지에는 그것이 목적입니다: 민감한 텍스트가 더 이상 추출 가능한 문자로 존재하지 않습니다. 민감한 내용이 없는 페이지는 필요한 것만 래스터화하면 일반 PDF 페이지로 남을 수 있습니다.