본문 바로가기

PDF 마스킹

이름, 번호 등 읽혀서는 안 되는 내용을 지웁니다. 가리는 것이 아니라 문서 자체에서 삭제합니다. 아무것도 저장하지 않습니다.

  • 저장되지 않음
  • 대기열 없음, 기다림 없음
  • 회원가입 없음, 워터마크 없음

사용 방법

1

PDF 추가

문서를 끌어다 놓으세요. 단어 하나를 정확히 겨냥할 수 있을 만큼 모든 페이지가 크게 표시됩니다.

2

지울 부분 드래그

지울 텍스트마다 상자를 그리세요. “실행 취소”와 “모두 지우기”는 클릭 한 번이면 되고, 저장하기 전까지는 아무것도 바뀌지 않습니다.

3

마스킹 후 다운로드

가린 텍스트를 파일에서 삭제한 다음, 그 위에 검은 상자를 그립니다.

검은 사각형이 마스킹이 아닌 이유

이는 경력을 끝내고 소송을 지게 만든 실수이므로 분명히 말해 둘 가치가 있습니다. PDF에서 텍스트 위에 검은 상자를 그려도 아무것도 숨겨지지 않습니다. 글자는 사각형 아래, 페이지의 콘텐츠 스트림에 그대로 있고, 누구나 선택하고 복사하거나 무료 도구로 4초 만에 꺼낼 수 있습니다. 합의 금액, 증인 이름, 가리지 않은 소송 서류 등 여러분이 읽은 모든 마스킹 실패 사례는 누군가 도형을 그려 놓고 그것을 믿은 문서였습니다.

여기서는 순서가 반대입니다. 사각형 안의 텍스트를 먼저 콘텐츠 스트림에서 삭제하고, 무언가 있었던 자리를 시각적으로 표시하기 위해 나중에 상자를 그립니다. 마스킹한 영역을 복사하면 아무것도 나오지 않습니다. 정말로 아무것도 없기 때문입니다. 페이지 텍스트를 추출해도 그 단어는 없습니다. 삭제된 조각의 개수를 보여 드리므로, 아무것도 걸리지 않은 채 조용히 넘어간 마스킹을 짐작이 아니라 눈으로 확인할 수 있습니다.

그래픽은 별개의 문제이고 해법도 따로 있습니다. 스캔한 페이지 속 이름이나 보고서에 붙여 넣은 스크린샷 속 이름은 텍스트가 아니라 픽셀이므로, 텍스트를 삭제해도 건드릴 수 없습니다. 그래픽 옵션을 켜면 마스킹이 이미 적용된 상태로 해당 페이지를 새로 렌더링하므로, 아래 픽셀은 가려지는 것이 아니라 정말로 사라집니다. 대가는 분명하며 솔직히 말씀드립니다. 그 페이지는 그림이 되어 텍스트를 더 이상 선택할 수 없고, 파일도 커집니다.

PDF는 페이지 외에도 여러 곳에 이름을 보관하며, 그런 곳은 여기서 건드리지 않습니다. 책갈피 개요, 양식 필드 값, 첨부 파일, 문서 정보, XMP 메타데이터 패킷, 파일 이름 자체는 모두 별도의 저장 위치이며, 이 중 어디에든 이름이 있으면 페이지를 완벽하게 마스킹해도 살아남습니다. 증분 저장된 문서라면 이전 버전도 마찬가지입니다. 마스킹한 파일을 중요한 곳에 보내기 전에 문서 속성을 열어 확인하고, 페이지가 더 이상 참조하지 않는 것을 버리도록 결과물을 다시 빌드하세요.

다른 작업이 필요할 때

법적인 문제가 걸려 있다면 그 무게에 맞게 만든 소프트웨어를 쓰세요. Adobe Acrobat Pro의 마스킹도 먼저 삭제하고 나중에 표시하는 같은 방식을 쓰며, 이 페이지로는 제공할 수 없는 기능을 더합니다. 바로 메타데이터, 첨부 파일, 숨은 레이어, 스크립트, 이전 저장 리비전을 한 번에 제거하는 삭제 정리(sanitise) 단계입니다. 법원 제출 서류라면 이 단계는 선택이 아닙니다.

무료 대안은 명령 두 개로 된 파이프라인이며, 정말 철저합니다. qpdf --qdf --object-streams=disable in.pdf out.pdf 는 문서 구조를 읽을 수 있는 텍스트로 풀어 주므로 이름이 사라졌는지 직접 눈으로 확인할 수 있고, exiftool -all:all= out.pdf 는 메타데이터를 지웁니다. 이어서 gs -sDEVICE=pdfwrite -o final.pdf out.pdf 를 실행하면 페이지가 실제로 참조하는 것만으로 파일을 다시 빌드해 연결이 끊긴 객체를 버립니다. 사람들이 건너뛰는 것은 확인 단계인데, 정작 중요한 것도 그 단계입니다.

자주 묻는 질문

검은 사각형을 그리는 것과 다른가요?

완전히 다르며, 바로 이것이 핵심입니다. PDF 편집기에서 그린 검은 사각형은 아무것도 숨기지 못합니다. 글자는 여전히 파일 안에 있어서 누구나 선택하고, 복사하고, 무료 도구로 추출할 수 있습니다. 신문사와 정부 기관도 정확히 이런 식으로 정보를 유출했습니다. 여기서는 먼저 페이지의 콘텐츠 스트림에서 텍스트를 삭제하고 나서 상자를 그립니다. 어떤 뷰어에서든 검은 영역을 선택해 보면 복사할 것이 없습니다.

제 문서가 어딘가에 저장되나요?

아니요. 마스킹 과정에서 아무것도 저장하지 않습니다. 이 점은 다른 어떤 도구보다 여기서 더 중요합니다. 사람들이 마스킹하는 문서는 웹사이트에 가장 맡기고 싶지 않은 문서이기 때문입니다.

상자 아래의 사진이나 스캔 이미지는 어떻게 되나요?

텍스트는 콘텐츠 스트림에서 삭제되지만, 이미지 속 픽셀은 다른 문제입니다. “아래 그래픽도 함께 삭제”를 켜면 해당 페이지가 평면화된 이미지로 다시 만들어져, 상자 아래에 있던 내용이 파일에서 더 이상 존재하지 않게 됩니다. 대신 그 페이지의 텍스트 레이어가 사라지므로 기본값이 아니라 선택 사항입니다.

제대로 됐는지 확인할 수 있나요?

네, 꼭 확인하세요. 결과 파일을 열어 마스킹한 영역을 선택해 보거나 PDF 텍스트 추출에 넣어 보세요. 단어가 없어야 합니다. 어떤 도구를 쓰든 보내기 전에 마스킹을 확인하는 것은 좋은 습관입니다.

메타데이터도 제거되나요?

아직은 아닙니다. 작성자 이름과 제목은 페이지가 아니라 문서 정보에 들어 있습니다. 민감한 내용을 공개하기 전에 따로 확인하세요.

참고: 텍스트는 페이지 콘텐츠에서 삭제됩니다. 같은 이름이 책갈피, 양식 필드, 첨부 파일, 문서 메타데이터에도 있다면 이는 별도의 위치이므로 건드리지 않습니다. 스캔 이미지 안의 텍스트를 마스킹하려면 그래픽 옵션이 필요하며, 이 옵션은 해당 페이지를 평면화하고 텍스트 레이어를 제거합니다.

내 웹사이트에 이 도구 넣기

블로그, 수업 페이지, 도움말 글 어디에나 무료로 넣을 수 있습니다. 코드 한 줄만 붙여 넣으면 방문자가 페이지에서 바로 사용할 수 있습니다.