PDF를 제대로 가리는 방법과 검은 상자만으로 부족한 이유
검게 가린 법원 문서나 정부 보고서의 내용을 그대로 복사할 수 있었다는 뉴스가 종종 나옵니다. 검은 상자는 실제로 있었지만 그 아래 텍스트도 그대로 남아 있었습니다.
업데이트:
검은 사각형이 아무것도 숨기지 못하는 이유
PDF는 여러 개체가 층으로 쌓인 구조입니다. 텍스트 한 줄 위에 검은 도형을 그리면 새 개체가 위에 추가될 뿐입니다. 아래 텍스트 개체는 모든 문자와 함께 파일에 남습니다.
누구나 영역을 선택해 복사하고 문서에서 이름을 검색하거나 편집기에서 상자를 옮길 수 있습니다. 검은 강조 표시, 검은 배경의 검은 글자, 주석도 약점이 같습니다.
진짜 정보 삭제가 해야 할 일
올바른 처리는 정보를 덮지 않고 없앱니다. 표시 영역 아래의 텍스트, 이미지 부분, 다른 모든 정보가 저장된 파일에 존재해서는 안 됩니다.
숨은 위치도 중요합니다. 문서 속성의 작성자 이름, 증분 저장에 남은 이전 버전, 첨부와 양식 필드의 데이터, 문자 인식이 만든 스캔 페이지의 보이지 않는 텍스트 층이 있습니다.
UseTool의 처리 방식
PDF 정보 삭제 도구는 이메일 주소나 전화번호 같은 민감한 내용을 먼저 제안하고 어디를 가릴지는 사용자가 결정합니다. 한 곳이라도 처리한 페이지는 이미지가 되고 검은 영역을 픽셀에 새깁니다. 그 페이지의 원래 텍스트는 새 파일로 옮기지 않습니다.
처리하지 않은 페이지는 그대로 복사되어 텍스트를 선택할 수 있습니다. 다시 만든 문서에는 원래 메타데이터, 첨부 파일, 능동 문서 동작을 넣지 않습니다.
- PDF를 열고 제안된 민감 정보를 검토합니다.
- 서명과 도장을 포함해 반드시 사라져야 하는 나머지 부분에도 상자를 추가합니다.
- 처리된 사본을 내보냅니다. 기기의 원본은 그대로 남습니다.
- 보내기 전에 아래 방법으로 결과를 검사합니다.
처리된 파일 확인하기
새 PDF를 열어 가린 단어를 검색하면 결과가 없어야 합니다. 처리 페이지의 텍스트도 선택할 수 없어야 합니다. 페이지 전체를 텍스트 편집기에 붙여 넣는 것도 빠른 추가 검사입니다.
PDF 텍스트 추출로도 확인할 수 있습니다. 추출한 글에 지운 이름이 나오면 놓친 부분이 있습니다.
받아들여야 하는 절충
처리 페이지는 이미지가 되므로 남은 글도 검색하거나 복사할 수 없고 파일이 커질 수 있습니다. 확실하게 없애기 위한 대가입니다. 법원, 기관, 대중에게 공유할 문서라면 조금 큰 파일이 정보 유출보다 훨씬 낫습니다.
