PDF を正しく黒塗りする方法:黒い四角だけでは不十分な理由
裁判資料や行政報告の黒塗り部分が簡単にコピーできた、というニュースはたびたび起きます。 黒い枠は実在していても、その下の文字も残っていたのです。
更新日:
黒い四角では何も隠せない理由
PDF は複数のオブジェクト層で構成されます。 文字の上に黒い図形を描くと、新しいオブジェクトが上へ加わるだけです。 下の文字オブジェクトは、文字情報ごとファイルに残ります。
誰でもその範囲を選択してコピーし、名前を検索し、編集ソフトで枠を移動できます。 黒い蛍光ペン、黒背景に黒文字、コメント注釈も同じ弱点を持ちます。
本当の墨消しに必要なこと
正しい墨消しは情報を覆うのではなく削除します。 指定範囲の下にあった文字、画像部分、その他すべてが保存後のファイルに残ってはいけません。
隠れた場所にも注意が必要です。 文書プロパティの作者名、差分保存に残る旧版、添付やフォーム欄の情報、スキャンページの文字認識による不可視テキスト層などがあります。
UseTool の墨消し方法
PDF 墨消しツールはメールアドレスや電話番号などを候補として示し、どこを黒くするかは利用者が決めます。 1 か所でも指定したページは画像へ変換し、黒い部分を画素へ焼き込みます。 そのページの元の文字は新しいファイルへ移りません。
指定のないページはそのままコピーされるため、文字を選択できます。 再構築した文書には元のメタデータ、添付、能動的な文書動作を含めません。
- PDF を開き、検出候補を確認します。
- 署名や印影を含め、消す必要がある残りの場所にも枠を追加します。
- 墨消し済みのコピーを出力します。 端末上の原本は変わりません。
- 送信前に次の方法で結果を検査します。
墨消し後のファイルを調べる
新しい PDF を開き、消した単語を検索します。 一致してはいけません。 処理したページの文字を選ぼうとしても、選べないはずです。 ページ全体をテキストエディターへ貼る確認も手軽です。
PDF からテキストへでも検査できます。 抽出結果に消した名前があれば、どこかを見落としています。
受け入れる必要がある代償
処理したページは画像になるので、残った文字も検索・コピーできず、容量が増える場合があります。 これは確実に消すための代償です。 裁判所、行政、一般公開へ出す文書なら、少し大きくなるほうが漏えいよりはるかに安全です。
