コンテンツへスキップ

PDFを墨消し

名前や番号など、読まれてはいけないものを削除します。覆い隠すのではなく、文書そのものから消します。何も保存されません。

  • 保存しません
  • 順番待ちなし
  • 登録不要・透かしなし

使い方

1

PDFを追加

文書をドロップします。すべてのページが1語だけを狙える大きさで表示されます。

2

消したい部分をドラッグ

消したいテキストごとに四角で囲みます。「元に戻す」と「クリア」はワンクリックで使え、保存するまでは何も変わりません。

3

墨消ししてダウンロード

囲んだテキストをファイルから削除してから、上に黒い四角を描きます。

黒い四角が墨消しにならない理由

これはキャリアを終わらせ、裁判を負けさせてきた失敗なので、はっきり言っておきます。PDFのテキストの上に黒い四角を描いても、何も隠れません。文字は四角の下、ページのコンテンツストリームに残っていて、誰でも選択やコピーができ、無料のツールを使えば4秒ほどで取り出せます。これまでに報じられた墨消しの失敗(和解金額、証人の名前、墨消しされていない訴訟書類)は、どれも誰かが図形を描いてそれで済んだと思い込んだ文書でした。

このツールでは順序が逆です。四角で囲んだ中のテキストをまずコンテンツストリームから削除し、そのあとで、何かがあった場所を示す目印として四角を描きます。墨消しした部分をコピーしても、何も取れません。何もないからです。ページのテキストを抽出しても、その言葉は出てきません。削除した箇所の数も表示されるので、何にも一致せずに黙って終わった墨消しも、思い込みではなく目で見て分かります。

図や画像は別の問題で、別の対処法があります。スキャンしたページの中の名前や、報告書に貼り付けたスクリーンショットの中の名前は、テキストではなくピクセルなので、テキストを削除しても消えません。図や画像のオプションをオンにすると、墨消しを適用した状態でそのページを描き直すので、下にあったピクセルは覆われるのではなく本当になくなります。代償ははっきりしています。そのページは画像になるのでテキストを選択できなくなり、ファイルも大きくなります。

PDFはページ以外の場所にも名前を保持していますが、ここではそれらには手を付けません。しおりの構成、フォーム入力欄の値、添付ファイル、文書情報、XMPメタデータ、そしてファイル名そのものは、それぞれ別の保管場所です。そのどれかに名前が残っていれば、ページの墨消しが完璧でも名前は残ります。文書が増分保存されていた場合は、以前のバージョンも同様です。墨消ししたファイルを重要な相手に渡す前に、文書のプロパティを開いて確認し、ページから参照されなくなったものを破棄する再構築にかけてください。

ほかの目的には

法的な重みがある場面では、それに見合うソフトを使いましょう。Adobe Acrobat Proの墨消しも「削除してから印を付ける」という同じ考え方で、さらにこのページでは提供しようのない機能を備えています。メタデータ、添付ファイル、非表示のレイヤー、スクリプト、過去に保存されたリビジョンを一度に取り除くサニタイズの手順です。裁判所に提出する書類なら、この手順は省けません。

無料でこれに相当するのは2つのコマンドの組み合わせで、これは本当に徹底しています。qpdf --qdf --object-streams=disable in.pdf out.pdfは文書の構造を読めるテキストとして展開するので、名前が消えたことを自分の目で確認できます。exiftool -all:all= out.pdfはメタデータを消去します。その後にgs -sDEVICE=pdfwrite -o final.pdf out.pdfを実行すると、ページが実際に参照しているものからファイルを作り直し、参照されていないオブジェクトを破棄します。確認の手順はつい省かれがちですが、いちばん大事なのはそこです。

よくある質問

黒い四角を描くのと何が違うのですか?

まったく違います。ここが一番大切な点です。PDF編集ソフトで描いた黒い四角は、何も隠していません。文字はファイルの中に残っていて、誰でも選択やコピーをしたり、無料のツールで抽出したりできます。新聞社や官公庁でも、まさにこの形で情報が漏れてきました。このツールでは、まずページのコンテンツストリームからテキストを削除し、そのあとで四角を描きます。どの閲覧ソフトで黒い部分を選択しても、コピーできるものは何もありません。

文書はどこかに保存されますか?

いいえ。墨消しの処理では何も保存されません。これはほかのどのツールよりも重要です。墨消しする文書こそ、Webサイトに渡したくない文書だからです。

四角の下にある写真やスキャン画像はどうなりますか?

テキストはコンテンツストリームから削除されますが、画像のピクセルは別の話です。「下にある図や画像も消去」をオンにすると、該当するページを平坦な画像として作り直すので、四角の下にあったものはファイルから完全になくなります。その代わりにそのページのテキストレイヤーが失われるため、既定ではなく選択式にしています。

うまく消えたか確認できますか?

はい、ぜひ確認してください。結果を開いて墨消しした部分を選択してみるか、PDFテキスト抽出にかけてみてください。文字は消えているはずです。どのツールを使ったとしても、送信する前に墨消しを確認するのはよい習慣です。

メタデータも削除されますか?

まだ対応していません。作成者名やタイトルはページではなく文書情報に入っています。機密性の高いものを公開する前に、これらは別途確認してください。

ご注意: テキストはページの内容から削除されます。名前がしおり、フォーム入力欄、添付ファイル、文書のメタデータにも含まれている場合、それらは別の場所なので変更されません。スキャン画像の中のテキストを墨消しするには図や画像のオプションが必要で、そのページは平坦な画像になり、テキストレイヤーが失われます。

このツールをあなたのサイトに設置

ブログ、授業のページ、ヘルプ記事などに無料で設置できます。コードを1つ貼り付けるだけで、訪問者がそのページ上でツールを使えるようになります。