RedactDrop › ガイド › 「検証済みの黒塗り」とは何か
「検証済みの黒塗り」とは何か — RedactDrop が自分の出力をどう確かめるか
2026 年 10 月 2 日公開 · Tekiba
要点:RedactDrop は、黒塗りした PDF を出す前に、別の pdf.js と独自の検査で新しいファイルを開き直し、消した語、メタデータ、注釈、描いた矩形の下に残ったものを探します。通らないページがあれば、ファイルは出しません。「検証済み:一致の残り 0 件、メタデータ 0 項目、注釈 0 件。」は、その検査が何を見て何を見つけたかの報告です。RedactDrop が読める範囲の話であり、PDF に含まれうるあらゆる構造について約束するものではありません。
なぜ確かめるのか
黒塗りの失敗は、目に見えません。語が何片かに分けて描かれていたり、2 か所に格納されていたり、以前の版に残っていたりしても、ページの見た目は正しく見えます。そこで RedactDrop は、見つけたものを取り除いたあと、新しいファイルを初めて見るファイルとして読み直します。
検査が読むもの
検査はお使いのブラウザーの中で、ダウンロードの前に、新しいファイルに対して行います。
- PDF の閲覧ソフトから見た文字。元のファイルを読んだものとは別の pdf.js が新しいファイルを開き、各ページの文字、注釈、フォーム、しおり、添付ファイル、メタデータを取り出します。
- RedactDrop 自身の読み取り。各ページ、フォーム XObject、注釈の外観、Type 3 グリフの描画命令を自前で解釈するので、pdf.js が違うふうに読む語も見つけます。
- ファイル内の文字列と名前。すべてのオブジェクトの文字列・名前・キーを、どのページからもたどれないオブジェクトも含めて探します。
- バイト列。ファイルと、復号したストリームを、複数の符号化で、また各フォント固有の文字コードで探します。JPEG などの画像データは、この方法では探しません。
- 構造。ファイルは、RedactDrop が書き出すもの――ページの描画に要るものと、選んで残したリンクやしおり――と一致しなければなりません。メタデータ、残すことを選んだリンク以外の注釈、以前の版があれば通りません。
- 描いた矩形の下。文字がないこと、周りと異なる画像の画素がないこと、矩形の内側に図形がないことを確かめます。
RedactDrop の試験では、さらに第三の独立した文字抽出ツール(Xpdf の pdftotext)でも出力を読み、すべての試験用ファイルで一致が 0 件であることを求めています。これは RedactDrop の試験の一部で、ブラウザーで行う検査の一部ではありません。
ファイルを出さないとき
通らないページがあれば、ファイルは書き出しません。よくある理由は次のとおりです。
- 矩形の下で切れない図形。矩形の内側から外側へ続く曲線、パターンやソフトマスクで塗られた図形、矩形をまたぐクリッピングパスなど。矩形の下の部分だけを取り除いて、残りが何かを言い切ることができないため、試みません。
- 斜めに組まれた文字。語にかける黒い四角は水平・垂直なので、斜めの文字では隣の文字まで消したり覆ったりしてしまう場合があります。そのページは書き出しません。
- 検査が何かを見つけた。取り除きで漏れて検査が見つけたものがあれば、ファイルは止まります。
ページを画像にする
問題が特定のページに結びついているときは、そのページを画像にすることを選べます。RedactDrop はページを描き、語と矩形の場所を画素の上で塗り、その画像をページの代わりに置いて、ファイル全体をもう一度確かめます。ほかのページはそのままです。問題がファイル全体に関わるときや、残った語がページのどこにあるか分からないときは、選べません。
代償もあります。画像にしたページには、選択や検索のできる文字がなく、画素は語の検査の対象外です。検査は、そのページに文字が残っていないことは確かめられますが、絵に何が写っているかまでは確かめられません。画像にしたページは、渡す前に目で確かめてください。RedactDrop がこれを勝手に選ぶことはなく、初期設定は「出さない」です。
検査の限界
検査が見るのは、RedactDrop が読める範囲です。画像やスキャンしたページの中の文字は読みません(OCR はありません)。JPEG などの画像データの中を語で探すこともしません。字形も読みません。表す文字と違う形を描くフォントや、線や絵で描かれた文字は見つかりません。描いた矩形が文字をどこまで取り除くかは、文字の幅に余白を加えた範囲で判断します。字形が幅を大きくはみ出す文字は、矩形の脇に残り、はみ出した部分が黒の下に残ることがあります。そして PDF は大きな形式で、誰も想定しなかった作り方のファイルもあります。だから「検証済み」は見つかったものの数で書き、利用規約は、結果をご自分でも確かめ、機密性の高い文書ではすべてのページを目で見るようお願いしています。
送る前に自分で確かめる
- 閲覧ソフトで、消した語と、その一部(姓だけ、番号の下 4 桁など)を検索します。全角と半角の両方で試してください。
- 黒い部分をまたいで選択し、コピーして、テキストエディターに貼り付けます。何も出てこないはずです。
- 閲覧ソフトの文書のプロパティで、タイトル・作成者・キーワードに手がかりが残っていないか見ます。添付ファイル、しおり、コメントの一覧も見ます。
- 別の閲覧ソフトで開くか、文字抽出ツールにかけます。Xpdf があれば
pdftotext -layout 黒塗り後.pdf -です。 - すべてのページを自分の目で見ます。検査は、探すよう作られたものしか見つけられません。
どれかで何かが見つかったら、そのファイルは送らないでください。
検査の結果を、ご自分の書類で見てください。黒塗りのページを開く
よくある質問
「検証済み」なら、そのまま送ってよいですか?
「検証済み」は、検査が何を見て何を見つけたかの報告で、RedactDrop が読める範囲の話です。送る前に、消した語で検索し、すべてのページを目で確かめてください。
検査はどこで行われますか?
お使いのブラウザーの中で、ダウンロードの前に行います。ファイルはアップロードしません。
ファイルが出てこないのはなぜですか?
通らないページがあると、ファイルは書き出しません。理由は画面に出ます。問題が特定のページにあるときは、そのページを画像にすることを選べます。
画像にしたページは何が違いますか?
選択や検索のできる文字がなく、画素は語の検査の対象外です。渡す前に目で確かめてください。