PDF を黒塗りする
PDF の読み込みと黒塗りは、このブラウザーのタブの中で行います。ファイルをアップロードすることはありません。
ここに PDF をドロップ
またはクリックしてファイルを選びます。文字情報のある PDF が対象です。画像やスキャンしたページの中の語は見つかりません(OCR はありません)。無料版は 3 ページまでの PDF 1 件。このツールにできないこともご覧ください。
矩形を描けるのは PDF を 1 件だけ開いているときです。複数の PDF では、各ファイルから語句を消します。
新しいファイルに残すもの
新しい PDF は、ページの描画に必要なものだけで作ります。それ以外は、語句を含むかどうかにかかわらず取り除きます。
- 文書情報辞書(タイトル、作成者、日付)、XMP メタデータ、文書 ID
- ActualText と代替テキスト、構造ツリー(スクリーンリーダーや検索が使うタグ)
- 注釈(コメント)、フォームフィールド、リンク、しおり、添付ファイル
- スクリプトと、増分更新で残った以前の版
次の 3 つは、ここでチェックすれば残せます。
描いた矩形は、文字の幅に余白を加えた範囲で判断し、矩形にかかる文字を取り除きます。PDF に埋め込まれたフォントの文字で、字形が幅を大きくはみ出すものは、矩形の脇に残ることがあり、その場合、矩形の下にはみ出した部分は黒の下でファイルに残ります。
Pro
ここから先は RedactDrop Pro の機能です。
このツールにできないこと
- 画像やスキャンしたページの中の文字を読むこと。OCR はありません。無料版にも Pro にもありません。画像だけのページや、ほとんどが画像のページは、結果にページ番号を示します。画像の中の語には矩形を描いてください。矩形の下の画像の画素を置き換えます。JPEG 2000、JBIG2、CCITT 形式の画像はこの方法で編集できないため、そのページを画像にすることを選ばない限り、そのページは書き出しません。
- 文字の形を読むこと。検査が読むのは PDF が「持っている」と言う文字です。表す文字と違う形を描くフォントや、線や絵で描かれた文字は見つかりません。
- 暗号化された PDF を開くこと。パスワードなどで暗号化されたファイルは、開く時点でお断りします。
- 斜めに組まれた文字で、隣の文字に触れずに語を黒塗りすること。語にかける黒い四角は水平・垂直です。斜めの文字で、隣の文字まで消したり覆ったりしてしまう場合、そのページは書き出さず、ファイルは出しません。そのページを画像にすることは選べます。
- どんな大きさでも処理すること。メモリ 32 GB の Windows PC の Chromium で、500 ページ(40 秒)と、画像からなる 51 MB の PDF(11 秒)まで試しています。それを超える場合やメモリが少ない場合は、ブラウザーで扱えない大きさのことがあります。ブラウザーがメモリ不足を知らせたときはページにそう表示し、ファイルは作りません。タブが応答しなくなったり閉じたりすることもあります。
- Safari のエンジンで、すべてのページを同じように描くこと。Safari のエンジンである WebKit では、白黒(1 ビット)画像の最後の行が、プレビューと画像にしたページで違って描かれることがあります。画像にしたページにはブラウザーが描いたものがそのまま残るため、その違いはダウンロードしたファイルにも残ります。画像にしたページのない黒塗り済みファイルは、どのブラウザーでも同じに書き出されます。RedactDrop は Chromium、Firefox、WebKit で試験していますが、Safari そのものでは試験していません。