PDF の語を消して黒塗りする。ブラウザーの中だけで
RedactDrop は、選んだ語を PDF から取り除きます。上に黒い四角をかぶせるだけではなく、文字そのものを消し、その場所を黒く塗ります。そのうえで新しいファイルを開き直して確認してから、ダウンロードできるようにします。アップロードはしません。ファイルはブラウザーの中で読み込み、ページのコンテンツセキュリティポリシー(CSP)が、このサイト自身への送信を拒みます。
文字情報のある PDF が対象です。画像やスキャンしたページの中の語は見つかりません。RedactDrop には OCR がなく、無料版にも Pro にもありません。
使い方
- PDF をページにドロップします。このブラウザーのタブで動く JavaScript が、このサイトから配信する pdf.js と pdf-lib を使って読み込みます。
- 消す語を入力するか、ページ上に矩形を描きます。大文字と小文字を区別するか、全角と半角を同じとみなすかを選べます。
- 黒塗りして確認します。語を描く命令をページの内容から取り除き、その場所を黒く塗ります。描いた矩形の下では、文字、画像の画素、図形も取り除きます。ただし、幅を大きくはみ出す文字には限界があり、黒塗りのページの「新しいファイルに残すもの」に書いています。
「検証済み」の意味
ファイルを出す前に、RedactDrop は別の pdf.js と独自の検査でファイルを開き直します。各ページの文字、ファイル内の文字列と名前、復号したストリームとそのバイト列(JPEG などの画像データを除く)を複数の符号化で、さらにメタデータと注釈を確認します。通らないページがあれば、ファイルは出しません。すべて通ると、次のような行が出ます。
検証済み:一致の残り 0 件、メタデータ 0 項目、注釈 0 件。
この行は、何を確認し、確認で何が見つかったかを示すものです。PDF に含まれうるあらゆる構造について約束するものではありません。送る前に、ご自分でも結果を確かめてください。利用規約もご覧ください。
新しいファイルに残すもの
新しい PDF は、ページの描画に必要なものから作り直します。文書情報(タイトル、作成者、日付)、XMP メタデータ、文書 ID、ActualText と構造ツリー、注釈、フォームフィールド、リンク、しおり、添付ファイル、スクリプト、以前に保存された版は、初期設定ではすべて取り除きます。リンク、しおり、ページに描き込んだフォームフィールドやコメントの見た目は、選べば残せます。
確認を通らないページがあるとき
その場で処理できないページ(たとえば、描いた矩形の下で切れない図形があるページ)は書き出しません。そのページだけを画像にすることは選べます。画像にしたページには選択できる文字がなく、画素は語の検査の対象外です。選ぶ前に、ページにそう表示します。
無料版と RedactDrop Pro
無料版:3 ページまでの PDF を 1 度に 1 件。
RedactDrop Pro では、ページ数の上限がなくなり、複数の PDF をまとめて(ZIP で)処理でき、メールアドレス・電話番号・カード番号に似た数字の候補表示、語句リストの保存と JSON での書き出し、保存できる検証レポートが加わります。$39(一回払い)。サブスクリプションなし、アカウントなし、アップロードなし。RedactDrop Pro の今後のアップデートは、サービスを提供している間すべて含まれます。価格は米ドル建てで、購入時の支払画面は Paddle が表示します。購入の受付はまだ始めていません。
ガイド
ほかのガイドは英語版にあります。
しないこと
- 画像やスキャンしたページの中の文字は読みません(OCR なし)。
- 暗号化された PDF は開きません。
- 何を黒塗りすべきかは判断しません。指定されたものを取り除きます。