メインコンテンツへスキップ
← ホームへ
使い方ガイド

PDFの黒塗りが本当に消えているか検証してから共有する

黒塗りしたPDFから、隠したはずの文字がコピーできてしまう。この事故を防ぐ唯一の方法は、提出前に自分でテキストを抽出して確認することです。塗って、検証して、必要なら画像化する。3ステップすべてがブラウザ内で完結します。

検証で0件ヒット

テキスト抽出で黒塗り箇所の文字が出ないことを確認済み

なぜこの作業は手間がかかるのか

黒塗りで一番多い失敗は、「見えなくなったこと」と「消えたこと」を取り違えることです。PDFの上に黒い四角を重ねても、その下のテキストは文字データとして残り続けます。受け取った側がテキスト選択してコピーすれば、あるいはテキスト抽出ツールにかければ、黒塗りしたはずの氏名も口座番号もそのまま読めます。実際にこの手順ミスによる情報流出は、官公庁でも企業でも繰り返し発生しています。

この作業で気をつけたい情報の扱い

  • ✓黒塗りの下にテキストが残るのは、PDFの構造上どのツールでも同じです。ラスタライズまで行って初めて「消えた」状態になります。
  • ✓処理はすべてブラウザのメモリ内で完結するため、機密文書を外部の黒塗りサービスへ預ける必要がありません。
  • ✓検証したい場合は、仕上げたPDFをPDFテキスト抽出ツールにかけてください。黒塗り部分の文字が出てこなければ成功です。

3ステップで解決

下のツール名をクリックして直接ツールへ移動できます。

  1. 1
    PDFマークアップ

    氏名・住所・口座番号などを不透明な黒で塗りつぶす。認印・スタンプ作成ツールで作った印影もCtrl+Vで貼り付けられます

  2. 2
    PDFテキスト抽出

    塗ったPDFからテキストを抽出し、隠したはずの文字列が出てこないか検証する。ここが本手順の要です

  3. 3
    PDF圧縮

    検証を通ったPDFをメール添付に適したサイズに圧縮して送付する

つまずきやすいポイント

手順どおりに進めても引っかかりやすい箇所です。着手前に目を通しておくと手戻りが減ります。

  • 黒塗りしただけのPDFはテキストが残ります。提出前に必ずPDFテキスト抽出ツールで検証してください。
  • ラスタライズすると文字が画像になるため、受け取った側は本文を検索・コピーできなくなります。検索性が必要な文書では、そもそも該当箇所を含むページごと削除する方が適切な場合があります。
  • 半透明の図形やハイライトでは下の文字が透けます。塗りつぶしは不透明な黒で行ってください。

よくある質問

黒塗りしたのに文字が読めてしまうのはなぜですか?
PDFは「描画される図形」と「文字データ」を別々に保持しているためです。黒い四角は図形として上に重なるだけで、その下の文字データには何も起きません。受け取った側がテキスト選択してコピーする、あるいはテキスト抽出ツールにかけると、塗った箇所の文字がそのまま取り出せます。これはツールの不具合ではなく、PDFという形式の仕様です。
本当に消えたかどうかは、どう確認すればいいですか?
PDFテキスト抽出ツールに仕上げたファイルを読み込ませ、隠したはずの氏名や番号で検索してください。ヒットしなければ成功です。ヒットする場合は、PDF→画像→画像→PDFの順にチェイン処理して全ページをラスタライズしてください。チェインボタンから続けて処理できます。
ラスタライズすると何が失われますか?
全ページが画像になるため、本文の検索・コピーができなくなり、スクリーンリーダーも読み上げられなくなります。ファイルサイズも大きくなります。相手が条項を検索して確認する必要がある文書では、ラスタライズではなく該当ページごと削除する方が適切な場合があります。
スキャンされた書類PDFにも対応しますか?
はい。スキャンPDFはページが元から画像なので、マークアップで塗った時点で下に文字データが存在せず、検証も通ります。ただしOCR処理済みのスキャンPDFにはテキスト層が追加されているため、通常のPDFと同様に検証が必要です。

関連する使い方

今すぐ試してみる

登録不要・無料・ブラウザ完結。