← ホームへ
使い方ガイド
PDFの黒塗りが本当に消えているか検証してから共有する
黒塗りしたPDFから、隠したはずの文字がコピーできてしまう。この事故を防ぐ唯一の方法は、提出前に自分でテキストを抽出して確認することです。塗って、検証して、必要なら画像化する。3ステップすべてがブラウザ内で完結します。
検証で0件ヒット
テキスト抽出で黒塗り箇所の文字が出ないことを確認済み
なぜこの作業は手間がかかるのか
黒塗りで一番多い失敗は、「見えなくなったこと」と「消えたこと」を取り違えることです。PDFの上に黒い四角を重ねても、その下のテキストは文字データとして残り続けます。受け取った側がテキスト選択してコピーすれば、あるいはテキスト抽出ツールにかければ、黒塗りしたはずの氏名も口座番号もそのまま読めます。実際にこの手順ミスによる情報流出は、官公庁でも企業でも繰り返し発生しています。
この作業で気をつけたい情報の扱い
- ✓黒塗りの下にテキストが残るのは、PDFの構造上どのツールでも同じです。ラスタライズまで行って初めて「消えた」状態になります。
- ✓処理はすべてブラウザのメモリ内で完結するため、機密文書を外部の黒塗りサービスへ預ける必要がありません。
- ✓検証したい場合は、仕上げたPDFをPDFテキスト抽出ツールにかけてください。黒塗り部分の文字が出てこなければ成功です。
3ステップで解決
下のツール名をクリックして直接ツールへ移動できます。
つまずきやすいポイント
手順どおりに進めても引っかかりやすい箇所です。着手前に目を通しておくと手戻りが減ります。
- 黒塗りしただけのPDFはテキストが残ります。提出前に必ずPDFテキスト抽出ツールで検証してください。
- ラスタライズすると文字が画像になるため、受け取った側は本文を検索・コピーできなくなります。検索性が必要な文書では、そもそも該当箇所を含むページごと削除する方が適切な場合があります。
- 半透明の図形やハイライトでは下の文字が透けます。塗りつぶしは不透明な黒で行ってください。
よくある質問
- 黒塗りしたのに文字が読めてしまうのはなぜですか?
- PDFは「描画される図形」と「文字データ」を別々に保持しているためです。黒い四角は図形として上に重なるだけで、その下の文字データには何も起きません。受け取った側がテキスト選択してコピーする、あるいはテキスト抽出ツールにかけると、塗った箇所の文字がそのまま取り出せます。これはツールの不具合ではなく、PDFという形式の仕様です。
- 本当に消えたかどうかは、どう確認すればいいですか?
- PDFテキスト抽出ツールに仕上げたファイルを読み込ませ、隠したはずの氏名や番号で検索してください。ヒットしなければ成功です。ヒットする場合は、PDF→画像→画像→PDFの順にチェイン処理して全ページをラスタライズしてください。チェインボタンから続けて処理できます。
- ラスタライズすると何が失われますか?
- 全ページが画像になるため、本文の検索・コピーができなくなり、スクリーンリーダーも読み上げられなくなります。ファイルサイズも大きくなります。相手が条項を検索して確認する必要がある文書では、ラスタライズではなく該当ページごと削除する方が適切な場合があります。
- スキャンされた書類PDFにも対応しますか?
- はい。スキャンPDFはページが元から画像なので、マークアップで塗った時点で下に文字データが存在せず、検証も通ります。ただしOCR処理済みのスキャンPDFにはテキスト層が追加されているため、通常のPDFと同様に検証が必要です。
関連する使い方
今すぐ試してみる
登録不要・無料・ブラウザ完結。