PDFの編集は「専用ソフトを買う」か「ファイルをどこかのサーバーにアップロードする」かの二択になりがちです。OFFiler のPDFツールはそのどちらでもありません。ページを開いた時点で処理に必要なコードがブラウザに読み込まれ、あとは選んだPDFを端末のメモリ上で読み書きするだけです。ファイルがネットワークへ出ていくことはなく、アカウント登録も、処理回数の制限もありません。
契約書・見積書・請求書・住民票のスキャン・研究論文・社内資料など、そもそも外に出したくないPDFほどオンラインの変換サイトは使いにくいものです。このページのツールはその「出したくない」を前提に作られています。以下では、似た名前で紛らわしいツールの使い分け、ブラウザだけで処理できる仕組み、扱えるファイルの上限、そしてよくある質問をまとめています。
目的別・PDFツールの選び方
「ページを分ける」「小さくする」だけでも複数のツールが該当します。目的から逆引きできるように整理しました。
ページを取り出す・消す・分ける・並べ替える
結果のファイルが1つで済むなら「ページ抽出」または「ページ削除」です。必要なページ番号のほうが少なければ抽出、捨てたいページのほうが少なければ削除、と考えると迷いません。どちらも元のPDFは変更せず、新しいPDFとして書き出します。
結果を複数ファイルに分けたいときは「PDF分割」を使います。ページ範囲の指定、Nページごとの等分、1ページ1ファイルの3通りに対応していて、生成されたファイルはZIPでまとめてダウンロードできます。逆に複数のPDFを1つにするのが「PDF結合」で、サムネイルをドラッグして順番を決められます。
ページの順番を入れ替えたい、特定のページだけ向きを直したい場合は「PDFページ整理」です。ドラッグ&ドロップでの並べ替えとページ単位の回転を、同じ画面でまとめて行えます。
ファイルサイズを小さくする
メール添付や申請システムの上限に引っかかったときは「PDF圧縮」です。圧縮の強さは3段階あり、それぞれ中身の処理がまったく違います。弱では文書情報やXMPメタデータ、埋め込みサムネイルなどを取り除くだけなので、見た目も文字の選択・検索性もそのまま保たれます。テキスト主体のPDFはまず弱を試してください。
中・強では各ページをいったん画像として描き直し、JPEGとしてPDFに組み直します。スキャン画像が大半を占めるPDFではこちらのほうが劇的に小さくなりますが、ページが画像になるためテキストの選択・検索・コピーはできなくなります。用途に応じて選び分けてください。プレビューで仕上がりを確認しながら圧縮率を決められます。
複数のPDFをまとめて圧縮したい場合は、そのまま複数ファイルを投入すると一括処理してZIPで返します。
PDFから文字を取り出す
PDFには「文字データが埋め込まれているPDF」と「紙をスキャンした画像だけのPDF」があり、必要なツールが変わります。まず「PDFテキスト抽出」を試してください。ここで文字が出てくればテキストは埋め込まれており、そのままコピーや保存ができます。
何も出てこない、あるいは白紙のような結果になる場合はスキャンPDFです。その場合は「OCRテキスト認識」で、画像の中の文字を検出モデル(DBNet)と認識モデル(CRNN)で読み取ります。モデルは英語辞書で動作するため、対象は英語テキストのみです。日本語や中国語のスキャンは認識できません。モデルはWebAssemblyで動くため、Chrome・Edge・Safari・Firefox のいずれでも利用できます。
PDFと画像を相互に変換する
「PDF→画像」は各ページをPNG画像として書き出します。解像度は72・96・150・300 DPIから選べます。スライドのサムネイルやブログへの貼り付けなら96〜150 DPI、印刷や拡大して見せる用途なら300 DPIが目安です。DPIを上げるほど画像は鮮明になりますが、その分ファイルサイズと処理時間も増えます。
逆に、スマホで撮った書類の写真やスクリーンショットを1つの資料にまとめたいときは「画像→PDF」です。複数のPNG・JPEG画像を順番に並べて1つのPDFにします。撮影した書類をそのまま提出用PDFにする、といった使い方ができます。
見せたくない部分を隠す・持ち出しを抑止する
「PDFマークアップ」では、黒塗りの矩形を置いたり、画像や印影を貼り付けたりできます。認印・スタンプ作成ツールで作った印鑑をコピーして Ctrl+V で押印することもできます。
ただし黒塗りには重要な注意点があります。このツールの黒塗りは、ページの上に黒い四角形を描き足す処理です。見た目には隠れますが、その下にあるテキストデータはPDFの中に残っており、テキスト抽出ツールやコピー操作で読めてしまう可能性があります。文字そのものを消してしまいたい場合は、黒塗りしたPDFを「PDF圧縮」の中または強で画像化し直すか、いったん「PDF→画像」で画像にしてから「画像→PDF」で組み直してください。画像化された時点で下のテキストデータは失われます。
配布する資料に「社外秘」「複製禁止」などを入れておきたい場合は「PDF透かし」を使います。文字はブラウザ側で描画してから埋め込むため、日本語の透かしもそのまま使えます。不透明度・サイズ・色・角度・配置を調整できます。
開けないPDF・向きがおかしいPDF
PDFのパスワードには2種類あります。1つは閲覧に必要な「ユーザーパスワード」、もう1つは印刷やコピーなどの操作だけを制限する「所有者パスワード」です。「PDFアンロック」は両方に対応しますが、挙動が異なります。所有者パスワードによる権限制限は取り除いてもテキストやベクター情報がそのまま残ります。ユーザーパスワードで暗号化されたPDFの場合は、正しいパスワードの入力が必須で、復号後は各ページを画像として組み直すため、出力されたPDFではテキストの選択・検索ができなくなります。
パスワードそのものを知らないPDFは開けません。パスワードを解析・推測する機能は用意していません。
スキャナーやスマホアプリが作ったPDFで、ビューアでは正しく見えるのに他のツールに読ませると横倒しになる、という現象があります。これはページに回転情報(Rotate)だけが設定されていて、中身の向きが変わっていないためです。「PDF正規化」を通すと、見た目どおりの向きでページを描き直すので、マークアップなど他のツールとの相性も良くなります。
ブラウザだけでPDFを処理できる仕組み
処理は端末の中で完結する
PDFの構造を読み書きする部分には pdf-lib を、ページの描画・テキスト抽出・暗号化PDFの復号には PDF.js を使っています。どちらもブラウザ上で動くライブラリで、選んだファイルは JavaScript の ArrayBuffer としてメモリに読み込まれるだけです。サーバーへ送信する処理は存在しません。
本当に送信されていないかは自分の目で確かめられます。ブラウザの開発者ツールを開いてネットワークタブを表示したままファイルを処理してみてください。ページ表示に必要なリソース以外に、ファイルをアップロードするリクエストが発生しないことを確認できます。
重い処理は Web Worker に逃がしているため、大きなPDFを扱っている間も画面が固まりにくくなっています。OCRのようにAIモデルを使う処理では、モデルファイル自体をブラウザにダウンロードして端末上で推論します。モデルは自分たちのサーバーから配信しており、外部CDNや外部APIには依存していません。
オフラインでも動く
OFFiler は PWA として動作します。一度アクセスしていれば、機内モードやネットワークが不安定な環境でもツールを開いて処理できます。ホーム画面やデスクトップに追加しておけば、アプリのように起動できます。
処理したファイルは端末のダウンロードフォルダに直接保存されます。サーバー側に一時ファイルが残ることも、処理履歴が記録されることもありません。
対応形式と制限事項
- 入力形式
- PDF(各ツール共通)/PNG・JPEG(画像→PDF、PDFマークアップの貼り付け画像)
- 出力形式
- PDF/PNG(PDF→画像)/テキスト(テキスト抽出・OCR)/ZIP(分割・複数ファイルの一括処理)
- ファイルサイズ
- PDFは1ファイルあたり100MBまで。実際に扱えるページ数は端末のメモリ量に左右されます
- ブラウザ要件
- 最新のChrome・Edge・Safari・Firefoxに対応(iOS Safariを含む)
- 言語
- テキスト抽出・透かしは日本語を含む多言語に対応。OCRは英語テキストのみ対応
- 費用・登録
- 無料。アカウント登録・ログイン・処理回数の制限はありません
PDFツールのよくある質問
PDFファイルは本当にアップロードされないのですか?
されません。処理はすべてブラウザ内のJavaScriptとWebAssemblyで行われ、ファイルの中身はネットワークに出ません。開発者ツールのネットワークタブを開いたまま処理すると、アップロードのリクエストが発生しないことを自分で確認できます。
無料ですか?会員登録は必要ですか?
無料です。会員登録もログインも不要で、1日の処理回数やファイル数の制限もありません。透かしが勝手に入ることもありません。
スマートフォンでも使えますか?
使えます。スマートフォンのブラウザでもほとんどのツールが動作します。ただし処理は端末のメモリを使うため、ページ数の多いPDFや大きなファイルではPCのほうが安定します。
PDFにパスワードを設定できますか?
PDF自体への暗号化・パスワード設定には対応していません。ブラウザ内で扱えるPDFライブラリに暗号化機能がないためです。ファイルを渡す相手を限定したい場合は、ZIPツールでAES-256のパスワード付きZIPにまとめる方法があります。こちらもブラウザ内で完結します。
圧縮してもファイルサイズがほとんど変わりません。
文字だけのPDFは元々小さく、弱(メタデータ削除)ではほぼ変化しないことがあります。サイズの大半を占めているのが写真やスキャン画像であれば、中または強を選ぶと各ページが画像として再構成され大きく減ります。逆に、すでに最適化済みのPDFではこれ以上小さくならない場合もあります。
黒塗りしたPDFから元の文字を読み取られることはありますか?
マークアップの黒塗りはページの上に黒い四角形を描く処理なので、下にあるテキストデータはPDF内に残ります。テキスト抽出などで読める可能性があります。完全に消したい場合は、黒塗り後に圧縮(中・強)で画像化するか、PDF→画像→画像→PDFの順で組み直してください。
スキャンしたPDFの文字を日本語で読み取れますか?
読み取れません。OCRの認識モデルは英語辞書で動作するため、対応は英語テキストのみです。日本語のスキャン文書に対応するには実用的な精度が得られなかったため、あえて英語専用としています。日本語のPDFでも、スキャンではなくテキストが埋め込まれたPDFであればテキスト抽出で取り出せます。
処理したファイルはどこに保存されますか?
ブラウザのダウンロード先、つまり自分の端末のダウンロードフォルダに保存されます。サーバー側にコピーが残ることはなく、処理の履歴も記録されません。ページを閉じればメモリ上のデータも破棄されます。
オフラインでも使えますか?
使えます。一度アクセスした後はPWAとしてキャッシュされるため、ネットワークに接続していない状態でもツールを開いて処理できます。ホーム画面やデスクトップに追加しておくと便利です。
PDF用語のミニ辞典
- ポイント(pt)
- PDFが内部で使う長さの単位で、1ポイント=1/72インチ。A4は約595×842ポイントです。
- ラスタライズ
- 文字や図形などのデータをピクセルの集まり(画像)に変換すること。圧縮の中・強や、ユーザーパスワード付きPDFのアンロックで行われます。
- テキストレイヤー
- PDFに埋め込まれた文字データ。これがあるとコピー・検索ができます。スキャンしただけのPDFには存在しません。
- ユーザーパスワード / 所有者パスワード
- 前者はPDFを開くために必要なパスワード、後者は印刷やコピーなどの操作を制限するためのパスワードです。
- DPI
- 1インチあたりのドット数。PDFを画像に変換するときの精細さの指標で、数値が大きいほど鮮明かつ大きなファイルになります。
- 回転情報(Rotate)
- ページ内容そのものは変えず、表示時の向きだけを指定するPDFの属性。これが原因で他のツールと見え方が食い違うことがあります。