1つのPDFを分けたい理由はいくつもあります。100ページの資料から自分の担当章だけを取り出したい、両面スキャンで1ファイルになった書類を書類ごとに分けたい、提出先ごとに必要な範囲が違う、といった具合です。ところが「分割」という言葉が指す動作はツールによってばらばらで、範囲指定なのか、等分なのか、1ページずつなのかが分からないまま使うことになりがちです。
OFFilerのPDF分割は、この3つを明示的なモードとして分けています。どのモードでも処理はブラウザ内で完結し、分割後の複数ファイルはZIPにまとめて受け取れます。以下では、各モードの指定方法と生成されるファイル、出力の命名規則、そして分割と抽出の使い分けを説明します。
3つの分割モード
ページ範囲指定:カンマ区切りで好きな塊を作る
「1-3, 5, 7-9」のように書くと、1〜3ページ・5ページ単独・7〜9ページの3つのPDFが生成されます。カンマで区切った1つの区切りが、そのまま出力1ファイルに対応します。ハイフンで範囲、単独の数字で1ページを指定でき、ページ番号は画面で見たとおりの1始まりです。
範囲の指定が文書のページ数を超えていたり、開始が終了より後になっていたりする場合は、処理を始める前にエラーとして知らせます。分割してから間違いに気づく、ということが起きないようになっています。
Nページごと/1ページずつ
「Nページごと」は、先頭から順にNページずつの塊に切り分けます。20ページのPDFを3ページごとに分ければ、3ページのファイルが6つと、余った2ページのファイルが1つできます。「1ページずつ」はページ数と同じ数のPDFを作ります。ページ番号を数えて範囲を書き出す必要がないので、機械的に切りたいときはこちらが速いです。
出力はゼロ埋めの連番でZIPにまとまる
生成されるファイルは part_01.pdf、part_02.pdf のように連番で命名されます。桁数は分割数に応じて広がるため、100個以上に分割しても part_001.pdf のように並び順が崩れません。これらはZIPにまとめて一度にダウンロードできます。ZIPの作成もブラウザ内で行われます。
分割と抽出の使い分け・注意点
1つのPDFが欲しいなら分割ではなく抽出
分割は「複数のファイルに分ける」ためのツールです。「50ページのうち10〜15ページだけが欲しい」という場合、必要なのは1ファイルなので、ページ抽出を使う方が手数が少なくて済みます。分割で範囲を1つだけ指定しても同じ結果は得られますが、ZIPを解凍する手間が余分にかかります。
しおりは引き継がれない/大量分割は時間がかかる
分割後の各PDFは新しい文書として組み立てられるため、しおり(アウトライン)や文書メタデータは引き継がれません。ページの中身そのものは再エンコードされないので、画質やテキストの選択可否は元のままです。
また、分割は塊ごとに元のPDFを読み直して1本ずつ書き出す作りになっています。数百ページを1ページずつに分けるような指定では、端末の性能によっては相応の時間がかかります。パスワードで保護されたPDFは読み込めないため、先にPDFアンロックで保護を外してください。
分割の後につなぐ
分けてから、並べ替えて、まとめ直す
スキャンした複数の書類が1ファイルになっている場合、まず分割で書類ごとに切り分け、不要な白紙をページ削除で落とし、必要なものだけを結合し直す、という流れが定番です。OFFilerでは各ステップの結果を保存し直さずに次のツールへ渡せます。
仕様と制限
- 対応形式
- PDF(application/pdf)
- サイズ上限
- 1ファイルあたり100MB
- 分割モード
- ページ範囲指定 / Nページごと / 1ページずつ
- 範囲の書式
- 1始まり。例「1-3, 5, 7-9」→ 3ファイル
- 出力名
- part_01.pdf 形式のゼロ埋め連番
- 受け取り方
- ZIPにまとめて一括ダウンロード
- 引き継がれない情報
- しおり、文書メタデータ
- 通信
- ファイルの送信なし。処理はすべてブラウザ内