コンテンツへスキップ
100% ローカル · アップロード 0 KBPDF を圧縮

PDF ファイルサイズ:何が PDF を大きくするのか?

1 ページのテキスト PDF は 30 KB で済みます。同じページをスキャンすると 3 MB になります。これは魔法ではなく、ファイル内の 4 つの特定の要因によるものです。それらを理解すれば、バイトがどこに使われているかが正確に分かります。

要因 1

埋め込み画像

画像は通常、PDF サイズの単一最大の寄与要因です。300 DPI で埋め込まれた高解像度の写真は容易に数メガバイトを占めます。同じ画像を 72 DPI の低品質 JPEG として保存すれば 5% のサイズで済むかもしれません。PDF は画像を元のエンコード(JPEG・PNG・非圧縮)のまま格納するため、源画像が大きすぎると PDF も大きくなります。

解決策は「画像を削除」ではありません。意図する用途(画面 vs 印刷)に応じた適切な解像度と、適切な圧縮フォーマットを使うことです。ウェブサイト向けの写真に印刷品質の解像度は不要です。

要因 2

埋め込みフォント

PDF は、それらのフォントがインストールされていないマシンでも文書が同一に見えるよう、フォントを埋め込めます。完全なフォントファイルは 200 KB 以上になり、複数のフォントを使う文書はサイズの大部分をフォントデータだけで費やす可能性があります。

標準的な軽減策はフォントサブセット化です:文書で実際に使われるグリフ(文字)だけを埋め込みます。200 KB のフォントを英文 1 文にしか使わなければ、サブセットは 10 KB 程度で済みます。ほとんどの PDF ツールはデフォルトでサブセット化しますが、すべてではありません — 完全フォントを埋め込む PDF は、そうしない PDF より顕著に大きくなります。

要因 3

スキャンページ

スキャン PDF は本質的に画像の束、ページごとに 1 枚です。各ページが選択可能なテキストやベクターグラフィックではなく、ページ全体のラスター画像であるため、スキャン PDF は最も大きい一般的な種類です。20 ページのスキャン文書は容易に 20〜60 MB に達します。

スキャン PDF を大幅に縮小する唯一の方法は、画像を低解像度で再エンコードするか、2 値テキスト向けの圧縮フォーマット(JBIG2 や CCITT Group 4 など)を使うことです。OCR でスキャンを選択可能なテキストに変換すると、画像からテキストとベクターに変わるため劇的に小さくなります — ただし OCR の品質はばらつきがあり、常に利用できるとは限りません。

要因 4

繰り返しオブジェクトとメタデータ

PDF は冗長なデータを保持できます:全ページに配置された同じ画像、フォントの複数コピー、冗長なメタデータ、作成アプリからの隠しコンテンツレイヤーなど。一部のオフィスエクスポートは中間ドラフトの未使用オブジェクトをファイルに残したままにします。

PDF を再保存すると、これらの未使用オブジェクトを削除し重複を統合できます。多くの場合、見た目の変化はありません。これが圧縮操作の典型的な内容です:オブジェクトストリームでファイルを書き直し、参照されないものをすべて破棄します。

対応策

あなたができること

PDF が予想より大きい場合、原因はほぼ常に上記 4 つのいずれかです。どこにもアップロードせずに縮小できます:ローカルのPDF 圧縮ツールにかけて、オブジェクトストリームで再保存し未使用オブジェクトを削除します。画像中心の PDF では、最大の削減は源画像を PDF に入れる前に再エンコードすることで得られます。

関連記事

関連リソース

関連記事

関連ガイド