PDF から画像を取り出す(ページのスクショではなく)
FreePDFチーム ·
取引先から 40 ページのカタログが届き、必要なのは商品写真だけ。一枚ずつスクリーンショットを撮れば解像度は落ちますし、PDF を JPG に変換すれば文字ごと焼き込まれたページが返ってきます。欲しいのは画像そのもの——誰かが書き出す前に文書へ放り込んだ、あの画像ファイルです。
画像の取り出しは、ページの変換ではない
別々の作業なのに、ツール名がよく似ています。どちらが必要かをはっきりさせておきます。
- PDF を JPG に変換:各ページを一枚の平らな画像に描き出します。本文も写真もノンブルも全部込みで、解像度は指定した値になります。
- 画像を取り出す:ファイルの中に手を入れて、埋め込まれた画像を一枚ずつ別ファイルとして取り出します。解像度は保存されたときのままです。
途中で再エンコードは一切しません。レイアウト上ではサムネイル程度に縮んでいても、3000×2000 の写真は 3000×2000 のまま出てきます。PDF は元画像をまるごと持っていて、小さく表示していただけだからです。ページで見えていたより大きい、というのはよくある嬉しい誤算です。
ZIP に入ってくるもの
60 回もダウンロードを押さずに済むよう、まとめて一つの ZIP で返ります。ファイル名は出てきたページと登場順で付くので、page7_23_Im4.png は 7 ページ目の 4 つ目の画像オブジェクトです。フォルダを名前順に並べれば読む順に並ぶので、本文との突き合わせも簡単です。
形式は PDF に保存されていたもの、たいていは PNG か JPG です。思ったより数が多いこともあります。ページの背景、全ページのヘッダーで繰り返される社章、2 ピクセルの画像として保存された細い罫線。すべてが写真だと思い込まず、ざっと見て要らないものは消してください。
欲しい図が出てこないとき
このツールが見つけるのはラスター画像、つまりピクセルでできたものだけです。ページ上では画像に見えても、そう保存されていないものがあります。
- ベクターで描かれたロゴ・アイコン・グラフ。 Illustrator から書き出したグラフや、帳票ツールが生成したグラフは、画像ではなく描画命令の集まりであることが多いです。取り出すべき画像オブジェクトが存在せず、ツールは「一枚も見つからない」と返します。
- 短冊状に切られた写真。 レイアウトソフトによっては、PDF を書き出すときに大きな画像を横帯に切り分けます。帯は順番どおりに返ってきますが、貼り合わせるのは自分の仕事です。
- レイアウト上でトリミングされた画像。 トリミングは表示の指示にすぎないので、ページで隠れていた部分も含めた元画像がまるごと返ります。
最初のケースに当たったら、ページごと描き出して切り抜くほうが早いです。元の解像度は失われますが、ベクターのグラフなら 300 DPI のページ描画でスライドや文書には十分な鮮明さになります。
スキャン文書は事情が違う
スキャナーやスマホのスキャンアプリから出た PDF なら、各ページ自体が一枚の大きな画像です。取り出せるのはまさにそれ、1 ページ 1 枚の写真、スキャンしたときの解像度そのままのスキャン画像です。誰かが結合した束から元のスキャンを取り戻したいときには本当に役立ちますし、ページに印刷された図版だけを抜きたいときには役に立ちません。図版が欲しいなら、ページの画像を取り出して切り抜いてください。
よくある質問
取り出した画像は PDF の中より画質が落ちますか?
落ちません。埋め込まれた画像データは保存し直さずそのままコピーされるので、二度目の圧縮は起きません。文書を作った時点ですでに 72 DPI に潰されていた写真なら、返ってくるのもその 72 DPI です。取り出しで悪くなることはありませんが、PDF にもともと無かったディテールを取り戻すこともできません。
特定の 1 ページの画像だけ取り出せますか?
一発ではできませんが、二段構えなら簡単です。まずそのページだけを別の PDF として抽出し、それに対して画像の取り出しを実行します。長い文書では、ヘッダーや罫線だらけの ZIP を掘り返すより速いことが多く、ファイル名もすっきりします。