guide·pdfty チーム··15 分で読めます

PDFから画像を抽出する方法(元の画質のまま)

PDFに埋め込まれた本物のJPG・PNGファイルを元の解像度のまま取り出す方法 — スクリーンショット不要、画質劣化なし。無料・登録不要で約30秒です。

PDFに埋め込まれた画像を元の解像度で抽出
原本はPDFの中にある。手を加えずに取り出そう。

誰かからPDFが送られてきた — パンフレット、レポート、製品シート — そして中の写真が必要になった。直感的にはズームしてスクリーンショットを撮りたくなりますが、やめましょう。フル品質でPDFから画像を抽出する方法は、埋め込まれた実ファイルそのものを取り出すことです。PDFは内部に原本を抱えて運んでいるのですから。無料のブラウザツールなら約30秒で、文書に配置されたときとまったく同じ状態の画像が返ってきます。

なぜスクリーンショットは画質を失い、抽出は失わないのか

PDFは写真をゼロから「描いて」いるわけではありません — 元の画像ファイル(たいていJPEGかPNG)を埋め込み、「この画像をここにこのサイズで置け」という命令を添えているだけです。印刷用パンフレットに配置された写真は通常300 dpiで保存されています。3×4インチの写真が300 dpiなら、ファイルの中におよそ900×1200ピクセルの実データが眠っています。

その写真を画面上でスクリーンショットすると、ビューアでたまたま表示されていたサイズ — たいてい72〜150 dpi相当 — で取り込むことになります。しかもピクセルはPDFレンダラーで一度リサンプリングされたうえ、スクリーンショットの保存時に再圧縮までされます。

方法得られるもの品質
ページをスクリーンショット72〜150 dpiの再レンダリング、再圧縮ありぼやけて小さく、文字や輪郭にアーティファクト
ビューアからコピペビューア依存で、縮小されがち予測不能 — うまくいくときもあるが、外れが多い
埋め込み画像を抽出保存された元ファイルをバイト単位でそのまま作者が配置したものと同一 — 多くは300 dpi以上

抽出はキャプチャではなくコピーです。作者が4000×3000の写真を配置したなら、あなたが受け取るのも4000×3000の写真です — たとえページ上では切手サイズで表示されていても。

30秒ですべての画像を抽出

1

ツールを開く

どのブラウザからでも画像抽出 にアクセスします — インストール不要、アカウント不要です。

Drop PDF here
2

PDFをアップロード

ドラッグして入れます。20 MB・50ページまで無料 — ほとんどのパンフレット、スライド資料、レポートをカバーします。

Drop PDF here
3

抽出は自動で実行

ツールが全ページから埋め込み画像オブジェクトをスキャンし、1つずつ手を加えずにコピーします — 一般的なファイルで2〜10秒です。

Compressing…69%~2 seconds remaining
4

ZIPをダウンロード

すべての画像が1つのアーカイブに。ページと位置で命名されている(例:page-03-img-01.jpg)ので、どの画像がどこにあったか辿れます。

contract_draft.pdfDownload
5

完了

透かしなし。アップロードしたファイルは1時間以内にサーバーから自動削除されます。

All done — file readyAuto-deleted in 1 hour

実際に何が返ってくるか

  • 形式。画像は保存されていた形式のまま出てきます — 写真はほぼ必ずJPG、透明部分やシャープな輪郭を持つグラフィックはPNGです。変換なし、再圧縮なしです。
  • 解像度。埋め込まれていたそのままです。印刷品質のPDFは300 dpiの画像を抱えていることが多く、Web書き出しのPDFは96〜150 dpi版しか持っていないこともあります。抽出はファイル内に存在する最良のコピーを返します — 元からなかったピクセルを発明することはできません。
  • 命名。ファイルはページと登場順で番号付けされるので、写真60枚入りの20ページカタログでも迷子になりません。
  • スキップされるもの。ベクターのロゴ、グラフ、線画はそもそも画像ではありません — 描画命令なので、抽出すべきファイルが存在しません。小さな装飾の断片(箇条書き記号や罫線)が出力に混ざることがありますが、無視すれば大丈夫です。
300+ dpi
印刷用PDFに保存されている典型的な解像度
72〜150 dpi
同じ画像をスクリーンショットしたときに得られるもの
0
再圧縮の回数 — ファイルはバイト単位でコピーされる
1時間
pdftyがアップロードを自動削除するまで

スキャンPDF:1ページ=1枚の大きな画像

PDFがスキャナーやスマホのスキャンアプリ由来なら、各ページそのものが1枚の全面画像です — 取り出せる独立した「写真」オブジェクトは存在しません。抽出は問題なく機能します:スキャンのフル解像度で、1ページにつき1枚の画像が得られます。

まず、本当に欲しいものを決めましょう:

  • ページ全体を画像として(どこかに再挿入する、アーカイブする) — 抽出がまさにそれをくれます。
  • スキャンページに写っている写真 — ページを抽出してから、任意の画像エディタで写真の領域をトリミングします。ツールには写真をまわりの紙面から切り分けることはできません。PDFにとってはすべてが1枚の絵だからです。
  • スキャン上のテキスト — それは画像の仕事ではまったくありません。代わりにOCRを実行しましょう。

数ページ分の画像だけ欲しいときは?

欲しい写真が12〜18ページに載っている200ページのレポートなら、まずPDF分割でそのページを抽出し(範囲指定のワークフローはPDFからページを抽出する方法で解説)、小さくなったファイルを画像抽出にかけましょう。アップロードは速く、ZIPは小さく、何百ものファイルを掘り返す必要もありません。無料枠の1日10回で、この2ステップ作業は余裕でこなせます。

よくある質問

抽出した画像は元の画質と一致しますか?

はい — 完全に一致します。埋め込まれた画像ファイルは、再レンダリングも再圧縮もなしにバイト単位でコピーされます。作者がPDFに配置したものが、そのままダウンロードされます。

画像はどの形式で出てきますか?

保存されていた形式のままです — 写真の多くはJPG、透明部分を持つグラフィックはPNGです。一部のPDFはあまり一般的でない内部エンコーディング(JPEG 2000や、スキャン用のCCITT faxなど)を使っています。それらはどこでも開けるよう、無劣化で標準形式に変換されます。

抽出した画像の一部が低解像度なのはなぜ?

PDFの中身がそれだけだからです。「Web用に書き出す」ツールは、ファイルを小さくするため画像を96〜150 dpiにダウンサンプリングすることがよくあります。抽出はPDFの内部に存在する最良のバージョンを返します — 埋め込まれていなかったものをアップスケールすることはできません。

ロゴやグラフが抽出されなかったのはなぜ?

おそらくベクターアートです — 保存された画像ファイルではなく、命令によって描かれる線と図形です。抽出できるものが存在しません。画像として必要なら、その要素を高倍率(400%以上)でスクリーンショットするのが回避策です。

パスワード保護されたPDFから画像を抽出できますか?

閲覧パスワードが必要です。まずPDFのロックを解除してから抽出しましょう。持っていないパスワードを回避するまっとうなツールは存在しません。

反転していたり、マスクされていたり、バラバラの画像が出てくるのはなぜ?

PDFは画像と透明マスクを別々に保存したり、大きな画像をタイルに分割したりすることがあります。ほとんどの抽出はきれいに済みますが、強く最適化されたPDFでは奇妙な断片がいくつか出ることがあります。使えるファイルを拾って、残りは無視しましょう。

無料プランの制限はありますか?

無料では20 MB・50ページまでのファイルを1日10回、透かしなし・登録不要で処理できます。Proは$9/moでファイル、ページ数、回数が無制限になります。

機密のPDFをアップロードしても安全ですか?

ファイルは抽出処理のためだけに使われ、1時間以内にサーバーから自動削除されます — 何も保持されず、出力に透かしも入りません。どうしてもアップロードできない資料には、ローカルのデスクトップツールを使いましょう。

pdfty チーム

pdfty チームはプライバシー重視のオンライン PDF ツール(圧縮・変換・OCR・署名・保護)を開発しています。ファイルは 1 時間以内に削除されます。 私たちについて →

関連記事