画像の抽出

PDF文書からすべての画像を抽出します

pdftyの抽出ツールは、PDFに実際に埋め込まれている画像(写真、ロゴ、図表、スキャン)を取り出し、個別のファイルとしてZIPでお渡しします。スクリーンショットと違い、抽出された画像は埋め込まれたときの元の解像度のまま、拡大縮小もトリミングもされずに、文書に配置されたそのままの状態で出力されます。

原本を紛失したレポートから写真を復元する、カタログPDFから商品画像を再利用する、論文やプレゼンから図を取り出す、スキャン文書からページスキャンを集める、といった用途に最適です。抽出にはPyMuPDFを使用しており、PDFの内部オブジェクトツリーを走査して、各画像をネイティブ形式で書き出します。JPEGは再圧縮ゼロでJPEGのまま、その他の形式は可逆のPNGとして出力されます。

20 MB・50ページまでのファイルは無料で、透かしも登録も不要です。ファイルはHTTPSでアップロードされ、1時間以内に完全に削除されます。埋め込み画像ではなく、ページ全体をレンダリングしたスナップショットが必要な場合は、PDF→JPGをお使いください。

使い方

  1. 1

    PDFをアップロード

    ドラッグ&ドロップするか、クリックして選択します。20 MB・50ページまで無料です。

  2. 2

    抽出

    PyMuPDFがファイルをスキャンし、埋め込まれたすべての画像を元の解像度で書き出します。

  3. 3

    結果をプレビュー

    ダウンロード前にサムネイルと枚数を確認できます。

  4. 4

    ZIPをダウンロード

    画像はページと位置に基づいて(page3-img2.jpgのように)命名され、整理しやすくなっています。

  5. 5

    1時間で完了

    PDFと抽出された画像は1時間以内にサーバーから削除されます。

よくある質問

PDFに埋め込まれている解像度そのままです。JPEGは再圧縮なしで抽出され、ファイルに保存されているものとバイト単位で同一です。

関連ツール

ガイドとチュートリアル