guide·pdfty 团队··11 分钟阅读

怎么从 PDF 里提取图片(原始画质)

把 PDF 内嵌的 JPG、PNG 原图按原始分辨率取出来——不截图、零画质损失。免费、免注册,30 秒搞定。

按原始分辨率提取 PDF 内嵌图片
原图就在 PDF 里。原封不动取出来。

有人发来一份 PDF——宣传册、报告、产品页——你需要里面的照片。本能反应是放大再截图。别这么干。想以完整画质从 PDF 里提取图片,正确做法是取出实际内嵌的文件,因为 PDF 里装着的就是原图。免费的浏览器工具约 30 秒完成这件事,图片以放进文档时的原样返还给你。

为什么截图掉画质(而提取不掉)

PDF 并不会从零「画」出照片——它内嵌了原始图片文件(通常是 JPEG 或 PNG),外加一条指令:「把这张图按这个尺寸放在这里」。放进印刷级宣传册的照片通常按 300 dpi 存储;一张 3×4 英寸、300 dpi 的照片,就是文件里躺着大约 900×1200 像素的真实数据。

而当你在屏幕上截那张照片时,你捕获的是它在查看器里恰好渲染出的尺寸——通常相当于 72-150 dpi。此外,这些像素已被 PDF 渲染器重采样过一次,保存截图时又要再压缩一遍。

方法你得到什么画质
给页面截图72-150 dpi 的重渲染,再度压缩发虚、偏小,文字和边缘有噪点
从查看器复制粘贴取决于查看器,常被缩小不可预测——偶尔还行,经常不行
提取内嵌图片原始存储文件,逐字节复制和作者放进去的一模一样——往往 300+ dpi

提取是复制,不是抓取。作者放进去的是 4000×3000 的照片,你拿到的就是 4000×3000 的照片——哪怕它在页面上只显示成邮票大小。

30 秒提取全部图片

1

打开工具

在任何浏览器访问 提取图片——不用安装,不要账号。

Drop PDF here
2

上传 PDF

拖进来即可。20 MB、50 页以内免费,大多数宣传册、演示稿和报告都不在话下。

Drop PDF here
3

提取自动运行

工具扫描每一页的内嵌图片对象,逐张原封不动复制出来——普通文件 2-10 秒。

Compressing…69%~2 seconds remaining
4

下载 ZIP

所有图片装进一个压缩包,按页码和位置命名(如 page-03-img-01.jpg),每张图都能追溯到它出现的位置。

contract_draft.pdfDownload
5

完成

无水印。上传的文件在 1 小时内从我们的服务器自动删除。

All done — file readyAuto-deleted in 1 hour

你实际拿回来的是什么

  • 格式。图片以其存储时的格式输出——照片几乎都是 JPG,带透明或锐利边缘的图形是 PNG。不转换、不重新压缩。
  • 分辨率。嵌进去多少就是多少。印刷级 PDF 常带 300 dpi 图片;为网页导出的 PDF 可能只有 96-150 dpi 的版本。提取给你的是文件里存在的最佳副本——它无法凭空发明从未存进去的像素。
  • 命名。文件按页码和出现顺序编号,60 张照片的 20 页产品目录也不会乱。
  • 哪些会被跳过。矢量 logo、图表和线稿根本不是图片——它们是绘图指令,没有文件可提取。细小的装饰碎片(项目符号、边框)可能出现在输出里;忽略即可。
300+ dpi
印刷级 PDF 的典型存储分辨率
72-150 dpi
同一张图截图能给你的分辨率
0
重压缩次数——文件被逐字节复制
1 小时
pdfty 自动删除你上传文件前的时间

扫描版 PDF:一页就是一张大图

如果你的 PDF 来自扫描仪或手机扫描应用,那每一页就是一整张全页图片——没有单独的「照片」对象可取。提取依然完全可用:你会得到每页一张、按扫描完整分辨率输出的图。

先想清楚你到底要什么:

  • 整页作为图片(要插到别处,或存档)——提取给你的正是这个。
  • 扫描页上出现的某张照片——先提取整页,再在任何图片编辑器里裁出照片区域。工具无法把照片从它周围的纸面上分离出来,因为在 PDF 眼里那是一整张图。
  • 扫描件上的文字——那根本不是图片活儿;去跑 OCR。

只需要其中几页的图片?

一份 200 页的报告,你要的照片在第 12-18 页——先用 拆分 PDF 把那几页提出来(范围写法见从 PDF 提取页面免费方法),再把小文件跑一遍提取图片。上传更快、ZIP 更小、不用在几百个文件里翻找。免费额度每天 10 次操作,这样的两步任务轻松覆盖。

常见问题

提取出的图片和原始画质一致吗?

一致——分毫不差。内嵌图片文件被逐字节复制出来,不重新渲染、不重新压缩。作者放进 PDF 的是什么,你下载到的就是什么。

图片会以什么格式输出?

以它们存储时的格式——照片多为 JPG,带透明的图形为 PNG。有些 PDF 用较少见的内部编码(如 JPEG 2000,或扫描件的 CCITT 传真编码);这些会被无损转换成标准格式,保证每个文件在哪儿都能打开。

为什么有些提取出的图片分辨率很低?

因为 PDF 里就只有这么多。「导出为网页版」的工具常把图片降采样到 96-150 dpi 来压文件。提取返回的是 PDF 内部存在的最佳版本——它无法放大从未嵌入过的东西。

为什么某个 logo 或图表没被提取出来?

它多半是矢量图——由指令画出的线条和形状,不是存储的图片文件。没有东西可提取。需要把它变成图片的话,变通办法是高倍放大(400%+)后对那个元素截图。

能从有密码保护的 PDF 里提取图片吗?

你需要打开密码。先解锁 PDF,再提取。正规工具都不会绕过一个你没有的密码。

有些图片出来是反色的、带遮罩的或碎成几块——为什么?

PDF 有时会把一张图和一个单独的透明遮罩分开存,或者把大图切成小块。绝大多数提取是干净的,但一份被深度优化过的 PDF 可能产出几个奇怪的碎片。留下好的文件,其余忽略。

免费方案有什么限制?

免费处理 20 MB、50 页以内的文件,每天 10 次操作,无水印,免注册。Pro 是 $9/mo,文件、页数和操作次数均不设限。

上传机密 PDF 安全吗?

文件仅用于本次提取处理,并在 1 小时内从服务器自动删除——不保留任何东西,输出没有水印。完全不能上传的材料,请改用本地桌面工具。

pdfty 团队

pdfty 团队打造注重隐私的在线 PDF 工具——压缩、转换、OCR、签名与保护。文件在 1 小时内删除。 关于我们 →

相关文章