PDF 转 Excel 免费方法(表格真正能用)
免费把 PDF 转成 Excel,得到真正的行和列而不是一团乱。文本 PDF 与扫描对账单的区别、OCR 流程,以及转换后的清理技巧。

你有一张困在 PDF 里的表格——银行对账单、发票、价目表、报告里 30 页的附录——手工重打要一小时,还会敲错数字。免费把 PDF 转成 Excel 只需约 30 秒,得到的是真正能排序、筛选、求和的行和列。麻烦在于:PDF 对表格是个货真价实的敌对格式,正确的流程取决于你手里是哪种 PDF。下面是完整的思路。
为什么 PDF 装不好表格
PDF 里不存在表格。它存的是类似*「在 x=412、y=305 处画出 '1,240.50'」的指令——几百个定位的文字碎片外加几条线。你看到*的行、列、单元格只存在于你的脑子里。文件里没有表格结构可复制,这就是为什么在 PDF 阅读器里选中表格粘贴到 Excel,所有内容会挤进同一列。
转换器必须逆向重建网格:按 y 坐标把碎片聚成行、根据 x 位置和表格线判断列边界、再拼回单元格。现代提取算法在整洁的表格上做得很好——但这是推断,不是复制,所以对照原件快速核查输出,永远是工作的一部分。
在浏览器里把 PDF 表格转成 Excel
打开转换器
在任何浏览器访问 PDF 转 Excel——不用安装,不要账号。
上传 PDF
20 MB、50 页以内免费——一年 12 个月的对账单装下绰绰有余。
转换
自动检测表格并重建为电子表格单元格。一份普通对账单需要 10-40 秒。
下载 .xlsx
可在 Excel、Google 表格或 LibreOffice 中打开。文件在 1 小时后从我们的服务器自动删除。
核对数字
对一个你知道总数的列求和,和 PDF 上的数对一下。对得上,这次提取就可信。
免费方案每天覆盖 10 次操作;要批量处理对账单的话,Pro($9/mo)解除全部限制。
文本 PDF 还是扫描 PDF——5 秒判别法
后面的一切都取决于你拿到的是哪种。打开 PDF,试着用光标选中文字:
- 文字能选中 → 原生数字 PDF(软件导出的)。直接转换;数字准确率接近完美。
- 什么都选不中 → 扫描 PDF(纸张的照片)。文件里字面意义上还没有文字——直接转换只会得到空表或乱码。
对于扫描件——大多数打印后又扫描回来的银行对账单、小票和旧档案都属于这类——流程是:
- 先用 OCR PDF 识别印刷字符、加上真实文字层。
- 把做完 OCR 的 PDF 喂给 PDF 转 Excel。
- 核对合计。清晰印刷件的 OCR 准确率在 95-99%,而它的经典误读恰恰是财务上最疼的那几个:0↔8、1↔7、5↔6。核对列合计是否与对账单自己印的合计一致,几乎能全部抓出来。
转换后的表格清理
再好的转换也会留下痕迹。常见嫌疑人和快速修法:
| 问题 | 你看到的现象 | 修法 |
|---|---|---|
| 合并单元格 | PDF 多行单元格变成合并块,排序全乱 | 全选 → 开始 → 合并后居中 → 取消单元格合并,再补上空格 |
| 数字被存成文本 | 数字左对齐,SUM 结果是 0 | 选中列 → 数据 → 分列 → 完成,强制重新解析 |
| 货币符号粘在数字上 | 「$1,240.50」整个是一个文本串 | 查找替换掉符号,再设置成货币格式 |
| 负数显示为 (123.45) | 括号被当成文本 | 分列会在多数区域设置下把它们重新解析成负数 |
| 页眉表头反复出现 | 每 40 行冒出一次列标题 | 在某一列筛选表头文字 → 删除可见行 |
| 列被拆开或错位 | PDF 的一列变成两列,或行漂移 | 通常是复杂版式——对照原件核查,手工合并 |
其中两个值得记住,因为处处用得上:分列(数据选项卡)是 Excel 的万能「重新读一遍这一列」按钮;取消合并再填充能把好看但没法用的版式变成可排序的数据集。
替代方案:Excel 自带的「从 PDF 获取数据」(Windows)
如果你在 Windows 上有 Microsoft 365,Excel 内置了导入器:数据 → 获取数据 → 来自文件 → 从 PDF。它会列出 Power Query 在文件里检测到的每张表格;你挑一张,可选择在 Power Query 编辑器里清理,然后加载到工作表。
它的强项:周期性导入。为每月的对账单把查询配置好一次,下个月对新文件点一下数据 → 刷新就行。它的短板:只有 Windows 能用(Mac 版这个功能长期落后)、完全读不了扫描件——没有 OCR——而且它的表格检测漏掉跨页表格的频率比专业转换器高。一次性的提取,或者在 Mac、Chromebook 上,浏览器工具是更短的路。
常见问题
PDF 转 Excel 真的免费吗?
在 pdfty 上,是的——单个文件 20 MB、50 页以内免费,每天 10 次操作,免注册,无水印。Pro($9/mo)解除限制。无论哪种方案,文件都在 1 小时后从服务器删除。
为什么转出来的表格是空的,或者一堆乱码?
你的 PDF 几乎可以肯定是扫描件——没有文字层的页面照片。先跑一遍 OCR PDF,再转换结果。如果 PDF 里文字能选中但输出仍然混乱,说明版式复杂——试试只转换含表格的那几页。
扫描版银行对账单能转成 Excel 吗?
能,分两步:先 OCR PDF,再 PDF 转 Excel。然后核对——对每个金额列求和,与对账单自己印的合计比对。
为什么 Excel 不给我转出来的数字求和?
它们被当成文本导入了。选中那一列,然后数据 → 分列 → 完成——这会强制 Excel 把值重新解析成数字。如果货币符号粘在数值上,先用查找替换清掉。
跨页的表格会合成一张表吗?
跨页延续的表格是逐页提取的;你可能会在每个分页处看到重复的表头行。筛选表头文字并删除那些行——20 秒——数据就叠成一张连续的表了。
原始电子表格里的公式会回来吗?
不会。PDF 只存打印出来的数值——公式在文件导出为 PDF 的那一刻就丢了。你拿到的是数字;需要的那几个公式自己重建。(要反着来?Excel 转 PDF 时注意打印区域设置,别让列被切断。)
上传银行对账单安全吗?
在 pdfty 上,文件通过 HTTPS 传输,绝不加水印、绝不共享,并在 1 小时后自动从服务器删除。不需要账号,也就没有和你绑定的历史记录。对于任何地方都不能上传的文档,Excel 内置的「从 PDF 获取数据」(Windows)能让一切留在本地。
直接从 PDF 里复制粘贴表格行不行?
可以试——小而简单的表格偶尔真能成。但因为 PDF 里没有真正的表格结构,粘贴通常会把所有内容塌进一列。超过几行的表格,用会重建网格的转换器,省去手工重新拆分的功夫。
pdfty 团队打造注重隐私的在线 PDF 工具——压缩、转换、OCR、签名与保护。文件在 1 小时内删除。 关于我们 →