指南 · 5 分钟阅读 · 更新于 2026-08-09

如何把 PDF 表格弄进 Excel

能保住列结构的路线:PDF 转 CSV,再把 CSV 导入 Excel。不用重打,不用上传。

把文件拖到这里或者从设备中选择一个文件支持格式: PDF

文件不会离开你的浏览器。

从 PDF 里复制表格粘贴进 Excel,基本上从来没成功过。你选中一个整整齐齐的网格,粘贴出来所有东西挤在一列里,数字和标签黏在一起。这不是 Excel 别扭,而是 PDF 存储表格的方式决定的。

PDF 里没有「表格」这个概念。没有行,没有单元格,没有列定义。只有一片文字碎片,每一片带着自己在页面上的 x 和 y 坐标。你看到的表格,是把这些碎片摆成整齐的列之后产生的错觉。你一复制,坐标丢了,只剩文字,错觉随之崩塌。

解决办法是从坐标里把网格重建出来,而不是把坐标扔掉。这就是 PDF 转 CSV 在做的事,而 CSV 是 Excel 原生就能打开的格式。

转换步骤

  1. 1
    把 PDF 转成 CSV把文件拖进下面的转换器。它先按垂直位置把文字归组找出行,再对水平位置做聚类算出列的边界在哪。每个识别出的表格区域会得到一份 CSV。
  2. 2
    下载之前先看预览结果会以真实的网格显示出来。这是确认列数和你在 PDF 里看到的一致的时机。在这里发现列被合并只要一秒;等你在上面搭好公式之后再发现就不是了。
  3. 3
    用 Excel 打开 CSV双击通常就能用。如果 Excel 把所有字段塞进 A 列,改用「数据 → 从文本/CSV」并选逗号作为分隔符——这条路径会给你一个明确的导入对话框,而不是依赖你的区域设置去猜。
  4. 4
    修一下数字格式CSV 不携带任何格式,所以一列货币会变成纯数字,日期可能需要重新指定为日期类型。选中整列设置格式即可。这是每列一次操作,不是每个单元格一次。
如果你的区域设置用逗号作小数点在欧洲很多地区,Excel 默认期待分号分隔的文件,并把逗号读成小数点。如果逗号分隔的文件导入错乱,用「数据 → 从文本/CSV」明确指定分隔符,它会覆盖区域设置的猜测。

列分错了怎么办

有两种失败模式值得认一认,因为它们的修法不同。

几列被并成一列:两列靠得太近,聚类把它们读成了同一组。密集的财务表里很常见。事后在 Excel 里用「数据 → 分列」拆开,通常比跟源文件较劲更快。

一行被拆成两行:某个单元格里的文字换行了,第二行的位置低到看起来像新的一行。你会看到一行大部分是空的,只有一个单元格里有一小段文字。删掉那行多余的,把碎片接回上面的单元格。

本身是图片的表格如果在原始 PDF 里你没法用光标选中那些数字,那这张表是图片,没有任何东西可以提取。这需要 OCR,是另一件事,准确度预期也不同——而且数值数据里的 OCR 错误特别容易被忽略。

为什么不直接用在线表格提取工具

它们大多要把你的文件上传到服务器。如果是已经公开的价目表,无所谓。但如果是工资汇总、银行流水,或者任何受保密协议约束的东西,那就等于把一份数据副本交给了一个你没读过其留存政策的第三方。下面的转换在你的浏览器里运行:PDF 由你自己机器上的 JavaScript 解析,从不离开这个标签页。

把文件拖到这里或者从设备中选择一个文件支持格式: PDF

文件不会离开你的浏览器。

常见问题

能不能直接给我 .xlsx 而不是 CSV?

这个工具不行。用 CSV 是有意的:它是纯文本格式,没有宏,没有厂商怪癖,Excel 原生就能打开,Google Sheets、Numbers 以及所有数据库导入工具也一样。如果你需要原生格式,进了 Excel 之后另存为 .xlsx 即可。

跨多页的表格怎么处理?

每一页单独分析,所以跨页延续的表格会每页产出一份 CSV。因为列结构是一致的,在 Excel 里把它们上下粘起来很简单——只要删掉重复的表头行。

能处理合并单元格吗?

部分能。跨两列的合并表头只有一个文字位置,所以它会落在一个单元格里,而不是在两列里各复制一份。表头可能需要手工调整;下面的数据行通常是对的。

有文件大小限制吗?

只受你设备内存限制。全部在本地运行,所以没有服务端上限。很大的 PDF 解析会慢一些,因为干活的是你自己的 CPU。

相关指南