PDF 表格 → Excel · 免费开始 · 不留邮箱
PDF 表格转 Excel:把那张表变成能算的单元格
PDF 里的表格其实不是表格,只是落在坐标上的字形——所以直接复制粘贴,得到的往往是挤成一行的文字。 上传下面的 PDF——输出格式已经选好了 Excel 表格(.xlsx)——那张表就会变成 可以排序、可以求和、可以直接改的单元格。
上传 PDF Basic 模式免费、无需账号:每天 10 页、每月 100 页;登录后每天 100 页、每月 1000 页。扫描件按页嵌入为图片,PDF 本身带有的文字仍可编辑。AI 模式把扫描件转写成真正可编辑的文字——需要登录并添加支付方式,或在下方粘贴你自己的 API key。无水印。
转换中…
默认不保留。不勾选时,你的 PDF 会按期删除;勾选后,我们仅保留它供工程师研究本次转换。随时可取消勾选。
选项 · AI / 基础 · 自带 key
高级——自带 AI 服务商
扫描件由 AI 视觉模型识别。自带你自己的服务商,即可按你选择的质量转换扫描件,费用直接付给服务商。
仅在使用你自己的 key 时生效。扫描件始终使用 AI 视觉识别。
仅用于本次转换,绝不保存、绝不记录。
最后更新:2026-09-16
我只要那一张表,不是整份文件
看一眼这个需求在网上排在最前面的是什么:第一条是 Reddit 的 r/ExcelTips 上一个帖子,标题就叫 「Convert PDF table into an excel document?」;往下还有一条是微软自家问答区的 「Export PDF table into Excel」。到今天大家还在互相问——这通常说明,正在回答这个查询的工具, 回答的其实是另一个略有出入的问题。
差别就在「表格」两个字上。几乎没有人想把四十页的年报整个变成电子表格。大家要的是第 4 页那张 费用表、银行流水的那些行、投标文件里的工程量清单、化验单上的数值——一张网格,夹在一份以文字 为主的文件中间。把整份 PDF 一股脑倒进一个工作表里,转换在技术上完成了,而你还站在原地。
所以工作簿是按原文的样子组织的:源文件一页对应一个工作表,依次叫
P1、P2、P3。找你的表,就是打开与它所在页码同号的那个
工作表。它在那里是一片活的单元格——选中、复制,粘进你自己那份台账就行。那一页上表格以外的内容
也会按阅读顺序跟着过来:表上方的标题、下方的单位说明、注明数据年份的那行脚注。这些恰恰是让
数字有意义的东西,也是「只抽表格」的做法最先丢掉的东西。
一格对一格:什么才算转对了
PDF 表格落进电子表格,出错的方式主要有两种,值得点名——因为这也是你验收任何结果(包括我们的) 时该看的地方。一种是塌缩:一整行挤进一个单元格,接下来一下午都在用「分列」。另一种是碎裂: 行是拆开了,但拆错了位置——一段换行的说明变成两行,一个空单元格让它后面所有列整体左移一格, 表面上看着合理,实际上错了,而且任何合计都看不出来。
「转对了」的标准比「看起来像」要窄:原文里的网格,和工作表里的网格,得是同一张网格。
- 行列按原文的画法落位——空单元格就在自己那一列留空,不会让后面的内容顶上来。
- 合并单元格仍然是合并的。横跨三列的表头写成一个跨三列的合并单元格,不复制 三份,也不只塞进最左一格;竖跨几行的侧栏标签同理。
- 列宽与行高来自原文实测的版面尺寸,打开时的比例大致就是纸面上的比例, 而不是所有列都是默认宽度。
- 单元格框线会带过来,所以一张有框的表还是一张有框的表。
然后是核对,而不是假定。工作簿写完之后会被校验、重新打开、逐格读回,把读到的内容与当初从 PDF 里抽出来的内容做比对,合并和框线也在比对范围内。这一步每次转换都跑,并且随任务一起留痕。 它不等于「永远不会读错」,但它是「给你一个文件」和「把要给你的文件自己看过一遍」之间的区别。
| 你用的是哪条路 | 出来的是什么 | 合并表头 | 最先出问题的地方 |
|---|---|---|---|
| 直接从 PDF 阅读器复制粘贴 | 一段按坐标排出来的文字 | 不保留 | 整行挤进一个单元格,接下来靠「分列」救 |
| 把整页截图贴进工作表 | 一张图片浮在单元格上方 | 不适用 | 数字算不了、排不了序、搜不到 |
| 只做 OCR 的常见转换器 | 识别出来的字符流 | 很少保留 | 网格被压平成文本行;空单元格让后面的列整体左移 |
| 重建成工作簿单元格(这个转换器) | 一页一个工作表,真正的单元格 | 保留为跨行跨列的合并单元格 | 倾斜或盖章的扫描页,网格更难还原,合计数要自己复核 |
表中各行描述的是几类做法,不是某个具名产品——我们没有跑过任何同类产品的对照测试,也不在这里给任何百分比。
开头是 0 的发票代码,落进表里还得是 0 开头
这是那种会悄悄毁掉一张表的错误,值得弄明白一次。税号、银行账号、身份证号、物料编码:纸面上
印的是 012001900211,进了 Excel 变成 12001900211——前面那个零没了,
这个编号从此对不上任何一张你打算拿它去匹配的表。
原因几乎总是同一个,而且不在「读」,在「写」:下游某个环节看见一串数字,判断它长得像数字, 就热心地把它变成了数字。所以在这条流水线上,单元格的类型是在读 PDF 的时候定的, 依据是纸面上真正印出来的那串字形;负责写工作簿的那一环永远没有权限去推断它:
- 前导零一律判为文本。不管它多像数字都不例外。
- 过长的纯数字串也留作文本——18 位身份证号、19 位银行卡号。Excel 里所有数字 都按双精度浮点存放,超过十五位左右的有效数字,尾巴会被悄悄抹平;写成数字就等于在 Excel 内部被改坏,读回校验也查不出来。
- 真正是数值的就写成数值,并带上原文自己的呈现方式——小数位、千分位、货币或 百分比格式——这样它可以直接排序、直接求和,不用先清洗一遍。
「数字仍是数字」这句话的全部内容就是这些,它的边界也在这里:纸面上印的是什么,单元格里就是什么。
表格本身是一张图(扫描件)
大家真正要转的表格,有一半根本不是文字:扫描的发票、拍下来的价目表、传真过来的送货单——里面 没有文字层可抽,只有像素,靠读文字层的转换器什么也读不到。
这里是逐页判断的。没有可用文字的页会交给 AI 视觉模型,读完之后先还原成文档结构:标题、段落、 表格行。输出格式是在这条流水线的末端才选的——同一次识别、同一次重建,按你要的产出 Word、工作簿或者 Markdown。表格这条路上没有另一条更弱的支线。
也把话说清楚:扫描件是本页里最难的一类输入。纸张倾斜、印章压在框线上、手写字写在空格里、 复印掉墨,都会让网格比原生 PDF 难还原得多。合计数请对着原页核一遍再用。扫描页要交给 AI 模式去读,因为每页都要花真金白银;这需要登录并绑定付款方式,也可以粘贴你自己的 API key, 按你自己的成本继续转。
跨页的表格:什么时候接回去,什么时候宁可不接
一张表在这一页排到底、下一页接着往下排,生成工作簿之前就会被接回成一整片。它落在这张表开始的
那一页对应的工作表上——从第 4 页排到第 6 页的表,最后是 P4 上的一整片区域——原文
在续页顶部重印的那行表头会被去掉,不会夹在数据中间。跨五页也一样,一页一页往下接,直到这张表
真的结束。
判定故意卡得很严,因为把两张不同的表接成一张,是你从结果里看不出来、也无法还原的损坏。列必须 对得上——列数一样,列宽占比的差距也要在很小的范围内——在这之上,还要么表头逐字重复,要么页面上 明写着「续表」或 continued。形状一样但表头换了内容,它就拒绝接。拒绝的时候,两半按原样 各自留在自己的工作表上:这是一次你看得见的复制粘贴,而不是一次你看不见的拼接。
中文表格和中英混排
中文表格会在一个西文表格不会出问题的地方翻车,原因是算术:一个全角字符占的横向宽度大约是一个 拉丁字母的两倍,所以如果按英文的方式给一列宋体正文算宽度,得到的列宽只有需要的一半,每个 单元格打开都是截断的。这里的列宽是按东亚宽度计算的,中文列打开就是能看的。
全角标点——顿号、《》书名号、全角逗号——按它本来的字符带过去,不会被换成半角的近似符号;中文 栏目名配拉丁文物料编码的混排表也不需要你做任何设置。如果你手上那份文件其实是以正文为主、 表格夹在其中,可以看看我们的 中文 PDF 转 Word 页面,那里讲的是同一套引擎在 Word 这一侧的表现,包括扫描中文页和字体名怎么处理。
三步转换
- 上传含表格的 PDF——文字版或扫描件都行,最多 2000 页。
- 输出格式已经选好了 Excel 表格(.xlsx),只有想要 Word 文档时才需要改。
- 下载工作簿,打开与你那张表所在页码同号的工作表。
不用装软件、不会跳转、不会往你邮箱里发东西。如果你要的是文档而不是数据,同一次上传也可以转成 Word——那是我们的主入口 PDF 转可编辑 Word;版式像幻灯片的 PDF 会自动转成 PowerPoint。
扫描件里的表格走的是同一条路,只是上传后先过一遍视觉识别。如果你的来源是复印件或手机拍照, 扫描件 PDF 转 Word这页把这条路径讲全了。
免费到什么程度,要不要留邮箱
文字版 PDF——也就是从 Word、WPS、排版系统直接导出的那一类,大多数报表、对账单、导出文件都属于 这一类——不用注册、不用留邮箱、产出没有水印。Basic 模式免费、无需账号:每天 10 页、每月 100 页;登录后每天 100 页、每月 1000 页。 输出格式刻意不作为计费维度:要一份工作簿和要一份 Word 文档是同样的价钱,而对文字版 PDF 来说,这个价钱是零。
扫描页是例外,因为每一页都要交给 AI 视觉模型去读,有实打实的每页成本。AI 模式把扫描件转写成真正可编辑的文字,需要登录并绑定付款方式,与 Basic 共用同一份账号额度;超出后按已购页数计费。 另有两条仍然不用付钱给我们的路:粘贴你自己的 Anthropic / OpenAI / Gemini 或任意 OpenAI 兼容端点的 API key,按你自己的成本继续转——自带 API key 的转换完全不计入额度。或者让任务退回到免费的 Basic 模式,文字页照样出数据、扫描页以图片嵌入。按页购买的页数包列在 价格页上,目前还没有开通;现在生效的是免费的 Basic 模式、需要 登录并绑定付款方式的 AI 模式和你自己的 key。
你上传的文件和我们产出的工作簿,大约六小时后自动删除——详见 隐私说明。这一条对表格比对一般文档更要紧:大家要转的那几页, 往往正是印着账号和价格的那几页。
资料来源
上文引用的各家做法均出自其官方文档,每个页面均于 2026-09-16 核对。每一家只被引用来说明其自家软件。
常见问题
PDF 表格转 Excel — 常见问题
怎么把 PDF 里的表格提取出来?
上传 PDF,在「输出格式」里选 Excel 表格(.xlsx),然后下载工作簿。源文件的每一页对应一个工作表,所以你要的那张表就在与它所在页码同号的工作表里,落下来的是真正的单元格,而不是一段文字。选中那片区域复制,直接粘进你手上已有的表格就行,不用再手工拆列。
为什么直接从 PDF 复制表格,粘到 Excel 就乱了?
PDF 里没有「行」这个东西,只有落在坐标上的字形——看起来是表格,其实只是一堆位置恰好对齐的文字。所以复制出来常常是一整行挤进一个单元格。走转换这条路,拿到的工作簿里表格本身已经是网格:一格对一格,合并的表头仍然是合并的,接下来只是一次普通的复制粘贴。
用 ChatGPT 也能把 PDF 表格弄成 Excel 吗?
通用聊天模型可以把表格读给你看,得到的是一段对话回复——文字,还要你自己搬进表格里。这里是转换器,给你的是文件本身:一份 .xlsx,单元格有类型、表头是合并的、列宽来自原文;而且在你下载之前,成品工作簿会被重新打开、逐格读回,与从 PDF 里抽出来的内容做比对。
合并表头、跨行跨列的单元格会保留吗?
会。原文里横跨三列的表头,写进工作簿就是一个横跨三列的合并单元格,不会被复制三份,也不会只塞进最左边那一格;竖着跨几行的侧栏标签同理。列宽和行高取自原文实测的版面尺寸,所以打开时的比例大致就是纸面上的比例,而不是所有列一律 Excel 默认宽度。
扫描件或拍照的表格能转吗?
扫描页没有可提取的文字,会交给 AI 视觉模型去读,先还原成文档结构,工作簿再从这个结构生成。这也是本页里最难的一类输入:纸张倾斜、印章压在框线上、手写字写在空格里,都会让网格更难还原,所以合计数请自己对着原页核一遍再用。把扫描页转写成真正的文字要用 AI 模式;Basic 模式免费,这些页按页嵌入为图片。AI 模式把扫描件转写成真正可编辑的文字,需要登录并绑定付款方式,与 Basic 共用同一份账号额度;超出后按已购页数计费。
表格跨了好几页,能拼成一张吗?
能。生成工作簿之前就会把续排的部分接回去:一张从第 4 页排到第 6 页的表,最后是第 4 页那个工作表上的一整片区域,原文在每页顶部重复的表头会被去掉,不会夹在数据中间。判定卡得很严——列要对得上,而且表头逐字重复或者页面上写着「续表」,两者至少占一样;条件不满足时,两半就按原样各自留在自己的工作表上。
要不要注册或者留邮箱?文件会留多久?
都不用。没有账号、不留邮箱、成品没有水印,上传、转换、下载都在浏览器里完成。Basic 模式免费、无需账号:每天 10 页、每月 100 页;登录后每天 100 页、每月 1000 页。转换产物大约六小时后自动删除——如果你要转的表格夹在合同、投标文件或者客户对账单里,这一条值得知道。