PDF 表格 → Excel · 免费开始 · 不留邮箱

PDF 表格转 Excel:把那张表变成能算的单元格

PDF 里的表格其实不是表格,只是落在坐标上的字形——所以直接复制粘贴,得到的往往是挤成一行的文字。 上传下面的 PDF——输出格式已经选好了 Excel 表格(.xlsx)——那张表就会变成 可以排序、可以求和、可以直接改的单元格。

一格对一格 合并表头保留 编号前导零不丢 无需注册

上传 PDF Basic 模式免费、无需账号:每天 10 页、每月 100 页;登录后每天 100 页、每月 1000 页。扫描件按页嵌入为图片,PDF 本身带有的文字仍可编辑。AI 模式把扫描件转写成真正可编辑的文字——需要登录并添加支付方式,或在下方粘贴你自己的 API key。无水印。

PDF
输出格式 默认输出 Word。Excel 表格适合以表格为主的 PDF;Markdown 文件会打包成 .zip,里面是 .md 和它的图片。幻灯片版式的 PDF 会自动转成 PowerPoint。 按页计费,选哪种格式价格都一样。

选项 · AI / 基础 · 自带 key
转换模式 基础模式免费、即时、无需账号:扫描页以图片形式嵌入,不可编辑文字。AI 模式会把扫描页识别为可编辑文字——质量最佳;需要登录并绑定付款方式,或自带 API key。
高级——自带 AI 服务商

扫描件由 AI 视觉模型识别。自带你自己的服务商,即可按你选择的质量转换扫描件,费用直接付给服务商。

质量

仅在使用你自己的 key 时生效。扫描件始终使用 AI 视觉识别。

仅用于本次转换,绝不保存、绝不记录。

最后更新:2026-09-16

我只要那一张表,不是整份文件

看一眼这个需求在网上排在最前面的是什么:第一条是 Reddit 的 r/ExcelTips 上一个帖子,标题就叫 「Convert PDF table into an excel document?」;往下还有一条是微软自家问答区的 「Export PDF table into Excel」。到今天大家还在互相问——这通常说明,正在回答这个查询的工具, 回答的其实是另一个略有出入的问题。

差别就在「表格」两个字上。几乎没有人想把四十页的年报整个变成电子表格。大家要的是第 4 页那张 费用表、银行流水的那些行、投标文件里的工程量清单、化验单上的数值——一张网格,夹在一份以文字 为主的文件中间。把整份 PDF 一股脑倒进一个工作表里,转换在技术上完成了,而你还站在原地。

所以工作簿是按原文的样子组织的:源文件一页对应一个工作表,依次叫 P1P2P3。找你的表,就是打开与它所在页码同号的那个 工作表。它在那里是一片活的单元格——选中、复制,粘进你自己那份台账就行。那一页上表格以外的内容 也会按阅读顺序跟着过来:表上方的标题、下方的单位说明、注明数据年份的那行脚注。这些恰恰是让 数字有意义的东西,也是「只抽表格」的做法最先丢掉的东西。

一格对一格:什么才算转对了

PDF 表格落进电子表格,出错的方式主要有两种,值得点名——因为这也是你验收任何结果(包括我们的) 时该看的地方。一种是塌缩:一整行挤进一个单元格,接下来一下午都在用「分列」。另一种是碎裂: 行是拆开了,但拆错了位置——一段换行的说明变成两行,一个空单元格让它后面所有列整体左移一格, 表面上看着合理,实际上错了,而且任何合计都看不出来。

「转对了」的标准比「看起来像」要窄:原文里的网格,和工作表里的网格,得是同一张网格。

然后是核对,而不是假定。工作簿写完之后会被校验、重新打开、逐格读回,把读到的内容与当初从 PDF 里抽出来的内容做比对,合并和框线也在比对范围内。这一步每次转换都跑,并且随任务一起留痕。 它不等于「永远不会读错」,但它是「给你一个文件」和「把要给你的文件自己看过一遍」之间的区别。

你用的是哪条路出来的是什么合并表头最先出问题的地方
直接从 PDF 阅读器复制粘贴一段按坐标排出来的文字不保留整行挤进一个单元格,接下来靠「分列」救
把整页截图贴进工作表一张图片浮在单元格上方不适用数字算不了、排不了序、搜不到
只做 OCR 的常见转换器识别出来的字符流很少保留网格被压平成文本行;空单元格让后面的列整体左移
重建成工作簿单元格(这个转换器)一页一个工作表,真正的单元格保留为跨行跨列的合并单元格倾斜或盖章的扫描页,网格更难还原,合计数要自己复核

表中各行描述的是几类做法,不是某个具名产品——我们没有跑过任何同类产品的对照测试,也不在这里给任何百分比。

开头是 0 的发票代码,落进表里还得是 0 开头

这是那种会悄悄毁掉一张表的错误,值得弄明白一次。税号、银行账号、身份证号、物料编码:纸面上 印的是 012001900211,进了 Excel 变成 12001900211——前面那个零没了, 这个编号从此对不上任何一张你打算拿它去匹配的表。

原因几乎总是同一个,而且不在「读」,在「写」:下游某个环节看见一串数字,判断它长得像数字, 就热心地把它变成了数字。所以在这条流水线上,单元格的类型是在读 PDF 的时候定的, 依据是纸面上真正印出来的那串字形;负责写工作簿的那一环永远没有权限去推断它:

「数字仍是数字」这句话的全部内容就是这些,它的边界也在这里:纸面上印的是什么,单元格里就是什么。

表格本身是一张图(扫描件)

大家真正要转的表格,有一半根本不是文字:扫描的发票、拍下来的价目表、传真过来的送货单——里面 没有文字层可抽,只有像素,靠读文字层的转换器什么也读不到。

这里是逐页判断的。没有可用文字的页会交给 AI 视觉模型,读完之后先还原成文档结构:标题、段落、 表格行。输出格式是在这条流水线的末端才选的——同一次识别、同一次重建,按你要的产出 Word、工作簿或者 Markdown。表格这条路上没有另一条更弱的支线。

也把话说清楚:扫描件是本页里最难的一类输入。纸张倾斜、印章压在框线上、手写字写在空格里、 复印掉墨,都会让网格比原生 PDF 难还原得多。合计数请对着原页核一遍再用。扫描页要交给 AI 模式去读,因为每页都要花真金白银;这需要登录并绑定付款方式,也可以粘贴你自己的 API key, 按你自己的成本继续转。

跨页的表格:什么时候接回去,什么时候宁可不接

一张表在这一页排到底、下一页接着往下排,生成工作簿之前就会被接回成一整片。它落在这张表开始的 那一页对应的工作表上——从第 4 页排到第 6 页的表,最后是 P4 上的一整片区域——原文 在续页顶部重印的那行表头会被去掉,不会夹在数据中间。跨五页也一样,一页一页往下接,直到这张表 真的结束。

判定故意卡得很严,因为把两张不同的表接成一张,是你从结果里看不出来、也无法还原的损坏。列必须 对得上——列数一样,列宽占比的差距也要在很小的范围内——在这之上,还要么表头逐字重复,要么页面上 明写着「续表」或 continued。形状一样但表头换了内容,它就拒绝接。拒绝的时候,两半按原样 各自留在自己的工作表上:这是一次你看得见的复制粘贴,而不是一次你看不见的拼接。

中文表格和中英混排

中文表格会在一个西文表格不会出问题的地方翻车,原因是算术:一个全角字符占的横向宽度大约是一个 拉丁字母的两倍,所以如果按英文的方式给一列宋体正文算宽度,得到的列宽只有需要的一半,每个 单元格打开都是截断的。这里的列宽是按东亚宽度计算的,中文列打开就是能看的。

全角标点——顿号、《》书名号、全角逗号——按它本来的字符带过去,不会被换成半角的近似符号;中文 栏目名配拉丁文物料编码的混排表也不需要你做任何设置。如果你手上那份文件其实是以正文为主、 表格夹在其中,可以看看我们的 中文 PDF 转 Word 页面,那里讲的是同一套引擎在 Word 这一侧的表现,包括扫描中文页和字体名怎么处理。

三步转换

  1. 上传含表格的 PDF——文字版或扫描件都行,最多 2000 页。
  2. 输出格式已经选好了 Excel 表格(.xlsx),只有想要 Word 文档时才需要改。
  3. 下载工作簿,打开与你那张表所在页码同号的工作表。

不用装软件、不会跳转、不会往你邮箱里发东西。如果你要的是文档而不是数据,同一次上传也可以转成 Word——那是我们的主入口 PDF 转可编辑 Word;版式像幻灯片的 PDF 会自动转成 PowerPoint。

扫描件里的表格走的是同一条路,只是上传后先过一遍视觉识别。如果你的来源是复印件或手机拍照, 扫描件 PDF 转 Word这页把这条路径讲全了。

免费到什么程度,要不要留邮箱

文字版 PDF——也就是从 Word、WPS、排版系统直接导出的那一类,大多数报表、对账单、导出文件都属于 这一类——不用注册、不用留邮箱、产出没有水印。Basic 模式免费、无需账号:每天 10 页、每月 100 页;登录后每天 100 页、每月 1000 页。 输出格式刻意不作为计费维度:要一份工作簿和要一份 Word 文档是同样的价钱,而对文字版 PDF 来说,这个价钱是零。

扫描页是例外,因为每一页都要交给 AI 视觉模型去读,有实打实的每页成本。AI 模式把扫描件转写成真正可编辑的文字,需要登录并绑定付款方式,与 Basic 共用同一份账号额度;超出后按已购页数计费。 另有两条仍然不用付钱给我们的路:粘贴你自己的 Anthropic / OpenAI / Gemini 或任意 OpenAI 兼容端点的 API key,按你自己的成本继续转——自带 API key 的转换完全不计入额度。或者让任务退回到免费的 Basic 模式,文字页照样出数据、扫描页以图片嵌入。按页购买的页数包列在 价格页上,目前还没有开通;现在生效的是免费的 Basic 模式、需要 登录并绑定付款方式的 AI 模式和你自己的 key。

你上传的文件和我们产出的工作簿,大约六小时后自动删除——详见 隐私说明。这一条对表格比对一般文档更要紧:大家要转的那几页, 往往正是印着账号和价格的那几页。

资料来源

上文引用的各家做法均出自其官方文档,每个页面均于 2026-09-16 核对。每一家只被引用来说明其自家软件。

PDF 表格转 Excel — 常见问题

怎么把 PDF 里的表格提取出来?

上传 PDF,在「输出格式」里选 Excel 表格(.xlsx),然后下载工作簿。源文件的每一页对应一个工作表,所以你要的那张表就在与它所在页码同号的工作表里,落下来的是真正的单元格,而不是一段文字。选中那片区域复制,直接粘进你手上已有的表格就行,不用再手工拆列。

为什么直接从 PDF 复制表格,粘到 Excel 就乱了?

PDF 里没有「行」这个东西,只有落在坐标上的字形——看起来是表格,其实只是一堆位置恰好对齐的文字。所以复制出来常常是一整行挤进一个单元格。走转换这条路,拿到的工作簿里表格本身已经是网格:一格对一格,合并的表头仍然是合并的,接下来只是一次普通的复制粘贴。

用 ChatGPT 也能把 PDF 表格弄成 Excel 吗?

通用聊天模型可以把表格读给你看,得到的是一段对话回复——文字,还要你自己搬进表格里。这里是转换器,给你的是文件本身:一份 .xlsx,单元格有类型、表头是合并的、列宽来自原文;而且在你下载之前,成品工作簿会被重新打开、逐格读回,与从 PDF 里抽出来的内容做比对。

合并表头、跨行跨列的单元格会保留吗?

会。原文里横跨三列的表头,写进工作簿就是一个横跨三列的合并单元格,不会被复制三份,也不会只塞进最左边那一格;竖着跨几行的侧栏标签同理。列宽和行高取自原文实测的版面尺寸,所以打开时的比例大致就是纸面上的比例,而不是所有列一律 Excel 默认宽度。

扫描件或拍照的表格能转吗?

扫描页没有可提取的文字,会交给 AI 视觉模型去读,先还原成文档结构,工作簿再从这个结构生成。这也是本页里最难的一类输入:纸张倾斜、印章压在框线上、手写字写在空格里,都会让网格更难还原,所以合计数请自己对着原页核一遍再用。把扫描页转写成真正的文字要用 AI 模式;Basic 模式免费,这些页按页嵌入为图片。AI 模式把扫描件转写成真正可编辑的文字,需要登录并绑定付款方式,与 Basic 共用同一份账号额度;超出后按已购页数计费。

表格跨了好几页,能拼成一张吗?

能。生成工作簿之前就会把续排的部分接回去:一张从第 4 页排到第 6 页的表,最后是第 4 页那个工作表上的一整片区域,原文在每页顶部重复的表头会被去掉,不会夹在数据中间。判定卡得很严——列要对得上,而且表头逐字重复或者页面上写着「续表」,两者至少占一样;条件不满足时,两半就按原样各自留在自己的工作表上。

要不要注册或者留邮箱?文件会留多久?

都不用。没有账号、不留邮箱、成品没有水印,上传、转换、下载都在浏览器里完成。Basic 模式免费、无需账号:每天 10 页、每月 100 页;登录后每天 100 页、每月 1000 页。转换产物大约六小时后自动删除——如果你要转的表格夹在合同、投标文件或者客户对账单里,这一条值得知道。