PDF 表格 → Excel · 免費開始 · 不留電子信箱
PDF 表格轉 Excel:把那張表變成算得動的儲存格
PDF 裡的表格其實不是表格,只是落在座標上的字形——所以直接複製貼上,得到的往往是擠成一列的文字。 上傳下面的 PDF——輸出格式已經幫你選好 Excel 試算表(.xlsx)——那張表就會變成 可以排序、可以加總、可以直接改的儲存格。
上傳 PDF Basic 模式免費、無需帳號:每天 10 頁、每月 100 頁;登入後每天 100 頁、每月 1000 頁。掃描檔按頁嵌入為圖片,PDF 本身帶有的文字仍可編輯。AI 模式把掃描檔轉寫成真正可編輯的文字——需要登入並新增付款方式,或在下方貼上你自己的 API key。無浮水印。
轉換中…
預設不保留。不勾選時,你的 PDF 會依排程刪除;勾選後,我們僅保留它供工程師研究本次轉換。隨時可取消勾選。
選項 · AI / 基礎 · 自備 key
進階——自備 AI 供應商
掃描檔由 AI 視覺模型辨識。自備你自己的供應商,即可按你選擇的品質轉換掃描檔,費用直接付給供應商。
僅在使用你自己的 key 時生效。掃描檔始終使用 AI 視覺辨識。
僅用於本次轉換,絕不儲存、絕不記錄。
最後更新:2026-09-16
我只要那一張表,不是整份檔案
看一眼這個需求在網路上排在最前面的是什麼:第一條是 Reddit 的 r/ExcelTips 上一則貼文, 標題就叫「Convert PDF table into an excel document?」;再往下還有一條是微軟自家問答區的 「Export PDF table into Excel」。到今天大家還在互相問——這通常表示,正在回答這個查詢的工具, 回答的其實是另一個略有出入的問題。
差別就在「表格」兩個字上。幾乎沒有人想把四十頁的年報整份變成試算表。大家要的是第 4 頁那張 費用表、銀行往來明細的那幾列、標案裡的數量清單、檢驗報告上的數值——一張網格,夾在一份以文字 為主的檔案中間。把整份 PDF 一股腦倒進一個工作表裡,轉檔在技術上完成了,而你還站在原地。
所以活頁簿是照原稿的樣子組織的:來源檔案一頁對應一個工作表,依序叫
P1、P2、P3。找你的表,就是打開與它所在頁碼同號的那個
工作表。它在那裡是一片活的儲存格——選起來、複製,貼進你自己那份台帳就行。那一頁上表格以外的
內容也會照閱讀順序跟著過來:表上方的標題、下方的單位說明、註明資料年度的那行附註。
這些恰恰是讓數字有意義的東西,也是「只抽表格」的做法最先丟掉的東西。
一格對一格:什麼才算轉對了
PDF 表格落進試算表,出錯的方式主要有兩種,值得點名——因為這也是你驗收任何結果(包括我們的) 時該看的地方。一種是塌縮:一整列擠進一個儲存格,接下來一整個下午都在手工把它拆成好幾欄。 另一種是碎裂:列是拆開了,但拆錯了位置——一段換行的說明變成兩列,一個空儲存格讓它後面所有欄 整體左移一格,表面上看著合理,實際上錯了,而且任何合計都看不出來。
「轉對了」的標準比「看起來像」要窄:原稿裡的網格,和工作表裡的網格,得是同一張網格。
- 欄列照原稿的畫法落位——空儲存格就在自己那一欄留空,不會讓後面的內容頂上來。
- 合併儲存格還是合併的。橫跨三欄的表頭寫成一個跨三欄的合併儲存格,不複製 三份,也不只塞進最左一格;直向跨好幾列的側欄標籤同理。
- 欄寬與列高來自原稿實際量到的版面尺寸,打開時的比例大致就是紙面上的比例, 而不是所有欄都是預設寬度。
- 儲存格框線會帶過來,所以一張有框的表還是一張有框的表。
然後是核對,而不是假定。活頁簿寫完之後會被驗證、重新打開、逐格讀回,把讀到的內容與當初從 PDF 裡抽出來的內容做比對,合併和框線也在比對範圍內。這一步每次轉換都跑,並且隨著任務一起留痕。 它不等於「永遠不會讀錯」,但它是「給你一個檔案」和「把要給你的檔案自己先看過一遍」之間的差別。
開頭是 0 的統一編號,落進表裡還得是 0 開頭
這是那種會悄悄毀掉一張表的錯誤,值得弄明白一次。統一編號、發票號碼、銀行帳號、料號:紙面上
印的是 012001900211,進了 Excel 變成 12001900211——前面那個零不見了,
這個號碼從此對不上任何一張你打算拿它去比對的表。
原因幾乎永遠是同一個,而且不在「讀」,在「寫」:下游某個環節看見一串數字,判斷它長得像數字, 就熱心地把它變成了數字。所以在這條流水線上,儲存格的型別是在讀 PDF 的時候決定的, 依據是紙面上真正印出來的那串字形;負責寫活頁簿的那一環永遠沒有權限去推測它:
- 開頭是 0 的一律判為文字。不管它多像數字都不例外。
- 過長的純數字串也留作文字——身分證字號、銀行帳號、十幾位的料號。Excel 裡 所有數字都用雙精度浮點存放,超過十五位左右的有效位數,尾巴會被悄悄抹平;寫成數字就等於在 Excel 內部被改壞,讀回核對也查不出來。
- 真正是數值的就寫成數值,並帶上原稿自己的呈現方式——小數位、千分位、 貨幣或百分比格式——這樣它可以直接排序、直接加總,不必先清洗一遍。
「數字還是數字」這句話的全部內容就是這些,它的邊界也在這裡:紙面上印的是什麼,儲存格裡就是什麼。
表格本身是一張圖(掃描檔)
大家真正要轉的表格,有一半根本不是文字:掃描的發票、拍下來的報價單、傳真過來的送貨單——裡面 沒有文字層可以抽,只有像素,靠讀文字層的轉檔工具什麼也讀不到。
這裡是逐頁判斷的。沒有可用文字的頁會交給 AI 視覺模型,讀完之後先還原成稿件結構:標題、段落、 表格列。輸出格式是在這條流水線的末端才選的——同一次辨識、同一次重建,按你要的產出 Word、活頁簿或者 Markdown。表格這條路上沒有另外一條比較弱的支線。
也把話說清楚:掃描檔是這一頁裡最難的一類輸入。紙張歪斜、印章壓在框線上、手寫字寫在空格裡、 影印掉墨,都會讓網格比原生 PDF 難還原得多。合計數請對著原頁核一遍再用。掃描頁走 AI 模式, 因為每一頁都要花真金白銀去讀,所以需要登入並綁定付款方式;也可以貼上你自己的 API key, 按你自己的成本繼續轉。
跨頁的表格:什麼時候接回去,什麼時候寧可不接
一張表在這一頁排到底、下一頁接著往下排,產生活頁簿之前就會被接回成一整片。它落在這張表開始的
那一頁對應的工作表上——從第 4 頁排到第 6 頁的表,最後是 P4 上的一整片區域——原稿
在續頁頂端重印的那列表頭會被拿掉,不會夾在資料中間。跨五頁也一樣,一頁一頁往下接,直到這張表
真的結束。
判定故意卡得很嚴,因為把兩張不同的表接成一張,是你從結果裡看不出來、也救不回來的損壞。欄必須 對得上——欄數一樣,欄寬佔比的差距也要在很小的範圍內——在這之上,還要麼表頭逐字重複,要麼頁面上 明寫著「續表」或 continued。形狀一樣但表頭換了內容,它就拒絕接。拒絕的時候,兩半按原樣 各自留在自己的工作表上:這是一次你看得見的複製貼上,而不是一次你看不見的拼接。
中文表格與中英混排
中文表格會在一個西文表格不會出問題的地方翻車,原因是算術:一個全形字元佔的橫向寬度大約是一個 拉丁字母的兩倍,所以如果按英文的方式去算一欄中文正文的寬度,得到的欄寬只有需要的一半, 每個儲存格打開都是截斷的。這裡的欄寬是按東亞寬度算的,中文欄打開就是看得了的。
全形標點——頓號、《》書名號、全形逗號——按它本來的字元帶過去,不會被換成半形的近似符號; 中文欄位名配拉丁料號的混排表也不需要你做任何設定。繁體與簡體同樣不必事先選語系, 一份台灣的標案在附件裡夾一張大陸廠商的報價表,也不必拆成兩次轉。
如果你手上那份其實是以正文為主、表格夾在其中,中文 PDF 轉 Word 那一頁講的是同一套引擎在 Word 這一側的表現,包括掃描中文頁和字型名怎麼處理。
三步驟轉檔
- 上傳含表格的 PDF——文字版或掃描檔都行,最多 2000 頁。
- 輸出格式已經幫你選好 Excel 試算表(.xlsx),只有想要 Word 檔時才需要改。
- 下載活頁簿,打開與你那張表所在頁碼同號的工作表。
不必安裝軟體、不會跳轉、不會往你的電子信箱裡寄東西。如果你要的是一份可以改的稿子而不是資料, 同一次上傳也可以轉成 Word——那是我們的主入口 PDF 轉可編輯 Word;版面像簡報的 PDF 會自動轉成 PowerPoint。 還在比較幾種轉法的話,PDF 轉 Word 的四種方法 那一頁把每一條路的機制和邊界都列了出來。
掃描檔裡的表格走的是同一條路,只是上傳後先過一遍視覺辨識。如果你的來源是影印稿或手機拍照, 掃描檔轉 Word 那一頁把這條路徑講全了。
免費到什麼程度,要不要留電子信箱
文字版 PDF——也就是從 Word、WPS、排版系統直接匯出的那一類,大多數報表、對帳單、匯出檔都屬於 這一類——走 Basic 模式,不必留電子信箱、產出也沒有浮水印。Basic 模式免費、無需帳號:每天 10 頁、每月 100 頁;登入後每天 100 頁、每月 1000 頁。 輸出格式刻意不當成計費維度: 要一份活頁簿和要一份 Word 檔是同樣的價錢,而對文字版 PDF 來說,這個價錢是零。
掃描頁是例外,因為每一頁都要交給 AI 視覺模型去讀,有實打實的每頁成本,所以 AI 模式需要 登入並綁定付款方式,與 Basic 共用同一份帳號額度,超出後依已購頁數計費。另有兩條仍然不必付錢給我們的路:貼上你自己的 Anthropic、OpenAI、 Gemini 或任何 OpenAI 相容端點的 API key,按你自己的成本繼續轉;或者讓這次任務退回免費的 Basic 模式,文字頁照樣出資料、掃描頁以影像嵌入。依頁數購買的頁數包列在 價格頁上,目前尚未開放;現在生效的是 Basic 模式和你自己的 key。
你上傳的檔案和我們產出的活頁簿,大約六小時後自動刪除——詳見 隱私權說明。這一條對表格比對一般稿件更要緊:大家要轉的那幾頁, 往往正是印著帳號和價格的那幾頁。
幾種常見取表方式,交回來的東西不一樣
| 做法 | 交回來的東西 | 回到 Excel 之後要補的工 |
|---|---|---|
| 直接從 PDF 閱讀器複製貼上 | 整張表擠進同一欄,或以空白切欄 | 手動分欄、重建表頭、補回合併格 |
| 只做 OCR 的常見轉換器 | 字都讀得到,但欄列邊界靠猜 | 對欄、補漏格;開頭是 0 的編號常被當數字 |
| 先轉成 Word 再貼進 Excel | 多繞一手,表格常在中途散成文字方塊 | 兩次重排,跨頁續表要自己接回去 |
| 直接讀出表格結構再寫成活頁簿(本站) | 一格對一格的 .xlsx,合併表頭保留 | 照常核對數字,欄列本身不用重建 |
上表比較的是四「類」做法,不是任何一款具名產品;我們沒有跑過任何同類產品的對照測試, 也不提供準確率數字。你手上的工具屬於哪一類,看轉出來的活頁簿能不能一格一格點開就知道。
資料來源
上文引用的廠商行為均出自各家官方說明,每個頁面均於 2026-09-16 核對。每家廠商只被引用來說明其自家軟體。
常見問題
PDF 表格轉 Excel — 常見問題
怎麼把 PDF 裡的表格抓出來?
上傳 PDF,在「輸出格式」裡選 Excel 試算表(.xlsx),然後下載活頁簿。來源檔案的每一頁對應一個工作表,所以你要的那張表就在與它所在頁碼同號的工作表裡,落下來的是真正的儲存格,不是一段文字。選起那片區域複製,直接貼進你手上已經有的表就行,不必再手工拆欄。
為什麼直接從 PDF 複製表格,貼到 Excel 就散掉了?
PDF 裡沒有「列」這個東西,只有落在座標上的字形——看起來是表格,其實只是一堆位置剛好對齊的文字。所以複製出來常常是一整列擠進一個儲存格。走轉檔這條路,拿到的活頁簿裡表格本身已經是網格:一格對一格,合併的表頭還是合併的,接下來只是一次普通的複製貼上。
合併表頭、跨欄跨列的儲存格會保留嗎?
會。原稿裡橫跨三欄的表頭,寫進活頁簿就是一個橫跨三欄的合併儲存格,不會被複製三份,也不會只塞進最左邊那一格;直向跨好幾列的側欄標籤同理。欄寬和列高取自原稿實際量到的版面尺寸,所以打開時的比例大致就是紙面上的比例,而不是所有欄一律 Excel 預設寬度。
統一編號、帳號開頭的 0 會不會不見?
不會。儲存格的型別是在讀 PDF 的時候就決定的,依據是紙面上真正印出來的那串字形:開頭是 0 的一律判為文字,太長的純數字串(身分證字號、銀行帳號、料號)也留作文字,因為 Excel 內部用雙精度浮點存數字,超過十五位左右尾巴會被悄悄抹掉。真正是數值的才寫成數值,並帶上原稿自己的呈現方式,可以直接排序、直接加總。
掃描或拍照的表格能轉嗎?
掃描頁沒有可以抽的文字,會交給 AI 視覺模型去讀,先還原成稿件結構,活頁簿再從這個結構產生。這也是這一頁裡最難的一類輸入:紙張歪斜、印章壓在框線上、手寫字寫在空格裡,都會讓網格更難還原,所以合計數請自己對著原頁核一遍再用。掃描頁走 AI 模式,需要登入並綁定付款方式,或自備 API key。
表格跨了好幾頁,能接成一張嗎?
能。產生活頁簿之前就會把續排的部分接回去:一張從第 4 頁排到第 6 頁的表,最後是第 4 頁那個工作表上的一整片區域,原稿在每一頁頂端重複的表頭會被拿掉,不會夾在資料中間。判定卡得很嚴——欄要對得上,而且表頭逐字重複或者頁面上寫著「續表」,兩者至少要佔一樣;條件不滿足時,兩半就按原樣各自留在自己的工作表上。
轉的是公司對帳單或發票,資料會不會被留下來或被看到?
不會刻意留著給誰看。整個流程不需要帳號、不需要留電子信箱,上傳、轉換、下載都在你自己的瀏覽器裡完成;轉出來的 Excel 和你原本上傳的 PDF,大約六小時後就會自動從系統裡刪除,不是你要求才刪,是設計上的預設行為。如果你轉的剛好是對帳單、發票或報價單這類本來就想盡快處理完的檔案,這一點值得先知道。