PDF 轉文字使用方法
- 選擇要擷取文字的 PDF 檔案,選好後會立即逐頁開始擷取。
- 如果不需要在頁與頁之間加上「----- 1 頁 -----」這類分隔線,取消勾選即可,結果會立即更新。
- 在結果欄中自行選取需要的段落複製,或按下全部複製。
- 按下存成 TXT,會儲存為可用記事本開啟的 UTF-8 文字檔。
為什麼 PDF 的文字複製不出來或格式亂掉?
在 PDF 閱讀器中拖曳選取文字再複製,常會遇到換行錯亂、雙欄排版文件左右兩欄的句子混在一起,或字與字之間多出奇怪空白等情況。這是因為 PDF 只記錄「在哪個位置畫出哪個字」,並不會另外儲存句子或段落的結構。
這個工具會讀取 PDF 中每個文字片段的座標,把同一高度的片段合併成一行,遇到行距較大的地方就視為換段並插入空行。因此得到的文字會比直接從閱讀器複製更容易閱讀。
掃描的 PDF 無法擷取文字
用掃描器或手機相機製作的 PDF,整頁其實是一張圖片。雖然肉眼看起來是文字,但檔案裡沒有文字資訊,所以擷取結果會是空白。這種情況需要能辨識圖片文字的 OCR(光學字元辨識)程式,本工具不支援 OCR。
想確認文件是否為掃描檔,可以在 PDF 閱讀器中試著拖曳選取文字。如果無法逐字選取,而是整頁被選起來,就代表這是圖片型 PDF。
擷取文字的實用技巧
檔案隱私與安全
PDF 的解析與文字擷取全部在你的瀏覽器裡完成,檔案不會上傳到任何伺服器。合約、成績單、公司內部報告等含個人資料或機密內容的文件,也可以放心使用。處理完成後關閉分頁,內容就不會留存。
常見問題
PDF 轉文字後結果是空白的?
掃描或用照片製作的 PDF 沒有文字資訊,因此無法擷取。這種情況需要使用具備 OCR 功能的程式。
擷取出來的中文變成亂碼怎麼辦?
有些 PDF 以特殊方式儲存字型資訊,檔案中記錄的文字編碼與實際文字不同。這類文件無論用哪種擷取工具,都很難取得正確的文字。
有密碼保護的 PDF 也能用嗎?
設有開啟密碼的 PDF 無法讀取。請先建立已解除密碼的副本再使用。
擷取的內容會留在伺服器上嗎?
不會。PDF 解析與文字擷取都在瀏覽器內進行,檔案與結果不會傳送到任何地方。
需要註冊或付費嗎?
不需要。本工具完全免費,不用註冊,開啟網頁即可使用,電腦和手機瀏覽器都能操作。