PDF 轉文字
上傳一個 PDF 檔案,FileTinker 會以裝置端 OCR 讀取其中的文字。選擇你的語言,再複製或下載結果——引擎在你的瀏覽器中執行,因此你的檔案絕不上傳。
OCR 引擎會在第一次使用時下載(數 MB),之後會被快取。
更多預設
前往其他預設 — 每個都有獨立頁面,並已將工具設定好:
如何將 PDF 轉成文字
- 選擇你的語言並上傳你的 PDF 檔案。
- 等待 OCR 引擎讀取文字(第一次執行會下載模型)。
- 複製辨識出的文字,或下載成 .txt 檔。
關於 PDF 轉文字(OCR)
將 PDF 轉成文字會用到 OCR——光學字元辨識——把文字的圖像轉成可編輯、可搜尋的文字。FileTinker 以 WebAssembly 在你的瀏覽器中執行 Tesseract 引擎,因此你的 PDF 會在你自己的裝置上辨識。
它在清晰、光線充足、高對比的文字上效果最佳。由於一切都在你的瀏覽器中執行,你的 PDF 保持私密——不會上傳,且引擎在第一次使用後會被快取。
這會把每一頁 PDF 算繪成影像再執行 OCR,專為像素底下沒有真實文字的掃描 PDF 打造。原生數位、文字可選取的 PDF 也能用,但 OCR 是從算繪後的頁面重新讀取,所以當文字已經可以選取時,直接複製更乾淨。至於掃描檔,這正是對的工具。
常見問題
如何將 PDF 轉成文字?
選擇你的語言、上傳你的 PDF 檔案,FileTinker 的瀏覽器內 OCR 就會讀取文字。複製它,或下載成 .txt 檔。
支援哪些語言?
英文、繁體中文與簡體中文,以及英文+中文的混合模式。請選擇與你的 PDF 相符的語言以獲得最佳準確度。
OCR 準確嗎?
在清晰、高解析度、高對比的文字上準確度最佳。藝術字型與手寫較困難。清晰的 PDF 會得到最乾淨的結果。
我的 PDF 會被上傳嗎?
不會。只會下載 OCR 引擎與語言模型;你的 PDF 完全在你的瀏覽器中處理。
多頁 PDF 是怎麼處理的?
每一頁都以兩倍比例算繪以獲得更銳利的字形,依序辨識後把文字合併成單一可編輯的輸出。長文件只是花的時間成比例地更長,一切都在本機執行,無論頁數多少都不會上傳任何內容。