文字辨識 PDF

閱讀掃描的 PDF 頁面中的文字。

tesseract.js。首次使用時下載語言包。

將文件拖放到此處

或從您的裝置中選擇一個檔案。

最多 12 頁。空範圍 = 從一開始。掃描使用更多記憶體。

文字辨識 PDF能做什麼

tesseract.js。首次使用時下載語言包。

本頁只對應文字辨識 PDF(ocr pdf)。閱讀掃描的 PDF 頁面中的文字。 Tool-You 上其他PDF工具外觀很像,因此下面這段任務定義才是文字辨識 PDF獨有的內容:tesseract.js。首次使用時下載語言包。

如何使用文字辨識 PDF

  1. 留在文字辨識 PDF這一頁(/ocr-pdf)。除非你真的需要從 PDF 中提取可選擇的文字。,否則不要跳到PDF 轉文本。
  2. 加入文字辨識 PDF所接受的檔案類型。路徑提示:ocr pdf。閱讀掃描的 PDF 頁面中的文字。
  3. 只調整與文字辨識 PDF相符的選項。相鄰的影像辨識是另一件事(讀取照片中的文字。)。工具說明:tesseract.js。首次使用時下載語言包。
  4. 在本分頁執行文字辨識 PDF。仍受瀏覽器記憶體限制:本地 Tesseract OCR。語言、頁面範圍、渲染比例。最多約 12 頁
  5. 從文字辨識 PDF下載或複製結果。若任務選錯了,請改用PDF 轉文本。

什麼情況下不要用文字辨識 PDF

若相鄰工具更合適,請不要用文字辨識 PDF,先看PDF 轉文本或影像辨識;或說明已提示會失敗時也不要用。本工具原話:tesseract.js。首次使用時下載語言包。

關於文字辨識 PDF的常見問題

文字辨識 PDF和其他PDF頁面有什麼不同?
tesseract.js。首次使用時下載語言包。 簡短說:閱讀掃描的 PDF 頁面中的文字。
文字辨識 PDF會把檔案或文字上傳到 Tool-You 伺服器嗎?
不會。文字辨識 PDF在目前分頁執行,檔案留在本機。限制說明:本地 Tesseract OCR。語言、頁面範圍、渲染比例。最多約 12 頁
我是否該用PDF 轉文本而不是文字辨識 PDF?
需要「閱讀掃描的 PDF 頁面中的文字。」時用文字辨識 PDF;需要「從 PDF 中提取可選擇的文字。」時用PDF 轉文本。同屬PDF,但不是同一項工作。
文字辨識 PDF有哪些限制?
本地 Tesseract OCR。語言、頁面範圍、渲染比例。最多約 12 頁 另外:tesseract.js。首次使用時下載語言包。