文字辨識 PDF
閱讀掃描的 PDF 頁面中的文字。
tesseract.js。首次使用時下載語言包。
將文件拖放到此處
或從您的裝置中選擇一個檔案。
最多 12 頁。空範圍 = 從一開始。掃描使用更多記憶體。
文字辨識 PDF能做什麼
tesseract.js。首次使用時下載語言包。
本頁只對應文字辨識 PDF(ocr pdf)。閱讀掃描的 PDF 頁面中的文字。 Tool-You 上其他PDF工具外觀很像,因此下面這段任務定義才是文字辨識 PDF獨有的內容:tesseract.js。首次使用時下載語言包。
如何使用文字辨識 PDF
- 留在文字辨識 PDF這一頁(/ocr-pdf)。除非你真的需要從 PDF 中提取可選擇的文字。,否則不要跳到PDF 轉文本。
- 加入文字辨識 PDF所接受的檔案類型。路徑提示:ocr pdf。閱讀掃描的 PDF 頁面中的文字。
- 只調整與文字辨識 PDF相符的選項。相鄰的影像辨識是另一件事(讀取照片中的文字。)。工具說明:tesseract.js。首次使用時下載語言包。
- 在本分頁執行文字辨識 PDF。仍受瀏覽器記憶體限制:本地 Tesseract OCR。語言、頁面範圍、渲染比例。最多約 12 頁
- 從文字辨識 PDF下載或複製結果。若任務選錯了,請改用PDF 轉文本。
什麼情況下不要用文字辨識 PDF
若相鄰工具更合適,請不要用文字辨識 PDF,先看PDF 轉文本或影像辨識;或說明已提示會失敗時也不要用。本工具原話:tesseract.js。首次使用時下載語言包。
關於文字辨識 PDF的常見問題
- 文字辨識 PDF和其他PDF頁面有什麼不同?
- tesseract.js。首次使用時下載語言包。 簡短說:閱讀掃描的 PDF 頁面中的文字。
- 文字辨識 PDF會把檔案或文字上傳到 Tool-You 伺服器嗎?
- 不會。文字辨識 PDF在目前分頁執行,檔案留在本機。限制說明:本地 Tesseract OCR。語言、頁面範圍、渲染比例。最多約 12 頁
- 我是否該用PDF 轉文本而不是文字辨識 PDF?
- 需要「閱讀掃描的 PDF 頁面中的文字。」時用文字辨識 PDF;需要「從 PDF 中提取可選擇的文字。」時用PDF 轉文本。同屬PDF,但不是同一項工作。
- 文字辨識 PDF有哪些限制?
- 本地 Tesseract OCR。語言、頁面範圍、渲染比例。最多約 12 頁 另外:tesseract.js。首次使用時下載語言包。