IMAGE → TEXT · OCR

圖片轉文字 — 隱私 OCR

從照片和螢幕截圖擷取文字。複製文字或下載文字檔案,全部在瀏覽器中完成。

01

新增圖片

0 個檔案

JPG · PNG · WebP · BMP

您也可以使用 Ctrl+V 或 ⌘V 貼上螢幕截圖。如果無法存取剪貼簿,請選擇圖片檔案。

最多 20 張圖片,每個檔案 20 MB,總計 100 MB,每張圖片最多 4000 萬像素。

選擇圖片中的文字語言。重新擷取會取代先前的結果。

02

辨識結果

擷取的文字會顯示在這裡。新增圖片即可開始。

適合清晰的印刷文字和螢幕截圖。手寫文字或複雜排版的辨識效果可能不佳。使用前請檢查並編輯結果。

圖片和文字始終保留在您的裝置上。辨識工具和語言檔案從 ItsyTools 載入。僅語言檔案會被快取;本工具不儲存您的圖片或文字。

從圖片中擷取並核對文字

使用保護隱私的 OCR,將螢幕截圖、照片或掃描頁面轉換為可複製或儲存的文字。辨識在您的裝置上執行。清晰的印刷文字效果最好;結果是需要複核的轉錄內容,並不保證每個字元、表格或閱讀順序都正確。

操作步驟

  1. 加入 JPG、PNG、WebP 或 BMP 圖片,或在瀏覽器允許存取剪貼簿時貼上圖片。選擇圖片中文字的語言;此設定與網站介面語言互相獨立。
  2. 開始辨識,等待引擎載入並處理圖片。保持分頁開啟。逐一選取批次中的結果,將姓名、日期、金額和標點與原圖比較。
  3. 複製或下載前,請修正辨識的文字。可以將單一結果儲存為文字,或為已完成的檔案下載合併文字。核對完轉錄內容前,請保留原始圖片。

設定與限制

辨識語言與載入
選擇與印刷文字相符的模型。首次使用時,網站會提供 OCR 引擎和語言模型讓瀏覽器下載;此下載並不是上傳您的圖片。已快取的資源並不保證每種語言都能離線使用。
輸入限制
最多加入 20 張圖片,每張不超過 20,000,000 位元組,總計不超過 100,000,000 位元組。每張圖片不得超過 40,000,000 像素,任一邊不得超過 20,000 像素。不直接接受 PDF 檔案;請先使用「PDF 轉圖片」。
準確度與縮小圖片
辨識前,大圖片會縮小至最長邊不超過 3,200 像素、像素總數約為 8,000,000。裁掉無關區域,使用擺正、清晰且高對比的文字。手寫文字、反光、分欄和表格可能導致不可靠的結果。

操作範例

下載 ocr-sample.png,並選擇英語作為辨識語言。執行 OCR,將轉錄結果與 ocr-expected.txt 比較;範例包含 3 行清晰的印刷文字。

預期結果

ITSYTOOLS SAMPLE
Invoice 204
Total 12.50

檢查結果是否包含 ITSYTOOLS SAMPLE、Invoice 204 和 Total 12.50,並確認數字一致。空白字元和換行可能不同。將文字用於其他文件前,請修正所有差異。

常見問題與疑難排解

為什麼字母或數字辨識錯誤?

OCR 根據可見像素推測字元。請嘗試更清晰的掃描圖、裁切至更靠近文字的範圍,並選擇正確語言。務必核對 O 和 0 等相似字元,尤其是在帳號和金額中。

為什麼文字順序錯誤?

分欄、表單和表格可能擾亂閱讀順序。請每次辨識一個裁切後的區域,並自行重建結構。純文字下載不會保留試算表儲存格或原始頁面配置。

為什麼辨識停止或無法開始?

模型下載、工作執行緒啟動或記憶體用量過大的圖片都可能導致失敗。請檢查初次下載引擎時的網路連線,嘗試較小的圖片或批次,然後重試。取消後,已完成的結果可能仍可用。