圖片工具 / 28

圖片轉文字(OCR)

在瀏覽器中從照片或螢幕截圖擷取文字,支援十二種語言,且不會上傳檔案。

圖片轉文字(OCR): TOEA執行編譯為WebAssembly的完整光學字元辨識引擎,讀取圖片中的字元,並將各行重新組合成段落,讓結果讀起來像一般文章。 全程在瀏覽器中於本機執行,檔案不會上傳至伺服器。

使用次數
在瀏覽器中
費用
免費・免註冊
可用狀態
可立即使用
圖片→文字工作台本機處理

全程在瀏覽器中執行

↥
選擇圖片

PNG, JPG, WebP, or BMP·上限30 MB,絕不上傳

選擇語言

先選擇文字所使用的語言,再開始辨識。語言模型會提供字母和詞彙,讓引擎據此檢查猜測結果;因此,法文頁面選擇英文會遺漏或弄錯重音符號,而拉丁字母模型會把中文、日文、韓文、阿拉伯文或俄文文字辨識成亂碼。頁面混用多種語言時,請選擇主要語言,並預期其他語言可能出現錯誤。

檢查合併後的段落

將各行合併成段落時,行尾的連字號會被視為單字切分並移除,因此真正的複合字若剛好在此處斷行,例如well-接著known,會變成wellknown。各行會以空格連接,這也會在中文或日文的每個換行處加入不該存在的空格。對於這些語言,以及表格、清單、地址和程式碼,換行具有意義,請關閉此選項。掃描的PDF請使用PDF OCR。

使用方式

  1. 選擇圖片。
  2. 選擇文字的語言。
  3. 查看結果並複製或下載。

隱私與限制

您的檔案絕不會上傳。辨識引擎和語言模型只需下載一次,約10 MB,之後會由瀏覽器快取,接著所有處理都會在您自己的裝置上執行。代管式OCR服務的運作方式正好相反:它們需要取得您的文件。

相關工具

常見問題

為什麼第一次執行需要較久時間?

引擎和語言模型第一次使用時必須下載,約10 MB。之後瀏覽器會將它們快取,後續執行就能立即開始。

辨識準確度如何?

清晰的螢幕截圖通常幾乎完全準確。手機以傾斜角度拍攝的頁面,或較小、模糊的文字,可能會出現錯誤。結果上方的信心分數會告訴您目前看到的結果有多可靠,而且最好仍對照原始內容重新閱讀。

可以辨識手寫字嗎?

不行。這個引擎是以印刷字體訓練的;手寫字是另一種問題,辨識結果會沒有意義。

怎麼做可以改善結果?

增加像素、讓文字更平直,以及提高對比度。請裁切到只剩文字,並將頁面平放拍攝,不要從傾斜角度拍攝。

免費工具・使用在瀏覽器中次・免註冊