Toolonit
  1. 首頁
  2. 圖片
  3. 圖片轉文字(精準)

高精準度圖片轉文字(OCR)

以最大的 OCR 模型擷取圖片中的文字,準確度最高,但首次下載的檔案較大。

將含有文字的圖片拖放到這裡或點擊選擇

照片、掃描檔與螢幕截圖:JPG、PNG、WebP、GIF、BMP、TIFF 或 AVIF。 可辨識英文等拉丁字母語言、中文與日文。無法辨識韓文。 檔案只在瀏覽器中處理,不會上傳。 圖片會保留在這個瀏覽器中,直到移除為止。

Ctrl+O選擇Ctrl+V貼上

文字辨識模型

精準模型 · …

可辨識英文與其他拉丁字母語言(法文、德文、西班牙文、波蘭文…)、中文(簡體與繁體)以及日文。無法辨識韓文、俄文等西里爾字母語言、阿拉伯文、泰文、印地文或越南文。

 

授權: 模型(Apache-2.0) · 引擎(MIT)

當準確度最重要時——小字、翻拍的頁面、收據、低對比或雜亂的圖片——這個工具會使用三種辨識模型中最大的一個。132 MB 的模型只需下載一次,並保存在瀏覽器中。有圖形加速(WebGPU,大多數現行桌面瀏覽器都支援)時,一頁密集的文字幾秒就能讀完;只靠處理器時,一小頁約需半分鐘。圖片不會離開你的裝置,而且免費、免註冊。

三種圖片轉文字模型比較

圖片轉文字(最快)圖片轉文字(平衡)圖片轉文字(精準)本頁
模型大小6 MB29.7 MB132.3 MB
首次使用:連同引擎的下載時間(50 Mbit/s)19.6 MB · ≈ 3 秒43.4 MB · ≈ 7 秒145.9 MB · ≈ 24 秒
之後儲存在瀏覽器中,不需再次下載
速度最快快最慢
準確度適合清晰的文字照片與小字更準確難辨識的圖片最準確
可辨識文字拉丁字母(英文、法文、德文等)和中文拉丁字母(英文、法文、德文等)、中文和日文拉丁字母(英文、法文、德文等)、中文和日文

辨識引擎(13.7 MB,支援 WebGPU 的瀏覽器為 27.4 MB)只需下載一次,三種模型共用。在工具中開始辨識之前不會下載任何內容。

如何以高精準度擷取文字

  1. 將圖片拖放到頁面任何位置、用 Ctrl+V 貼上,或點擊選擇檔案。已在其他圖片工具加入的圖片——例如為了比較而在「平衡」頁面加入的——已經在清單中了。
  2. 第一次使用時,點擊「下載模型並辨識文字」。下載(連同引擎約 146 MB)只會進行一次——進度面板會顯示大小、百分比與剩餘時間——之後就會儲存在瀏覽器中,所以下次開啟頁面時會立即辨識所選的圖片,清單中的其他圖片則用「辨識」或「全部辨識」來辨識。
  3. 對照圖片旁的文字:點擊區塊可找到對應的行,按兩下即可編輯那一行。加上底線的行值得再看一眼。接著點擊「複製文字」(Ctrl+Shift+C)或「下載 .txt」。
  4. 若要分享不含文字的圖片,請在「隱藏圖片中的文字」中選擇顏色與要遮蔽的區塊,再下載遮蔽後的副本。

功能

  • 最大的模型:132 MB,連同引擎約 146 MB,只下載一次,之後儲存在瀏覽器中
  • 小字、模糊、旋轉或低對比的文字,也能辨識得最準確
  • 使用 WebGPU 時,一頁密集文字只需幾秒;只靠處理器時,一小頁約半分鐘
  • 可辨識英文與其他拉丁字母語言、中文(簡體與繁體)以及日文
  • 依閱讀順序輸出文字,並在圖片上框出各區塊、加上編號
  • 可編輯、複製文字或下載為 .txt,也能下載隱藏文字後的圖片副本
  • 每個下載的檔案在使用前都會先驗證;下載中斷時,已完整下載的檔案會保留

隱私安全嗎?

是的。模型在瀏覽器中執行,圖片與辨識出的文字都不會上傳,圖片會一直保留在這個瀏覽器中,直到從清單中移除。因此很適合處理收據、身分證件、合約,以及其他你不想傳給線上服務的文件。

常見問題

這個工具和另外兩個有什麼不同?

它能更正確地辨識小字、模糊、旋轉或低對比的文字,因為使用的是最大的辨識模型。代價是一次性的下載量較大(132 MB 的模型,另外兩個分別為 6 MB 與 30 MB),而且在沒有圖形加速的瀏覽器中辨識較慢:一小頁約半分鐘,密集的頁面要好幾分鐘,手機上更久。清晰的截圖用「最快」或「平衡」就夠了。

每次都要重新下載嗎?

不用。模型與其引擎(14 MB;使用 WebGPU 時為 27 MB,與另外兩個工具共用)只下載一次,並儲存在瀏覽器中,每個檔案在使用前都會先驗證。下次啟動工具時不需要再下載。隨時可以用「刪除已下載的模型」釋放空間。

可以辨識哪些語言?

印刷體的英文與其他拉丁字母語言(法文、德文、西班牙文、葡萄牙文、義大利文、波蘭文、捷克文、土耳其文等)、數字與符號、中文(簡體與繁體)以及日文(漢字、平假名與片假名)。無法辨識韓文、俄文等西里爾字母語言、阿拉伯文、泰文、印地文或越南文。

可以辨識上下顛倒或斜拍的頁面嗎?

可以。上下顛倒的頁面會被偵測出來並以正確方向辨識;稍微傾斜的照片會先把各行拉直,再依閱讀順序排列,行與行就不會混在一起。直式的中文與日文會以由右至左的直行辨識。

下載中斷了怎麼辦?

再試一次就好:進度面板會說明發生了什麼問題,並提供「重試」按鈕。已完整下載且通過驗證的檔案會保留,所以重試時只會下載剩下的部分;下載到一半的檔案絕不會被使用。

相關工具