快速圖片轉文字(OCR)
以最小的 OCR 模型擷取圖片中的文字,下載與執行速度最快。
將含有文字的圖片拖放到這裡或點擊選擇
照片、掃描檔與螢幕截圖:JPG、PNG、WebP、GIF、BMP、TIFF 或 AVIF。 可辨識英文等拉丁字母語言與中文。無法辨識韓文或日文假名。 檔案只在瀏覽器中處理,不會上傳。 圖片會保留在這個瀏覽器中,直到移除為止。
Ctrl+O選擇Ctrl+V貼上
文字辨識模型
最快模型 · …
可辨識英文與其他拉丁字母語言(法文、德文、西班牙文、波蘭文…)以及中文。無法辨識韓文、日文假名、俄文等西里爾字母語言、阿拉伯文、泰文、印地文或越南文。
授權: 模型(Apache-2.0) · 引擎(MIT)
把截圖、照片或掃描頁面快速轉成可以複製、編輯的文字。這是三種圖片轉文字工具中最輕量的一種:辨識模型只有 6 MB,即使在手機上,第一次啟動也很快,之後一張截圖只要一兩秒就能讀完。全部在瀏覽器中執行:圖片不會離開你的裝置,而且免費、免註冊。
三種圖片轉文字模型比較
| 圖片轉文字(最快)本頁 | 圖片轉文字(平衡) | 圖片轉文字(精準) | |
|---|---|---|---|
| 模型大小 | 6 MB | 29.7 MB | 132.3 MB |
| 首次使用:連同引擎的下載時間(50 Mbit/s) | 19.6 MB · ≈ 3 秒 | 43.4 MB · ≈ 7 秒 | 145.9 MB · ≈ 24 秒 |
| 之後 | 儲存在瀏覽器中,不需再次下載 | ||
| 速度 | 最快 | 快 | 最慢 |
| 準確度 | 適合清晰的文字 | 照片與小字更準確 | 難辨識的圖片最準確 |
| 可辨識文字 | 拉丁字母(英文、法文、德文等)和中文 | 拉丁字母(英文、法文、德文等)、中文和日文 | 拉丁字母(英文、法文、德文等)、中文和日文 |
辨識引擎(13.7 MB,支援 WebGPU 的瀏覽器為 27.4 MB)只需下載一次,三種模型共用。在工具中開始辨識之前不會下載任何內容。
如何快速將圖片轉成文字
- 將一張或多張圖片拖放到頁面任何位置、用 Ctrl+V 貼上截圖,或點擊選擇檔案。在其他圖片工具加入的圖片已經在清單中,範例收據也可以示範運作方式。
- 第一次使用時,點擊「下載模型並辨識文字」。約 20 MB 的模型與執行它的引擎只會下載一次,並儲存在瀏覽器中;之後新加入的圖片會立即辨識,所選的圖片在開啟頁面時就會辨識,清單中原有的其他圖片則在點擊「辨識」或「全部辨識」時辨識。
- 對照圖片旁的文字。點擊圖片中的區塊即可找到對應的那一行;模型沒把握的行會加上底線。直接輸入即可修正,然後點擊「複製文字」(Ctrl+Shift+C)或「下載 .txt」。
- 選用:在「隱藏圖片中的文字」中選擇顏色,下載一份文字被色塊遮住的圖片副本。
功能
- 最小的模型:6 MB,連同引擎約 20 MB,只下載一次,之後儲存在瀏覽器中
- 模型儲存後,一張截圖一兩秒就能讀完
- 可辨識英文與其他拉丁字母語言、數字與中文
- 依閱讀順序輸出文字,並在圖片上框出各區塊、加上編號
- 可編輯、複製文字或下載為 .txt;模型沒把握的行會加上底線
- 隱藏圖片中的文字,並下載遮蔽後的副本
- 可一次處理多張圖片
隱私安全嗎?
是的。辨識完全在瀏覽器中執行,圖片與文字都不會離開你的裝置,圖片會一直保留在這個瀏覽器中,直到從清單中移除。唯一的下載,是第一次使用時從本網站取得的模型與引擎。
常見問題
為什麼第一次執行比較慢?
因為第一次使用時,瀏覽器要下載辨識模型(6 MB)與執行它的引擎(14 MB;透過 WebGPU 使用顯示卡的瀏覽器則為 27 MB),並完成準備。兩者都會儲存在瀏覽器中,所以之後的圖片與下次造訪都不需要再下載。引擎與「平衡」和「精準」工具共用,之後改用這兩種工具時,只需下載它們的模型。
可以辨識哪些語言?
印刷體的英文與其他使用拉丁字母的語言(法文、德文、西班牙文、葡萄牙文、義大利文、波蘭文、捷克文、土耳其文等)、數字與符號,以及中文。無法辨識韓文、日文假名、俄文等西里爾字母語言、阿拉伯文、泰文、印地文或越南文;日文請使用「平衡」或「精準」工具。
最快的模型準確度如何?
對截圖、文件、招牌等清晰的印刷文字非常準確。小字或模糊的照片,用「平衡」與「精準」工具會辨識得更正確;模型沒把握的行會加上底線,方便你檢查。
最快、平衡、精準,該用哪一個?
文字清晰、希望下載量最小時用「最快」:第一次約 20 MB。「平衡」(約 43 MB)辨識照片與小字更準確,也能辨識日文;「精準」(約 146 MB)對最困難的圖片辨識效果最好,但沒有圖形加速(WebGPU)時速度較慢。
如何釋放模型佔用的空間?
在「文字辨識模型」下點擊「刪除已下載的模型」:所有已儲存的模型都會從這個瀏覽器中移除。下次辨識文字時會重新下載。