Toolonit
  1. 首页
  2. 图片
  3. 图片转文字(极速)

极速图片转文字(OCR)

使用最小的 OCR 模型提取图片中的文字,下载和识别速度最快。

拖放带文字的图片到此处或点击选择

照片、扫描件和截图:JPG、PNG、WebP、GIF、BMP、TIFF 或 AVIF。 可识别英文及其他拉丁字母语言,以及中文。无法识别韩文和日文假名。 文件仅在浏览器中处理,不会上传。 图片会保存在此浏览器中,直到被移除。

Ctrl+O选择Ctrl+V粘贴

文字识别模型

极速模型 · …

可识别英文及其他拉丁字母语言(法语、德语、西班牙语、波兰语……)和中文。无法识别韩文、日文假名、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文。

 

许可证: 模型(Apache-2.0) · 引擎(MIT)

把截图、照片或扫描页快速转换成可复制、可编辑的文字。这是三款图片转文字工具中最轻量的一款:识别模型只有 6 MB,即使在手机上首次启动也很快,之后识别一张截图只需一两秒。一切都在浏览器中运行:图片不会离开你的设备;免费,无需注册。

三种图片转文字模型对比

图片转文字(极速)本页图片转文字(均衡)图片转文字(高精度)
模型大小6 MB29.7 MB132.3 MB
首次使用:连同引擎的下载时间(50 Mbit/s)19.6 MB · ≈ 3秒43.4 MB · ≈ 7秒145.9 MB · ≈ 24秒
之后保存在浏览器中,无需再次下载
速度最快快最慢
准确度适合清晰的文字照片和小字更准确难识别的图片最准确
可识别文字拉丁字母(英语、法语、德语等)和中文拉丁字母(英语、法语、德语等)、中文和日语拉丁字母(英语、法语、德语等)、中文和日语

识别引擎(13.7 MB,支持 WebGPU 的浏览器为 27.4 MB)只需下载一次,三种模型共用。在工具中开始识别之前不会下载任何内容。

如何快速把图片转成文字

  1. 把一张或多张图片拖到页面任意位置,用 Ctrl+V 粘贴截图,或点击选择文件。在其他图片工具中添加的图片已经在列表中,示例收据可以演示使用效果。
  2. 首次使用时,点“下载模型并识别文字”。约 20 MB 的模型及其运行引擎只需下载一次,并保存在浏览器中;此后新添加的图片会立即识别,所选的图片在打开页面时就会识别,列表中原有的其他图片则在点“识别”或“全部识别”时识别。
  3. 对照图片检查旁边的文字。点击图片中的某个区域可找到对应的行;模型不确定的行会加下划线。直接输入即可修改,然后点“复制文字”(Ctrl+Shift+C)或“下载 .txt”。
  4. 可选:在“遮盖图片中的文字”下选择颜色,下载一份文字被色块遮住的图片副本。

功能

  • 最小的模型:6 MB,加上引擎约 20 MB,只需下载一次,之后保存在浏览器中
  • 模型保存后,一两秒即可识别一张截图
  • 可识别英文及其他拉丁字母语言、数字和中文
  • 文字按阅读顺序排列,图片上的各个区域会被框出并编号
  • 可编辑、复制文字或下载为 .txt;模型不确定的行会加下划线
  • 遮盖图片中的文字,并下载遮盖后的副本
  • 可同时处理多张图片

隐私安全吗?

是的。识别完全在浏览器中进行;图片和文字都不会离开设备,图片会一直保留在这个浏览器中,直到从列表中移除。唯一的下载是首次使用时从本站获取的模型及其引擎。

常见问题

为什么第一次运行比较慢?

因为第一次使用时,浏览器要下载识别模型(6 MB)和运行它的引擎(14 MB;在通过 WebGPU 使用显卡的浏览器中为 27 MB),然后进行准备。两者都会保存在浏览器中,所以之后的图片和下次访问都无需再下载。引擎与“均衡”和“高精度”工具共用,之后再试用它们时只需下载各自的模型。

能识别哪些语言?

印刷体英文及其他使用拉丁字母书写的语言(法语、德语、西班牙语、葡萄牙语、意大利语、波兰语、捷克语、土耳其语……)、数字和符号,以及中文。它无法识别韩文、日文假名、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文;日文请使用“均衡”或“高精度”工具。

最快的模型准确度如何?

对于截图、文档和标牌等清晰的印刷文字,效果非常好。遇到小字或模糊的照片时,“均衡”和“高精度”工具识别得更准确;模型不确定的行会加下划线,方便你检查。

极速、均衡、高精度,应该用哪个?

文字清晰、希望下载量最小时用“极速”:首次约 20 MB。“均衡”(约 43 MB)识别照片和小字更准确,还能识别日文;“高精度”(约 146 MB)识别最难的图片效果最好,但没有图形加速(WebGPU)时速度较慢。

如何释放模型占用的空间?

在“文字识别模型”下点“删除已下载的模型”:所有已保存的模型都会从这个浏览器中删除。下次识别文字时会重新下载。

相关工具