Toolonit
  1. 首页
  2. 图片
  3. 图片转文字(高精度)

高精度图片转文字(OCR)

使用最大的 OCR 模型提取图片中的文字,准确度最高,首次下载体积较大。

拖放带文字的图片到此处或点击选择

照片、扫描件和截图:JPG、PNG、WebP、GIF、BMP、TIFF 或 AVIF。 可识别英文及其他拉丁字母语言、中文和日文。无法识别韩文。 文件仅在浏览器中处理,不会上传。 图片会保存在此浏览器中,直到被移除。

Ctrl+O选择Ctrl+V粘贴

文字识别模型

高精度模型 · …

可识别英文及其他拉丁字母语言(法语、德语、西班牙语、波兰语……)、中文(简体和繁体)和日文。无法识别韩文、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文。

 

许可证: 模型(Apache-2.0) · 引擎(MIT)

当准确度最重要时——小字、拍摄的页面、收据、低对比度或背景杂乱的图片——本工具使用三款识别模型中最大的一款。132 MB 的模型只需下载一次,之后保存在浏览器中。有图形加速(WebGPU,大多数新版桌面浏览器都支持)时,一页密集的文字几秒钟就能识别完;仅用处理器时,一页短文约需半分钟。图片不会离开你的设备;免费,无需注册。

三种图片转文字模型对比

图片转文字(极速)图片转文字(均衡)图片转文字(高精度)本页
模型大小6 MB29.7 MB132.3 MB
首次使用:连同引擎的下载时间(50 Mbit/s)19.6 MB · ≈ 3秒43.4 MB · ≈ 7秒145.9 MB · ≈ 24秒
之后保存在浏览器中,无需再次下载
速度最快快最慢
准确度适合清晰的文字照片和小字更准确难识别的图片最准确
可识别文字拉丁字母(英语、法语、德语等)和中文拉丁字母(英语、法语、德语等)、中文和日语拉丁字母(英语、法语、德语等)、中文和日语

识别引擎(13.7 MB,支持 WebGPU 的浏览器为 27.4 MB)只需下载一次,三种模型共用。在工具中开始识别之前不会下载任何内容。

如何高精度提取图片中的文字

  1. 把图片拖到页面任意位置,用 Ctrl+V 粘贴,或点击选择文件。已在其他图片工具中添加的图片——比如为了对比在“均衡”页面添加的——已经在列表中了。
  2. 首次使用时,点“下载模型并识别文字”。下载(连同引擎约 146 MB)只需进行一次——进度面板会显示大小、百分比和剩余时间——之后保存在浏览器中,所以下次打开页面时会立即识别所选的图片,列表中的其他图片则用“识别”或“全部识别”来识别。
  3. 对照图片检查旁边的文字:点击区域可找到对应的行,双击可编辑该行。加下划线的行值得再看一眼。然后点“复制文字”(Ctrl+Shift+C)或“下载 .txt”。
  4. 如果想分享图片但不带其中的文字,可在“遮盖图片中的文字”下下载遮盖后的副本——选择颜色和要遮盖的区域即可。

功能

  • 最大的模型:132 MB,加上引擎约 146 MB,只需下载一次,之后保存在浏览器中
  • 识别小字、模糊、旋转或低对比度的文字最准确
  • 使用 WebGPU 时,一页密集的文字只需几秒;仅用处理器时,一页短文约需半分钟
  • 可识别英文及其他拉丁字母语言、中文(简体和繁体)和日文
  • 文字按阅读顺序排列,图片上的各个区域会被框出并编号
  • 可编辑、复制文字或下载为 .txt,还可下载文字被遮盖的图片副本
  • 每个下载的文件在使用前都会经过校验;下载中断时,已完整下载的文件会被保留

隐私安全吗?

是的。模型在浏览器中运行;图片和识别出的文字都不会上传,图片会一直保留在这个浏览器中,直到从列表中移除。因此它适合处理收据、证件、合同以及其他不愿发送给在线服务的文件。

常见问题

它和另外两款工具有什么不同?

它使用最大的识别模型,所以识别小字、模糊、旋转或低对比度的文字更准确。代价是一次性下载更大(132 MB 模型,另外两款分别为 6 MB 和 30 MB),并且在浏览器没有图形加速时识别更慢:一页短文约半分钟,一页密集的文字要几分钟,在手机上更久。清晰的截图用“极速”或“均衡”就够了。

每次都要重新下载吗?

不用。模型及其引擎(14 MB,使用 WebGPU 时为 27 MB,与另外两款工具共用)只需下载一次并保存在浏览器中,每个文件在使用前都会经过校验。下次打开工具时无需下载。点“删除已下载的模型”即可随时释放空间。

能识别哪些语言?

印刷体英文及其他拉丁字母语言(法语、德语、西班牙语、葡萄牙语、意大利语、波兰语、捷克语、土耳其语……)、数字和符号、中文(简体和繁体)以及日文(汉字、平假名和片假名)。它无法识别韩文、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文。

能识别上下颠倒或斜着拍的页面吗?

能。上下颠倒的页面会被检测出来并按正确方向识别;略微倾斜的照片中的文字行会先被校正,再按阅读顺序排列,因此不会错乱。竖排的中文和日文会按从右到左的列来识别。

下载中断了怎么办?

再试一次即可:进度面板会说明出了什么问题,并提供“重试”按钮。已完整下载并通过校验的文件会被保留,所以重试时只下载剩下的部分;下载了一半的文件永远不会被使用。

相关工具