高精度图片转文字(OCR)
使用最大的 OCR 模型提取图片中的文字,准确度最高,首次下载体积较大。
拖放带文字的图片到此处或点击选择
照片、扫描件和截图:JPG、PNG、WebP、GIF、BMP、TIFF 或 AVIF。 可识别英文及其他拉丁字母语言、中文和日文。无法识别韩文。 文件仅在浏览器中处理,不会上传。 图片会保存在此浏览器中,直到被移除。
Ctrl+O选择Ctrl+V粘贴
文字识别模型
高精度模型 · …
可识别英文及其他拉丁字母语言(法语、德语、西班牙语、波兰语……)、中文(简体和繁体)和日文。无法识别韩文、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文。
许可证: 模型(Apache-2.0) · 引擎(MIT)
当准确度最重要时——小字、拍摄的页面、收据、低对比度或背景杂乱的图片——本工具使用三款识别模型中最大的一款。132 MB 的模型只需下载一次,之后保存在浏览器中。有图形加速(WebGPU,大多数新版桌面浏览器都支持)时,一页密集的文字几秒钟就能识别完;仅用处理器时,一页短文约需半分钟。图片不会离开你的设备;免费,无需注册。
三种图片转文字模型对比
| 图片转文字(极速) | 图片转文字(均衡) | 图片转文字(高精度)本页 | |
|---|---|---|---|
| 模型大小 | 6 MB | 29.7 MB | 132.3 MB |
| 首次使用:连同引擎的下载时间(50 Mbit/s) | 19.6 MB · ≈ 3秒 | 43.4 MB · ≈ 7秒 | 145.9 MB · ≈ 24秒 |
| 之后 | 保存在浏览器中,无需再次下载 | ||
| 速度 | 最快 | 快 | 最慢 |
| 准确度 | 适合清晰的文字 | 照片和小字更准确 | 难识别的图片最准确 |
| 可识别文字 | 拉丁字母(英语、法语、德语等)和中文 | 拉丁字母(英语、法语、德语等)、中文和日语 | 拉丁字母(英语、法语、德语等)、中文和日语 |
识别引擎(13.7 MB,支持 WebGPU 的浏览器为 27.4 MB)只需下载一次,三种模型共用。在工具中开始识别之前不会下载任何内容。
如何高精度提取图片中的文字
- 把图片拖到页面任意位置,用 Ctrl+V 粘贴,或点击选择文件。已在其他图片工具中添加的图片——比如为了对比在“均衡”页面添加的——已经在列表中了。
- 首次使用时,点“下载模型并识别文字”。下载(连同引擎约 146 MB)只需进行一次——进度面板会显示大小、百分比和剩余时间——之后保存在浏览器中,所以下次打开页面时会立即识别所选的图片,列表中的其他图片则用“识别”或“全部识别”来识别。
- 对照图片检查旁边的文字:点击区域可找到对应的行,双击可编辑该行。加下划线的行值得再看一眼。然后点“复制文字”(Ctrl+Shift+C)或“下载 .txt”。
- 如果想分享图片但不带其中的文字,可在“遮盖图片中的文字”下下载遮盖后的副本——选择颜色和要遮盖的区域即可。
功能
- 最大的模型:132 MB,加上引擎约 146 MB,只需下载一次,之后保存在浏览器中
- 识别小字、模糊、旋转或低对比度的文字最准确
- 使用 WebGPU 时,一页密集的文字只需几秒;仅用处理器时,一页短文约需半分钟
- 可识别英文及其他拉丁字母语言、中文(简体和繁体)和日文
- 文字按阅读顺序排列,图片上的各个区域会被框出并编号
- 可编辑、复制文字或下载为 .txt,还可下载文字被遮盖的图片副本
- 每个下载的文件在使用前都会经过校验;下载中断时,已完整下载的文件会被保留
隐私安全吗?
是的。模型在浏览器中运行;图片和识别出的文字都不会上传,图片会一直保留在这个浏览器中,直到从列表中移除。因此它适合处理收据、证件、合同以及其他不愿发送给在线服务的文件。
常见问题
它和另外两款工具有什么不同?
它使用最大的识别模型,所以识别小字、模糊、旋转或低对比度的文字更准确。代价是一次性下载更大(132 MB 模型,另外两款分别为 6 MB 和 30 MB),并且在浏览器没有图形加速时识别更慢:一页短文约半分钟,一页密集的文字要几分钟,在手机上更久。清晰的截图用“极速”或“均衡”就够了。
每次都要重新下载吗?
不用。模型及其引擎(14 MB,使用 WebGPU 时为 27 MB,与另外两款工具共用)只需下载一次并保存在浏览器中,每个文件在使用前都会经过校验。下次打开工具时无需下载。点“删除已下载的模型”即可随时释放空间。
能识别哪些语言?
印刷体英文及其他拉丁字母语言(法语、德语、西班牙语、葡萄牙语、意大利语、波兰语、捷克语、土耳其语……)、数字和符号、中文(简体和繁体)以及日文(汉字、平假名和片假名)。它无法识别韩文、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文。
能识别上下颠倒或斜着拍的页面吗?
能。上下颠倒的页面会被检测出来并按正确方向识别;略微倾斜的照片中的文字行会先被校正,再按阅读顺序排列,因此不会错乱。竖排的中文和日文会按从右到左的列来识别。
下载中断了怎么办?
再试一次即可:进度面板会说明出了什么问题,并提供“重试”按钮。已完整下载并通过校验的文件会被保留,所以重试时只下载剩下的部分;下载了一半的文件永远不会被使用。