极速图片转文字(OCR)
使用最小的 OCR 模型提取图片中的文字,下载和识别速度最快。
拖放带文字的图片到此处或点击选择
照片、扫描件和截图:JPG、PNG、WebP、GIF、BMP、TIFF 或 AVIF。 可识别英文及其他拉丁字母语言,以及中文。无法识别韩文和日文假名。 文件仅在浏览器中处理,不会上传。 图片会保存在此浏览器中,直到被移除。
Ctrl+O选择Ctrl+V粘贴
文字识别模型
极速模型 · …
可识别英文及其他拉丁字母语言(法语、德语、西班牙语、波兰语……)和中文。无法识别韩文、日文假名、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文。
许可证: 模型(Apache-2.0) · 引擎(MIT)
把截图、照片或扫描页快速转换成可复制、可编辑的文字。这是三款图片转文字工具中最轻量的一款:识别模型只有 6 MB,即使在手机上首次启动也很快,之后识别一张截图只需一两秒。一切都在浏览器中运行:图片不会离开你的设备;免费,无需注册。
三种图片转文字模型对比
| 图片转文字(极速)本页 | 图片转文字(均衡) | 图片转文字(高精度) | |
|---|---|---|---|
| 模型大小 | 6 MB | 29.7 MB | 132.3 MB |
| 首次使用:连同引擎的下载时间(50 Mbit/s) | 19.6 MB · ≈ 3秒 | 43.4 MB · ≈ 7秒 | 145.9 MB · ≈ 24秒 |
| 之后 | 保存在浏览器中,无需再次下载 | ||
| 速度 | 最快 | 快 | 最慢 |
| 准确度 | 适合清晰的文字 | 照片和小字更准确 | 难识别的图片最准确 |
| 可识别文字 | 拉丁字母(英语、法语、德语等)和中文 | 拉丁字母(英语、法语、德语等)、中文和日语 | 拉丁字母(英语、法语、德语等)、中文和日语 |
识别引擎(13.7 MB,支持 WebGPU 的浏览器为 27.4 MB)只需下载一次,三种模型共用。在工具中开始识别之前不会下载任何内容。
如何快速把图片转成文字
- 把一张或多张图片拖到页面任意位置,用 Ctrl+V 粘贴截图,或点击选择文件。在其他图片工具中添加的图片已经在列表中,示例收据可以演示使用效果。
- 首次使用时,点“下载模型并识别文字”。约 20 MB 的模型及其运行引擎只需下载一次,并保存在浏览器中;此后新添加的图片会立即识别,所选的图片在打开页面时就会识别,列表中原有的其他图片则在点“识别”或“全部识别”时识别。
- 对照图片检查旁边的文字。点击图片中的某个区域可找到对应的行;模型不确定的行会加下划线。直接输入即可修改,然后点“复制文字”(Ctrl+Shift+C)或“下载 .txt”。
- 可选:在“遮盖图片中的文字”下选择颜色,下载一份文字被色块遮住的图片副本。
功能
- 最小的模型:6 MB,加上引擎约 20 MB,只需下载一次,之后保存在浏览器中
- 模型保存后,一两秒即可识别一张截图
- 可识别英文及其他拉丁字母语言、数字和中文
- 文字按阅读顺序排列,图片上的各个区域会被框出并编号
- 可编辑、复制文字或下载为 .txt;模型不确定的行会加下划线
- 遮盖图片中的文字,并下载遮盖后的副本
- 可同时处理多张图片
隐私安全吗?
是的。识别完全在浏览器中进行;图片和文字都不会离开设备,图片会一直保留在这个浏览器中,直到从列表中移除。唯一的下载是首次使用时从本站获取的模型及其引擎。
常见问题
为什么第一次运行比较慢?
因为第一次使用时,浏览器要下载识别模型(6 MB)和运行它的引擎(14 MB;在通过 WebGPU 使用显卡的浏览器中为 27 MB),然后进行准备。两者都会保存在浏览器中,所以之后的图片和下次访问都无需再下载。引擎与“均衡”和“高精度”工具共用,之后再试用它们时只需下载各自的模型。
能识别哪些语言?
印刷体英文及其他使用拉丁字母书写的语言(法语、德语、西班牙语、葡萄牙语、意大利语、波兰语、捷克语、土耳其语……)、数字和符号,以及中文。它无法识别韩文、日文假名、俄文或其他西里尔字母文字、阿拉伯文、泰文、印地文或越南文;日文请使用“均衡”或“高精度”工具。
最快的模型准确度如何?
对于截图、文档和标牌等清晰的印刷文字,效果非常好。遇到小字或模糊的照片时,“均衡”和“高精度”工具识别得更准确;模型不确定的行会加下划线,方便你检查。
极速、均衡、高精度,应该用哪个?
文字清晰、希望下载量最小时用“极速”:首次约 20 MB。“均衡”(约 43 MB)识别照片和小字更准确,还能识别日文;“高精度”(约 146 MB)识别最难的图片效果最好,但没有图形加速(WebGPU)时速度较慢。
如何释放模型占用的空间?
在“文字识别模型”下点“删除已下载的模型”:所有已保存的模型都会从这个浏览器中删除。下次识别文字时会重新下载。