- Главная
- Изображения
- Распознавание текста (скорость)
Быстрое распознавание текста (OCR)
Извлекает текст из изображения самой маленькой OCR-моделью — она быстрее всех скачивается и работает.
Перетащите изображения с текстом сюда или нажмите, чтобы выбрать
Фото, сканы и скриншоты: JPG, PNG, WebP, GIF, BMP, TIFF или AVIF. Читает английский и другие языки на латинице, а также китайский. Корейский и японскую кану не читает. Файлы обрабатываются в браузере и никуда не загружаются. Они хранятся в этом браузере, пока вы их не уберёте.
Ctrl+OвыбратьCtrl+Vвставить
Модель распознавания текста
Модель «Скорость» · …
Читает английский и другие языки на латинице (французский, немецкий, испанский, польский…) и китайский. Не читает корейский, японскую кану, русский и другие языки на кириллице, арабский, тайский, хинди и вьетнамский.
Лицензии: модели (Apache-2.0) · движок (MIT)
Превратите скриншот, фото или отсканированную страницу в текст, который можно скопировать и отредактировать, — быстро. Это самый лёгкий из трёх инструментов распознавания текста: его модель весит всего 6 МБ, поэтому первый запуск быстрый даже на телефоне, а затем скриншот читается за секунду-другую. Всё работает в браузере: изображение не покидает ваше устройство, бесплатно и без регистрации.
Сравнение трёх моделей распознавания текста
| Распознавание текста (скорость)Эта страница | Распознавание текста (баланс) | Распознавание текста (точность) | |
|---|---|---|---|
| Размер модели | 6 MB | 29,7 MB | 132,3 MB |
| Первый запуск: загрузка вместе с движком при 50 Мбит/с | 19,6 MB · ≈ 3 с | 43,4 MB · ≈ 7 с | 145,9 MB · ≈ 24 с |
| Потом | Хранится в браузере — повторной загрузки нет | ||
| Скорость | Самая быстрая | Быстрая | Самая медленная |
| Точность | Хороша на чётком тексте | Точнее на фото и мелком шрифте | Лучшая на сложных изображениях |
| Читает | латиница (английский, французский, немецкий…) и китайский | латиница (английский, французский, немецкий…), китайский и японский | латиница (английский, французский, немецкий…), китайский и японский |
Движок распознавания (13,7 MB, или 27,4 MB в браузерах с WebGPU) загружается один раз и общий для всех трёх моделей. Ничего не загружается, пока вы не запустите распознавание.
Как быстро распознать текст на изображении
- Перетащите одно или несколько изображений в любое место страницы, вставьте скриншот сочетанием Ctrl+V или нажмите, чтобы выбрать файлы. Изображения, добавленные в другом инструменте для изображений, уже есть в списке, а пример чека показывает, как это работает.
- В первый раз нажмите «Скачать модель и распознать текст». Около 20 МБ — модель и движок, который её запускает, — скачиваются один раз и сохраняются в браузере; после этого добавленное изображение распознаётся сразу, выбранное — как только вы открываете страницу, а остальные, уже бывшие в списке, — когда вы нажимаете «Распознать» или «Распознать все».
- Проверьте текст рядом с картинкой. Нажмите на область изображения, чтобы найти её строку; строки, в которых модель не уверена, подчёркнуты. Исправьте что нужно, затем нажмите «Копировать текст» (Ctrl+Shift+C) или «Скачать .txt».
- При желании в разделе «Скрыть текст на изображении» выберите цвет и скачайте копию картинки, где текст закрыт прямоугольниками.
Возможности
- Самая маленькая модель: 6 МБ, вместе с движком около 20 МБ — скачивается один раз и сохраняется в браузере
- Скриншот распознаётся за секунду-другую, когда модель уже сохранена
- Читает английский и другие языки на латинице, цифры и китайский
- Текст в порядке чтения, а области на изображении обведены и пронумерованы
- Текст можно отредактировать, скопировать или скачать в .txt; строки, в которых модель не уверена, подчёркнуты
- Скрытие текста на изображении и скачивание замаскированной копии
- Несколько изображений сразу
Это конфиденциально?
Да. Распознавание полностью выполняется в браузере; изображение и текст не покидают ваше устройство, а изображения остаются в этом браузере, пока вы не уберёте их из списка. Скачиваются только модель и её движок — с этого сайта, при первом использовании.
Частые вопросы
Почему первый запуск медленнее?
Потому что в первый раз браузер скачивает модель распознавания (6 МБ) и движок, который её запускает (14 МБ или 27 МБ в браузерах, использующих видеокарту через WebGPU), а затем подготавливает их. Оба сохраняются в браузере, поэтому следующие изображения и следующий визит обходятся без скачивания. Движок общий с инструментами «Баланс» и «Точность», так что если позже попробовать их, скачается только их модель.
Какие языки распознаются?
Печатный английский и другие языки на латинице (французский, немецкий, испанский, португальский, итальянский, польский, чешский, турецкий…), цифры и символы, а также китайский. Корейский, японскую кану, русский и другие языки на кириллице, арабский, тайский, хинди и вьетнамский он читать не умеет; для японского используйте инструмент «Баланс» или «Точность».
Насколько точна самая быстрая модель?
Очень хороша на чётком печатном тексте — скриншотах, документах и вывесках. Мелкий шрифт или размытые фото точнее читают инструменты «Баланс» и «Точность», а строки, в которых модель не уверена, подчёркнуты, чтобы вы могли их проверить.
«Скорость», «Баланс» или «Точность» — что выбрать?
«Скорость» — когда текст чёткий и нужен самый маленький объём скачивания: около 20 МБ в первый раз. «Баланс» (около 43 МБ) точнее читает фото и мелкий текст, а также японский; «Точность» (около 146 МБ) лучше всех справляется с самыми сложными изображениями, но работает медленно без графического ускорения (WebGPU).
Как освободить место, которое занимает модель?
Нажмите «Удалить скачанные модели» в разделе «Модель распознавания текста»: все сохранённые модели будут удалены из этого браузера. Модель снова скачается, когда вы в следующий раз будете распознавать текст.