Toolonit
  1. Главная
  2. Изображения
  3. Распознавание текста (скорость)

Быстрое распознавание текста (OCR)

Извлекает текст из изображения самой маленькой OCR-моделью — она быстрее всех скачивается и работает.

Перетащите изображения с текстом сюда или нажмите, чтобы выбрать

Фото, сканы и скриншоты: JPG, PNG, WebP, GIF, BMP, TIFF или AVIF. Читает английский и другие языки на латинице, а также китайский. Корейский и японскую кану не читает. Файлы обрабатываются в браузере и никуда не загружаются. Они хранятся в этом браузере, пока вы их не уберёте.

Ctrl+OвыбратьCtrl+Vвставить

Модель распознавания текста

Модель «Скорость» · …

Читает английский и другие языки на латинице (французский, немецкий, испанский, польский…) и китайский. Не читает корейский, японскую кану, русский и другие языки на кириллице, арабский, тайский, хинди и вьетнамский.

 

Лицензии: модели (Apache-2.0) · движок (MIT)

Превратите скриншот, фото или отсканированную страницу в текст, который можно скопировать и отредактировать, — быстро. Это самый лёгкий из трёх инструментов распознавания текста: его модель весит всего 6 МБ, поэтому первый запуск быстрый даже на телефоне, а затем скриншот читается за секунду-другую. Всё работает в браузере: изображение не покидает ваше устройство, бесплатно и без регистрации.

Сравнение трёх моделей распознавания текста

Распознавание текста (скорость)Эта страницаРаспознавание текста (баланс)Распознавание текста (точность)
Размер модели6 MB29,7 MB132,3 MB
Первый запуск: загрузка вместе с движком при 50 Мбит/с19,6 MB · ≈ 3 с43,4 MB · ≈ 7 с145,9 MB · ≈ 24 с
ПотомХранится в браузере — повторной загрузки нет
СкоростьСамая быстраяБыстраяСамая медленная
ТочностьХороша на чётком текстеТочнее на фото и мелком шрифтеЛучшая на сложных изображениях
Читаетлатиница (английский, французский, немецкий…) и китайскийлатиница (английский, французский, немецкий…), китайский и японскийлатиница (английский, французский, немецкий…), китайский и японский

Движок распознавания (13,7 MB, или 27,4 MB в браузерах с WebGPU) загружается один раз и общий для всех трёх моделей. Ничего не загружается, пока вы не запустите распознавание.

Как быстро распознать текст на изображении

  1. Перетащите одно или несколько изображений в любое место страницы, вставьте скриншот сочетанием Ctrl+V или нажмите, чтобы выбрать файлы. Изображения, добавленные в другом инструменте для изображений, уже есть в списке, а пример чека показывает, как это работает.
  2. В первый раз нажмите «Скачать модель и распознать текст». Около 20 МБ — модель и движок, который её запускает, — скачиваются один раз и сохраняются в браузере; после этого добавленное изображение распознаётся сразу, выбранное — как только вы открываете страницу, а остальные, уже бывшие в списке, — когда вы нажимаете «Распознать» или «Распознать все».
  3. Проверьте текст рядом с картинкой. Нажмите на область изображения, чтобы найти её строку; строки, в которых модель не уверена, подчёркнуты. Исправьте что нужно, затем нажмите «Копировать текст» (Ctrl+Shift+C) или «Скачать .txt».
  4. При желании в разделе «Скрыть текст на изображении» выберите цвет и скачайте копию картинки, где текст закрыт прямоугольниками.

Возможности

  • Самая маленькая модель: 6 МБ, вместе с движком около 20 МБ — скачивается один раз и сохраняется в браузере
  • Скриншот распознаётся за секунду-другую, когда модель уже сохранена
  • Читает английский и другие языки на латинице, цифры и китайский
  • Текст в порядке чтения, а области на изображении обведены и пронумерованы
  • Текст можно отредактировать, скопировать или скачать в .txt; строки, в которых модель не уверена, подчёркнуты
  • Скрытие текста на изображении и скачивание замаскированной копии
  • Несколько изображений сразу

Это конфиденциально?

Да. Распознавание полностью выполняется в браузере; изображение и текст не покидают ваше устройство, а изображения остаются в этом браузере, пока вы не уберёте их из списка. Скачиваются только модель и её движок — с этого сайта, при первом использовании.

Частые вопросы

Почему первый запуск медленнее?

Потому что в первый раз браузер скачивает модель распознавания (6 МБ) и движок, который её запускает (14 МБ или 27 МБ в браузерах, использующих видеокарту через WebGPU), а затем подготавливает их. Оба сохраняются в браузере, поэтому следующие изображения и следующий визит обходятся без скачивания. Движок общий с инструментами «Баланс» и «Точность», так что если позже попробовать их, скачается только их модель.

Какие языки распознаются?

Печатный английский и другие языки на латинице (французский, немецкий, испанский, португальский, итальянский, польский, чешский, турецкий…), цифры и символы, а также китайский. Корейский, японскую кану, русский и другие языки на кириллице, арабский, тайский, хинди и вьетнамский он читать не умеет; для японского используйте инструмент «Баланс» или «Точность».

Насколько точна самая быстрая модель?

Очень хороша на чётком печатном тексте — скриншотах, документах и вывесках. Мелкий шрифт или размытые фото точнее читают инструменты «Баланс» и «Точность», а строки, в которых модель не уверена, подчёркнуты, чтобы вы могли их проверить.

«Скорость», «Баланс» или «Точность» — что выбрать?

«Скорость» — когда текст чёткий и нужен самый маленький объём скачивания: около 20 МБ в первый раз. «Баланс» (около 43 МБ) точнее читает фото и мелкий текст, а также японский; «Точность» (около 146 МБ) лучше всех справляется с самыми сложными изображениями, но работает медленно без графического ускорения (WebGPU).

Как освободить место, которое занимает модель?

Нажмите «Удалить скачанные модели» в разделе «Модель распознавания текста»: все сохранённые модели будут удалены из этого браузера. Модель снова скачается, когда вы в следующий раз будете распознавать текст.

Похожие инструменты