- Главная
- Изображения
- Распознавание текста (точность)
Распознавание текста с высокой точностью (OCR)
Извлекает текст из изображения самой большой OCR-моделью: она точнее всех, но загрузка больше.
Перетащите изображения с текстом сюда или нажмите, чтобы выбрать
Фото, сканы и скриншоты: JPG, PNG, WebP, GIF, BMP, TIFF или AVIF. Читает английский и другие языки на латинице, китайский и японский. Корейский не читает. Файлы обрабатываются в браузере и никуда не загружаются. Они хранятся в этом браузере, пока вы их не уберёте.
Ctrl+OвыбратьCtrl+Vвставить
Модель распознавания текста
Модель «Точность» · …
Читает английский и другие языки на латинице (французский, немецкий, испанский, польский…), китайский (упрощённый и традиционный) и японский. Не читает корейский, русский и другие языки на кириллице, арабский, тайский, хинди и вьетнамский.
Лицензии: модели (Apache-2.0) · движок (MIT)
Когда точность важнее всего — мелкий шрифт, сфотографированные страницы, чеки, малоконтрастные или пёстрые изображения, — этот инструмент использует самую большую из трёх моделей распознавания. Модель на 132 МБ скачивается один раз и хранится в браузере. С графическим ускорением (WebGPU, есть в большинстве современных настольных браузеров) плотная страница читается за несколько секунд; только на процессоре короткая страница занимает около полуминуты. Изображения не покидают ваше устройство, бесплатно и без регистрации.
Сравнение трёх моделей распознавания текста
| Распознавание текста (скорость) | Распознавание текста (баланс) | Распознавание текста (точность)Эта страница | |
|---|---|---|---|
| Размер модели | 6 MB | 29,7 MB | 132,3 MB |
| Первый запуск: загрузка вместе с движком при 50 Мбит/с | 19,6 MB · ≈ 3 с | 43,4 MB · ≈ 7 с | 145,9 MB · ≈ 24 с |
| Потом | Хранится в браузере — повторной загрузки нет | ||
| Скорость | Самая быстрая | Быстрая | Самая медленная |
| Точность | Хороша на чётком тексте | Точнее на фото и мелком шрифте | Лучшая на сложных изображениях |
| Читает | латиница (английский, французский, немецкий…) и китайский | латиница (английский, французский, немецкий…), китайский и японский | латиница (английский, французский, немецкий…), китайский и японский |
Движок распознавания (13,7 MB, или 27,4 MB в браузерах с WebGPU) загружается один раз и общий для всех трёх моделей. Ничего не загружается, пока вы не запустите распознавание.
Как распознать текст с высокой точностью
- Перетащите изображения в любое место страницы, вставьте картинку сочетанием Ctrl+V или нажмите, чтобы выбрать файлы. Изображение, которое вы уже добавили в другом инструменте для изображений — скажем, на странице «Баланс», чтобы сравнить, — уже есть в списке.
- В первый раз нажмите «Скачать модель и распознать текст». Скачивание (около 146 МБ вместе с движком) происходит один раз — панель прогресса показывает размер, проценты и оставшееся время, — после чего всё сохраняется в браузере, и в следующий раз выбранное изображение распознаётся сразу при открытии страницы, а остальные в списке — кнопками «Распознать» или «Распознать все».
- Проверьте текст рядом с картинкой: нажмите на область, чтобы найти её строку, или дважды щёлкните по ней, чтобы отредактировать эту строку. Подчёркнутые строки стоит перепроверить. Затем нажмите «Копировать текст» (Ctrl+Shift+C) или «Скачать .txt».
- Чтобы поделиться картинкой без текста, скачайте замаскированную копию в разделе «Скрыть текст на изображении» — выберите цвет и области, которые нужно закрыть.
Возможности
- Самая большая модель: 132 МБ, вместе с движком около 146 МБ — скачивается один раз и сохраняется в браузере
- Точнее всех читает мелкий, размытый, повёрнутый или малоконтрастный текст
- С WebGPU плотная страница — за несколько секунд; только на процессоре — около полуминуты на короткую страницу
- Читает английский и другие языки на латинице, китайский (упрощённый и традиционный) и японский
- Текст в порядке чтения, а области на изображении обведены и пронумерованы
- Текст можно отредактировать, скопировать или скачать в .txt, а также скачать копию изображения со скрытым текстом
- Каждый скачанный файл проверяется перед использованием, а полностью полученные файлы сохраняются, даже если скачивание прервалось
Это конфиденциально?
Да. Модель работает в браузере; изображение и распознанный текст никуда не загружаются, а изображения остаются в этом браузере, пока вы не уберёте их из списка. Поэтому инструмент подходит для чеков, удостоверений личности, договоров и других документов, которые не хочется отправлять в онлайн-сервис.
Частые вопросы
Чем этот инструмент отличается от двух других?
Он правильнее читает мелкий, размытый, повёрнутый или малоконтрастный текст, потому что использует самую большую модель распознавания. Плата за это — больший разовый объём скачивания (модель на 132 МБ против 6 и 30 МБ) и более медленное распознавание там, где у браузера нет графического ускорения: около полуминуты на короткую страницу и несколько минут на плотную, а на телефонах ещё дольше. Для чётких скриншотов достаточно «Скорости» или «Баланса».
Нужно ли скачивать модель каждый раз?
Нет. Модель и её движок (14 МБ или 27 МБ с WebGPU, общий с двумя другими инструментами) скачиваются один раз и сохраняются в браузере, а каждый файл проверяется перед использованием. В следующий раз инструмент запустится без скачивания. Кнопка «Удалить скачанные модели» в любой момент освободит место.
Какие языки распознаются?
Печатный английский и другие языки на латинице (французский, немецкий, испанский, португальский, итальянский, польский, чешский, турецкий…), цифры и символы, китайский (упрощённый и традиционный) и японский (кандзи, хирагану и катакану). Корейский, русский и другие языки на кириллице, арабский, тайский, хинди и вьетнамский он читать не умеет.
Прочитает ли он перевёрнутую страницу или фото, снятое под углом?
Да. Перевёрнутая страница распознаётся и читается в правильной ориентации, а строки слегка наклонённого фото выпрямляются, прежде чем выстроиться в порядке чтения, поэтому не перемешиваются. Вертикальный китайский и японский текст читается колонками справа налево.
Что делать, если скачивание прервалось?
Просто попробуйте ещё раз: панель прогресса сообщит, что пошло не так, и предложит кнопку «Повторить». Полностью полученные файлы, прошедшие проверку, сохраняются, поэтому повторная попытка скачивает только остальное; недокачанные файлы никогда не используются.