Imagen a texto de alta precisión (OCR)
Extrae el texto de una imagen con el modelo OCR más grande: el más preciso, con una descarga inicial mayor.
Suelta imágenes con texto aquí o haz clic para elegirlas
Fotos, escaneos y capturas de pantalla: JPG, PNG, WebP, GIF, BMP, TIFF o AVIF. Lee inglés y otros idiomas con alfabeto latino, chino y japonés. No puede leer coreano. Los archivos se procesan en tu navegador y nunca se suben. Se quedan en este navegador hasta que las quites.
Ctrl+OelegirCtrl+Vpegar
Modelo de reconocimiento de texto
Modelo: Precisión · …
Lee inglés y otros idiomas con alfabeto latino (francés, alemán, español, polaco…), chino (simplificado y tradicional) y japonés. No puede leer coreano, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.
Licencias: modelos (Apache-2.0) · motor (MIT)
Cuando lo que más importa es la precisión (letra pequeña, páginas fotografiadas, recibos, imágenes con poco contraste o recargadas), esta herramienta usa el mayor de los tres modelos de reconocimiento. El modelo de 132 MB se descarga una vez y se guarda en tu navegador. Con aceleración gráfica (WebGPU, en la mayoría de los navegadores de escritorio actuales), una página densa se lee en unos segundos; solo con el procesador, una página corta tarda alrededor de medio minuto. Tus imágenes nunca salen de tu dispositivo, y es gratis y sin registro.
Comparación de los tres modelos de imagen a texto
| Imagen a texto (más rápido) | Imagen a texto (equilibrado) | Imagen a texto (precisión)Esta página | |
|---|---|---|---|
| Descarga del modelo | 6 MB | 29,7 MB | 132,3 MB |
| Primer uso: descarga con el motor a 50 Mbit/s | 19,6 MB · ≈ 3 s | 43,4 MB · ≈ 7 s | 145,9 MB · ≈ 24 s |
| Después | Se guarda en el navegador: no se vuelve a descargar | ||
| Velocidad | La más rápida | Rápida | La más lenta |
| Precisión | Buena con texto nítido | Mejor con fotos y letra pequeña | La mejor con imágenes difíciles |
| Lee | alfabeto latino (inglés, español, francés…) y chino | alfabeto latino (inglés, español, francés…), chino y japonés | alfabeto latino (inglés, español, francés…), chino y japonés |
El motor de reconocimiento (13,7 MB, o 27,4 MB en navegadores con WebGPU) se descarga una sola vez y lo comparten los tres. No se descarga nada hasta que pides a la herramienta que lea una imagen.
Cómo extraer texto con alta precisión
- Suelta imágenes en cualquier parte de la página, pega una con Ctrl+V o haz clic para elegir archivos. Una imagen que ya añadiste en otra herramienta de imagen (por ejemplo, en la página Equilibrado, para comparar) ya está en la lista.
- La primera vez, haz clic en Descargar modelo y leer texto. La descarga, de unos 146 MB con el motor, se hace una sola vez (el panel de progreso muestra el tamaño, el porcentaje y el tiempo restante) y después queda guardada en tu navegador, así que la próxima vez la imagen seleccionada se lee en cuanto se abre la página, y las demás de la lista con Leer o Leer todas.
- Revisa el texto junto a la imagen: haz clic en una zona para encontrar su línea y doble clic para editar esa línea. Conviene revisar las líneas subrayadas. Después, usa Copiar texto (Ctrl+Mayús+C) o Descargar .txt.
- Para compartir la imagen sin su texto, descarga la copia tapada en Ocultar el texto de la imagen: elige el color y las zonas que quieres tapar.
Funciones
- El modelo más grande: 132 MB, unos 146 MB con su motor, que se descarga una vez y después se guarda en tu navegador
- Lee con la máxima precisión el texto pequeño, borroso, girado o con poco contraste
- Con WebGPU, una página densa en unos segundos; solo con el procesador, alrededor de medio minuto para una página corta
- Lee inglés y otros idiomas con alfabeto latino, chino (simplificado y tradicional) y japonés
- Texto en orden de lectura, con las zonas marcadas y numeradas sobre la imagen
- Edita, copia o descarga el texto como .txt, y descarga una copia de la imagen con el texto oculto
- Cada archivo descargado se comprueba antes de usarse, y los archivos que llegaron completos se conservan si se interrumpe una descarga
¿Es privado?
Sí. El modelo se ejecuta en tu navegador; la imagen y el texto reconocido nunca se suben, y las imágenes se quedan en este navegador hasta que las quitas de la lista. Por eso sirve para recibos, documentos de identidad, contratos y otros documentos que prefieres no enviar a un servicio online.
Preguntas frecuentes
¿En qué se diferencia de las otras dos herramientas?
Lee con más acierto el texto pequeño, borroso, girado o con poco contraste, porque usa el modelo de reconocimiento más grande. El precio es una descarga única mayor (un modelo de 132 MB, frente a 6 MB y 30 MB) y una lectura más lenta donde el navegador no tiene aceleración gráfica: alrededor de medio minuto para una página corta y varios minutos para una densa, más en móviles. Para capturas de pantalla claras, basta con Más rápido o Equilibrado.
¿Tengo que descargarlo cada vez?
No. El modelo y su motor (14 MB, o 27 MB con WebGPU, compartido con las otras dos herramientas) se descargan una vez y se guardan en tu navegador, y cada archivo se comprueba antes de usarse. La próxima vez, la herramienta arranca sin descarga. Eliminar modelos descargados libera el espacio cuando quieras.
¿Qué idiomas lee?
Inglés impreso y otros idiomas con alfabeto latino (francés, alemán, español, portugués, italiano, polaco, checo, turco…), dígitos y símbolos, chino (simplificado y tradicional) y japonés (kanji, hiragana y katakana). No puede leer coreano, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.
¿Puede leer una página boca abajo o fotografiada en ángulo?
Sí. Una página boca abajo se detecta y se lee en el sentido correcto, y las líneas de una foto ligeramente inclinada se enderezan antes de ponerlas en orden de lectura, para que no se mezclen. El texto vertical en chino y japonés se lee en columnas de derecha a izquierda.
¿Y si se interrumpe la descarga?
Vuelve a intentarlo: el panel de progreso indica qué ha fallado y ofrece Reintentar. Los archivos que llegaron completos y superaron la comprobación se conservan, así que al reintentar solo se descarga el resto; nunca se usa nada descargado a medias.