Toolonit
  1. Inicio
  2. Imagen
  3. Imagen a texto (más rápido)

Imagen a texto rápido (OCR)

Extrae el texto de una imagen con el modelo OCR más pequeño: el más rápido de descargar y ejecutar.

Suelta imágenes con texto aquí o haz clic para elegirlas

Fotos, escaneos y capturas de pantalla: JPG, PNG, WebP, GIF, BMP, TIFF o AVIF. Lee inglés y otros idiomas con alfabeto latino, y chino. No puede leer coreano ni kana japonés. Los archivos se procesan en tu navegador y nunca se suben. Se quedan en este navegador hasta que las quites.

Ctrl+OelegirCtrl+Vpegar

Modelo de reconocimiento de texto

Modelo: Más rápido · …

Lee inglés y otros idiomas con alfabeto latino (francés, alemán, español, polaco…) y chino. No puede leer coreano, kana japonés, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.

 

Licencias: modelos (Apache-2.0) · motor (MIT)

Convierte una captura de pantalla, una foto o una página escaneada en texto que puedes copiar y editar, y hazlo rápido. Es la más ligera de las tres herramientas de Imagen a texto: su modelo de reconocimiento solo ocupa 6 MB, así que el primer arranque es rápido incluso en un móvil, y después una captura se lee en uno o dos segundos. Todo se ejecuta en tu navegador: la imagen nunca sale de tu dispositivo, y es gratis y sin registro.

Comparación de los tres modelos de imagen a texto

Imagen a texto (más rápido)Esta páginaImagen a texto (equilibrado)Imagen a texto (precisión)
Descarga del modelo6 MB29,7 MB132,3 MB
Primer uso: descarga con el motor a 50 Mbit/s19,6 MB · ≈ 3 s43,4 MB · ≈ 7 s145,9 MB · ≈ 24 s
DespuésSe guarda en el navegador: no se vuelve a descargar
VelocidadLa más rápidaRápidaLa más lenta
PrecisiónBuena con texto nítidoMejor con fotos y letra pequeñaLa mejor con imágenes difíciles
Leealfabeto latino (inglés, español, francés…) y chinoalfabeto latino (inglés, español, francés…), chino y japonésalfabeto latino (inglés, español, francés…), chino y japonés

El motor de reconocimiento (13,7 MB, o 27,4 MB en navegadores con WebGPU) se descarga una sola vez y lo comparten los tres. No se descarga nada hasta que pides a la herramienta que lea una imagen.

Cómo convertir una imagen a texto rápidamente

  1. Suelta una o varias imágenes en cualquier parte de la página, pega una captura con Ctrl+V o haz clic para elegir archivos. Las imágenes que añadiste en otra herramienta de imagen ya están en la lista, y el recibo de muestra enseña cómo funciona.
  2. La primera vez, haz clic en Descargar modelo y leer texto. Unos 20 MB (el modelo y el motor que lo ejecuta) se descargan una sola vez y se guardan en tu navegador; a partir de entonces, una imagen que añades se lee al momento, la seleccionada en cuanto abres la página, y las demás que ya estaban en la lista cuando haces clic en Leer o Leer todas.
  3. Revisa el texto junto a la imagen. Haz clic en una zona de la imagen para encontrar su línea; las líneas de las que el modelo no está seguro aparecen subrayadas. Corrige lo que haga falta escribiendo y, después, haz clic en Copiar texto (Ctrl+Mayús+C) o Descargar .txt.
  4. Opcional: en Ocultar el texto de la imagen, elige un color y descarga una copia de la imagen con el texto tapado por recuadros.

Funciones

  • El modelo más pequeño: 6 MB, unos 20 MB con su motor, que se descarga una vez y después se guarda en tu navegador
  • Una captura de pantalla leída en uno o dos segundos una vez guardado el modelo
  • Lee inglés y otros idiomas con alfabeto latino, dígitos y chino
  • Texto en orden de lectura, con las zonas marcadas y numeradas sobre la imagen
  • Edita, copia o descarga el texto como .txt; las líneas de las que el modelo no está seguro aparecen subrayadas
  • Oculta el texto de la imagen y descarga la copia tapada
  • Varias imágenes a la vez

¿Es privado?

Sí. El reconocimiento se hace por completo en tu navegador; la imagen y el texto nunca salen de tu dispositivo, y las imágenes se quedan en este navegador hasta que las quitas de la lista. Lo único que se descarga, desde este sitio y la primera vez que lo usas, es el modelo y su motor.

Preguntas frecuentes

¿Por qué la primera vez va más lento?

Porque la primera vez tu navegador descarga el modelo de reconocimiento (6 MB) y el motor que lo ejecuta (14 MB, o 27 MB en navegadores que usan la tarjeta gráfica mediante WebGPU), y después los prepara. Ambos se guardan en el navegador, así que las siguientes imágenes y tu próxima visita empiezan sin descarga. El motor se comparte con las herramientas Equilibrado y Precisión, así que, si las pruebas después, solo se descarga su modelo.

¿Qué idiomas puede leer?

Inglés impreso y otros idiomas escritos con el alfabeto latino (francés, alemán, español, portugués, italiano, polaco, checo, turco…), dígitos y símbolos, y chino. No puede leer coreano, kana japonés, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita; para japonés, usa la herramienta Equilibrado o Precisión.

¿Qué precisión tiene el modelo más rápido?

Muy buena con texto impreso claro, como capturas de pantalla, documentos y carteles. Para letra pequeña o fotos borrosas, las herramientas Equilibrado y Precisión leen mejor, y las líneas de las que el modelo no está seguro aparecen subrayadas para que puedas revisarlas.

¿Más rápido, Equilibrado o Precisión? ¿Cuál debo usar?

Más rápido, cuando el texto es claro y quieres la descarga más pequeña: unos 20 MB la primera vez. Equilibrado (unos 43 MB) lee con más precisión fotos y texto pequeño, y también lee japonés; Precisión (unos 146 MB) es el que mejor lee las imágenes más difíciles, pero es lento sin aceleración gráfica (WebGPU).

¿Cómo libero el espacio que ocupa el modelo?

Haz clic en Eliminar modelos descargados, en Modelo de reconocimiento de texto: todos los modelos guardados se eliminan de este navegador. El modelo se vuelve a descargar la próxima vez que leas texto.

Herramientas relacionadas