Toolonit
  1. Inicio
  2. Imagen
  3. Imagen a texto (equilibrado)

Imagen a texto (OCR)

Extrae el texto de una imagen con un modelo OCR mediano: equilibrio entre velocidad y precisión.

Suelta imágenes con texto aquí o haz clic para elegirlas

Fotos, escaneos y capturas de pantalla: JPG, PNG, WebP, GIF, BMP, TIFF o AVIF. Lee inglés y otros idiomas con alfabeto latino, chino y japonés. No puede leer coreano. Los archivos se procesan en tu navegador y nunca se suben. Se quedan en este navegador hasta que las quites.

Ctrl+OelegirCtrl+Vpegar

Modelo de reconocimiento de texto

Modelo: Equilibrado · …

Lee inglés y otros idiomas con alfabeto latino (francés, alemán, español, polaco…), chino (simplificado y tradicional) y japonés. No puede leer coreano, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.

 

Licencias: modelos (Apache-2.0) · motor (MIT)

Copia el texto de la foto de un documento, de una página escaneada o de una captura de pantalla, y después edítalo y guárdalo. Es la opción para el día a día de las tres herramientas de Imagen a texto: su modelo de reconocimiento de 30 MB lee la letra pequeña, las fotos tomadas en ángulo y los fondos recargados bastante mejor que el más rápido, y aun así lee una captura en segundos. Todo se ejecuta en tu navegador: tus imágenes nunca salen de tu dispositivo, y es gratis y sin registro.

Comparación de los tres modelos de imagen a texto

Imagen a texto (más rápido)Imagen a texto (equilibrado)Esta páginaImagen a texto (precisión)
Descarga del modelo6 MB29,7 MB132,3 MB
Primer uso: descarga con el motor a 50 Mbit/s19,6 MB · ≈ 3 s43,4 MB · ≈ 7 s145,9 MB · ≈ 24 s
DespuésSe guarda en el navegador: no se vuelve a descargar
VelocidadLa más rápidaRápidaLa más lenta
PrecisiónBuena con texto nítidoMejor con fotos y letra pequeñaLa mejor con imágenes difíciles
Leealfabeto latino (inglés, español, francés…) y chinoalfabeto latino (inglés, español, francés…), chino y japonésalfabeto latino (inglés, español, francés…), chino y japonés

El motor de reconocimiento (13,7 MB, o 27,4 MB en navegadores con WebGPU) se descarga una sola vez y lo comparten los tres. No se descarga nada hasta que pides a la herramienta que lea una imagen.

Cómo extraer el texto de una imagen

  1. Suelta imágenes en cualquier parte de la página, pega una con Ctrl+V o haz clic para elegir archivos; puedes añadir varias a la vez. Las imágenes que ya añadiste en cualquier herramienta de imagen, incluidas las páginas Más rápido y Precisión, esperan en la lista.
  2. La primera vez, haz clic en Descargar modelo y leer texto. El modelo (30 MB) y el motor que lo ejecuta, unos 43 MB en total, se descargan una sola vez y se guardan en tu navegador, así que después una imagen que añades se lee al momento, la seleccionada en cuanto abres la página, y las demás que ya estaban en la lista con Leer o Leer todas.
  3. Compara el texto con la imagen: haz clic en una zona para encontrar su línea, o en una línea para encontrar su zona. Las líneas subrayadas son aquellas de las que el modelo no está seguro. Corrige lo necesario y usa Copiar texto (Ctrl+Mayús+C) o Descargar .txt.
  4. Para compartir la imagen sin su texto, abre Ocultar el texto de la imagen, elige un color, deja visibles las zonas que quieras conservar y descarga la copia tapada.

Funciones

  • Lee inglés impreso y otros idiomas con alfabeto latino, chino (simplificado y tradicional) y japonés
  • Texto en orden de lectura: las columnas una tras otra, y los artículos de un recibo junto a sus precios
  • Zonas de texto marcadas y numeradas sobre la imagen; haz clic en una zona para encontrar su línea
  • Edita el texto y cópialo o descárgalo como .txt; las líneas de las que el modelo no está seguro aparecen subrayadas
  • Oculta el texto: descarga una copia de la imagen con el texto tapado por recuadros
  • Varias imágenes a la vez; las páginas boca abajo se detectan y se leen en el sentido correcto
  • Una sola descarga de unos 43 MB (el modelo de 30 MB y su motor), que después se guarda en tu navegador

¿Es privado?

Sí. La imagen la lee un modelo que se ejecuta en tu navegador; ni la imagen ni el texto se envían a ningún sitio, y tus imágenes se quedan en este navegador hasta que las quitas de la lista. Solo se descargan el modelo y su motor, una vez y desde este sitio, y se quedan guardados en tu navegador.

Preguntas frecuentes

¿Qué idiomas lee?

Inglés impreso y otros idiomas con alfabeto latino (francés, alemán, español, portugués, italiano, polaco, checo, turco…), dígitos y símbolos, chino (simplificado y tradicional) y japonés (kanji, hiragana y katakana). No puede leer coreano, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.

¿Por qué la primera vez va más lento?

Porque solo la primera vez el navegador descarga el modelo y el motor que lo ejecuta (14 MB, o 27 MB en navegadores que usan la tarjeta gráfica mediante WebGPU) y los prepara. Después quedan guardados, así que la lectura empieza sin descarga, y una página que ya está abierta sigue funcionando sin conexión. Si ya usaste otra herramienta de Imagen a texto, el motor ya está ahí y solo se descarga el modelo.

¿Más rápido, Equilibrado o Precisión? ¿Cuál debo usar?

Equilibrado sirve para la mayoría de las imágenes. Más rápido (un modelo de 6 MB, unos 20 MB de descarga la primera vez) basta para capturas y documentos claros en inglés o chino. Equilibrado (30 MB, unos 43 MB) es más preciso con fotos y texto pequeño y también lee japonés. Precisión (132 MB, unos 146 MB) es el que mejor lee las imágenes más difíciles, pero sin aceleración gráfica (WebGPU) necesita alrededor de medio minuto para una página corta. Cada uno se descarga una vez y después se guarda en tu navegador.

¿Mantiene la maquetación de la página?

Mantiene el orden de lectura, no la maquetación exacta: los fragmentos de texto de una misma fila se unen, cada fila es una línea y una línea en blanco separa los párrafos. Las columnas contiguas se leen una tras otra, y las tablas salen como texto en orden de lectura, no como una hoja de cálculo.

¿Puedo leer varias imágenes a la vez?

Sí. Añade tantas como quieras; cada una se lee por turno. Copiar todas las imágenes copia todos los textos bajo el nombre de su archivo, y Descargar todo (ZIP) guarda las copias tapadas.

Herramientas relacionadas