Toolonit
  1. Inicio
  2. Imagen
  3. Imagen a texto (precisión)

Imagen a texto de alta precisión (OCR)

Extrae el texto de una imagen con el modelo OCR más grande: el más preciso, con una descarga inicial mayor.

Suelta imágenes con texto aquí o haz clic para elegirlas

Fotos, escaneos y capturas de pantalla: JPG, PNG, WebP, GIF, BMP, TIFF o AVIF. Lee inglés y otros idiomas con alfabeto latino, chino y japonés. No puede leer coreano. Los archivos se procesan en tu navegador y nunca se suben. Se quedan en este navegador hasta que las quites.

Ctrl+OelegirCtrl+Vpegar

Modelo de reconocimiento de texto

Modelo: Precisión · …

Lee inglés y otros idiomas con alfabeto latino (francés, alemán, español, polaco…), chino (simplificado y tradicional) y japonés. No puede leer coreano, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.

 

Licencias: modelos (Apache-2.0) · motor (MIT)

Cuando lo que más importa es la precisión (letra pequeña, páginas fotografiadas, recibos, imágenes con poco contraste o recargadas), esta herramienta usa el mayor de los tres modelos de reconocimiento. El modelo de 132 MB se descarga una vez y se guarda en tu navegador. Con aceleración gráfica (WebGPU, en la mayoría de los navegadores de escritorio actuales), una página densa se lee en unos segundos; solo con el procesador, una página corta tarda alrededor de medio minuto. Tus imágenes nunca salen de tu dispositivo, y es gratis y sin registro.

Comparación de los tres modelos de imagen a texto

Imagen a texto (más rápido)Imagen a texto (equilibrado)Imagen a texto (precisión)Esta página
Descarga del modelo6 MB29,7 MB132,3 MB
Primer uso: descarga con el motor a 50 Mbit/s19,6 MB · ≈ 3 s43,4 MB · ≈ 7 s145,9 MB · ≈ 24 s
DespuésSe guarda en el navegador: no se vuelve a descargar
VelocidadLa más rápidaRápidaLa más lenta
PrecisiónBuena con texto nítidoMejor con fotos y letra pequeñaLa mejor con imágenes difíciles
Leealfabeto latino (inglés, español, francés…) y chinoalfabeto latino (inglés, español, francés…), chino y japonésalfabeto latino (inglés, español, francés…), chino y japonés

El motor de reconocimiento (13,7 MB, o 27,4 MB en navegadores con WebGPU) se descarga una sola vez y lo comparten los tres. No se descarga nada hasta que pides a la herramienta que lea una imagen.

Cómo extraer texto con alta precisión

  1. Suelta imágenes en cualquier parte de la página, pega una con Ctrl+V o haz clic para elegir archivos. Una imagen que ya añadiste en otra herramienta de imagen (por ejemplo, en la página Equilibrado, para comparar) ya está en la lista.
  2. La primera vez, haz clic en Descargar modelo y leer texto. La descarga, de unos 146 MB con el motor, se hace una sola vez (el panel de progreso muestra el tamaño, el porcentaje y el tiempo restante) y después queda guardada en tu navegador, así que la próxima vez la imagen seleccionada se lee en cuanto se abre la página, y las demás de la lista con Leer o Leer todas.
  3. Revisa el texto junto a la imagen: haz clic en una zona para encontrar su línea y doble clic para editar esa línea. Conviene revisar las líneas subrayadas. Después, usa Copiar texto (Ctrl+Mayús+C) o Descargar .txt.
  4. Para compartir la imagen sin su texto, descarga la copia tapada en Ocultar el texto de la imagen: elige el color y las zonas que quieres tapar.

Funciones

  • El modelo más grande: 132 MB, unos 146 MB con su motor, que se descarga una vez y después se guarda en tu navegador
  • Lee con la máxima precisión el texto pequeño, borroso, girado o con poco contraste
  • Con WebGPU, una página densa en unos segundos; solo con el procesador, alrededor de medio minuto para una página corta
  • Lee inglés y otros idiomas con alfabeto latino, chino (simplificado y tradicional) y japonés
  • Texto en orden de lectura, con las zonas marcadas y numeradas sobre la imagen
  • Edita, copia o descarga el texto como .txt, y descarga una copia de la imagen con el texto oculto
  • Cada archivo descargado se comprueba antes de usarse, y los archivos que llegaron completos se conservan si se interrumpe una descarga

¿Es privado?

Sí. El modelo se ejecuta en tu navegador; la imagen y el texto reconocido nunca se suben, y las imágenes se quedan en este navegador hasta que las quitas de la lista. Por eso sirve para recibos, documentos de identidad, contratos y otros documentos que prefieres no enviar a un servicio online.

Preguntas frecuentes

¿En qué se diferencia de las otras dos herramientas?

Lee con más acierto el texto pequeño, borroso, girado o con poco contraste, porque usa el modelo de reconocimiento más grande. El precio es una descarga única mayor (un modelo de 132 MB, frente a 6 MB y 30 MB) y una lectura más lenta donde el navegador no tiene aceleración gráfica: alrededor de medio minuto para una página corta y varios minutos para una densa, más en móviles. Para capturas de pantalla claras, basta con Más rápido o Equilibrado.

¿Tengo que descargarlo cada vez?

No. El modelo y su motor (14 MB, o 27 MB con WebGPU, compartido con las otras dos herramientas) se descargan una vez y se guardan en tu navegador, y cada archivo se comprueba antes de usarse. La próxima vez, la herramienta arranca sin descarga. Eliminar modelos descargados libera el espacio cuando quieras.

¿Qué idiomas lee?

Inglés impreso y otros idiomas con alfabeto latino (francés, alemán, español, portugués, italiano, polaco, checo, turco…), dígitos y símbolos, chino (simplificado y tradicional) y japonés (kanji, hiragana y katakana). No puede leer coreano, ruso ni otros idiomas en cirílico, árabe, tailandés, hindi ni vietnamita.

¿Puede leer una página boca abajo o fotografiada en ángulo?

Sí. Una página boca abajo se detecta y se lee en el sentido correcto, y las líneas de una foto ligeramente inclinada se enderezan antes de ponerlas en orden de lectura, para que no se mezclen. El texto vertical en chino y japonés se lee en columnas de derecha a izquierda.

¿Y si se interrumpe la descarga?

Vuelve a intentarlo: el panel de progreso indica qué ha fallado y ofrece Reintentar. Los archivos que llegaron completos y superaron la comprobación se conservan, así que al reintentar solo se descarga el resto; nunca se usa nada descargado a medias.

Herramientas relacionadas