Toolonit
  1. Início
  2. Imagem
  3. Imagem para texto (equilibrado)

Imagem para texto (OCR)

Extraia o texto de uma imagem com um modelo de OCR médio — equilíbrio entre velocidade e precisão.

Solte imagens com texto aqui ou clique para escolher

Fotos, digitalizações e capturas de tela: JPG, PNG, WebP, GIF, BMP, TIFF ou AVIF. Lê inglês e outros idiomas de alfabeto latino, chinês e japonês. Não lê coreano. Os arquivos são processados no navegador e nunca enviados. Elas ficam neste navegador até você removê-las.

Ctrl+OescolherCtrl+Vcolar

Modelo de reconhecimento de texto

Modelo Equilibrado · …

Lê inglês e outros idiomas de alfabeto latino (francês, alemão, espanhol, polonês…), chinês (simplificado e tradicional) e japonês. Não lê coreano, russo ou outras línguas em cirílico, árabe, tailandês, hindi nem vietnamita.

 

Licenças: modelos (Apache-2.0) · mecanismo (MIT)

Copie o texto de uma foto de documento, de uma página escaneada ou de uma captura de tela, depois edite e salve. Esta é a escolha do dia a dia entre as três ferramentas de imagem para texto: o modelo de reconhecimento de 30 MB lê letras pequenas, fotos tiradas em ângulo e fundos carregados bem melhor que o mais rápido e ainda lê uma captura de tela em segundos. Tudo roda no seu navegador: suas imagens nunca saem do seu dispositivo, e é grátis, sem cadastro.

Compare os três modelos de imagem para texto

Imagem para texto (mais rápido)Imagem para texto (equilibrado)Esta páginaImagem para texto (precisão)
Download do modelo6 MB29,7 MB132,3 MB
Primeiro uso: download com o motor a 50 Mbit/s19,6 MB · ≈ 3 s43,4 MB · ≈ 7 s145,9 MB · ≈ 24 s
Depois dissoFica salvo no navegador: sem novo download
VelocidadeO mais rápidoRápidoO mais lento
PrecisãoBom com texto nítidoMelhor com fotos e letras pequenasO melhor com imagens difíceis
Lêalfabeto latino (inglês, português, espanhol…) e chinêsalfabeto latino (inglês, português, espanhol…), chinês e japonêsalfabeto latino (inglês, português, espanhol…), chinês e japonês

O motor de reconhecimento (13,7 MB, ou 27,4 MB em navegadores com WebGPU) é baixado uma única vez e compartilhado pelos três. Nada é baixado até você pedir à ferramenta que leia uma imagem.

Como extrair o texto de uma imagem

  1. Solte imagens em qualquer lugar da página, cole uma com Ctrl+V ou clique para escolher os arquivos — várias de uma vez, sem problema. As imagens já adicionadas em qualquer ferramenta de imagem, inclusive nas páginas Mais rápido e Precisão, estão esperando na lista.
  2. Na primeira vez, clique em Baixar modelo e ler texto. O modelo (30 MB) e o mecanismo que o executa — cerca de 43 MB juntos — são baixados uma única vez e guardados no seu navegador, então depois uma imagem que você adiciona é lida na hora, a selecionada assim que você abre a página, e as outras que já estão na lista com Ler ou Ler todas.
  3. Compare o texto com a imagem: clique em uma região para encontrar a linha dela, ou em uma linha para encontrar a região. As linhas sublinhadas são aquelas de que o modelo não tem certeza. Edite e depois clique em Copiar texto (Ctrl+Shift+C) ou Baixar .txt.
  4. Para compartilhar a imagem sem o texto, abra Ocultar o texto na imagem, escolha uma cor, deixe visível qualquer região que queira manter e baixe a cópia mascarada.

Recursos

  • Lê inglês impresso e outros idiomas de alfabeto latino, chinês (simplificado e tradicional) e japonês
  • Texto na ordem de leitura: colunas uma depois da outra, os itens de um recibo ao lado dos preços
  • Regiões de texto contornadas e numeradas na imagem; clique em uma região para encontrar a linha
  • Edite o texto e depois copie-o ou baixe-o como .txt; as linhas de que o modelo não tem certeza aparecem sublinhadas
  • Oculte o texto: baixe uma cópia da imagem com o texto coberto por caixas
  • Várias imagens de uma vez; páginas de cabeça para baixo são detectadas e lidas na posição certa
  • Um único download de cerca de 43 MB (o modelo de 30 MB e o mecanismo), depois salvo no seu navegador

É privado?

Sim. A imagem é lida por um modelo que roda no seu navegador; nem a imagem nem o texto são enviados a lugar nenhum, e as suas imagens ficam neste navegador até você removê-las da lista. Só o modelo e o mecanismo são baixados, uma vez, deste site, e ficam salvos no seu navegador.

Perguntas frequentes

Quais idiomas ele lê?

Inglês impresso e outros idiomas de alfabeto latino (francês, alemão, espanhol, português, italiano, polonês, tcheco, turco…), dígitos e símbolos, chinês (simplificado e tradicional) e japonês (kanji, hiragana e katakana). Ele não lê coreano, russo ou outras línguas em cirílico, árabe, tailandês, hindi nem vietnamita.

Por que a primeira execução é mais lenta?

Porque, só na primeira vez, o navegador baixa o modelo e o mecanismo que o executa (14 MB, ou 27 MB em navegadores que usam a placa de vídeo via WebGPU) e os prepara. Depois disso eles ficam salvos, então a leitura começa sem download, e uma página que já está aberta continua funcionando sem conexão. Se você já usou outra ferramenta de imagem para texto, o mecanismo já está lá e só o modelo é baixado.

Mais rápido, Equilibrado ou Precisão — qual devo usar?

Equilibrado serve para a maioria das imagens. Mais rápido (um modelo de 6 MB, cerca de 20 MB para baixar na primeira vez) basta para capturas de tela e documentos nítidos em inglês ou chinês. Equilibrado (30 MB, cerca de 43 MB) é mais preciso em fotos e letras pequenas e também lê japonês. Precisão (132 MB, cerca de 146 MB) lê melhor as imagens mais difíceis, mas sem aceleração gráfica (WebGPU) leva cerca de meio minuto para uma página curta. Cada um é baixado uma vez e depois fica salvo no seu navegador.

Ele mantém o layout da página?

Mantém a ordem de leitura, não o layout exato: trechos de texto na mesma altura são unidos, cada fileira vira uma linha, e uma linha em branco separa os parágrafos. Colunas lado a lado são lidas uma depois da outra, e tabelas saem como texto na ordem de leitura, não como planilha.

Posso ler várias imagens de uma vez?

Sim. Adicione quantas quiser; cada uma é lida por vez. Copiar todas as imagens copia todos os textos, cada um sob o nome do arquivo, e Baixar tudo (ZIP) salva as cópias mascaradas.

Ferramentas relacionadas