Toolonit
  1. Início
  2. Imagem
  3. Imagem para texto (mais rápido)

OCR rápido: imagem para texto

Extraia o texto de uma imagem com o menor modelo de OCR — o mais rápido de baixar e executar.

Solte imagens com texto aqui ou clique para escolher

Fotos, digitalizações e capturas de tela: JPG, PNG, WebP, GIF, BMP, TIFF ou AVIF. Lê inglês e outros idiomas de alfabeto latino, e chinês. Não lê coreano nem kana japonês. Os arquivos são processados no navegador e nunca enviados. Elas ficam neste navegador até você removê-las.

Ctrl+OescolherCtrl+Vcolar

Modelo de reconhecimento de texto

Modelo Mais rápido · …

Lê inglês e outros idiomas de alfabeto latino (francês, alemão, espanhol, polonês…) e chinês. Não lê coreano, kana japonês, russo ou outras línguas em cirílico, árabe, tailandês, hindi nem vietnamita.

 

Licenças: modelos (Apache-2.0) · mecanismo (MIT)

Transforme uma captura de tela, uma foto ou uma página escaneada em texto que você pode copiar e editar — rápido. Esta é a mais leve das três ferramentas de imagem para texto: o modelo de reconhecimento tem só 6 MB, então a primeira execução é rápida até no celular, e depois disso uma captura de tela é lida em um ou dois segundos. Tudo roda no seu navegador: a imagem nunca sai do seu dispositivo, e é grátis, sem cadastro.

Compare os três modelos de imagem para texto

Imagem para texto (mais rápido)Esta páginaImagem para texto (equilibrado)Imagem para texto (precisão)
Download do modelo6 MB29,7 MB132,3 MB
Primeiro uso: download com o motor a 50 Mbit/s19,6 MB · ≈ 3 s43,4 MB · ≈ 7 s145,9 MB · ≈ 24 s
Depois dissoFica salvo no navegador: sem novo download
VelocidadeO mais rápidoRápidoO mais lento
PrecisãoBom com texto nítidoMelhor com fotos e letras pequenasO melhor com imagens difíceis
Lêalfabeto latino (inglês, português, espanhol…) e chinêsalfabeto latino (inglês, português, espanhol…), chinês e japonêsalfabeto latino (inglês, português, espanhol…), chinês e japonês

O motor de reconhecimento (13,7 MB, ou 27,4 MB em navegadores com WebGPU) é baixado uma única vez e compartilhado pelos três. Nada é baixado até você pedir à ferramenta que leia uma imagem.

Como converter uma imagem em texto rapidamente

  1. Solte uma ou mais imagens em qualquer lugar da página, cole uma captura de tela com Ctrl+V ou clique para escolher os arquivos. As imagens que você adicionou em outra ferramenta de imagem já estão na lista, e o recibo de exemplo mostra como funciona.
  2. Na primeira vez, clique em Baixar modelo e ler texto. Cerca de 20 MB — o modelo e o mecanismo que o executa — são baixados uma única vez e salvos no seu navegador; a partir daí, uma imagem que você adiciona é lida na hora, a selecionada assim que você abre a página, e as outras que já estão na lista quando você clica em Ler ou Ler todas.
  3. Confira o texto ao lado da imagem. Clique em uma região da imagem para encontrar a linha dela; as linhas de que o modelo não tem certeza aparecem sublinhadas. Corrija o que for preciso digitando e clique em Copiar texto (Ctrl+Shift+C) ou Baixar .txt.
  4. Opcional: em Ocultar o texto na imagem, escolha uma cor e baixe uma cópia da imagem com o texto coberto por caixas.

Recursos

  • O menor modelo: 6 MB, cerca de 20 MB com o mecanismo, baixado uma vez e depois salvo no seu navegador
  • Uma captura de tela lida em um ou dois segundos depois que o modelo está salvo
  • Lê inglês e outros idiomas de alfabeto latino, dígitos e chinês
  • Texto na ordem de leitura, com as regiões contornadas e numeradas na imagem
  • Edite, copie ou baixe o texto como .txt; as linhas de que o modelo não tem certeza aparecem sublinhadas
  • Oculte o texto na imagem e baixe a cópia mascarada
  • Várias imagens de uma vez

É privado?

Sim. O reconhecimento roda inteiramente no seu navegador; a imagem e o texto nunca saem do seu dispositivo, e as imagens ficam neste navegador até você removê-las da lista. O único download é o do modelo e do mecanismo, a partir deste site, na primeira vez que você usa a ferramenta.

Perguntas frequentes

Por que a primeira execução é mais lenta?

Porque, na primeira vez, o navegador baixa o modelo de reconhecimento (6 MB) e o mecanismo que o executa (14 MB, ou 27 MB em navegadores que usam a placa de vídeo via WebGPU) e depois os prepara. Os dois ficam salvos no navegador, então as próximas imagens e a sua próxima visita começam sem download. O mecanismo é compartilhado com as ferramentas Equilibrado e Precisão, então, se você experimentá-las depois, só o modelo delas será baixado.

Quais idiomas ele lê?

Inglês impresso e outros idiomas escritos no alfabeto latino (francês, alemão, espanhol, português, italiano, polonês, tcheco, turco…), dígitos e símbolos, e chinês. Ele não lê coreano, kana japonês, russo ou outras línguas em cirílico, árabe, tailandês, hindi nem vietnamita; para japonês, use a ferramenta Equilibrado ou Precisão.

Qual é a precisão do modelo mais rápido?

Muito boa em textos impressos nítidos, como capturas de tela, documentos e placas. Para letras pequenas ou fotos borradas, as ferramentas Equilibrado e Precisão leem com mais acerto, e as linhas de que o modelo não tem certeza aparecem sublinhadas para você conferir.

Mais rápido, Equilibrado ou Precisão — qual devo usar?

Mais rápido, quando o texto é nítido e você quer o menor download: cerca de 20 MB na primeira vez. Equilibrado (cerca de 43 MB) lê fotos e letras pequenas com mais precisão e também lê japonês; Precisão (cerca de 146 MB) lê melhor as imagens mais difíceis, mas é lento sem aceleração gráfica (WebGPU).

Como liberar o espaço que o modelo ocupa?

Clique em Excluir modelos baixados, em Modelo de reconhecimento de texto: todos os modelos salvos são removidos deste navegador. O modelo é baixado de novo na próxima vez que você ler um texto.

Ferramentas relacionadas