Imagem para texto de alta precisão (OCR)
Extraia o texto de uma imagem com o maior modelo de OCR — o mais preciso, com um download inicial maior.
Solte imagens com texto aqui ou clique para escolher
Fotos, digitalizações e capturas de tela: JPG, PNG, WebP, GIF, BMP, TIFF ou AVIF. Lê inglês e outros idiomas de alfabeto latino, chinês e japonês. Não lê coreano. Os arquivos são processados no navegador e nunca enviados. Elas ficam neste navegador até você removê-las.
Ctrl+OescolherCtrl+Vcolar
Modelo de reconhecimento de texto
Modelo Precisão · …
Lê inglês e outros idiomas de alfabeto latino (francês, alemão, espanhol, polonês…), chinês (simplificado e tradicional) e japonês. Não lê coreano, russo ou outras línguas em cirílico, árabe, tailandês, hindi nem vietnamita.
Licenças: modelos (Apache-2.0) · mecanismo (MIT)
Quando a precisão é o que mais importa — letras pequenas, páginas fotografadas, recibos, imagens com pouco contraste ou fundo carregado —, esta ferramenta usa o maior dos três modelos de reconhecimento. O modelo de 132 MB é baixado uma vez e guardado no seu navegador. Com aceleração gráfica (WebGPU, na maioria dos navegadores atuais para computador), uma página densa é lida em poucos segundos; só com o processador, uma página curta leva cerca de meio minuto. Suas imagens nunca saem do seu dispositivo, e é grátis, sem cadastro.
Compare os três modelos de imagem para texto
| Imagem para texto (mais rápido) | Imagem para texto (equilibrado) | Imagem para texto (precisão)Esta página | |
|---|---|---|---|
| Download do modelo | 6 MB | 29,7 MB | 132,3 MB |
| Primeiro uso: download com o motor a 50 Mbit/s | 19,6 MB · ≈ 3 s | 43,4 MB · ≈ 7 s | 145,9 MB · ≈ 24 s |
| Depois disso | Fica salvo no navegador: sem novo download | ||
| Velocidade | O mais rápido | Rápido | O mais lento |
| Precisão | Bom com texto nítido | Melhor com fotos e letras pequenas | O melhor com imagens difíceis |
| Lê | alfabeto latino (inglês, português, espanhol…) e chinês | alfabeto latino (inglês, português, espanhol…), chinês e japonês | alfabeto latino (inglês, português, espanhol…), chinês e japonês |
O motor de reconhecimento (13,7 MB, ou 27,4 MB em navegadores com WebGPU) é baixado uma única vez e compartilhado pelos três. Nada é baixado até você pedir à ferramenta que leia uma imagem.
Como extrair texto com alta precisão
- Solte imagens em qualquer lugar da página, cole uma com Ctrl+V ou clique para escolher os arquivos. Uma imagem que você já adicionou em outra ferramenta de imagem — por exemplo, na página Equilibrado, para comparar — já está na lista.
- Na primeira vez, clique em Baixar modelo e ler texto. O download (cerca de 146 MB com o mecanismo) acontece uma única vez — o painel de progresso mostra o tamanho, a porcentagem e o tempo restante — e depois fica salvo no seu navegador, então na próxima vez a imagem selecionada é lida assim que a página abre, e as outras da lista com Ler ou Ler todas.
- Confira o texto ao lado da imagem: clique em uma região para encontrar a linha dela e dê um clique duplo para editar essa linha. Vale a pena olhar de novo as linhas sublinhadas. Depois, clique em Copiar texto (Ctrl+Shift+C) ou Baixar .txt.
- Para compartilhar a imagem sem o texto, baixe a cópia mascarada em Ocultar o texto na imagem — escolha a cor e as regiões a cobrir.
Recursos
- O maior modelo: 132 MB, cerca de 146 MB com o mecanismo, baixado uma vez e depois salvo no seu navegador
- Lê com mais precisão textos pequenos, borrados, girados ou com pouco contraste
- Com WebGPU, uma página densa em poucos segundos; só com o processador, cerca de meio minuto para uma página curta
- Lê inglês e outros idiomas de alfabeto latino, chinês (simplificado e tradicional) e japonês
- Texto na ordem de leitura, com as regiões contornadas e numeradas na imagem
- Edite, copie ou baixe o texto como .txt e baixe uma cópia da imagem com o texto oculto
- Cada arquivo baixado é verificado antes do uso, e os arquivos que chegaram completos são mantidos se um download for interrompido
É privado?
Sim. O modelo roda no seu navegador; a imagem e o texto reconhecido nunca são enviados, e as imagens ficam neste navegador até você removê-las da lista. Isso o torna adequado para recibos, documentos de identidade, contratos e outros documentos que você prefere não mandar a um serviço online.
Perguntas frequentes
Qual é a diferença para as outras duas ferramentas?
Ela lê com mais acerto textos pequenos, borrados, girados ou com pouco contraste, porque usa o maior modelo de reconhecimento. O custo é um download único maior (um modelo de 132 MB, contra 6 MB e 30 MB) e uma leitura mais lenta onde o navegador não tem aceleração gráfica: cerca de meio minuto para uma página curta e vários minutos para uma densa, mais em celulares. Para capturas de tela nítidas, Mais rápido ou Equilibrado bastam.
Preciso baixar o modelo toda vez?
Não. O modelo e o mecanismo (14 MB, ou 27 MB com WebGPU, compartilhado com as outras duas ferramentas) são baixados uma vez e salvos no seu navegador, e cada arquivo é verificado antes do uso. Na próxima vez, a ferramenta começa sem download. Excluir modelos baixados libera o espaço quando você quiser.
Quais idiomas ele lê?
Inglês impresso e outros idiomas de alfabeto latino (francês, alemão, espanhol, português, italiano, polonês, tcheco, turco…), dígitos e símbolos, chinês (simplificado e tradicional) e japonês (kanji, hiragana e katakana). Ele não lê coreano, russo ou outras línguas em cirílico, árabe, tailandês, hindi nem vietnamita.
Ele lê uma página de cabeça para baixo ou fotografada em ângulo?
Sim. Uma página de cabeça para baixo é detectada e lida na posição certa, e as linhas de uma foto um pouco inclinada são endireitadas antes de entrar na ordem de leitura, para não se misturarem. Texto vertical em chinês e japonês é lido em colunas, da direita para a esquerda.
E se o download for interrompido?
É só tentar de novo: o painel de progresso diz o que deu errado e oferece Tentar de novo. Os arquivos que chegaram completos e passaram na verificação são mantidos, então a nova tentativa baixa só o resto; nada baixado pela metade é usado.