Converter imagem para texto
Converter imagem para texto é simples: arraste a foto, digitalização ou print, escolha o idioma, clique em “Reconhecer texto” – e copie o resultado ou salve como .txt. O reconhecimento roda inteiramente no seu navegador, a imagem não é enviada para nenhum servidor.
Como o cálculo é feito
O reconhecimento de texto (OCR, Optical Character Recognition) transforma os pixels de uma imagem de volta em letras: a foto de uma carta, a digitalização de uma nota fiscal ou o print de um documento viram um texto que você pode copiar, buscar e editar. Esta ferramenta usa o Tesseract, o motor de OCR gratuito mais conhecido, em uma versão WebAssembly que roda direto no seu navegador.
Como transformar imagem em texto
- Arraste a imagem, selecione um arquivo ou cole com Ctrl + V (por exemplo, um print copiado da área de transferência).
- Confira o idioma na imagem. Aqui o padrão é Português; também dá para escolher Alemão, Inglês, Francês e Espanhol.
- Clique em “Reconhecer texto”. A barra mostra se os dados ainda estão sendo carregados ou se o texto já está sendo reconhecido.
- Corrija o texto no campo se precisar, depois copie ou salve como arquivo .txt.
Dicas para um bom reconhecimento
- Contraste: letras escuras em um fundo claro e uniforme funcionam melhor. Sombras, gradientes, padrões ou marcas d’água atrás do texto reduzem a precisão.
- Foto de frente: fotografe a folha de cima, sem inclinar. Linhas muito tortas ou curvadas (lombada de um livro, por exemplo) são reconhecidas com bem menos precisão.
- Resolução: como referência, use cerca de 300 dpi ao digitalizar. Em fotos, isso significa que o texto precisa aparecer grande o suficiente – letras maiúsculas com pelo menos uns 20 pixels de altura. Imagens muito pequenas são ampliadas automaticamente pela ferramenta (no máximo o dobro), e imagens muito grandes são reduzidas até 5.000 pixels no lado maior.
- Recorte: recorte só a área com texto, deixando de fora bordas, mãos e a mesa. Em prints, capture a janela em vez da tela inteira.
- Idioma certo: o idioma define o dicionário e o conjunto de caracteres usados. Com “Inglês” faltam letras como ç, ã e õ; com “Português” faltam os acentos do francês.
Limites
O Tesseract foi feito para texto impresso. Letra manuscrita é raramente reconhecida, assim como fontes muito estilizadas, texto em fotos de placas com perspectiva ou texto sobre um fundo agitado. Tabelas e layouts em várias colunas saem como texto corrido – a ordem das colunas pode ficar embaralhada. A confiança mostrada é a média que o Tesseract calcula para todas as palavras; abaixo de uns 70%, vale a pena tentar uma imagem melhor. Sempre confira à mão números importantes (valores, dados bancários, números de nota fiscal): trocas como 0/O, 1/l ou 5/S acontecem até em imagens boas.
Na primeira vez, dados são carregados
Para que o reconhecimento funcione sem servidor, no primeiro clique em “Reconhecer texto” o navegador baixa o programa de reconhecimento (cerca de 3,7 MB, comprimido em torno de 1,5 MB) e os dados do idioma escolhido: Português 1,3 MB, Alemão 1,3 MB, Inglês 2,8 MB, Francês 0,7 MB, Espanhol 2,0 MB. Todos os arquivos ficam neste servidor, nenhuma rede de distribuição de conteúdo externa é usada. O navegador guarda os dados do idioma localmente (IndexedDB), então da próxima vez fica bem mais rápido. Reconhecer uma página leva alguns segundos, dependendo do aparelho e do tamanho da imagem.
Privacidade
Sua imagem não sai do seu aparelho. O reconhecimento de texto roda totalmente no seu navegador (em um web worker), e o texto reconhecido também não é enviado para lugar nenhum. Depois de fechar a aba, nada disso fica salvo – só os dados de idioma baixados permanecem no armazenamento do navegador, até você limpá-lo.
Perguntas frequentes
Minha imagem é enviada para algum servidor?
Não. O reconhecimento de texto roda inteiramente no seu navegador. Só o programa de reconhecimento e os dados do idioma são baixados – deste servidor, não de um provedor externo. A imagem e o texto ficam no seu aparelho.
Quais idiomas são reconhecidos?
Português, Alemão, Inglês, Francês e Espanhol. O padrão é o idioma desta página. O idioma escolhido deve corresponder ao texto da imagem, senão faltam caracteres especiais como ç, ã, õ ou ä, ö, ü, e o reconhecimento fica menos preciso.
A ferramenta consegue ler letra manuscrita?
Quase nunca. O Tesseract foi treinado para texto impresso. Uma letra de forma bem caprichada às vezes funciona, mas letra cursiva comum praticamente nunca.
Por que o texto reconhecido saiu errado?
Geralmente é a imagem: pequena demais, desfocada, torta, com pouco contraste ou fundo agitado. Fotografe a folha de frente, com boa luz, recorte para mostrar só o texto e confira o idioma escolhido. Como referência, use uma resolução em torno de 300 dpi.
Por que o primeiro reconhecimento demora mais?
Na primeira vez, o navegador baixa o programa de reconhecimento (cerca de 1,5 MB comprimido) e os dados do idioma (Português 1,3 MB, Inglês 2,8 MB). Depois disso, os dados ficam salvos no navegador e as próximas imagens são mais rápidas.
Dá para copiar texto de um print?
Sim. Tire o print (Windows: Win + Shift + S, Mac: Cmd + Shift + 4), cole aqui com Ctrl + V e clique em “Reconhecer texto”. Prints costumam ser ideais: nítidos, retos e com bom contraste.
Funciona com arquivos PDF?
Não diretamente – a ferramenta lê imagens. Se o PDF for digitalizado, tire um print da página ou exporte-a como imagem e cole aqui. Se o PDF já tiver texto, é só selecioná-lo e copiá-lo direto no leitor de PDF.
Qual é a precisão do reconhecimento?
Em digitalizações e prints limpos com texto impresso, é bem alta, muitas vezes sem erros. A confiança mostrada abaixo do resultado ajuda a avaliar: abaixo de uns 70%, vale tentar uma imagem melhor. Números como valores ou dados bancários você deve sempre conferir.
Fontes e base legal
- Tesseract.js – biblioteca de OCR para o navegador (GitHub, Apache-2.0)
- Documentação do Tesseract OCR – melhorar a qualidade do reconhecimento (em inglês)
- Licenças: Tesseract.js, motor Tesseract e dados de idioma (Apache-2.0)
Última atualização:
Ferramentas relacionadas
- Limpar texto onlineRemova quebras de linha, espaços extras, linhas vazias e caracteres invisíveis, apague linhas duplicadas e ordene listas. Grátis e privado, no navegador.
- Contador de caracteres e palavrasConte caracteres com e sem espaço, palavras, frases, parágrafos e tempo de leitura na hora, com os limites do X, Instagram, TikTok, LinkedIn e SMS.
- Converter maiúsculas em minúsculas e vice-versaTransforme texto em MAIÚSCULAS ou minúsculas, inicial maiúscula na frase ou em cada palavra, camelCase e snake_case. Grátis, com acentos e ç, no navegador.
- Comprimir imagem – reduza o tamanho sem perda visívelComprimir imagem grátis e sem upload: reduza o tamanho de JPG, PNG, WebP e HEIC, até 20 por vez, com tamanho-alvo em KB e download em ZIP.
- Comparar textos: encontre as diferençasCompare dois textos online e destaque as diferenças por linha, palavra ou caractere, com porcentagem de semelhança. Grátis e privado, no navegador.
- Contador de hashtags e formatador de legenda do InstagramConte hashtags e menções @, encontre hashtags repetidas e formate a legenda do Instagram: hashtags no final e parágrafos preservados. Grátis.