Converter imagem para texto

Converter imagem para texto é simples: arraste a foto, digitalização ou print, escolha o idioma, clique em “Reconhecer texto” – e copie o resultado ou salve como .txt. O reconhecimento roda inteiramente no seu navegador, a imagem não é enviada para nenhum servidor.

Arraste os arquivos para cá ou

JPG, PNG, WebP, HEIC, GIF, BMP ou TIFF – uma imagem, até 50 MB

Dica: você também pode colar imagens com Ctrl + V.

Seus arquivos são processados só no seu navegador e não são enviados para nenhum servidor – eles não saem do seu aparelho.

Melhores resultados: texto impresso, foto tirada de frente, nítida, letras escuras em fundo claro, resolução em torno de 300 dpi. Letra manuscrita é raramente reconhecida.

Texto reconhecido

Escolha uma imagem, confira o idioma e clique em “Reconhecer texto”.

Resultado

Como o cálculo é feito

O reconhecimento de texto (OCR, Optical Character Recognition) transforma os pixels de uma imagem de volta em letras: a foto de uma carta, a digitalização de uma nota fiscal ou o print de um documento viram um texto que você pode copiar, buscar e editar. Esta ferramenta usa o Tesseract, o motor de OCR gratuito mais conhecido, em uma versão WebAssembly que roda direto no seu navegador.

Como transformar imagem em texto

  1. Arraste a imagem, selecione um arquivo ou cole com Ctrl + V (por exemplo, um print copiado da área de transferência).
  2. Confira o idioma na imagem. Aqui o padrão é Português; também dá para escolher Alemão, Inglês, Francês e Espanhol.
  3. Clique em “Reconhecer texto”. A barra mostra se os dados ainda estão sendo carregados ou se o texto já está sendo reconhecido.
  4. Corrija o texto no campo se precisar, depois copie ou salve como arquivo .txt.

Dicas para um bom reconhecimento

Limites

O Tesseract foi feito para texto impresso. Letra manuscrita é raramente reconhecida, assim como fontes muito estilizadas, texto em fotos de placas com perspectiva ou texto sobre um fundo agitado. Tabelas e layouts em várias colunas saem como texto corrido – a ordem das colunas pode ficar embaralhada. A confiança mostrada é a média que o Tesseract calcula para todas as palavras; abaixo de uns 70%, vale a pena tentar uma imagem melhor. Sempre confira à mão números importantes (valores, dados bancários, números de nota fiscal): trocas como 0/O, 1/l ou 5/S acontecem até em imagens boas.

Na primeira vez, dados são carregados

Para que o reconhecimento funcione sem servidor, no primeiro clique em “Reconhecer texto” o navegador baixa o programa de reconhecimento (cerca de 3,7 MB, comprimido em torno de 1,5 MB) e os dados do idioma escolhido: Português 1,3 MB, Alemão 1,3 MB, Inglês 2,8 MB, Francês 0,7 MB, Espanhol 2,0 MB. Todos os arquivos ficam neste servidor, nenhuma rede de distribuição de conteúdo externa é usada. O navegador guarda os dados do idioma localmente (IndexedDB), então da próxima vez fica bem mais rápido. Reconhecer uma página leva alguns segundos, dependendo do aparelho e do tamanho da imagem.

Privacidade

Sua imagem não sai do seu aparelho. O reconhecimento de texto roda totalmente no seu navegador (em um web worker), e o texto reconhecido também não é enviado para lugar nenhum. Depois de fechar a aba, nada disso fica salvo – só os dados de idioma baixados permanecem no armazenamento do navegador, até você limpá-lo.

Perguntas frequentes

Minha imagem é enviada para algum servidor?

Não. O reconhecimento de texto roda inteiramente no seu navegador. Só o programa de reconhecimento e os dados do idioma são baixados – deste servidor, não de um provedor externo. A imagem e o texto ficam no seu aparelho.

Quais idiomas são reconhecidos?

Português, Alemão, Inglês, Francês e Espanhol. O padrão é o idioma desta página. O idioma escolhido deve corresponder ao texto da imagem, senão faltam caracteres especiais como ç, ã, õ ou ä, ö, ü, e o reconhecimento fica menos preciso.

A ferramenta consegue ler letra manuscrita?

Quase nunca. O Tesseract foi treinado para texto impresso. Uma letra de forma bem caprichada às vezes funciona, mas letra cursiva comum praticamente nunca.

Por que o texto reconhecido saiu errado?

Geralmente é a imagem: pequena demais, desfocada, torta, com pouco contraste ou fundo agitado. Fotografe a folha de frente, com boa luz, recorte para mostrar só o texto e confira o idioma escolhido. Como referência, use uma resolução em torno de 300 dpi.

Por que o primeiro reconhecimento demora mais?

Na primeira vez, o navegador baixa o programa de reconhecimento (cerca de 1,5 MB comprimido) e os dados do idioma (Português 1,3 MB, Inglês 2,8 MB). Depois disso, os dados ficam salvos no navegador e as próximas imagens são mais rápidas.

Dá para copiar texto de um print?

Sim. Tire o print (Windows: Win + Shift + S, Mac: Cmd + Shift + 4), cole aqui com Ctrl + V e clique em “Reconhecer texto”. Prints costumam ser ideais: nítidos, retos e com bom contraste.

Funciona com arquivos PDF?

Não diretamente – a ferramenta lê imagens. Se o PDF for digitalizado, tire um print da página ou exporte-a como imagem e cole aqui. Se o PDF já tiver texto, é só selecioná-lo e copiá-lo direto no leitor de PDF.

Qual é a precisão do reconhecimento?

Em digitalizações e prints limpos com texto impresso, é bem alta, muitas vezes sem erros. A confiança mostrada abaixo do resultado ajuda a avaliar: abaixo de uns 70%, vale tentar uma imagem melhor. Números como valores ou dados bancários você deve sempre conferir.

Fontes e base legal

Última atualização:

Ferramentas relacionadas