Convertir imagen a texto

Arrastra una foto, un escaneo o una captura, elige el idioma, haz clic en «Reconocer texto» y copia el resultado o guárdalo como .txt. Así pasas de imagen a texto sin complicaciones: el reconocimiento se ejecuta totalmente en tu navegador, la imagen no se sube a ningún sitio.

Arrastra y suelta tus archivos aquí o

JPG, PNG, WebP, HEIC, GIF, BMP o TIFF – una imagen, hasta 50 MB

Consejo: también puedes pegar imágenes con Ctrl + V.

Tus archivos se procesan solo en tu navegador y no se suben a ningún servidor: no salen de tu dispositivo.

Mejores resultados: texto impreso, fotografiado recto, nítido, letra oscura sobre fondo claro, resolución de unos 300 ppp. La letra manuscrita apenas se reconoce.

Texto reconocido

Elige una imagen, revisa el idioma y haz clic en «Reconocer texto».

Resultado

Cómo se calcula

El reconocimiento óptico de caracteres (OCR, Optical Character Recognition) convierte de nuevo en letras los píxeles de una imagen: la foto de una carta, el escaneo de una factura o la captura de un documento se transforman en texto que puedes copiar, buscar y editar. Esta herramienta usa Tesseract, el motor de OCR libre más conocido, en su versión WebAssembly, directamente en tu navegador.

Cómo pasar una imagen a texto

  1. Arrastra la imagen, selecciónala o pégala con Ctrl + V (por ejemplo, una captura desde el portapapeles).
  2. Revisa el idioma del texto en la imagen. Viene preseleccionado el español; también puedes elegir alemán, inglés, francés o portugués.
  3. Haz clic en «Reconocer texto». La barra indica si se están cargando datos o si ya se está reconociendo el texto.
  4. Corrige el texto en el cuadro si hace falta y luego cópialo o guárdalo como archivo .txt.

Consejos para un buen reconocimiento

Límites

Tesseract está pensado para texto impreso. La letra manuscrita apenas se reconoce, igual que las tipografías muy decorativas, el texto de fotos de carteles en perspectiva o sobre fondos recargados. Las tablas y los diseños a varias columnas salen como texto corrido, y el orden de las columnas puede alterarse. La confianza que se muestra es el promedio que Tesseract calcula para todas las palabras; si baja de un 70 % aproximadamente, conviene usar una imagen mejor. Revisa siempre a mano los datos importantes (importes, IBAN, números de factura): confusiones como 0/O, 1/l o 5/S ocurren incluso con buenas imágenes.

La primera vez se cargan unos datos

Para que el reconocimiento funcione sin servidor, la primera vez que haces clic en «Reconocer texto» tu navegador descarga el motor de reconocimiento (unos 3,7 MB, comprimido en la transferencia a cerca de 1,5 MB) y los datos del idioma elegido: español 2,0 MB, alemán 1,3 MB, inglés 2,8 MB, francés 0,7 MB, portugués 1,3 MB. Todos los archivos están en este servidor, no se pide nada a ninguna red de distribución de contenido externa. Los datos del idioma quedan guardados en tu navegador (IndexedDB), así que la próxima vez irá bastante más rápido. Reconocer una página tarda unos segundos, según el dispositivo y el tamaño de la imagen.

Privacidad

Tu imagen no sale de tu dispositivo. El reconocimiento se calcula por completo en tu navegador (en un Web Worker), y el texto reconocido tampoco se envía a ningún sitio. Al cerrar la pestaña no queda nada guardado, salvo los datos de idioma descargados, que permanecen en el navegador hasta que lo vacíes.

Preguntas frecuentes

¿Se sube mi imagen?

No. El reconocimiento de texto se ejecuta totalmente en tu navegador. Solo se descargan el motor de reconocimiento y los datos del idioma, desde este servidor, no desde un proveedor externo. La imagen y el texto se quedan en tu dispositivo.

¿Qué idiomas se reconocen?

Alemán, inglés, francés, español y portugués. El idioma preseleccionado es el de esta página. Debe coincidir con el texto de la imagen; si no, faltan caracteres especiales como á, é, í, ñ o ¿/¡, y el reconocimiento es menos preciso.

¿La herramienta puede leer letra manuscrita?

Apenas. Tesseract está entrenado para texto impreso. Una letra de imprenta muy cuidada a veces funciona; la letra cursiva normal, prácticamente nunca.

¿Por qué el texto reconocido tiene errores?

Suele ser por la imagen: demasiado pequeña, borrosa, torcida, con poco contraste o con un fondo recargado. Fotografía la hoja recta desde arriba con buena luz, recorta ajustando al texto y revisa el idioma elegido. Como referencia, una resolución de unos 300 ppp.

¿Por qué el primer reconocimiento tarda más?

La primera vez, el navegador descarga el motor de reconocimiento (comprimido, unos 1,5 MB) y los datos del idioma (español 2,0 MB, inglés 2,8 MB). Después esos datos quedan guardados en el navegador y las siguientes imágenes van más rápido.

¿Puedo copiar texto de una captura de pantalla?

Sí. Haz la captura (Windows: Win + Mayús + S; Mac: Cmd + Mayús + 4), pégala aquí con Ctrl + V y haz clic en «Reconocer texto». Las capturas suelen ser ideales: nítidas, rectas y con buen contraste.

¿Funciona también con archivos PDF?

No directamente: la herramienta lee imágenes. Si tienes un PDF escaneado, haz una captura de la página o expórtala como imagen y pégala aquí. Si el PDF ya tiene texto, puedes seleccionarlo y copiarlo directamente en el lector de PDF.

¿Qué tan precisa es la herramienta?

Muy alta con escaneos y capturas limpias en letra impresa, a menudo sin errores. La confianza que aparece bajo el resultado ayuda a valorarlo: por debajo de un 70 % aproximadamente conviene usar una imagen mejor. Revisa siempre cifras como importes o el IBAN.

Fuentes y base legal

Última actualización:

Herramientas relacionadas