Suelta aquí imágenes o un PDF
o haz clic para elegir — puedes seleccionar varios a la vez
Idioma
Añade una imagen o un PDF para empezar a leer

Extraer texto de imágenes y PDF escaneados

Suelta una captura de pantalla, la foto de una página o un PDF escaneado, y el texto que contiene vuelve como algo que puedes seleccionar, copiar y editar. El reconocimiento sucede en tu navegador: el archivo no sale de tu dispositivo. Puedes soltar varias imágenes a la vez, y un PDF se lee página a página.

Qué hace esta herramienta

Lee bien el texto impreso

Con capturas limpias y buenos escaneos el reconocimiento es casi exacto. También aguanta fotos con iluminación desigual o algo de perspectiva, aunque una toma recta y bien iluminada siempre se lee mejor que una torcida.

Nueve idiomas

Inglés, chino (simplificado y tradicional), japonés, coreano, alemán, francés, español e italiano. Las opciones que no son inglés cargan también el inglés, porque los documentos reales están llenos de números de pedido, correos e importes en caracteres latinos.

PDF escaneados, página a página

El PDF se abre y cada página se lee por turno, así que no tienes que exportar las páginas como imágenes antes.

Varios archivos a la vez

Suelta una carpeta entera de capturas y se ponen en cola. Si una falla, las demás siguen — un archivo defectuoso no detiene el lote.

No se sube nada

El motor de reconocimiento funciona en la propia página. Tus imágenes y PDF no se envían a ninguna parte, algo que importa cuando el documento es una factura, un contrato o cualquier cosa con datos personales.

Copiar o descargar

Lleva el resultado directamente al portapapeles o descárgalo como archivo .txt. Con varios archivos, cada resultado va etiquetado para que no se mezclen.

Cómo extraer el texto de una imagen

1

Añade tus archivos

Arrastra imágenes o un PDF, o haz clic para elegirlos. Funcionan JPG, PNG, WebP, GIF, BMP y PDF, hasta 50 MB cada uno.

2

Elige el idioma

El del texto de la imagen, no el de esta página. Este ajuste influye en la precisión más que ningún otro.

3

Copia o descarga el texto

Los resultados aparecen según van terminando los archivos. Copia todo al portapapeles o guárdalo como .txt.

Cuándo resulta útil

Texto atrapado en una captura

Alguien te manda la captura de un mensaje de error, una dirección o un fragmento de código. En vez de teclearlo otra vez, saca el texto y pégalo.

Documentos escaneados que no se pueden buscar

Un contrato escaneado no es más que una imagen para el ordenador. Solo al extraer el texto se vuelve algo que puedes buscar y citar.

Páginas fotografiadas

Una página de un libro, o la pizarra después de una reunión. Recuperas las palabras sin transcribirlas a mano.

Facturas y recibos

Saca referencias e importes sin entrecerrar los ojos ante una foto para copiar dígito a dígito.

Papeleo antiguo que se está archivando

Cuando se escanean cajas de papel, lo que queda son imágenes. Es el texto extraído lo que hace que el archivo sirva de algo después.

Material en un idioma que estás aprendiendo

Con los caracteres convertidos en texto puedes buscarlos en el diccionario, algo imposible mientras siguen encerrados en una imagen.

Para obtener mejores resultados

Ajusta primero el idioma

Es con diferencia el factor que más pesa. Leer texto en chino con el modelo de inglés dará un galimatías por muy nítida que sea la imagen.

Recorta hasta dejar solo el texto

Las fotos de páginas suelen incluir la mesa, una mano, parte de la habitación. Dejando solo el papel, el motor tiene menos con lo que confundirse.

Mejor luz uniforme que luz intensa

Una sombra cruzando media página perjudica más que una foto algo oscura en conjunto. Muévete para que la luz sea uniforme en lugar de más fuerte.

Mantén las líneas horizontales

El texto inclinado se lee bastante peor. Enderezar la foto antes de subirla merece esos segundos.

Usa el archivo original

Una captura de una captura, o una foto reenviada por varias aplicaciones de mensajería, se ha comprimido cada vez. El original siempre es más nítido.

Texto impreso sí, manuscrito no

Esto funciona con texto impreso y compuesto. La escritura a mano es un problema realmente distinto y el resultado te decepcionará.

Por qué usar esta

Tus documentos siguen siendo tuyos

La mayoría de los conversores online suben tu archivo a su servidor. Este no: todo ocurre en el navegador, así que después no queda nada que borrar.

Gratis, sin cuenta y sin marca de agua

Sin límite de páginas, sin registro a mitad de camino, sin venta cruzada antes de ver el resultado. El sitio es gratuito y seguirá siéndolo.

Funciona sin conexión una vez cargado

Tras descargar el motor la primera vez, tu navegador lo conserva. Las visitas siguientes empiezan al momento y funcionan sin conexión.

El lote y el PDF vienen incluidos

Varias imágenes a la vez y los PDF de varias páginas forman parte de la herramienta gratuita, no de un plan de pago.

El chino, el japonés y el coreano están bien cuidados

Los motores de reconocimiento suelen esparcir espacios entre todos los caracteres, y el resultado queda incómodo de usar. Aquí se limpian, pero los espacios entre caracteres CJK y latinos se conservan, porque esos sí son reales.

Funciona en el móvil

Todo se ejecuta en el navegador móvil, así que puedes leer una foto directamente desde tu galería.

Preguntas sobre extraer texto

Sí. OCR — reconocimiento óptico de caracteres — es el nombre general de leer texto impreso a partir de una imagen, y es exactamente lo que ocurre aquí. La diferencia con la mayoría de webs de OCR está en dónde se ejecuta: el motor se descarga a tu navegador en lugar de subir tu archivo al servidor de alguien.
Con texto impreso limpio — capturas, buenos escaneos — es casi exacto. En nuestras propias pruebas, el texto impreso en inglés salió perfecto y el chino rondó el 98 %. Las fotos con iluminación desigual o algo de perspectiva quedaron en torno al 94–95 %. Conviene revisar el resultado por encima en lugar de fiarse a ciegas, sobre todo con los números.
No, y conviene decirlo claro. El motor está hecho para texto impreso y compuesto. El reconocimiento de escritura a mano es otro problema que necesita otros modelos, e intentarlo aquí solo te hará perder el tiempo.
No. El texto de dentro de la tabla se leerá, pero la estructura de filas y columnas no se conserva: obtienes las palabras, no una cuadrícula. El motor no detecta en absoluto la estructura de las tablas, así que no hay forma de exportar un Excel aprovechable.
No. El motor de reconocimiento se descarga a tu navegador y se ejecuta allí. Tus imágenes y PDF se leen directamente desde tu dispositivo y no se envían a ninguna parte. Por eso también sigue funcionando si se corta la conexión una vez cargada la página.
La primera vez, el navegador descarga el motor de reconocimiento y los datos del idioma: unos 6 MB en total. Después tu navegador los guarda en caché, las siguientes veces arranca al instante y cada imagen tarda bastante menos de un segundo.
El del texto de la imagen, no el de esta página. Si te equivocas, el resultado será un galimatías incluso con una imagen perfectamente nítida. Las opciones que no son inglés cargan también el inglés, de modo que los documentos mixtos con números de pedido y correos se leen correctamente.
Sí. Cada página se renderiza y se lee por turno, y los resultados aparecen página a página. Los documentos muy largos se limitan a las primeras 100 páginas, y se te avisa en lugar de dejarte con la duda.
Verás «No se ha encontrado texto» en lugar de un error, porque una imagen sin texto legible es un resultado normal. Suele significar que la imagen está borrosa, la letra es demasiado pequeña o el idioma elegido no es el correcto.
Porque no debería llevarlos. Los motores de reconocimiento tratan cada carácter chino como una palabra aparte y ponen espacios entre todos ellos, lo que deja un resultado incómodo. Aquí se eliminan, pero los espacios entre caracteres chinos y latinos se conservan, porque esos son reales.
Sí. Suelta tantas imágenes como quieras y se pondrán en cola, con los resultados apareciendo según terminan. Si un archivo falla los demás continúan, y puedes detenerlo en cualquier momento sin perder lo ya leído.
Extraer texto de imagen y PDF, gratis y online