Extraer texto

Copia todo el texto del PDF

Sin base de datos: AIMRAN no guarda tus archivos, textos ni resultados

¿Qué es Extraer texto?

Copiar texto de un PDF página a página es lento y a menudo se descoloca. Esta herramienta saca todo el texto del documento de una vez para que lo pegues en Word, en un correo o donde lo necesites.

Puedes añadir separadores con el número de cada página y ver cuántas palabras y caracteres tiene el documento. Si el PDF es un escaneo y no tiene texto, la herramienta te lo indica y te lleva al OCR.

Cómo se usa

  1. Arrastra el PDF.
  2. Activa «Separar por páginas» si quieres marcas entre páginas.
  3. Pulsa «Extraer texto».
  4. Copia el texto o descárgalo como archivo .txt.

Ventajas

Detalles técnicos

La extracción usa pdf.js para leer los fragmentos de texto de cada página y reconstruye las líneas siguiendo el orden del contenido: inserta un salto cuando cambia la línea base y un espacio cuando detecta un hueco horizontal entre fragmentos. Con la opción de separar por páginas se añade «--- Página N ---» antes de cada una. Solo se obtiene el texto real del PDF; las imágenes y los documentos escaneados no contienen texto y requieren OCR. Las tablas y columnas complejas pueden perder su disposición original. Admite PDF de hasta 200 MB.

Preguntas frecuentes

¿Cómo copiar todo el texto de un PDF?

Arrastra el PDF, pulsa «Extraer texto» y luego copia el resultado o descárgalo como .txt.

¿Por qué no sale texto de mi PDF?

Probablemente es un documento escaneado, formado por imágenes. Usa la herramienta «OCR de PDF escaneado» para reconocer el texto.

¿Se mantiene el formato al extraer el texto?

Se mantienen las líneas y los párrafos, pero no las negritas, tamaños ni tablas. Es texto plano.

¿Cómo pasar un PDF a TXT?

Extrae el texto y pulsa descargar: obtendrás un archivo .txt con el contenido del PDF.

Más herramientas de PDF