Extraer el texto de un PDF
Saca todo el texto de un PDF como texto plano limpio, conservando párrafos y orden de lectura. Revisa el resultado, cópialo al portapapeles o descarga un .txt — sin que el documento salga de tu dispositivo.
100% privado: los archivos se procesan en tu navegador y nunca se suben a ningún servidor.
Cómo funciona
- Arrastra un PDF al recuadro de arriba — la extracción empieza automáticamente.
- Comprueba el texto en la ventana de vista previa.
- Copia todo al portapapeles, o descárgalo como archivo .txt.
Sacar las palabras de un PDF
A veces solo necesitas el texto crudo — para citar un pasaje, meter un documento en otro programa, contar palabras o guardar una copia en texto plano. Extraer el texto saca las palabras de un PDF como un archivo .txt limpio que puedes pegar en cualquier sitio, sin formato ni lector de PDF.
Orden de lectura y párrafos, conservados
La extracción ingenua suele producir texto revuelto, porque un PDF guarda los caracteres por posición, no por orden de lectura. Esta herramienta recompone las líneas en párrafos usando el diseño de la página y vuelve a unir las palabras cortadas con guion entre líneas, así que la salida se lee como el documento en lugar de como un amasijo de fragmentos.
Cuando la extracción sale vacía
Si el resultado sale en blanco o casi, tu PDF es casi con seguridad un escaneo — las páginas son imágenes sin texto subyacente que extraer. La solución es el OCR: pasa el archivo por la herramienta OCR PDF para reconocer el texto primero y extráelo después. Y si quieres conservar encabezados y listas en vez de texto plano, usa la herramienta PDF a Markdown; usa el mismo motor con estructura añadida.
Para qué sirve el texto extraído
El texto plano es la forma más portable que puede tomar un documento, así que sacarlo de un PDF desbloquea muchas cosas. Puedes citar un pasaje sin reteclearlo, contar palabras o revisar el documento con un corrector ortográfico. Puedes meter el texto en otro programa — un traductor, una base de datos, un script de análisis — que espera entrada plana en vez de un PDF. Puedes pegarlo en una nota o un correo en segundos. Y una copia en texto plano es un archivo pequeño y a prueba de futuro de las palabras de un documento, legible en cualquier dispositivo durante décadas.
Preguntas frecuentes
¿Por qué el texto extraído sale vacío?
Probablemente tu PDF es un escaneo: las páginas son imágenes, no texto. Usa la herramienta OCR PDF para reconocer el texto primero, y extráelo después.
¿Conserva los párrafos y el orden de lectura?
Sí. Las líneas se recomponen en párrafos usando el diseño del documento, y las palabras cortadas con guion al final de línea se vuelven a unir.
¿Guardáis una copia de mi documento o de su texto?
No. Todo se ejecuta en tu navegador; ni el PDF ni el texto extraído se envían a ningún sitio.
Necesito también encabezados y listas — no solo texto plano.
Usa la herramienta PDF a Markdown: es el mismo motor, pero además reconstruye encabezados, listas y negritas como marcado Markdown.