Convertir PDF a Markdown

Extrae el texto de un PDF como Markdown estructurado: encabezados, párrafos, listas y negritas se reconstruyen a partir del diseño del documento. Perfecto para notas, wikis, prompts de IA y contenido de sitios estáticos. Pocas herramientas lo ofrecen, y aquí funciona íntegramente en tu navegador.

Arrastra tus archivos aquío haz clic para elegir archivos — se procesan en tu dispositivo, nunca se suben

100% privado: los archivos se procesan en tu navegador y nunca se suben a ningún servidor.

Cómo funciona

  1. Arrastra un PDF al recuadro de arriba — la extracción empieza automáticamente.
  2. Revisa el Markdown en la vista previa y ajusta lo que quieras.
  3. Cópialo al portapapeles o descárgalo como archivo .md.

Por qué Markdown, y por qué ahora

Markdown se ha convertido discretamente en el idioma común del trabajo escrito. Las apps de notas, los wikis, los generadores de sitios estáticos, las herramientas de documentación y — cada vez más — los asistentes de IA lo leen y lo escriben. Pasar un PDF a Markdown limpio significa que su contenido puede fluir hacia cualquiera de ellos, editado como texto plano con estructura en lugar de atrapado en un documento de maquetación fija.

El auge de la IA ha hecho esto especialmente útil. Los modelos de lenguaje funcionan mejor con texto limpio y estructurado, así que convertir un informe o un artículo a Markdown antes de pegarlo en un prompt da resultados mucho mejores que volcar el texto crudo y desordenado de un PDF.

Cómo se reconstruye el diseño

Un PDF no guarda encabezados, listas ni párrafos como tales — guarda caracteres en posiciones de una página. Para reconstruir la estructura, la herramienta analiza ese diseño: agrupa los caracteres en líneas por su posición vertical, une líneas en párrafos usando el espaciado entre ellas, infiere niveles de encabezado a partir de los tamaños de fuente relativos, detecta listas con viñetas y numeradas, marca los tramos en negrita y vuelve a unir las palabras cortadas por guiones al final de línea. El resultado es Markdown que refleja la estructura del documento, no solo su texto crudo.

Qué funciona bien, y qué conviene revisar

Los documentos sencillos — informes, artículos, ebooks, cartas — se convierten limpiamente. Los diseños complejos son más difíciles: las páginas a varias columnas, las tablas, las notas al pie y el diseño recargado pueden confundir a cualquier método de reconstrucción, así que merece la pena echar un vistazo a la vista previa y arreglar lo que haya salido raro antes de usarlo. La vista previa editable está justo para que corrijas esos casos en segundos.

Preguntas frecuentes

¿En qué se diferencia de PDF a texto?

La extracción de texto plano te da un bloque de palabras sin formato. Esta herramienta analiza tamaños de fuente, espaciado y diseño para reconstruir la estructura: los encabezados #, las listas -, las **negritas** y los párrafos salen como Markdown real.

¿Funciona con cualquier PDF?

Funciona con PDF que contienen texto real (la mayoría de documentos, informes y ebooks). Los PDF escaneados solo contienen imágenes — pásalos antes por la herramienta OCR PDF y convierte el resultado.

¿La reconstrucción del diseño es perfecta?

Las heurísticas funcionan bien con documentos típicos, pero los diseños complejos — varias columnas, tablas, notas al pie — pueden necesitar retoques. La vista previa te deja corregir antes de descargar.

¿Mi documento se sube para convertirlo?

No. La extracción y la reconstrucción a Markdown se ejecutan íntegramente en tu navegador. El PDF nunca sale de tu dispositivo — útil cuando el documento es confidencial.

¿Las tablas se convierten en tablas Markdown?

La reconstrucción de tablas es intrínsecamente poco fiable en PDF arbitrarios, así que las tablas complejas pueden necesitar retoque manual en la vista previa. El texto y las listas simples salen bien.