Skip to main content

pdf-to-markdown-multisource

Convert scientific, academic, scanned, two-column, and math-heavy PDFs into provenance-rich Markdown with CUDA Docling, PyMuPDF4LLM, native geometry, GROBID, MinerU, span-preserving PP-StructureV3 region rescue, and benchmark-gated VLM evidence. Use when extraction quality matters, especially for interleaved columns, glued words, headers/footers, watermark fragments, broken section order, empty grids, missing sections, or corrupt equations, tables, figures, and captions. Treat every automated output as a quality-gated draft that requires direct native-PDF inspection and manual Markdown postprocessing before final use.

Ir a la instalación

Datos de origen

Repositorio
CamiloMartinezM/pdf-to-markdown-multisource
Última actividad en el origen
3 de agosto de 2026 a las 10:34
Idioma detectado de SKILL.md
inglés
Estrellas
4
Forks
0

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.