Skip to main content

pdf-to-markdown-multisource

Convert scientific, academic, scanned, two-column, and math-heavy PDFs into provenance-rich Markdown with CUDA Docling, PyMuPDF4LLM, native geometry, GROBID, MinerU, span-preserving PP-StructureV3 region rescue, and benchmark-gated VLM evidence. Use when extraction quality matters, especially for interleaved columns, glued words, headers/footers, watermark fragments, broken section order, empty grids, missing sections, or corrupt equations, tables, figures, and captions. Treat every automated output as a quality-gated draft that requires direct native-PDF inspection and manual Markdown postprocessing before final use.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
CamiloMartinezM/pdf-to-markdown-multisource
آخر نشاط في المصدر
٣ أغسطس ٢٠٢٦ في ١٠:٣٤
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٤
التفرعات
٠

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.