Skip to main content

document-conversion

Usa a convertir muchos formatos con MarkItDown.

Zur Installation springen

Quellinformationen

Repository
Ntizar/MasterMind
Letzte Quellaktivität
5. September 2026 um 21:34
Erkannte Sprache von SKILL.md
Spanisch
Sterne
2
Forks
0

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.

SKILL.md wird angezeigt

SKILL.md
Quellanweisungen · Schreibgeschützte Vorschau
name
document-conversion
description
Usa a convertir muchos formatos con MarkItDown.
version
2.0.0
tags
["documentos","conversion","markitdown","pdf","docx","xlsx","python","llm"]
related_skills
["markitdown","document-conversion","pdf-processing","docx","xlsx"]
# MarkItDown — conversión de documentos a markdown para LLM > ⚠️ Corrección 2026-09-05 (auditoría): la fuente real es **`microsoft/markitdown`** (el manifest apuntaba a firecrawl/anydoc por error). MarkItDown **no convierte .mp4/.avi**: soporta PDF, Office, imágenes, audio, HTML, CSV/JSON/XML, ZIP, YouTube URLs y EPUB. No requiere poppler (usa pdfminer); solo Python 3.10+. **Repo:** `https://github.com/microsoft/markitdown` (Python, ~178K⭐). ## When to Use - Cuando pidas **convertir documentos** (PDF, DOCX, PPTX, XLSX, imágenes, audio, HTML…) a **Markdown** para consumir con un LLM. ## Uso ```bash pip install "markitdown[all]" # extras: [pdf,docx,pptx,xlsx,audio-transcription,youtube-transcription] ``` ```python from markitdown import MarkItDown md = MarkItDown() result = md.convert("documento.pdf") # también CLI: `markitdown archivo` print(result.text_content) ``` ## Formatos soportados PDF, PPTX, DOCX, XLSX, imágenes, audio (transcripción), HTML, CSV/JSON/XML, ZIP, YouTube URLs y EPUB. *(NO vídeo raw .mp4/.avi.)* ## Pitfalls - **No** convierte vídeo (.mp4/.avi). - **No** requiere poppler-utils (usa pdfminer); Python 3.10+. - Fuente: `microsoft/markitdown`. ## Verificación - `md.convert(doc.pdf)` → `text_content`; probar con DOCX/XLSX.
Auf GitHub ansehen