来源信息
- 仓库
- Ntizar/MasterMind
- 最近来源活动
- 2026年9月5日 21:34
- 检测到的 SKILL.md 语言
- 西班牙语
- 星标
- 2
- 分支
- 0
安装方式
默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。
检查来源文件
决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。
文件资源管理器
8 个文件正在显示 SKILL.md
SKILL.md
来源说明 · 只读预览- name
- liteparse-document-ai-parsing
- description
- Usa a parsear documentos en local con LiteParse.
- version
- 2.0.0
- tags
- ["parseo","liteparse","ocr","pdfium","pdf","local","rust"]
- related_skills
- ["liteparse","pdf-processing","marker-pdf-conversion","mineru-pdf-to-markdown"]
# LiteParse — parser de documentos LOCAL (v2)
> ⚠️ Corrección 2026-09-05 (auditoría): la v1 usaba `from liteparse import DocumentParser` con `model='gpt-4o'` y `schema=...` — **no existe**. LiteParse (v2) es un parser **local** (PDFium + Tesseract OCR) con API `LiteParse().parse(...)`, sin LLM ni cloud ni output CSV.
**Repo:** `https://github.com/run-llama/liteparse` (Rust, ~12K⭐).
## When to Use
- Cuando pidas **parsear documentos a Markdown/JSON/texto** en local, sin depender de un LLM/cloud. Parser de PDF con OCR.
## Uso (API real)
```python
from liteparse import LiteParse
parser = LiteParse()
result = parser.parse("documento.pdf") # parser local (PDFium + Tesseract OCR)
# formatos de salida: json | text | markdown (NO csv)
```
También vía CLI (crate Rust): `cargo install liteparse`.
## Pitfalls
- **NO** `DocumentParser(model="gpt-4o", schema=...)` — esa clase/params no existen.
- Es un parser local, explícitamente "sin features LLM propietarias ni dependencias cloud".
- Salidas: **json / text / markdown**; **no hay CSV**.
## Verificación
- `LiteParse().parse(doc.pdf)` → comprobar que produce markdown/texto con bounding boxes correctos.
在 GitHub 查看