Skip to main content

liteparse-document-ai-parsing

Usa a parsear documentos en local con LiteParse.

跳到安装

来源信息

仓库
Ntizar/MasterMind
最近来源活动
2026年9月5日 21:34
检测到的 SKILL.md 语言
西班牙语
星标
2
分支
0

安装方式

默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。

检查来源文件

决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。

文件资源管理器
8 个文件

正在显示 SKILL.md

SKILL.md
来源说明 · 只读预览
name
liteparse-document-ai-parsing
description
Usa a parsear documentos en local con LiteParse.
version
2.0.0
tags
["parseo","liteparse","ocr","pdfium","pdf","local","rust"]
related_skills
["liteparse","pdf-processing","marker-pdf-conversion","mineru-pdf-to-markdown"]
# LiteParse — parser de documentos LOCAL (v2) > ⚠️ Corrección 2026-09-05 (auditoría): la v1 usaba `from liteparse import DocumentParser` con `model='gpt-4o'` y `schema=...` — **no existe**. LiteParse (v2) es un parser **local** (PDFium + Tesseract OCR) con API `LiteParse().parse(...)`, sin LLM ni cloud ni output CSV. **Repo:** `https://github.com/run-llama/liteparse` (Rust, ~12K⭐). ## When to Use - Cuando pidas **parsear documentos a Markdown/JSON/texto** en local, sin depender de un LLM/cloud. Parser de PDF con OCR. ## Uso (API real) ```python from liteparse import LiteParse parser = LiteParse() result = parser.parse("documento.pdf") # parser local (PDFium + Tesseract OCR) # formatos de salida: json | text | markdown (NO csv) ``` También vía CLI (crate Rust): `cargo install liteparse`. ## Pitfalls - **NO** `DocumentParser(model="gpt-4o", schema=...)` — esa clase/params no existen. - Es un parser local, explícitamente "sin features LLM propietarias ni dependencias cloud". - Salidas: **json / text / markdown**; **no hay CSV**. ## Verificación - `LiteParse().parse(doc.pdf)` → comprobar que produce markdown/texto con bounding boxes correctos.
在 GitHub 查看