一键导入
liteparse
Parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica — extracción de contenido estructurado.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
Parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica — extracción de contenido estructurado.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Catálogo de Addy Osmani de skills engineering para AI coding agents — 8 slash commands mapeados al SDLC (spec → plan → build → test → review → ship).
Generación de informes y documentos profesionales mediante LLM. Arquitectura prompt→LLM→HTML capítulo, plantillas por sección, integración con datos de appState, y patrón demo interactivo. Aplicable a PMST, informes técnicos, auditorías, y cualquier documento estructurado.
AI Engineering Hub — catálogo de proyectos y tutoriales de ingeniería de IA con Jupyter notebooks.
AI Website Cloner — genera clonaciones de sitios web completas con IA desde una URL.
AutoScraper — scraping web automático con IA, aprende patrones de selección y extrae datos sin código.
Baidu Unlimited OCR — OCR gratuito de alta calidad sin límites de uso.
| name | liteparse |
| description | Parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica — extracción de contenido estructurado. |
| version | 1.0.0 |
| tags | ["parsing","LLM","web","document","structure","extraction"] |
Herramienta de parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica. 10k⭐.
github.com/run-llama/liteparsepip install liteparse
# o
npm install @run-llama/liteparse
from liteparse import LiteParse
parser = LiteParse()
# Parsear HTML → estructura semántica
doc = parser.parse("<html>...")
structured = doc.to_dict() # Extrae títulos, párrafos, listas, tablas
# Parsear documento
with open("documento.pdf", "rb") as f:
doc = parser.parse(f.read(), format="pdf")
md = doc.to_markdown()
marker-pdf-conversion (parseo semántico vs conversión a MD)llm-friendly-web-crawler preprocessing