원클릭으로
liteparse
Parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica — extracción de contenido estructurado.
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
Parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica — extracción de contenido estructurado.
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
SOC 직업 분류 기준
Catálogo de Addy Osmani de skills engineering para AI coding agents — 8 slash commands mapeados al SDLC (spec → plan → build → test → review → ship).
Generación de informes y documentos profesionales mediante LLM. Arquitectura prompt→LLM→HTML capítulo, plantillas por sección, integración con datos de appState, y patrón demo interactivo. Aplicable a PMST, informes técnicos, auditorías, y cualquier documento estructurado.
AI Engineering Hub — catálogo de proyectos y tutoriales de ingeniería de IA con Jupyter notebooks.
AI Website Cloner — genera clonaciones de sitios web completas con IA desde una URL.
AutoScraper — scraping web automático con IA, aprende patrones de selección y extrae datos sin código.
Baidu Unlimited OCR — OCR gratuito de alta calidad sin límites de uso.
| name | liteparse |
| description | Parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica — extracción de contenido estructurado. |
| version | 1.0.0 |
| tags | ["parsing","LLM","web","document","structure","extraction"] |
Herramienta de parseo inteligente de páginas web y documentos para pipelines LLM con estructura semántica. 10k⭐.
github.com/run-llama/liteparsepip install liteparse
# o
npm install @run-llama/liteparse
from liteparse import LiteParse
parser = LiteParse()
# Parsear HTML → estructura semántica
doc = parser.parse("<html>...")
structured = doc.to_dict() # Extrae títulos, párrafos, listas, tablas
# Parsear documento
with open("documento.pdf", "rb") as f:
doc = parser.parse(f.read(), format="pdf")
md = doc.to_markdown()
marker-pdf-conversion (parseo semántico vs conversión a MD)llm-friendly-web-crawler preprocessing