一键导入
website-downloader
Descargar sitios web completos para análisis offline — scraping batch de sitios enteros.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
Descargar sitios web completos para análisis offline — scraping batch de sitios enteros.
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Catálogo de Addy Osmani de skills engineering para AI coding agents — 8 slash commands mapeados al SDLC (spec → plan → build → test → review → ship).
Generación de informes y documentos profesionales mediante LLM. Arquitectura prompt→LLM→HTML capítulo, plantillas por sección, integración con datos de appState, y patrón demo interactivo. Aplicable a PMST, informes técnicos, auditorías, y cualquier documento estructurado.
AI Engineering Hub — catálogo de proyectos y tutoriales de ingeniería de IA con Jupyter notebooks.
AI Website Cloner — genera clonaciones de sitios web completas con IA desde una URL.
AutoScraper — scraping web automático con IA, aprende patrones de selección y extrae datos sin código.
Baidu Unlimited OCR — OCR gratuito de alta calidad sin límites de uso.
| name | website-downloader |
| description | Descargar sitios web completos para análisis offline — scraping batch de sitios enteros. |
| version | 1.0.0 |
| tags | ["downloader","website","scraping","batch","offline","analysis"] |
Descargar sitios web completos para análisis offline — scraping batch de sitios enteros. 4k⭐.
github.com/AhmadIbrahiim/Website-downloaderpip install website-downloader
# o clonar
git clone https://github.com/AhmadIbrahiim/Website-downloader.git
cd Website-downloader && pip install -r requirements.txt
from website_downloader import WebsiteDownloader
downloader = WebsiteDownloader()
# Descargar sitio completo
downloader.download(
url="https://ejemplo.com",
output_dir="./sites/ejemplo",
max_depth=3,
max_pages=100,
follow_links=True,
save_images=True,
)
# Descargar con filtros
downloader.download(
url="https://docs.ejemplo.com",
output_dir="./docs",
file_types=[".html", ".css", ".js"],
exclude_patterns=["/admin/*", "/login"],
)
firecrawl-web-scraping — descarga local vs APIstatic-digest-pipeline con fuentes localesllm-friendly-web-crawler