Skip to main content

autoscraper

AutoScraper — scraping web automático con IA, aprende patrones de selección y extrae datos sin código.

설치로 이동

소스 정보

저장소
Ntizar/NtizarBrainMasterMind
최근 소스 활동
2026년 7월 16일 08:02
감지된 SKILL.md 언어
스페인어
스타
2
포크
0

설치 방법

기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.

소스 파일 검토

설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.

SKILL.md 표시 중

SKILL.md
소스 지침 · 읽기 전용 미리보기
name
autoscraper
description
AutoScraper — scraping web automático con IA, aprende patrones de selección y extrae datos sin código.
category
data-pipeline
# AutoScraper — Scraping Web con IA ## Qué es AutoScraper es una herramienta de scraping que usa patrones de aprendizaje para extraer datos: - **Pattern learning** — aprende patrones de selección de la página - **No code** — no requiere selectors CSS o XPath - **Adaptive** — se adapta a cambios en la estructura de la página - **Fast** — basado en requests + pattern matching ## Instalación ```bash pip install autoscraper ``` ## Uso básico ```python from autoscraper import AutoScraper # Crear scraper aprendiendo de ejemplos wanted_list = ['Price', 'Rating', 'Reviews'] response = requests.get('https://example.com/product') scraper = AutoScraper() result = scraper.build(response.text, wanted_list) # Extraer de nueva página new_response = requests.get('https://example.com/product2') new_result = scraper.run(new_response.text) print(new_result) ``` ## Casos de uso para David - **Web scraping** — extraer datos de sites sin API - **Data collection** — recoger datos estructurados de la web - **Integration** — usar con crawlee para scraping robusto - **Anti-detection** — usar con curl-impersonate ## Pitfalls - No funciona bien con contenido JS-renderizado (usa requests, no browser) - Los patrones pueden romperse si la página cambia - No maneja autenticación/login - Combinar con Playwright/Selenium para JS sites ## Referencias - Repo: `github.com/alirezamika/autoscraper` (7K⭐)
GitHub에서 보기