소스 정보
- 저장소
- ptreezh/sscisubagent-skills
- 최근 소스 활동
- 2025년 12월 28일 15:46
- 감지된 SKILL.md 언어
- 중국어
- 스타
- 28
- 포크
- 7
설치 방법
기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.
소스 파일 검토
설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.
메뉴
기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.
설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.
SOC 직업 분류 기준
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
직접 명령은 검토 Prompt를 거치지 않습니다. 실행하기 전에 소스를 확인하세요.
npx skills add https://github.com/ptreezh/sscisubagent-skills --skill trusted-web-scraper명령은 한 줄로 유지됩니다. 복사하기 전에 가로로 스크롤해 전체 내용을 확인하세요.
로컬 사본을 원하시나요? SkillsMP에서 현재 제공할 수 있는 파일을 다운로드하세요.
SKILL.md 표시 중
| name | trusted-web-scraper |
| description | 专门用于爬取可信网站(企业官网、教育网、政务网)信息的爬虫技能,确保数据来源的可靠性 |
| version | 1.0.0 |
| author | socienceAI.com |
| license | MIT |
| tags | ["web-scraping","trusted-sources","data-collection","research","enterprise-websites","educational-sites","government-sites"] |
| compatibility | Claude 3.5 Sonnet and above |
| metadata | {"domain":"data-collection","methodology":"web-scraping","complexity":"advanced","integration_type":"data_collection_tool","last_updated":"2025-12-27"} |
| allowed-tools | ["python","bash","read_file","write_file","web_fetch"] |
可信网站爬虫技能专门用于从可信网站(企业官网、教育网、政务网)收集信息,确保数据来源的可靠性和权威性。该技能采用多种技术手段来验证网站可信度,并使用适当的爬取策略来获取所需信息。
当用户请求以下操作时使用此技能:
当用户请求爬取可信网站信息时:
url: 要爬取的网站URLcontent_type: 要提取的内容类型(text, images, tables, documents等)data_fields: 指定要提取的数据字段verification_level: 验证级别(basic, standard, thorough)rate_limit: 请求频率限制(requests per minute)timeout: 请求超时时间(秒)retry_attempts: 重试次数output_format: 输出格式(json, csv, markdown等)methodology: 爬取方法(static, dynamic, api)cultural_context: 文化背景考虑(特别是中文网站)User: "收集某知名科技公司的产品信息和最新公告" Response: 验证网站可信度,提取产品目录和新闻公告,生成结构化数据。
User: "提取某大学计算机科学专业的课程信息" Response: 验证教育网站可信度,提取课程列表、描述和要求,整理成结构化格式。
User: "获取最新的教育政策文件" Response: 验证政府网站可信度,提取政策文件和相关内容,提供结构化摘要。
{
"summary": {
"url": "https://example.com",
"status_code": 200,
"trust_level": "high",
"content_extracted": 15,
"processing_time": 2.5
},
"details": {
"extracted_data": [...],
"metadata": {...},
"verification_info": {...}
},
"metadata": {
"timestamp": "2025-12-27T10:30:00",
"version": "1.0.0"
}
}
完成高质量的可信网站爬取应包括:
此技能为研究提供可靠的网络数据收集支持,确保数据来源的可信度和提取过程的合规性。