원클릭으로
authoritative-data-harvester
自动定位并获取权威公开数据(优先API/官方批量下载),输出可复现抓取与清洗方案。Invoke when用户需要权威数据、官方统计、API下载或数据源爬取。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
自动定位并获取权威公开数据(优先API/官方批量下载),输出可复现抓取与清洗方案。Invoke when用户需要权威数据、官方统计、API下载或数据源爬取。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
Manages persistent memory. Invoke to read active context or archive old tasks. Structure: Long-term Principles (Rules) + Short-term Workbench (Tasks).
自动清洗赛题或爬取的数据(处理缺失/异常/格式),并生成可视化图表。Invoke when 用户需要处理原始数据、清洗数据或生成数据分析图表。
按常见评分点生成建模论文结构与写作清单,并根据题目类型与数据条件给出模型选择与对照实验路线。Invoke when需要“论文格式/评分对齐/模型选型/路线不确定”。
基于微单元模板与脚本批量生成并合并论文内容。Invoke when需要按微单元拆分逐单元写作并用 scripts/generate_all_offline.py 与 scripts/merge.py 自动生成论文。
串联赛题解析、数据计算与微单元脚本,一键从赛题文件夹到完整论文。Invoke when用户已放好赛题与附件,希望自动跑完全流程。
解析赛题PDF/Word,抽取任务与数据条件并给出模型选型与验证路线。Invoke when用户提供赛题文档或题目文本,需要确定采用何模型/方法。
SOC 직업 분류 기준
| name | authoritative-data-harvester |
| description | 自动定位并获取权威公开数据(优先API/官方批量下载),输出可复现抓取与清洗方案。Invoke when用户需要权威数据、官方统计、API下载或数据源爬取。 |
在数学建模任务中,快速找到“权威、可引用、可复现”的公开数据源,并以尽量不爬网页、优先 API/批量下载的方式获取数据,最终输出:
输出“数据需求表”,至少包含:
按任务类型优先匹配:
交付脚本必须具备:
当某源不可用/受限:
crawled_data/raw/。crawled_data/processed/。crawled_data/sources.json(包含 url、参数、访问日期、许可证/条款)。data-cleaning-and-visualization(把 crawled_data/ 里的数据统一清洗并出图)。paper-workflow-orchestrator。context-memory-keeper,记录“新增数据源名称”与“存放路径”到 Short-term Workbench。crawled_data/。crawled_data/sources.json 中记录可引用来源信息。data-cleaning-and-visualization,把数据清洗并生成 paper_output/figures/ 的证据图表。