بنقرة واحدة
authoritative-data-harvester
自动定位并获取权威公开数据(优先API/官方批量下载),输出可复现抓取与清洗方案。Invoke when用户需要权威数据、官方统计、API下载或数据源爬取。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
自动定位并获取权威公开数据(优先API/官方批量下载),输出可复现抓取与清洗方案。Invoke when用户需要权威数据、官方统计、API下载或数据源爬取。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
Manages persistent memory. Invoke to read active context or archive old tasks. Structure: Long-term Principles (Rules) + Short-term Workbench (Tasks).
自动清洗赛题或爬取的数据(处理缺失/异常/格式),并生成可视化图表。Invoke when 用户需要处理原始数据、清洗数据或生成数据分析图表。
按常见评分点生成建模论文结构与写作清单,并根据题目类型与数据条件给出模型选择与对照实验路线。Invoke when需要“论文格式/评分对齐/模型选型/路线不确定”。
基于微单元模板与脚本批量生成并合并论文内容。Invoke when需要按微单元拆分逐单元写作并用 scripts/generate_all_offline.py 与 scripts/merge.py 自动生成论文。
串联赛题解析、数据计算与微单元脚本,一键从赛题文件夹到完整论文。Invoke when用户已放好赛题与附件,希望自动跑完全流程。
解析赛题PDF/Word,抽取任务与数据条件并给出模型选型与验证路线。Invoke when用户提供赛题文档或题目文本,需要确定采用何模型/方法。
استنادا إلى تصنيف SOC المهني
| name | authoritative-data-harvester |
| description | 自动定位并获取权威公开数据(优先API/官方批量下载),输出可复现抓取与清洗方案。Invoke when用户需要权威数据、官方统计、API下载或数据源爬取。 |
在数学建模任务中,快速找到“权威、可引用、可复现”的公开数据源,并以尽量不爬网页、优先 API/批量下载的方式获取数据,最终输出:
输出“数据需求表”,至少包含:
按任务类型优先匹配:
交付脚本必须具备:
当某源不可用/受限:
crawled_data/raw/。crawled_data/processed/。crawled_data/sources.json(包含 url、参数、访问日期、许可证/条款)。data-cleaning-and-visualization(把 crawled_data/ 里的数据统一清洗并出图)。paper-workflow-orchestrator。context-memory-keeper,记录“新增数据源名称”与“存放路径”到 Short-term Workbench。crawled_data/。crawled_data/sources.json 中记录可引用来源信息。data-cleaning-and-visualization,把数据清洗并生成 paper_output/figures/ 的证据图表。