| name | cumcm-data-code-pipeline |
| description | Organize reproducible data processing, modeling code, generated outputs, and supporting materials for 2026 CUMCM. Use when creating or reviewing code folders, data provenance, preprocessing scripts, experiment logs, generated figures/tables, appendix code listings, or reproducibility instructions. |
CUMCM Data Code Pipeline
Use this skill to make contest code reproducible and submission-safe.
Workflow
- Separate raw data, processed data, scripts, outputs, and paper assets.
- Keep generated figures and tables traceable to scripts.
- Prefer deterministic scripts over notebook-only workflows for final artifacts.
- Add a support-material file list in the appendix or submission notes.
- Check for identity leaks and absolute local paths before packaging.
- Read
references/checklist.md for the expected file layout.
- Read
references/directory-layout.md, references/reproducibility-rules.md, and references/support-material-list.md when preparing a real project package.
- Read
references/examples.md when organizing or reviewing an actual code/data folder.
Guardrails
- Do not include private credentials, local usernames, school names, or personal metadata.
- Do not overwrite raw data.
- Do not fabricate data to fill missing contest inputs.