用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/mycyg/WorkHub --skill data-analysis命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
基于 SOC 职业分类
正在显示 SKILL.md
| name | data-analysis |
| description | 用 pandas/numpy 做数据分析(描述统计、分组聚合、相关性),产出 CSV + 结论报告 |
| when_to_use | 任务要求分析数据、出统计结论、做对比汇总时 |
库已预装(pilot 镜像)。只用下面验证过的模式。
import pandas as pd
import numpy as np
df = pd.read_csv("输入文件.csv") # 工作目录内的输入;Excel 用 pd.read_excel
# 1) 体检
profile = pd.DataFrame({
"dtype": df.dtypes.astype(str),
"non_null": df.notna().sum(),
"nulls": df.isna().sum(),
})
profile.to_csv("outputs/data-profile.csv")
# 2) 描述统计
df.describe(include="all").to_csv("outputs/describe.csv")
# 3) 分组聚合
summary = df.groupby("分组列").agg(
数量=("数值列", "count"),
均值=("数值列", "mean"),
合计=("数值列", "sum"),
).round(2)
summary.to_csv("outputs/group-summary.csv")
# 4) 数值列相关性
numeric = df.select_dtypes(include=[np.number])
if numeric.shape[1] >= 2:
numeric.corr().round(3).to_csv("outputs/correlation.csv")
outputs/analysis.md:结论先行(3 条以内)→ 关键数字(引用哪个 CSV 哪一行)→ 方法与口径 → 数据质量备注(缺失/异常值如何处理)。dropna/fillna 用了哪个、为什么),不要静默处理。groupby().agg() 用命名聚合(如上),不要用已废弃的 dict-of-dict 形式。encoding="gbk" 一次,仍失败按 blocker 上报。