Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
직접 명령은 검토 Prompt를 거치지 않습니다. 실행하기 전에 소스를 확인하세요.
npx skills add https://github.com/mycyg/WorkHub --skill data-analysis명령은 한 줄로 유지됩니다. 복사하기 전에 가로로 스크롤해 전체 내용을 확인하세요.
로컬 사본을 원하시나요? SkillsMP에서 현재 제공할 수 있는 파일을 다운로드하세요.
SKILL.md 표시 중
| name | data-analysis |
| description | 用 pandas/numpy 做数据分析(描述统计、分组聚合、相关性),产出 CSV + 结论报告 |
| when_to_use | 任务要求分析数据、出统计结论、做对比汇总时 |
库已预装(pilot 镜像)。只用下面验证过的模式。
import pandas as pd
import numpy as np
df = pd.read_csv("输入文件.csv") # 工作目录内的输入;Excel 用 pd.read_excel
# 1) 体检
profile = pd.DataFrame({
"dtype": df.dtypes.astype(str),
"non_null": df.notna().sum(),
"nulls": df.isna().sum(),
})
profile.to_csv("outputs/data-profile.csv")
# 2) 描述统计
df.describe(include="all").to_csv("outputs/describe.csv")
# 3) 分组聚合
summary = df.groupby("分组列").agg(
数量=("数值列", "count"),
均值=("数值列", "mean"),
合计=("数值列", "sum"),
).round(2)
summary.to_csv("outputs/group-summary.csv")
# 4) 数值列相关性
numeric = df.select_dtypes(include=[np.number])
if numeric.shape[1] >= 2:
numeric.corr().round(3).to_csv("outputs/correlation.csv")
outputs/analysis.md:结论先行(3 条以内)→ 关键数字(引用哪个 CSV 哪一行)→ 方法与口径 → 数据质量备注(缺失/异常值如何处理)。dropna/fillna 用了哪个、为什么),不要静默处理。groupby().agg() 用命名聚合(如上),不要用已废弃的 dict-of-dict 形式。encoding="gbk" 一次,仍失败按 blocker 上报。SOC 직업 분류 기준