data-analysis
النجوم٠
التفرعات٠
آخر تحديث١٨ يناير ٢٠٢٦ في ١٧:٢٣
数据分析流程,从数据探索到洞察报告的完整工作流
التثبيت
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
SKILL.md
readonlyالقائمة
数据分析流程,从数据探索到洞察报告的完整工作流
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
| name | data-analysis |
| description | 数据分析流程,从数据探索到洞察报告的完整工作流 |
| version | 1.1.0 |
| author | AI Mine |
| tags | ["data","analysis","visualization","statistics"] |
| enabled | true |
| tools | ["bash","file_read","file_write","rag_search"] |
结构化的数据分析工作流程,从原始数据到可执行洞察。
import pandas as pd
# 加载数据
df = pd.read_csv('data.csv')
# 基本信息
print(f"数据形状: {df.shape}")
print(f"列信息:\n{df.dtypes}")
print(f"缺失值:\n{df.isnull().sum()}")
print(f"基本统计:\n{df.describe()}")
import matplotlib.pyplot as plt
import seaborn as sns
# 设置中文字体
plt.rcParams['font.sans-serif'] = ['SimHei', 'Arial Unicode MS']
plt.rcParams['axes.unicode_minus'] = False
# 常用图表
fig, axes = plt.subplots(2, 2, figsize=(12, 10))
# ... 绑定到 axes
plt.tight_layout()
plt.savefig('analysis.png', dpi=150)
# 📊 数据分析报告
## 1. 数据概览
### 数据集信息
| 属性 | 值 |
|------|------|
| 记录数 | X |
| 字段数 | Y |
| 时间范围 | YYYY-MM-DD ~ YYYY-MM-DD |
| 数据质量 | 缺失率 X% |
### 字段说明
| 字段 | 类型 | 描述 | 示例值 |
|------|------|------|--------|
| field1 | int | ... | ... |
## 2. 数据质量
### 缺失值
| 字段 | 缺失数 | 缺失率 | 处理方式 |
|------|--------|--------|----------|
| ... | ... | ...% | 删除/填充均值 |
### 异常值
- [字段]: 发现 X 个异常值,处理方式: [...]
## 3. 统计分析
### 数值字段统计
| 字段 | 均值 | 中位数 | 标准差 | 最小值 | 最大值 |
|------|------|--------|--------|--------|--------|
| ... | ... | ... | ... | ... | ... |
### 分类字段分布
| 字段 | 类别数 | Top 3 类别 |
|------|--------|-----------|
| ... | ... | A(X%), B(Y%), C(Z%) |
### 相关性分析
[热力图或相关系数表]
## 4. 关键发现
### 发现 1: [标题]
- **现象**: [描述观察到的现象]
- **数据支撑**: [具体数字]
- **可能原因**: [假设]
### 发现 2: [标题]
...
## 5. 可视化
[图表]
## 6. 建议与行动
### 短期行动
- [ ] [具体可执行的建议]
### 长期优化
- [ ] [需要进一步分析的方向]
## 附录: 代码
[关键分析代码]