dl-skill
星标1
分支0
更新时间2026年7月12日 16:02
深度学习新手入门知识库 — 整合李宏毅(LeeDL)和李沐(d2l)两本教材,覆盖从ML基础到ChatGPT/扩散/强化学习/视觉RL的24章。提供框架速查、代码模板、故障决策树和概念检索
安装
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
SKILL.md
readonly菜单
深度学习新手入门知识库 — 整合李宏毅(LeeDL)和李沐(d2l)两本教材,覆盖从ML基础到ChatGPT/扩散/强化学习/视觉RL的24章。提供框架速查、代码模板、故障决策树和概念检索
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
| name | dl-skill |
| description | 深度学习新手入门知识库 — 整合李宏毅(LeeDL)和李沐(d2l)两本教材,覆盖从ML基础到ChatGPT/扩散/强化学习/视觉RL的24章。提供框架速查、代码模板、故障决策树和概念检索 |
24 章新手入门深度学习知识库。每章 = Core Idea + Framework + 代码 + 反模式 + 实例 + 知识连接。可用关键词检索概念、按任务找模型选型、故障调试查决策树。
这 7 个框架贯穿全书,是所有技术的基础:
y_pred = model(x) → loss(y_pred, y) → loss.backward() → optimizer.step()。关键细节:每一批前 optimizer.zero_grad()| # | 章节 | 一句话 |
|---|---|---|
| 1 | 机器学习基础 | ML三步骤、任务类型(分类/回归/聚类)、过拟合vs欠拟合 |
| 2 | 数学预备 | 线性代数(矩阵乘/转置/逆)、微积分(梯度/链式法则)、概率(分布/条件) |
| 3 | 线性模型与从零实现 | 线性回归(MSE闭式解)、Softmax多分类,从零手写+d2l实现 |
| 4 | 多层感知机 | 隐藏层+非线性激活(ReLU/Sigmoid),MLP万能逼近,GPU加速 |
| 5 | 深度学习计算 | autograd(自动求导)、nn.Module(参数管理)、DataLoader(数据迭代) |
| 6 | 实践方法论 | 训练流程、故障诊断(Loss曲线分析)、超参搜索策略、验证集设计 |
| 7 | 优化算法 | SGD+Momentum+Adam三件套、学习率调度(Warmup+余弦)、梯度裁剪 |
| 8 | 正则化与泛化 | Weight Decay/Dropout/BN/数据增强/Early Stopping,五件套防过拟合 |
| 9 | 卷积神经网络基础 | 卷积核(局部连接+参数共享)、池化(降采样)、多通道、BN作用 |
| 10 | 现代CNN架构 | LeNet→AlexNet→VGG→NiN→GoogLeNet→ResNet→DenseNet,深度+残差 |
| 11 | 循环神经网络 | RNN/LSTM(3门控)/GRU(2门控)、BPTT、梯度消失/爆炸、Seq2Seq |
| 12 | 注意力机制与Transformer | Self-Attention(QKV)、多头注意、位置编码、编码器+解码器、BERT/GPT |
| 13 | 计算机视觉 | 数据增强、微调/迁移学习、目标检测(锚框/NMS/SSD/R-CNN)、语义分割(FCN/U-Net) |
| 14 | 自然语言处理 | word2vec(Skip-Gram/CBOW)、负采样、GloVe/fastText/BPE、BERT微调 |
| 15 | 生成模型 | GAN(G+D对抗)、WGAN-GP、条件GAN、CycleGAN、IS/FID评估、模式崩塌 |
| 16 | 扩散模型 | DDPM(前向加噪+逆向去噪)、噪声预测、潜在扩散(Stable Diffusion)、CFG |
| 17 | 自监督学习与表示学习 | BERT(MLM填空)、GPT(自回归)、自编码器、VQ-VAE、特征解耦、多语言BERT |
| 18 | 对抗攻击与模型鲁棒性 | FGSM/I-FGSM、白盒vs黑盒(代理网络)、防御(模糊化/随机化/对抗训练) |
| 19 | 迁移学习 | 领域偏移、领域自适应(领域对抗训练)、领域泛化、微调策略、TTT |
| 20 | 强化学习 | 策略梯度、4版A(即时/累积/折扣/减基线)、Actor-Critic、MC vs TD、探索 |
| 21 | 元学习与终身学习 | MAML(学初始化)、NAS、N-way K-shot、灾难性遗忘、EWC(守卫bᵢ)、GEM |
| 22 | 网络压缩与可解释性AI | 剪枝/蒸馏/量化/深度可分离/动态计算;显著图/SmoothGrad/探针/全局解释/LIME |
| 23 | ChatGPT与大语言模型 | GPT演进、预训练+监督微调+RLHF三阶段、ICL、多语言迁移、提示工程 |
| 24 | MineCraft纯视觉RL案例 | LS-Imagine(长短期世界模型)、功用性图、跳跃转换、AC在混合想象序列上 |
按任务/概念快速定位:
| 要找什么 | 去第几章 |
|---|---|
| 训练不收敛/Loss曲线异常 | Ch 6, 7, 8 |
| 过拟合了怎么办 | Ch 8 |
| 选什么优化器/学习率 | Ch 7 |
| CNN 架构怎么选 | Ch 9, 10 |
| 处理文本/序列数据 | Ch 11, 12, 14 |
| BERT 怎么用 | Ch 14, 17 |
| GPT/ChatGPT 原理 | Ch 17, 23 |
| 图像分类/检测/分割 | Ch 9, 10, 13 |
| 生成图片 | Ch 15, 16 |
| 文生图(Stable Diffusion) | Ch 16 |
| 模型太大要压缩 | Ch 22 |
| 模型决策需解释 | Ch 22 |
| 新任务数据太少 | Ch 13, 19, 21 |
| 玩游戏/AI决策 | Ch 20, 24 |
| 对抗样本攻击与防御 | Ch 18 |
| 多任务持续学习 | Ch 21 |
| 数学基础忘了 | Ch 2 |
覆盖范围: 深度学习从入门到进阶的完整知识体系:
不在范围内: 图神经网络(GNN)、3D视觉、推荐系统、强化学习的详细理论(Sutton & Barto水平)、多模态(除MineCLIP外)、分布式训练系统
来源: 李宏毅深度学习教程v1.2.4(LeeDL_Tutorial) + 李沐动手学深度学习PyTorch 2.0.0(d2l-zh-pytorch)。两书重叠内容融合为统一章节,各自独有的进阶主题作为独立章节保留
使用方式: 先查 cheatsheet 快速定位问题/选型,再用 patterns 找技术方案,然后去对应章节深入细节,用 glossary 查术语定义,章节末尾的 Connects To 帮助跳转相关知识