| ch01 | 平台概览与硬件资源 | 集群架构, 思源一号, Pi2.0, AI, ARM, 致远一号 |
| ch02 | 账号申请与集群登录 | 主账号/子账号, SSH登录, HPC Studio, Tabby, VS Code, Tmux |
| ch03 | 文件系统与数据管理 | Lustre, GPFS, /scratch, /union, 冷存储, 数据共享 |
| ch04 | 数据传输 | data节点, scp/rsync, 集群间传输, 线下迁移, 远程挂载 |
| ch05 | SLURM作业提交与管理 | sbatch, squeue, scancel, 作业脚本, 交互式作业, 环境变量 |
| ch06 | 队列详解与资源选择 | 各队列参数, GPU配比, 作业延长, debug队列 |
| ch07 | 软件模块与编译器 | module命令, GCC, Intel, MPI库, 数学库, 软件安装 |
| ch08 | GPU计算 | A100, V100, GPU作业脚本, TensorFlow, CUDA |
| ch09 | HPC可视化平台 | HPC Studio, 远程桌面, Jupyter, RStudio, DeepSeek, MATLAB, ParaView |
| ch10 | 容器使用 | Singularity镜像构建, AI平台容器编译 |
| ch11 | 常见问题与排错 | 登录问题, 作业失败, 软件安装, 代理设置, node_fail |
| ch12 | 学科应用软件 | GROMACS, LAMMPS, VASP, OpenFOAM, WRF, Quantum ESPRESSO, 生信软件 |
| ch13 | GPU深度学习实战 | PyTorch, A100, debuga100, CUDA匹配, DDP多卡训练 |
| ch14 | 并行配置与性能优化 | BLAS线程, worker公式, 超额订阅, ProcessPoolExecutor |
| ch15 | 计费标准与成本管理 | 核时/卡时计费, 存储费用, 省钱策略, 查账充值 |
| ch16 | 实用脚本与工具 | 批量作业, 自动化, 监控, 数据管理脚本 |
| ch17 | 进阶故障排查 | 错误码, 性能诊断, 代理配置, fail2ban, 存储急救 |
| ch18 | Python/R 环境配置 | Conda管理, GPU环境, R并行, Jupyter, 环境迁移, NLP/ML工作流 |
| ch19 | HPC REST API | Token认证, SSH证书自动化, 配额查询, Agent集成 |