专门用于 Ascend 集群 Profiling 性能数据的“快慢卡”诊断专家技能。当用户提供【集群性能数据目录/路径】并要求分析【快慢卡】、【慢节点】、【负载不均衡】或【集群瓶颈】时,必须触发此技能。该技能会自动接收集群路径,调度相关工具输出快慢卡的宏观定性与微观根因(如 Host 下发瓶颈、算子计算劣化)。
原文の言語: 中国語
メニュー
このリポジトリの skills
SkillsMP は ascend-ai-coding/awesome-ascend-skills から 207 件の skill を収集しています。skill を開くとソースと詳細を確認できます。
ascend-ai-coding/awesome-ascend-skills収集済み skill 207 件中 40 件を表示しています。
专门用于 Ascend 集群 Profiling 性能数据的“快慢卡”诊断专家技能。当用户提供【集群性能数据目录/路径】并要求分析【快慢卡】、【慢节点】、【负载不均衡】或【集群瓶颈】时,必须触发此技能。该技能会自动接收集群路径,调度相关工具输出快慢卡的宏观定性与微观根因(如 Host 下发瓶颈、算子计算劣化)。
原文の言語: 中国語
当用户希望你像第一次接触项目的人一样,真实按仓库的 README、安装文档或 quick start 跑一遍,并判断“新人能不能走通”“文档是否可用”“哪里会卡住”“安装/启动说明是否对新手友好”时,使用这个 skill。它适用于 repo onboarding audit、documentation UX review、quickstart validation、README walkthrough、按文档验证安装与运行并输出问题报告的场景;即使用户只是说“按 README…
原文の言語: 中国語
用于审查 GitCode PR,并结合 PR metadata、diff 与整个代码仓上下文生成深度审查结论或发布逐行评论。当用户希望 review GitCode PR、检查某个 GitCode PR 链接、分析变更风险、或将审查意见发布到 GitCode PR 时使用。典型触发方式包括“review this PR”“检视这个 PR”“检查 PR”,或直接提供 GitCode PR 链接,例如 https://gitcode.com/owner/repo/pull/123 。
原文の言語: 中国語
当用户提供 GitHub 文件页面链接,或希望读取某个仓库中的源码、配置、README、Markdown、docs 内容时,使用此技能。技能不仅支持将 `github.com/<owner>/<repo>/blob/<ref>/...` 转换为 `raw.githubusercontent.com` 链接,还要求在读取仓库 docs 前优先读取同仓库同 ref 的 `agent_router.md`,根据其中声明的目录结构或路由规则拼出真实路径,并优先通过 `curl` 获取内容。
原文の言語: 中国語
当用户提供 MindStudio profiler 采集的性能数据(框架 profiler、msprof 命令行)时,对数据完整性、采集状态及关键配置进行校验,确保后续分析工具能正常运行。
原文の言語: 中国語
为 msModelSlim 创建基础 Transformers 模型适配器(Model Adapter)。 包含创建适配器、实现必需接口及四步验证流程。 适用:Decoder-only LLM、理解类 VLM(仅 LLM/text 部分)。 不适用:多模态生成模型(图像/视频/语音生成)、Encoder-only、非 Transformers 架构。
原文の言語: 中国語
在实现适配器前对候选模型做分析。确定模型实现来源(transformers 或模型目录)、结构特征、是否需逐层加载及 MoE 融合权重风险。适用于用户询问模型适配可行性或做适配前分析时使用。
原文の言語: 中国語
计算算子(如 matmul/GEMM)的 MFU(Machine FLOP Utilization),并给出清晰的公式和推导过程。
原文の言語: 中国語
Automates GitCode open-source repo merge workflow: commit → push → issue → PR → pipeline → review → /lgtm & /approve → merge. Invoke when user wants to submit code to a GitCode open-source repository.
原文の言語: 中国語
GitHub Issue root cause analysis skill. Analyze specified GitHub issues to identify possible root causes by examining issue content, code repository, and related resources. Use when user asks to analyze issue root cause, investigate issue, RCA analysis, or…
原文の言語: 英語
Analyze closed GitHub issues to create troubleshooting case studies with root cause analysis and lessons learned. Use when: (1) summarizing resolved issue troubleshooting process, (2) creating issue case studies, (3) documenting problem-solving methodology,…
原文の言語: 英語
昇腾社区论坛问题分析工具,读取Excel格式的论坛帖子数据,自动筛选问题、故障、报错类帖子,获取帖子详细内容,并根据关键词进行多维度筛选分析,最终导出结构化的问题数据Excel报告。用于分析昇腾论坛中的技术问题、故障排查和报错处理相关帖子。
原文の言語: 中国語
读取昇腾社区论坛(Hiascend Community Forum)的帖子内容,支持按时间范围筛选并导出为Excel。支持时间快捷选项(今年、本月、本周、今天)和自定义区间,自动剔除置顶贴(top>0),智能终止查询,时区自动转换(+8小时),并发分页获取提升效率,并将topicId转换为可点击的论坛链接。当用户需要获取昇腾论坛帖子、筛选特定时间范围的论坛内容、导出论坛数据到Excel时触发使用。
原文の言語: 中国語
AI for Science 昇腾 NPU 总入口 Skill,用于在用户只给出 AI for Science 需求、模型名、TensorFlow/Keras 项目或性能采集诉求时,判断应该进入 Profiling 采集、模型迁移或 TF 框架三条路线,并分流到对应子 skill。
原文の言語: 中国語
Ankh 蛋白质语言模型昇腾 NPU 迁移 Skill,适用于 Ankh base/large、Ankh3 large/XL 以及同类基于 HuggingFace Transformers 与 PyTorch 的蛋白模型从 CUDA/GPU 到华为 Ascend NPU 的环境检查、代码适配、权重加载、验证脚本补齐与文档沉淀。
原文の言語: 中国語
DeepFRI 的 TensorFlow 到 PyTorch 转换与昇腾 NPU 迁移 Skill,适用于蛋白质功能预测场景下的 TF 模型分析、PyTorch 重写、权重逐层映射、NPU 推理与精度验证,尤其适合需要在 Ascend 上运行 DeepFRI CNN 或 GCN 路径时使用。
原文の言語: 中国語
昇腾虚拟化实例(AVI)和vNPU管理技能。用于查询/设置AVI模式、管理vNPU实例(创建/销毁)、查询vNPU配置恢复状态等操作。支持安全确认机制,在执行修改操作前检查设备状态。
原文の言語: 中国語
当用户需要对华为昇腾 NPU 进行硬件层面的管理、测试或诊断时使用此 skill。典型场景: - 查看 NPU 卡的状态、温度、利用率 - 测试内存带宽(h2d/d2h/d2d/p2p) - 跑算力/功耗基准测试(TFLOPS、TOPS) - 诊断 NPU 硬件故障或做健康检查 - 对 NPU 卡做压力测试(aicore、内存) - 复位/恢复卡住或异常的 NPU 卡 典型用户问题(即使不提 ascend-dmi 也应触发): - "帮我测一下这台服务器的算力和带宽" - "看看 192.168.1.50 上…
原文の言語: 中国語
Directly launch Docker containers on Ascend NPU servers for users. Collect requirements and execute docker run commands with proper NPU device mounting, networking, volume mounts, and environment variables. Use when users need to: (1) Start a Docker container…
原文の言語: 英語
Huawei Ascend NPU npu-smi command reference. Use for device queries (health, temperature, power, memory, processes, ECC), configuration (thresholds, modes, fan), firmware upgrades (MCU, bootloader, VRD), virtualization (vNPU), and certificate management.
原文の言語: 英語
Guide for connecting to remote servers via SSH, managing containers, and executing commands remotely. Covers SSH connection setup with multiple authentication methods (SSH key, sshpass, Paramiko, Fabric, tmux interactive), Docker container connection and…
原文の言語: 英語
华为昇腾 Ascend Extension for PyTorch (torch_npu) 的环境检查、部署与能力指引。在用户使用 @torch_npu、昇腾 NPU、CANN、或需要将 PyTorch 迁移到 NPU 时自动应用;当用户使用 @torch_npu_doc 时,基于 skill 的 reference 文档提供项目内中文文档能力说明。
原文の言語: 中国語
AISBench Benchmark - AI model evaluation tool for Ascend NPU. Supports accuracy evaluation (service/local models on text, multimodal datasets), performance evaluation (latency, throughput, stress testing, steady-state, real traffic simulation), vLLM/Triton…
原文の言語: 英語
HuggingFace Diffusers 环境配置指南,用于华为昇腾 NPU。覆盖 CANN 版本检测、PyTorch + torch_npu 安装、Diffusers 库安装及环境验证。当用户需要在昇腾 NPU 上配置 Diffusers 环境时使用。
原文の言語: 中国語
Diffusers Pipeline 推理指南,用于华为昇腾 NPU。覆盖环境预检、通用 Pipeline 推理(图像/视频模型)、内存优化(CPU offload、attention slicing、VAE slicing)、LoRA 加载与融合、多卡推理和按版本检索 Diffusers API。用户一旦提到在昇腾 NPU 上运行 FLUX、SDXL、Wan、CogVideoX 等 Diffusers 推理,或需要排查推理参数、显存优化、LoRA 接入、Pipeline API 路径时,就应使用此 skill。
原文の言語: 中国語
Diffusers 模型权重准备工具,用于华为昇腾 NPU。支持从 HuggingFace 和 ModelScope 下载模型权重,以及基于 model_index.json 和各组件 config.json 生成假权重用于业务验证。当用户需要下载 Diffusers 模型权重或生成测试权重时使用。
原文の言語: 中国語
华为昇腾 NPU 服务器模型quant工具技能,专为在昇腾 NPU 卡上进行大语言模型quant加速,聚焦于msmodelslim已验证模型的快速量化流程,支持量化流程和量化配置的轻微修改。支持 INT4/INT8/INT16 quant,提供完整的quant工作流,包括环境检查、动态方案query、容器deployment、quant执行等。
原文の言語: 中国語
Deploy vLLM inference services on Ascend NPU servers with automatic model detection and optimized configuration. Supports local and remote deployment across bare metal, containers, and Docker images. Handles model discovery, quantization auto-detection,…
原文の言語: 英語
vLLM Ascend plugin for LLM inference serving on Huawei Ascend NPU. Use for offline batch inference, API server deployment, quantization inference (with msmodelslim quantized models), tensor/pipeline parallelism for distributed serving, and OpenAI-compatible…
原文の言語: 英語
Interactive online benchmark orchestrator for vLLM inference services using `vllm bench serve`. Supports single benchmarks, multi-case batch execution with result aggregation, and auto-optimization to find optimal concurrency/throughput under latency SLO…
原文の言語: 英語
This skill provides comprehensive guidance for adapting Wan-series video generation models (Wan2.1/Wan2.2) from NVIDIA CUDA to Huawei Ascend NPU. It should be used when performing NPU migration of DiT-based video diffusion models, including device layer…
原文の言語: 英語
用于指导 Ascend C(CANN / xpu_kernel)算子开发完成后接入 PyTorch:与 torch_npu 对接、Host 侧注册与构建、Python 暴露与冒烟测试。涵盖算子工程内轻量化接入、必要时参考 op-plugin、Pybind 快速联调、复用图算子封装等。适用于 Ascend C、算子接入、torch_npu、NPU 自定义算子、op-plugin、xpu_kernel、cpp_extension、自定义算子等场景。
原文の言語: 中国語
昇腾 NPU 单算子性能基准测试 Skill;当前版本只做现有环境检查、CANN 版本识别、用户确认后执行 benchmark,不负责修复或安装环境。
原文の言語: 中国語
将 GPU/CUDA Triton 算子迁移为 Triton-Ascend,或将 Python/PyTorch 算子改写为可在 Ascend NPU 上运行的 Triton-Ascend 实现,并在发现明确优化空间时直接输出优化后的代码、最小验证脚本和排障说明。用户只要提到 昇腾、Ascend、NPU、triton-ascend、Triton 算子迁移、PyTorch 算子改写、coreDim、UB overflow、1D grid、物理核绑定、block_ptr、stride、访存对齐、mask…
原文の言語: 中国語
MindSpeed-LLM 数据预处理指南,用于华为昇腾 NPU。覆盖预训练数据、指令微调数据(Alpaca/ShareGPT 格式)、偏好对齐数据(Pairwise)的预处理流程。包含分词、打包、输出文件结构说明和 prompt 模板配置。当用户需要为 MindSpeed-LLM 训练准备数据时使用。
原文の言語: 中国語
MindSpeed-LLM 环境搭建指南,用于华为昇腾 NPU。覆盖 CANN 环境激活、PyTorch + torch_npu 安装、MindSpeed 加速库安装、Megatron-LM 核心模块集成、MindSpeed-LLM 安装及环境验证。当用户需要在昇腾 NPU 上搭建 MindSpeed-LLM 训练环境时使用。
原文の言語: 中国語
MindSpeed-LLM 端到端训练部署流水线,用于华为昇腾 NPU。串联环境搭建、数据预处理、权重转换、分布式训练、推理验证、评估、权重导出的完整流程。覆盖参数一致性校验、阶段间数据流转、模型特定配置(Qwen、LLaMA、DeepSeek)。用户需要在昇腾 NPU 上完成 MindSpeed-LLM 训练部署全流程时使用。
原文の言語: 中国語
MindSpeed-LLM 分布式训练启动指南,用于华为昇腾 NPU。覆盖预训练、指令微调(Full/LoRA/QLoRA)、偏好对齐(DPO)的训练启动配置,包含入口脚本选择、并行策略(TP/PP/CP)、训练参数、可选评估。当用户需要在昇腾 NPU 上启动 MindSpeed-LLM 训练任务时使用。
原文の言語: 中国語
MindSpeed-LLM 权重转换指南,用于华为昇腾 NPU。覆盖 HuggingFace 到 Megatron 格式转换、Megatron 到 HuggingFace 反向转换、LoRA 权重合并导出、TP/PP/EP 并行切分配置。支持 v1 和 v2 转换器,适用于 Qwen、LLaMA、DeepSeek、Mixtral 等模型。当用户需要转换模型权重格式时使用。
原文の言語: 中国語
MindSpeed-MM multimodal model suite environment setup guide for Huawei Ascend NPU. Covers CANN activation, PyTorch + torch_npu installation, MindSpeed acceleration library, Megatron-LM core module integration, and MindSpeed-MM installation. Use when setting…
原文の言語: 英語