Skip to main content
vipshop
Perfil de criador do GitHub

vipshop

Visão por repositório de 8 skills coletadas em 2 repositórios do GitHub.

skills coletadas
8
repositórios
2
atualizado
6 de jul. de 2026
mapa de repositórios

Onde as skills estão

Principais repositórios por número de skills coletadas, com sua participação neste catálogo do criador e sua distribuição ocupacional.

explorador de repositórios

Repositórios e skills representativas

cache-dit-model-integration
Desenvolvedores de software

High-level guide for integrating a new DiT model into cache-dit: Cache (BlockAdapter/ForwardPattern), Context Parallelism, Tensor Parallelism, Text Encoder Parallelism (TE-P), VAE Parallelism (VAE-P), generate CLI, installation, testing workflow, and detailed…

6 de jul. de 2026
triton-kernel
Desenvolvedores de software

Write optimized Triton GPU kernels for deep learning operations. Covers the full spectrum from basic vector ops to Flash Attention, persistent matmul, fused normalization, quantized GEMM, and memory-efficient patterns.

19 de mai. de 2026
cuda-cpp-kernel
Desenvolvedores de software

Use when writing, debugging, porting, reviewing, or optimizing CUDA C++ or PTX kernels; investigating CUDA Runtime or Driver API behavior; profiling kernels with Nsight Systems or Nsight Compute; or reasoning about Tensor Core instructions, shared memory,…

10 de abr. de 2026
cute-dsl-kernel
Desenvolvedores de software

Use when writing, modifying, porting, or optimizing CuTe DSL GPU kernels in Python; reading CuTe DSL API reference material; integrating a CuTe DSL kernel into a project; or rewriting an existing CUDA or C++ operator into CuTe DSL while preserving correctness…

10 de abr. de 2026
cutlass-cpp-kernel
Desenvolvedores de software

Use when writing, debugging, porting, reviewing, or optimizing CUTLASS or CuTe C++ kernels and templates; navigating CUTLASS examples, collectives, epilogues, pipelines, GEMM schedules, or CuTe headers; or analyzing template configuration, tiling, memory…

10 de abr. de 2026
operator-migration
Desenvolvedores de software

Use when doing operator migration or kernel migration for CUDA, Triton, or custom ops in cache-dit; porting kernels from nunchaku, deepcompressor, or other repos; designing operator registration and public wrappers; wiring build and packaging for optional…

9 de abr. de 2026
ptq-workflow-integration
Desenvolvedores de software

Use when integrating a new PTQ workflow into cache-dit; designing quantize/load API shape, backend-specific config validation, save/load manifests, benchmark and regression tests, or reviewing a PTQ integration plan. Uses the SVDQ PTQ integration only as a…

8 de abr. de 2026
Mostrando 2 de 2 repositórios
Todos os repositórios foram exibidos