Skip to main content

Skills neste repositório

TuYv/ccpm - Página 111

O SkillsMP coletou 5.287 skills de TuYv/ccpm. Abra uma skill para revisar a origem e os detalhes.

TuYv/ccpm

Mostrando 40 de 5.287 skills coletadas.

ocupação
Desenvolvedores de software
descrição

Add or edit Cobra commands in openshift/rosa while keeping command wiring thin and package logic aligned with repo structure.

Idioma do texto original: inglês

atualizado
ocupação
Analistas de garantia de qualidade de software e testadores
descrição

Keep CLI docs, structure tests, and user-facing guidance in sync when commands or workflow docs change.

Idioma do texto original: inglês

atualizado
ocupação
Analistas de garantia de qualidade de software e testadores
descrição

Choose the right local verification steps before claiming a ROSA change is complete.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Orchestrates end-to-end autonomous AI research projects using a two-loop architecture. The inner loop runs rapid experiment iterations with clear optimization targets. The outer loop synthesizes results, identifies patterns, and steers research direction.…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Provides guidance for automatically evolving and optimizing AI agents across any domain using LLM-driven evolution algorithms. Use when building self-improving agents, optimizing agent prompts and skills against benchmarks, or implementing automated agent…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Simplest distributed training API. 4 lines to add distributed support to any PyTorch script. Unified API for DeepSpeed/FSDP/Megatron/DDP. Automatic device placement, mixed precision (FP16/BF16/FP8). Interactive config, single launch command. HuggingFace…

Idioma do texto original: inglês

atualizado
ocupação
Desenvolvedores de software
descrição

Autonomous AI agent platform for building and deploying continuous agents. Use when creating visual workflow agents, deploying persistent autonomous agents, or building complex multi-step AI automation systems.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Activation-aware weight quantization for 4-bit LLM compression with 3x speedup and minimal accuracy loss. Use when deploying large models (7B-70B) on limited GPU memory, when you need faster inference than GPTQ with better accuracy preservation, or for…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Expert guidance for fine-tuning LLMs with Axolotl - YAML configs, 100+ models, LoRA/QLoRA, DPO/KTO/ORPO/GRPO, multimodal support

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Evaluates code generation models across HumanEval, MBPP, MultiPL-E, and 15+ benchmarks with pass@k metrics. Use when benchmarking code models, comparing coding abilities, testing multi-language support, or measuring code generation quality. Industry standard…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Quantizes LLMs to 8-bit or 4-bit for 50-75% memory reduction with minimal accuracy loss. Use when GPU memory is limited, need to fit larger models, or want faster inference. Supports INT8, NF4, FP4 formats, QLoRA training, and 8-bit optimizers. Works with…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Anthropic's method for training harmless AI through self-improvement. Two-phase approach - supervised learning with self-critique/revision, then RLAIF (RL from AI Feedback). Use for safety alignment, reducing harmful outputs without human labels. Powers…

Idioma do texto original: inglês

atualizado
ocupação
Desenvolvedores de software
descrição

Multi-agent orchestration framework for autonomous AI collaboration. Use when building teams of specialized agents working together on complex tasks, when you need role-based agent collaboration with memory, or for production workflows requiring…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Expert guidance for distributed training with DeepSpeed - ZeRO optimization stages, pipeline parallelism, FP16/BF16/FP8, 1-bit Adam, sparse attention

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Optimizes transformer attention with Flash Attention for 2-4x speedup and 10-20x memory reduction. Use when training/running transformers with long sequences (>512 tokens), encountering GPU memory issues with attention, or need faster inference. Supports…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

GGUF format and llama.cpp quantization for efficient CPU/GPU inference. Use when deploying models on consumer hardware, Apple Silicon, or when needing flexible quantization from 2-8 bit without GPU requirements.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Post-training 4-bit quantization for LLMs with minimal accuracy loss. Use for deploying large models (70B, 405B) on consumer GPUs, when you need 4× memory reduction with <2% perplexity degradation, or for faster inference (3-4× speedup) vs FP16. Integrates…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Expert guidance for GRPO/RL fine-tuning with TRL for reasoning and task-specific model training

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Half-Quadratic Quantization for LLMs without calibration data. Use when quantizing models to 4/3/2-bit precision without needing calibration datasets, for fast quantization workflows, or when deploying with vLLM or HuggingFace Transformers.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Fast tokenizers optimized for research and production. Rust-based implementation tokenizes 1GB in <20 seconds. Supports BPE, WordPiece, and Unigram algorithms. Train custom vocabularies, track alignments, handle padding/truncation. Integrates seamlessly with…

Idioma do texto original: inglês

atualizado
ocupação
Administradores de redes e sistemas de computador
descrição

Reserved and on-demand GPU cloud instances for ML training and inference. Use when you need dedicated GPU instances with simple SSH access, persistent filesystems, or high-performance multi-node clusters for large-scale training.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Implements and trains LLMs using Lightning AI's LitGPT with 20+ pretrained architectures (Llama, Gemma, Phi, Qwen, Mistral). Use when need clean model implementations, educational understanding of architectures, or production fine-tuning with LoRA/QLoRA.…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Runs LLM inference on CPU, Apple Silicon, and consumer GPUs without NVIDIA hardware. Use for edge deployment, M1/M2/M3 Macs, AMD/Intel GPUs, or when CUDA is unavailable. Supports GGUF quantization (1.5-8 bit) for reduced memory and 4-10× speedup vs PyTorch on…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Expert guidance for fine-tuning LLMs with LLaMA-Factory - WebUI no-code, 100+ models, 2/3/4/5/6/8-bit QLoRA, multimodal support

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Meta's 7-8B specialized moderation model for LLM input/output filtering. 6 safety categories - violence/hate, sexual content, weapons, substances, self-harm, criminal planning. 94-95% accuracy. Deploy with vLLM, HuggingFace, Sagemaker. Integrates with NeMo…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Evaluates LLMs across 60+ academic benchmarks (MMLU, HumanEval, GSM8K, TruthfulQA, HellaSwag). Use when benchmarking model quality, comparing models, reporting academic results, or tracking training progress. Industry standard used by EleutherAI, HuggingFace,…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

State-space model with O(n) complexity vs Transformers' O(n²). 5× faster inference, million-token sequences, no KV cache. Selective SSM with hardware-aware design. Mamba-1 (d_state=16) and Mamba-2 (d_state=128, multi-head). Models 130M-2.8B on HuggingFace.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Trains large language models (2B-462B parameters) using NVIDIA Megatron-Core with advanced parallelism strategies. Use when training models >1B parameters, need maximum GPU efficiency (47% MFU on H100), or require tensor/pipeline/sequence/context/expert…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Provides guidance for enterprise-grade RL training using miles, a production-ready fork of slime. Use when training large MoE models with FP8/INT4, needing train-inference alignment, or requiring speculative RL for maximum throughput.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Battle-tested PyTorch training recipes for all domains — LLMs, vision, diffusion, medical imaging, protein/drug discovery, spatial omics, genomics. Covers training loops, optimizer selection (AdamW, Muon), LR scheduling, mixed precision, debugging, and…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Track ML experiments, manage model registry with versioning, deploy models to production, and reproduce experiments with MLflow - framework-agnostic ML lifecycle platform

Idioma do texto original: inglês

atualizado
ocupação
Administradores de redes e sistemas de computador
descrição

Serverless GPU cloud platform for running ML workloads. Use when you need on-demand GPU access without infrastructure management, deploying ML models as APIs, or running batch jobs with automatic scaling.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Educational GPT implementation in ~300 lines. Reproduces GPT-2 (124M) on OpenWebText. Clean, hackable code for learning transformers. By Andrej Karpathy. Perfect for understanding GPT architecture from scratch. Train on Shakespeare (CPU) or OpenWebText…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

GPU-accelerated data curation for LLM training. Supports text/image/video/audio. Features fuzzy deduplication (16× faster), quality filtering (30+ heuristics), semantic deduplication, PII redaction, NSFW detection. Scales across GPUs with RAPIDS. Use for…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Evaluates LLMs across 100+ benchmarks from 18+ harnesses (MMLU, HumanEval, GSM8K, safety, VLM) with multi-backend execution. Use when needing scalable evaluation on local Docker, Slurm HPC, or cloud platforms. NVIDIA's enterprise-grade platform with…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

NVIDIA's runtime safety framework for LLM applications. Features jailbreak detection, input/output validation, fact-checking, hallucination detection, PII filtering, toxicity detection. Uses Colang 2.0 DSL for programmable rails. Production-ready, runs on T4…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Provides guidance for interpreting and manipulating neural network internals using nnsight with optional NDIF remote execution. Use when needing to run interpretability experiments on massive models (70B+) without local GPU resources, or when working with any…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

High-performance RLHF framework with Ray+vLLM acceleration. Use for PPO, GRPO, RLOO, DPO training of large models (7B-70B+). Built on Ray, vLLM, ZeRO-3. 2× faster than DeepSpeedChat with distributed architecture and GPU resource sharing.

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Parameter-efficient fine-tuning for LLMs using LoRA, QLoRA, and 25+ methods. Use when fine-tuning large models (7B-70B) with limited GPU memory, when you need to train <1% of parameters with minimal accuracy loss, or for multi-adapter serving. HuggingFace's…

Idioma do texto original: inglês

atualizado
ocupação
Cientistas de dados
descrição

Meta's 86M prompt injection and jailbreak detector. Filters malicious prompts and third-party data for LLM apps. 99%+ TPR, <1% FPR. Fast (<2ms GPU). Multilingual (8 languages). Deploy with HuggingFace or batch processing for RAG security.

Idioma do texto original: inglês

atualizado
Mostrando 40 de 5.287 skills coletadas.