CI/CD integration and automation frameworks for continuous AI security testing
Idioma del texto original: inglés
Menú
SkillsMP ha recopilado 25 skills de pluginagentmarketplace/custom-plugin-ai-red-teaming. Abre una skill para revisar su origen y sus detalles.
Mostrando 25 de 25 skills recopiladas.
CI/CD integration and automation frameworks for continuous AI security testing
Idioma del texto original: inglés
Standard datasets and benchmarks for evaluating AI security, robustness, and safety
Idioma del texto original: inglés
Professional certifications, CTF competitions, and training resources for AI security practitioners
Idioma del texto original: inglés
Tools and frameworks for AI red teaming including PyRIT, garak, Counterfit, and custom attack automation
Idioma del texto original: inglés
Ethical vulnerability reporting, coordinated disclosure, and bug bounty participation for AI systems
Idioma del texto original: inglés
Structured approaches for AI security testing including threat modeling, penetration testing, and red team operations
Idioma del texto original: inglés
Generate adversarial inputs, edge cases, and boundary test payloads for stress-testing LLM robustness
Idioma del texto original: inglés
Defensive techniques using adversarial examples to improve model robustness and security
Idioma del texto original: inglés
Test AI systems for code injection vulnerabilities including prompt-to-code attacks and agent exploitation
Idioma del texto original: inglés
Real-time monitoring and detection of adversarial attacks and model drift in production
Idioma del texto original: inglés
Test AI training pipelines for data poisoning vulnerabilities and backdoor injection
Idioma del texto original: inglés
Implement mitigations, create input filters, design output guards, and build defensive prompting for LLM security
Idioma del texto original: inglés
Securing AI/ML infrastructure including model storage, API endpoints, and compute resources
Idioma del texto original: inglés
Implementing safety filters, content moderation, and guardrails for AI system inputs and outputs
Idioma del texto original: inglés
Advanced LLM jailbreaking techniques, safety mechanism bypass strategies, and constraint circumvention methods
Idioma del texto original: inglés
Techniques to extract model weights, architecture, and training data through API queries
Idioma del texto original: inglés
Privacy attacks to extract training data and sensitive information from AI models
Idioma del texto original: inglés
Advanced prompt manipulation including direct attacks, indirect injection, and multi-turn exploitation
Idioma del texto original: inglés
Master prompt injection attacks, jailbreak techniques, input manipulation, and payload crafting for LLM security testing
Idioma del texto original: inglés
Attack techniques for Retrieval-Augmented Generation systems including knowledge base poisoning
Idioma del texto original: inglés
Professional security report generation, executive summaries, finding documentation, and remediation tracking
Idioma del texto original: inglés
Techniques to test and bypass AI safety filters, content moderation systems, and guardrails for security assessment
Idioma del texto original: inglés
Security best practices for deploying AI/ML models to production environments
Idioma del texto original: inglés
Comprehensive security testing automation for AI/ML systems with CI/CD integration
Idioma del texto original: inglés
Systematic vulnerability finding, threat modeling, and attack surface analysis for AI/LLM security assessments
Idioma del texto original: inglés