Skip to main content

detecting-ai-model-prompt-injection-attacks

Detects prompt injection using regex signature matching, heuristic scoring for structural anomalies, and DeBERTa-based transformer classification, flagging direct injections (system-prompt overrides, role-play escapes) and indirect injections (encoded payloads, obfuscation) per OWASP LLM Top 10 (LLM01:2025). Use for input validation layers in chatbots/agents/RAG pipelines, or for retrospectively classifying injection attempts in logs or incident investigations.

Ir a la instalación

Datos de origen

Repositorio
mukul975/Anthropic-Cybersecurity-Skills
Última actividad en el origen
2 de agosto de 2026 a las 16:32
Idioma detectado de SKILL.md
inglés
Estrellas
27.732
Forks
3366

Opciones de instalación

De forma predeterminada está seleccionado el prompt que primero revisa el origen. Puedes cambiar a un comando directo o descargar una copia local.

Revisa los archivos de origen

Lee SKILL.md y los archivos complementarios que muestra SkillsMP antes de decidir si quieres instalarlo.