Skip to main content

human-agent-trust-exploit-detection

Detect social engineering, deceptive responses, false assurances, or prompts that induce unsafe user actions.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
Tencent/AI-Infra-Guard
آخر نشاط في المصدر
٢٩ يوليو ٢٠٢٦ في ٠٦:٤٤
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
٦٬٠٧٧
التفرعات
٥٦٣

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.