| name | ai-drama-review |
| description | AI短剧规范识别技能包。检测AI短剧中的文本/小说版权侵权、年龄分级合规性(18+/12+)、小说魔改程度,并生成结构化合规报告。支持本地关键词快速扫描 + AI深度分析两层架构。Beta 阶段 - 仅供参考,不作为法律依据。 |
This skill identifies compliance risks in AI-generated short dramas, including copyright infringement, age rating violations, and unauthorized novel adaptations. It uses a two-layer architecture: local keyword scanning for fast baseline detection, plus AI-powered deep analysis for context-aware accuracy.
Warning: BETA — 本技能包正在测试中,检测结果仅供参考,不作为法律依据。请结合专业法律意见使用。
用户提供剧本文本、字幕文件或视频描述,本技能将执行合规审查并生成结构化风险报告。
Phase 1: 环境检测与初始化
当用户请求对短剧内容进行合规审查时,先执行环境检测:
python3 scripts/env_detect.py
检测内容:
- Python 版本: >= 3.8
- 可用 API 密钥: OPENAI_API_KEY / ANTHROPIC_API_KEY(用于深度分析)
- 可选 Python 包: jieba(中文分词,提升版权检测精度)
- 网络连通性: API 端点可达性
确定运行模式:
- 仅本地模式 (local_only): 无 API 密钥时的降级模式,仅执行关键词匹配和文本算法分析
- 混合模式 (hybrid)(推荐): 本地快速扫描 + AI 深度上下文分析,精度更高
向用户展示环境状态和可用功能。
Phase 2: 版权侵权检测
接收用户提供的剧本/台词文本,执行版权侵权检测:
python3 scripts/text_similarity.py --input <script_file> --reference-dir <reference_texts_dir>
2.1 文本预处理
- 统一编码(Unicode 归一化)
- 去除标点符号和多余空白
- 按段落分割,过滤过短段落(< 20 字)
- 中文分词(优先使用 jieba,降级为字符级分词)
2.2 三重相似度检测
对每个段落与参考文本库逐段比对,计算三种互补指标:
| 算法 | 检测能力 | 权重 |
|---|
| n-gram Jaccard 系数 | 局部词汇重复 | 0.3 |
|