| name | douyin-compliance |
| description | 抖音作品发布前自查与表现预测。检查违规/限流风险(广告法违禁词、引流词、AI生成标注、医疗/金融/法律/教育资质红线、健康分风险),并基于粉丝量级与赛道预测播放区间。当用户说"自查抖音作品/这条能发吗/帮我查违禁词/预测这条抖音表现/抖音发布前检查"时触发。 |
抖音作品自查 + 表现预测
发布抖音前,对作品做①违规自查 ②表现预测 ③自动存档。规则数据来自 references/(溯源见各文件头,原始来源在仓库 docs/sources/)。
一、收集输入
必填:作品文案 / 口播文稿(含标题、字幕文字)。
预测用元数据(缺则用默认并注明,不要因缺字段拒绝):
- 账号当前粉丝量(缺→询问或按 0–1000 保守估)
- 账号健康分(缺→按 95)
- 视频时长(秒)、画面比例(9:16/16:9/其他)
- 赛道(缺→AI知识科普)
- 是否真人出镜、是否含AI生成 + 是否已双标注、信息密度(高/中/低)
- 发布时段(可选)
若用户没提是否含 AI,主动问一句(AI 标注是高频雷区)。
二、执行流程
- 读
references/白名单_L3.md,建立白名单语境。
- 读
references/违禁词库_L2.md,扫文案/字幕/标题(含谐音/拼音/变体)。每个疑似命中先过 L3:白名单语境内不报或降🟡;否则定类别+严重度+安全替换。
- 读
references/规则_AI标注与资质.md:
- AI 双标注检查(发布端勾选 + 前5秒画面字幕≥3秒,缺一不可);
- 资质红线检查(医/金/法/教,触碰即🔴);
- 关联健康分扣分风险。
- 读
references/预测模型.md,按 基准区间(粉丝×赛道) × 质量系数 × 合规系数 算预测区间 + 流量池预判 + 短板。
- 存档:追加一条记录到
records/records.jsonl(见第四节)。
三、输出格式(严格三段式)
📋 违规自查报告
- 命中清单(表格):
命中词/表达 | 类别 | 严重度🔴🟠🟡 | 安全替换
- AI 标注检查:是否需标注、是否达标,缺则🔴提醒双标注。
- 资质红线:是否触碰医/金/法/教。
- 白名单说明:列出"看着像违禁、此处安全"而未报的词(让用户安心、防瞎改)。
- 总评:✅ 可发 / 🛠 改完可发(列必改项)/ ⛔ 高风险勿发。
📈 表现预测
- 预测播放区间:正常 X–Y,优质可冲 Z。
- 流量池预判:大概到哪级 + 卡点。
- 短板提示:最该补的 1-2 项。
- 声明:「此为基于规则与行业基准的估算,浮动大(±30%+),靠你回填真实播放量逐步校准。」
- 若命中🔴高风险违禁词/资质红线:预测改为「先改违规再谈预测」。
💾 存档
末尾一句:「已存档第 N 条到 records.jsonl(回填真实播放量可让预测越来越准)。」
四、存档调用
把本次记录追加到仓库内 records/records.jsonl(每行一个 JSON 对象),可用脚本:
python skill/scripts/log_record.py "<json字符串>"
记录字段建议:作品标题/摘要、粉丝量、健康分、时长、比例、赛道、是否真人、是否含AI及是否标注、信息密度、命中违规摘要、预测区间、流量池预判。real_views 等真实数据列留空待回填。
(也可直接用文件追加方式写入同一文件。)
关键纪律
- 先白名单后违禁词,宁可多说一句"此处安全",绝不误杀让用户瞎改。
- 预测只给区间,永远带"估算/待校准"声明,不报精确数字。
- 规则会变:
references/ 各文件头有整理日期,过时需更新(原始数据源在 docs/sources/)。