一键导入
document-privacy-audit
针对指定 PDF 或 Office 文档(.pdf/.docx/.xlsx/.pptx)进行全文解析、检索与深度理解,识别并汇总隐私/敏感信息(PII、金融、健康、账号凭据等),输出审计报告与风险提示。用于合规审查、数据脱敏准备、外发前检查或隐私扫描。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
针对指定 PDF 或 Office 文档(.pdf/.docx/.xlsx/.pptx)进行全文解析、检索与深度理解,识别并汇总隐私/敏感信息(PII、金融、健康、账号凭据等),输出审计报告与风险提示。用于合规审查、数据脱敏准备、外发前检查或隐私扫描。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
| name | document-privacy-audit |
| description | 针对指定 PDF 或 Office 文档(.pdf/.docx/.xlsx/.pptx)进行全文解析、检索与深度理解,识别并汇总隐私/敏感信息(PII、金融、健康、账号凭据等),输出审计报告与风险提示。用于合规审查、数据脱敏准备、外发前检查或隐私扫描。 |
执行全文抽取与结构化检索,结合规则与语义判断定位隐私信息,输出带定位与风险等级的汇总报告。
scripts/extract_text.py 输出 JSONL,保留页码/段落/单元格定位。ocrmypdf 或 tesseract)后再抽取。示例:
python scripts/extract_text.py --input /path/to/file.pdf --output /path/to/extracted.jsonl
python scripts/extract_text.py --input /path/to/file.docx --output /path/to/extracted.jsonl
rg 或自定义脚本),保留命中位置。scripts/pii_scan.py 做规则扫描,生成候选清单。references/pii_catalog.md。示例:
python scripts/pii_scan.py --input /path/to/extracted.jsonl --output /path/to/pii_report.json
# 隐私审计报告
- 文件: <path>
- 扫描范围: <PII/财务/健康/凭据>
- 扫描时间: <YYYY-MM-DD>
- 结论: <低/中/高风险 + 1-2 句说明>
## 发现摘要
| 类别 | 数量 | 示例(脱敏) | 位置 |
| --- | --- | --- | --- |
| 邮箱 | 3 | a***@example.com | page:2, page:5 |
| 手机 | 2 | 13******45 | page:3 |
## 高风险项
- <类别 + 脱敏示例 + 位置 + 风险原因>
## 细项清单
- <类别> | <脱敏示例> | <位置> | <上下文简述>
## 建议
- <脱敏/删除/分级访问/加密存储等>
extract_text.py: 统一抽取 PDF/Office 文本并保留定位。pii_scan.py: 规则扫描隐私信息并生成 JSON 报告。pii_catalog.md: 隐私类别、风险等级与脱敏示例。将平庸、模板化、AI 味重的草稿重构为更有人味、更有张力、更有说服力的叙事。Use when Codex needs to improve or design stories, speeches, essays, founder narratives, sales copy, leadership messaging, positioning narratives, or AI-generated drafts by applying RENT (Relatability, Ease, Novelty, Tension), Pyramid Principle, Big Idea, Story Spine, Hero's Journey, audience-muse alignment, vulnerability, taste-based editing, or explicit requests about Super Skill, Storytelling Economy, Vortex of Mid, 叙事升维, 共鸣, 钩子, 张力, 脆弱性, 品味, or 先独立思考后 AI 辅助.
极客级 YouTube 播客提取与可视化方案。遵循电影感字幕视觉标准 (Cinema Style),通过词窗重叠算法去重字幕,并利用 Playwright 渲染高质量金句卡片。适用于需要将长视频转化为高价值社交分享内容的场景。
专业书籍核心内容萃取专家。基于语义深度分析,提炼书籍 50% 的核心高价值内容,构建费曼讲解主线。
EPUB 高清转换专家。技术脚本生成出版级 PDF/MD,支持内置字体提取与高清排版重构。
抓取微信公众号文章,支持全文提取、图文混排、图片本地化下载及概要生成。在需要访问微信公众号链接并转化为 Markdown 时调用。
Downloads Xiaoyuzhou podcasts, transcribes using FunASR, and generates raw, structured, and optimized text files. Invoke when user provides a Xiaoyuzhou episode link.
基于 SOC 职业分类