بنقرة واحدة
twitter-workflow
Twitter 数据采集到数据库的全流程自动化(采集→筛选→Grok 转换→数据库录入)
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
Twitter 数据采集到数据库的全流程自动化(采集→筛选→Grok 转换→数据库录入)
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
仿写/复刻单篇小红书笔记的写作风格:从“单个帖子样本”(标题+正文+标签+可选图片/排版特征)抽取风格指纹,并结合用户给定主题要点与可选知识库链接,生成同风格但不抄袭的新笔记(标题/正文/话题标签/可选配图建议)。当用户说“仿写这篇小红书/按这篇的风格写一篇/复刻口吻排版/基于这条笔记生成同风格内容”,或提供 info.json、detail.txt、链接、截图等作为风格样本时使用。
AI深度分析语音记录,揭示行为模式、认知偏见和战略盲点。不只是数据汇总,而是直击本质的战略洞察和否定性指导。提取可沉淀的核心原则和工作偏好,构建个人工作模式知识库。
A generic requirement/problem clarification workflow. Use when a user/client request is ambiguous, underspecified, or hard to execute/verify. The skill reframes the request, defines scope, constraints, inputs, and acceptance criteria, then outputs a concise one-page definition and a minimal question set to close gaps. Suitable for product/feature requests, content requests, ops tasks, research asks, and decision-making prompts.
Guide for creating effective skills. This skill should be used when users want to create a new skill (or update an existing skill) that extends Claude's capabilities with specialized knowledge, workflows, or tool integrations.
统一的推文内容获取技能。支持单条/批量推文提取,输出结构化数据。当用户提供 Twitter/X 链接并希望获取内容时自动触发。
从 Markdown 文件中自动提取并下载 Twitter 图片,生成可直接发布的版本。 当用户说"下载推文图片"、"提取Twitter图片"、"download twitter images"时触发。
| name | twitter-workflow |
| description | Twitter 数据采集到数据库的全流程自动化(采集→筛选→Grok 转换→数据库录入) |
Twitter 数据从采集到数据库的完整自动化流程。
当你需要从 Twitter 采集数据,经过人工筛选,转换为结构化数据并录入数据库时使用。
1. 采集链接(twitter-collector)
↓
2. 人工筛选(预览页)
↓
3. Grok 转换(grok-json-generator)
↓
4. 数据库录入(db-importer)
# 一键执行所有阶段
node scripts/workflow.js --stage all --preset nano-banana-pro
# 只采集 + 筛选
node scripts/workflow.js --stage collector --preset nano-banana-pro
# 只 Grok 转换
node scripts/workflow.js --stage grok --input-file /Users/douba/twitter-output/twitter-links-2026-01-13.txt
# 只数据库录入
node scripts/workflow.js --stage import --input-file /Users/douba/twitter-output/grok-data-2026-01-13.json
# 第一阶段:采集
node scripts/workflow.js --stage collector --preset nano-banana-pro
# 第二阶段:打开预览页
node scripts/workflow.js --stage collector --output preview
# 第三阶段:Grok 转换
node scripts/workflow.js --stage grok --links "https://x.com/link1 https://x.com/link2"
# 第四阶段:数据库录入
node scripts/workflow.js --stage import --input-file /Users/douba/twitter-output/grok-data-2026-01-13.json
# 第五阶段:断点续跑(从第 10 条开始)
node scripts/workflow.js --stage import --start-index 10
| 参数 | 说明 | 默认值 | 示例 |
|---|---|---|---|
--stage | 执行阶段 | all | all, collector, grok, import |
--preset | 采集预设 | nano-banana-pro | nano-banana-pro |
--links | 链接列表 | - | "https://x.com/link1 https://x.com/link2" |
--input-file | 输入文件路径 | - | /Users/douba/twitter-output/grok-data.json |
--start-index | 起始索引 | 0 | 10 |
不同阶段的参数会传递到对应的技能:
--preset <预设>
--output <输出格式>
--score-keywords <评分关键词>
--min-score <最低评分>
--filter-url <筛选页 URL>
--output-dir <输出目录>
--links <链接列表>
--input-file <文件>
--grok-url <Grok URL>
--prompt <提示词>
--batch-size <批大小>
--output-dir <输出目录>
--browser <浏览器端口>
--input-file <JSON 文件>
--start-index <起始索引>
--batch-size <批大小>
--delay <延迟时间>
--output-dir <输出目录>
--browser <浏览器端口>
🔄 Twitter 完整工作流启动...
📊 执行阶段: all
🔍 采集预设: nano-banana-pro
📋 阶段 1: 采集
🔍 搜索参数: (#NanoBananaPro OR #NanoBanana OR "Nano Banana" OR "prompt") AND -female -woman -hair -GEMINIFOURTH
📊 最大采集: 100 条
✅ 采集完成
📁 预览页: /Users/douba/twitter-output/twitter-preview-2026-01-13.html
📋 阶段 2: Grok 转换
🔗 输入文件: /Users/douba/twitter-output/twitter-links-2026-01-13.txt
✅ Grok 转换完成
📁 数据文件: /Users/douba/twitter-output/grok-data-2026-01-13.json
📋 阶段 3: 数据库录入
🔗 输入文件: /Users/douba/twitter-output/grok-data-2026-01-13.json
📤 正在录入: 1/10, 2/10, 3/10...
✅ 录入完成
📁 进度文件: /Users/douba/twitter-output/importer-progress.json
🎉 全流程执行完成!
本技能组合了以下独立技能:
graph LR
A[采集] --> B[筛选]
B --> C[Grok转换]
C --> D[数据库录入]
A --> A1[评分]
A --> A2[预览页]
C --> C1[结构化]
C1 --> C2[JSON文件]
D --> D1[网页录入]
D1 --> D2[进度跟踪]
twitter-workflow/
├── scripts/
│ └── workflow.js # 主流程编排脚本
└── skill.md # 本技能说明
grok-json-generator/
├── scripts/
│ └── rok-generator.js # Grok 转换脚本
└── README.md # Grok 转换说明
db-importer/
├── scripts/
│ └── importer.js # 数据库录入脚本
└── README.md # 数据库录入说明
twitter-collector/
├── scripts/
│ └── collector.js # 采集脚本
├── README.md # 采集技能说明
twitter-output/
├── twitter-links-*.txt # 链接文件
├── twitter-preview-*.html # 预览页
├── grok-data-*.json # Grok 数据文件
└── importer-progress.json # 进度文件
每个阶段完成后更新状态:
{
"workflow_stage": "collector",
"completed_at": "2026-01-13T10:00:00Z",
"outputs": {
"links_file": "twitter-links-2026-01-13.txt",
"preview_file": "twitter-preview-2026-01-13.html",
"grok_file": "grok-data-2026-01-13.json",
"import_status": "pending"
}
}
每完成一个阶段后,立即验证输出:
# 检查采集的链接
cat /Users/douba/twitter-output/twitter-links-2026-01-13.txt
# 检查预览页
open /Users/douba/twitter-output/twitter-preview-2026-06-13.html
# 检查 Grok 数据
cat / /Users/douba/twitter-output/grok-data-2026-06-13.json
如果在数据库录入阶段中断:
# 从第 30 条继续
node scripts/workflow.js --stage import --start-index 30
根据不同情况灵活调整参数:
# 采集更多数据
node scripts/workflow.js --stage collector --preset nano-banana-pro --max-tweets 200
# 减少批大小以提高成功率
node scripts/workflow.js --stage import --batch-size 5
# 增加延迟以避免限流
node scripts/workflow.js --stage import --delay 3000
实时查看各阶段状态:
# 检查工作流状态
cat /Users/douba/twitter-output/workflow-status.json
# 检查数据库录入进度
cat /Users/douba/twitter-output/importer-progress.json
录入完成后,数据已在你的数据库中,可以进行后续的筛选和分析工作。