with one click
twitter-workflow
Twitter 数据采集到数据库的全流程自动化(采集→筛选→Grok 转换→数据库录入)
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Menu
Twitter 数据采集到数据库的全流程自动化(采集→筛选→Grok 转换→数据库录入)
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Based on SOC occupation classification
仿写/复刻单篇小红书笔记的写作风格:从“单个帖子样本”(标题+正文+标签+可选图片/排版特征)抽取风格指纹,并结合用户给定主题要点与可选知识库链接,生成同风格但不抄袭的新笔记(标题/正文/话题标签/可选配图建议)。当用户说“仿写这篇小红书/按这篇的风格写一篇/复刻口吻排版/基于这条笔记生成同风格内容”,或提供 info.json、detail.txt、链接、截图等作为风格样本时使用。
AI深度分析语音记录,揭示行为模式、认知偏见和战略盲点。不只是数据汇总,而是直击本质的战略洞察和否定性指导。提取可沉淀的核心原则和工作偏好,构建个人工作模式知识库。
A generic requirement/problem clarification workflow. Use when a user/client request is ambiguous, underspecified, or hard to execute/verify. The skill reframes the request, defines scope, constraints, inputs, and acceptance criteria, then outputs a concise one-page definition and a minimal question set to close gaps. Suitable for product/feature requests, content requests, ops tasks, research asks, and decision-making prompts.
Guide for creating effective skills. This skill should be used when users want to create a new skill (or update an existing skill) that extends Claude's capabilities with specialized knowledge, workflows, or tool integrations.
统一的推文内容获取技能。支持单条/批量推文提取,输出结构化数据。当用户提供 Twitter/X 链接并希望获取内容时自动触发。
从 Markdown 文件中自动提取并下载 Twitter 图片,生成可直接发布的版本。 当用户说"下载推文图片"、"提取Twitter图片"、"download twitter images"时触发。
| name | twitter-workflow |
| description | Twitter 数据采集到数据库的全流程自动化(采集→筛选→Grok 转换→数据库录入) |
Twitter 数据从采集到数据库的完整自动化流程。
当你需要从 Twitter 采集数据,经过人工筛选,转换为结构化数据并录入数据库时使用。
1. 采集链接(twitter-collector)
↓
2. 人工筛选(预览页)
↓
3. Grok 转换(grok-json-generator)
↓
4. 数据库录入(db-importer)
# 一键执行所有阶段
node scripts/workflow.js --stage all --preset nano-banana-pro
# 只采集 + 筛选
node scripts/workflow.js --stage collector --preset nano-banana-pro
# 只 Grok 转换
node scripts/workflow.js --stage grok --input-file /Users/douba/twitter-output/twitter-links-2026-01-13.txt
# 只数据库录入
node scripts/workflow.js --stage import --input-file /Users/douba/twitter-output/grok-data-2026-01-13.json
# 第一阶段:采集
node scripts/workflow.js --stage collector --preset nano-banana-pro
# 第二阶段:打开预览页
node scripts/workflow.js --stage collector --output preview
# 第三阶段:Grok 转换
node scripts/workflow.js --stage grok --links "https://x.com/link1 https://x.com/link2"
# 第四阶段:数据库录入
node scripts/workflow.js --stage import --input-file /Users/douba/twitter-output/grok-data-2026-01-13.json
# 第五阶段:断点续跑(从第 10 条开始)
node scripts/workflow.js --stage import --start-index 10
| 参数 | 说明 | 默认值 | 示例 |
|---|---|---|---|
--stage | 执行阶段 | all | all, collector, grok, import |
--preset | 采集预设 | nano-banana-pro | nano-banana-pro |
--links | 链接列表 | - | "https://x.com/link1 https://x.com/link2" |
--input-file | 输入文件路径 | - | /Users/douba/twitter-output/grok-data.json |
--start-index | 起始索引 | 0 | 10 |
不同阶段的参数会传递到对应的技能:
--preset <预设>
--output <输出格式>
--score-keywords <评分关键词>
--min-score <最低评分>
--filter-url <筛选页 URL>
--output-dir <输出目录>
--links <链接列表>
--input-file <文件>
--grok-url <Grok URL>
--prompt <提示词>
--batch-size <批大小>
--output-dir <输出目录>
--browser <浏览器端口>
--input-file <JSON 文件>
--start-index <起始索引>
--batch-size <批大小>
--delay <延迟时间>
--output-dir <输出目录>
--browser <浏览器端口>
🔄 Twitter 完整工作流启动...
📊 执行阶段: all
🔍 采集预设: nano-banana-pro
📋 阶段 1: 采集
🔍 搜索参数: (#NanoBananaPro OR #NanoBanana OR "Nano Banana" OR "prompt") AND -female -woman -hair -GEMINIFOURTH
📊 最大采集: 100 条
✅ 采集完成
📁 预览页: /Users/douba/twitter-output/twitter-preview-2026-01-13.html
📋 阶段 2: Grok 转换
🔗 输入文件: /Users/douba/twitter-output/twitter-links-2026-01-13.txt
✅ Grok 转换完成
📁 数据文件: /Users/douba/twitter-output/grok-data-2026-01-13.json
📋 阶段 3: 数据库录入
🔗 输入文件: /Users/douba/twitter-output/grok-data-2026-01-13.json
📤 正在录入: 1/10, 2/10, 3/10...
✅ 录入完成
📁 进度文件: /Users/douba/twitter-output/importer-progress.json
🎉 全流程执行完成!
本技能组合了以下独立技能:
graph LR
A[采集] --> B[筛选]
B --> C[Grok转换]
C --> D[数据库录入]
A --> A1[评分]
A --> A2[预览页]
C --> C1[结构化]
C1 --> C2[JSON文件]
D --> D1[网页录入]
D1 --> D2[进度跟踪]
twitter-workflow/
├── scripts/
│ └── workflow.js # 主流程编排脚本
└── skill.md # 本技能说明
grok-json-generator/
├── scripts/
│ └── rok-generator.js # Grok 转换脚本
└── README.md # Grok 转换说明
db-importer/
├── scripts/
│ └── importer.js # 数据库录入脚本
└── README.md # 数据库录入说明
twitter-collector/
├── scripts/
│ └── collector.js # 采集脚本
├── README.md # 采集技能说明
twitter-output/
├── twitter-links-*.txt # 链接文件
├── twitter-preview-*.html # 预览页
├── grok-data-*.json # Grok 数据文件
└── importer-progress.json # 进度文件
每个阶段完成后更新状态:
{
"workflow_stage": "collector",
"completed_at": "2026-01-13T10:00:00Z",
"outputs": {
"links_file": "twitter-links-2026-01-13.txt",
"preview_file": "twitter-preview-2026-01-13.html",
"grok_file": "grok-data-2026-01-13.json",
"import_status": "pending"
}
}
每完成一个阶段后,立即验证输出:
# 检查采集的链接
cat /Users/douba/twitter-output/twitter-links-2026-01-13.txt
# 检查预览页
open /Users/douba/twitter-output/twitter-preview-2026-06-13.html
# 检查 Grok 数据
cat / /Users/douba/twitter-output/grok-data-2026-06-13.json
如果在数据库录入阶段中断:
# 从第 30 条继续
node scripts/workflow.js --stage import --start-index 30
根据不同情况灵活调整参数:
# 采集更多数据
node scripts/workflow.js --stage collector --preset nano-banana-pro --max-tweets 200
# 减少批大小以提高成功率
node scripts/workflow.js --stage import --batch-size 5
# 增加延迟以避免限流
node scripts/workflow.js --stage import --delay 3000
实时查看各阶段状态:
# 检查工作流状态
cat /Users/douba/twitter-output/workflow-status.json
# 检查数据库录入进度
cat /Users/douba/twitter-output/importer-progress.json
录入完成后,数据已在你的数据库中,可以进行后续的筛选和分析工作。