一键导入
wechat-article-fetch
抓取微信公众号文章全文并保存为 Markdown。用于 AI News Digest 工作流中处理 mp.weixin.qq.com 链接、公众号首发动态、深度分析文章和搜索结果中的微信原文。 当日报采集需要读取微信文章正文、抽取标题/摘要/原文链接、归档图文素材时触发。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
抓取微信公众号文章全文并保存为 Markdown。用于 AI News Digest 工作流中处理 mp.weixin.qq.com 链接、公众号首发动态、深度分析文章和搜索结果中的微信原文。 当日报采集需要读取微信文章正文、抽取标题/摘要/原文链接、归档图文素材时触发。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
| name | wechat-article-fetch |
| description | 抓取微信公众号文章全文并保存为 Markdown。用于 AI News Digest 工作流中处理 mp.weixin.qq.com 链接、公众号首发动态、深度分析文章和搜索结果中的微信原文。 当日报采集需要读取微信文章正文、抽取标题/摘要/原文链接、归档图文素材时触发。 |
本 skill 基于 Playwright headless 抓取微信公众号文章,解决搜索结果只能拿到标题/片段、无法稳定读取 mp.weixin.qq.com 正文的问题。它是 AI News Digest 的辅助采集层,不负责判断新闻价值,抓取结果交给 ai-daily-report / ralph-daily-loop 做去重、分级和 QA。
参考实现来自 cat-xierluo/legal-skills/skills/wechat-article-fetch,本仓库只保留公众号抓取与 Markdown 归档能力,不引入法律文本格式化协议。
首次使用前在本目录执行:
npm install
npx playwright install chromium
# 输出到控制台,并自动按标题归档
node scripts/fetch.js "https://mp.weixin.qq.com/s/xxxxx"
# 保存到指定 Markdown 文件
node scripts/fetch.js "https://mp.weixin.qq.com/s/xxxxx" "./wechat-articles/article.md"
# 保存到目录,文件名由文章标题生成
node scripts/fetch.js "https://mp.weixin.qq.com/s/xxxxx" "./wechat-articles/"
抓取到的微信文章应进入 data/00b-wechat-articles.json,数组格式:
{
"title": "文章标题",
"source": "微信公众号名称或搜索来源",
"url": "https://mp.weixin.qq.com/s/...",
"summary": "50-100 字摘要",
"board": "大厂动向 | 初创动向 | 生态动向 | 技术博客&论文 | 观点与深度",
"date": "YYYY-MM-DD",
"wechat_archive": "wechat-articles/<title>.md",
"signal": "candidate"
}
mp.weixin.qq.com 链接。summary 或 qa_notes 中标记 wechat_fetch_failed。ai-daily-report 轨道②:公众号 + 社交媒体扫描ralph-daily-loop 并行 Goal:FETCH_WECHAT_ARTICLESMERGE_DEDUP 汇合阶段:把 00b-wechat-articles.json 与 Newsletter、中文、英文、Builder、虾评、MCP/RSS、HN 共识统一去重生成每日 AI 行业新闻日报(中文),包含结构化新闻摘要、来源链接、质量审核报告、CSV 数据输出、飞书结构化文档和飞书 Newsrun 卡片。 当用户提到以下场景时触发本技能:生成 AI 日报、AI 行业新闻汇总、今日 AI 新闻、 AI daily report、搜索今天的 AI 新闻、AI 行业资讯整理、AI 日报试跑、 每日新闻速递、AI news digest、新闻质量审核。 即使用户只是简单说"跑一下日报"、"今天有什么 AI 新闻"、"出一期日报"也应触发。 不要在用户只是随口聊 AI 话题时触发——只在用户明确需要新闻汇总/日报产出时使用。
AI 日报 Ralph Loop 编排器。将 800 行的 ai-daily-report 工作流拆分为 9 个主 Goal + Newsletter / 微信文章 2 条并行预采集线, 通过文件系统持久化实现跨上下文记忆,支持 Codex /goal、Claude Code Ralph Loop、 Mira 定时任务三种执行模式。解决单次运行上下文爆炸(100k+ tokens)的问题。 触发词:ralph loop、ralph 日报、分阶段跑日报、日报不要爆上下文、 goal 模式跑日报、持续运行日报、日报编排、ralph-daily-loop
Advanced content and topic research skill that analyzes trends across Google Analytics, Google Trends, Substack, Medium, Reddit, LinkedIn, X, blogs, podcasts, and YouTube to generate data-driven article outlines based on user intent analysis
Comprehensive news aggregator that fetches, filters, and deeply analyzes real-time content from 28 sources including Hacker News, GitHub, Hugging Face Papers, AI Newsletters, WallStreetCN, Weibo, and Podcasts. Use when user requests 'daily scans', 'tech news', 'finance updates', 'AI briefings', 'deep analysis', or says '如意如意' to open the interactive menu.
极简网页抓取工具。当传统web_fetch/web_search失败时使用。 核心方法(按优先级尝试): 1. 在URL前加 markdown.new/ (Cloudflare网站首选) 2. 加 defuddle.md/ (非Cloudflare网站) 3. 加 r.jina.ai/ (终极备选) 4. 使用Scrapling爬虫工具(终极方案) 5. 使用Playwright动态渲染(最后手段) 触发词: - "抓取这个网页:[URL]" - "读取这个链接" - "获取这个页面的内容" - "传统方法失败了,用smart-web-fetch试试"