一键导入
wechat-claw
微信公众号文章综合获取工具。支持两项核心功能:1.单篇文章提取:提供公开链接可稳定解析标题与正文纯文本。2.公众号全量获取:提取目标公众号的全部历史文章与正文。必须根据本地机器与云服务器环境严格区分登录授信策略。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
微信公众号文章综合获取工具。支持两项核心功能:1.单篇文章提取:提供公开链接可稳定解析标题与正文纯文本。2.公众号全量获取:提取目标公众号的全部历史文章与正文。必须根据本地机器与云服务器环境严格区分登录授信策略。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
| name | wechat-claw |
| description | 微信公众号文章综合获取工具。支持两项核心功能:1.单篇文章提取:提供公开链接可稳定解析标题与正文纯文本。2.公众号全量获取:提取目标公众号的全部历史文章与正文。必须根据本地机器与云服务器环境严格区分登录授信策略。 |
本 skill 提供对微信公众号文章的综合获取能力,无论是单篇文章的结构化解析,还是整个公众号历史文章的全量提取。
适用场景:用户提供了 https://mp.weixin.qq.com/s/... 公开文章链接,需要获取文章的标题、时间、作者和正文。
特点:
适用场景:用户想获取某个公众号的全部历史文章,或者某段日期之后的文章列表及其全文正文。 特点:
--credentials 参数拼接投喂给爬虫执行。_full_.json,不再需要两步操作。本 skill 需要以下 Python 依赖与环境支持:
pip install -r requirements.txt
playwright install chromium
由于微信页面包含极其复杂的动态反机器逻辑,只要用户给出了文章链接进行单篇处理,必须使用以下脚本提取内容,严格禁止使用 web_fetch 或 web_search 等其它内置工具替代。
python read_wechat_article.py "https://mp.weixin.qq.com/s/..."
Agent 核心准则:如果在对话上下文中不知道用户环境,必须先问!如果知道是在云服务器,必须让用户自己提取后给你!绝不能随意启动。
如果双方明确这是在本地本机执行,直接无参调用。 Agent 的引导话术: “我们将自动拉起 Chrome,请准备好手机扫码进行验证。”
# 执行并等待用户手动扫描弹出窗口
python crawler.py --nickname "公众号名称" --since 2026-03-01 --max 50
如果双方明确是跑在海外/机房云服务等远端计算节点。 Agent 的首要任务: 绝不要让用户去做拼装 JSON 之类复杂的开发工作! Agent 的引导话术: “请在您个人的电脑浏览器上打卡微信公众平台,并按下 F12 查看网络报文,直接把请求头里的完整 Cookie 以及 URL 参数里的 token 复制粘贴发给我即可,剩下的拼接工作交给我。”
拿到用户发来的原始 Cookie 和 Token 后,由 Agent 负责在底层自动拼装成合法的 JSON 字符串,并通过传参方式执行:
python crawler.py --nickname "公众号名称" --credentials '{"cookie":"这里塞用户的超级长cookie","token":"这里塞用户的token"}'
--max 10 仅获取最新的十篇--since 2026-03-01 仅获取指定日期以来的文章--fakeid "MzI..." 手动指定目标 fakeid (可跳过检索)Cookie 和 Token 存活期通常仅几小时。如果执行时脚本抛出 [!] 可能是 cookie/token 已过期,Agent 必须主动作出判断:
fetch_content.py 去弄二次请求,现版 crawler.py 在首阶段提取出列表结构后,会自动执行这一过程,并产出 _full_xxxx.json。此时 Agent 应该帮用户直接审视这份 _full_ 后缀的新结果即可!