بنقرة واحدة
url-reader
智能读取任意URL内容,支持微信公众号、小红书、今日头条、抖音、淘宝、天猫、京东、百度等中国主流平台,自动识别平台类型并提取核心内容。自动保存内容为Markdown,下载图片到本地。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
智能读取任意URL内容,支持微信公众号、小红书、今日头条、抖音、淘宝、天猫、京东、百度等中国主流平台,自动识别平台类型并提取核心内容。自动保存内容为Markdown,下载图片到本地。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
自媒体自动化工具 / IP 爆款制造机。完整流程:找热点挖掘爆款文章 → 改写文案生成短视频脚本和公众号长文 → 自动配图生成封面和插图 → 一键发布到微信公众号。 **触发场景**:用户提到"找热点"、"挖掘爆款"、"改写文案"、"生成短视频脚本"、"做公众号配图"、"发布到公众号"、"帮我做自媒体"、"这个素材帮我 IP 化"、"生成封面图片"、"把这篇文章发到微信"时必须使用。 **也请主动使用**:当用户提到"公众号文章"、"短视频内容"、"内容二创"、"IP 风格"、"自媒体运营"、"微信发布"、"内容改写"、"爆款分析"、"选题挖掘"、"小红书内容"、"抖音视频"、"爬取文章"、"提取内容"、"mp.weixin.qq.com"、"抖音链接"等相关概念时,即使用户没有明确说要使用技能——因为这是处理此类任务最高效的方式。 **特别注意**:当用户说"帮我爬取/抓取/提取这篇公众号文章"时,**必须**使用本技能的 `from-article` 命令,不要尝试用通用爬虫或自己解析 HTML。本技能内置 url-reader + 次幂数据 API 双重兜底,确保 100% 获取成功率。
抖音无水印视频下载和文案提取工具
微信公众号内容全流程助手:热点抓取 → 选题 → 框架 → 内容增强 → 写作 → SEO → 视觉AI → 排版推送草稿箱。 触发关键词:公众号、推文、微信文章、微信推文、草稿箱、微信排版、选题、热搜、 热点抓取、封面图、配图、写公众号、写一篇、主题画廊、排版主题、容器语法。 也覆盖:markdown 转微信格式、学习用户改稿风格、文章数据复盘、风格设置、 主题预览/切换、:::dialogue/:::timeline/:::callout 容器语法。 不应被通用的"写文章"、blog、邮件、PPT、抖音/短视频、网站 SEO 触发—— 需要有公众号/微信等明确上下文。
| name | url-reader |
| description | 智能读取任意URL内容,支持微信公众号、小红书、今日头条、抖音、淘宝、天猫、京东、百度等中国主流平台,自动识别平台类型并提取核心内容。自动保存内容为Markdown,下载图片到本地。 |
一键读取任意URL的内容,自动识别平台类型,智能选择最佳读取策略,自动保存内容和图片到本地。
/Users/ys/laoyang知识库/nickys/素材/
保存格式:
素材/
└── 2026-01-30_文章标题/
├── content.md # Markdown内容
├── img_01.webp # 图片1
├── img_02.webp # 图片2
└── ...
┌─────────────────────────────────────────────────────────────────┐
│ URL Reader 技术架构 │
├─────────────────────────────────────────────────────────────────┤
│ │
│ 用户输入 URL │
│ ↓ │
│ ┌─────────────┐ │
│ │ 平台识别器 │ → 识别URL所属平台(微信/小红书/淘宝等) │
│ └─────────────┘ │
│ ↓ │
│ ┌─────────────────────────────────────────────────────────────┐│
│ │ 策略选择器 ││
│ │ ┌───────────┐ ┌───────────┐ ┌───────────┐ ││
│ │ │ 策略1 │ │ 策略2 │ │ 策略3 │ ││
│ │ │ Firecrawl │→│ Jina │→│ Playwright │ ││
│ │ │ (首选) │ │ (备选) │ │ (兜底) │ ││
│ │ └───────────┘ └───────────┘ └───────────┘ ││
│ └─────────────────────────────────────────────────────────────┘│
│ ↓ │
│ ┌─────────────┐ │
│ │ 内容提取器 │ → 提取标题、正文、作者、时间等 │
│ └─────────────┘ │
│ ↓ │
│ ┌─────────────┐ │
│ │ 格式化输出 │ → Markdown 格式 │
│ └─────────────┘ │
│ │
└─────────────────────────────────────────────────────────────────┘
特点:
API 调用:
from firecrawl import Firecrawl
app = Firecrawl(api_key="fc-YOUR_API_KEY")
result = app.scrape(url, formats=["markdown"])
定价:
特点:
使用方式:
https://r.jina.ai/{原始URL}
特点:
适用场景:
用户:帮我读取这个链接 https://mp.weixin.qq.com/s/xxxxx
用户:看看这个小红书 https://www.xiaohongshu.com/explore/xxxxx
用户:读一下这个网页 https://example.com/article
/url-reader https://example.com/article
| 平台 | 域名 | 推荐策略 | 备注 |
|---|---|---|---|
| 微信公众号 | mp.weixin.qq.com | Firecrawl → Playwright | 可能需要登录 |
| 小红书 | xiaohongshu.com | Firecrawl → Jina | 短链接需解析 |
| 今日头条 | toutiao.com | Firecrawl → Jina | - |
| 抖音 | douyin.com | Firecrawl | 提取视频描述 |
| 淘宝 | taobao.com | Firecrawl → Playwright | 可能需要登录 |
| 天猫 | tmall.com | Firecrawl → Playwright | 可能需要登录 |
| 京东 | jd.com | Firecrawl → Jina | - |
| 百度 | baidu.com | Firecrawl → Jina | - |
| 知乎 | zhihu.com | Firecrawl → Jina | - |
| 微博 | weibo.com | Firecrawl → Playwright | 可能需要登录 |
| B站 | bilibili.com | Firecrawl → Jina | - |
| 通用网站 | * | Firecrawl → Jina | - |
1. 接收 URL
2. 识别平台类型
3. 选择读取策略:
├─ 尝试 Firecrawl API
│ ├─ 成功 → 返回内容
│ └─ 失败 → 继续
├─ 尝试 Jina Reader
│ ├─ 成功 → 返回内容
│ └─ 失败 → 继续
└─ 尝试 Playwright(需要登录态)
├─ 有登录态 → 读取内容
└─ 无登录态 → 提示用户设置
4. 提取核心内容
5. 格式化输出
# [文章标题]
**来源**:[平台名称]
**作者**:[作者名称]
**发布时间**:[时间]
**原文链接**:[URL]
---
[正文内容]
---
**互动数据**(如有):
- 阅读/播放:xxx
- 点赞:xxx
- 评论:xxx
export FIRECRAWL_API_KEY="fc-...".env:在 self-media-workflow 根目录下的 .env 中设置 FIRECRAWL_API_KEY=...用于需要登录的平台(如微信公众号):
cd ~/.claude/skills/url-reader
source .venv/bin/activate
python scripts/wechat_reader.py setup
url-reader/
├── skill.md # 本文档
├── metadata.json # 元数据
├── scripts/
│ ├── url_reader.py # 主读取器(整合三种策略)
│ ├── firecrawl_reader.py # Firecrawl 策略
│ ├── jina_reader.py # Jina 策略
│ ├── wechat_reader.py # Playwright 策略(微信)
│ └── url_identifier.py # URL 平台识别器
└── data/
└── wechat_auth.json # 微信登录态(自动生成)
cd ~/.claude/skills/url-reader
python3 -m venv .venv
source .venv/bin/activate
# 核心依赖
pip install firecrawl-py requests
# Playwright(可选,用于需要登录的平台)
pip install playwright
playwright install chromium
A: 可能原因:
A:
A: 微信反爬最严格,建议: