Skip to main content

deai-hotspot

从多个平台采集热点话题(微博、百度、知乎问题热榜、知乎推荐问题、知乎邀请问题、知乎想法话题、头条、B站、抖音、百度指数、知微事见、IT之家、澎湃新闻、网易新闻、InfoQ中国、虎嗅、品玩)。使用时:需要获取今日热点榜单作为选题依据。跨来源去重、热度归一化,输出融合排名。

Jump to install

Source facts

Repository
lornshrimp/Lorn.TechProductManagerContentCreatorSkill
Last source activity
September 1, 2026 at 00:57
Detected SKILL.md language
Chinese
Stars
1
Forks
0

Install options

The review-first prompt is selected by default. You can switch to a direct command or download a local copy.

Review the source files

Read SKILL.md and any companion files shown by SkillsMP before deciding whether to install.

File Explorer
21 files

Showing SKILL.md

SKILL.md
Source instructions · Read-only preview
name
deai-hotspot
description
从多个平台采集热点话题(微博、百度、知乎问题热榜、知乎推荐问题、知乎邀请问题、知乎想法话题、头条、B站、抖音、百度指数、知微事见、IT之家、澎湃新闻、网易新闻、InfoQ中国、虎嗅、品玩)。使用时:需要获取今日热点榜单作为选题依据。跨来源去重、热度归一化,输出融合排名。
user-invocable
true
# `deai-hotspot` — 热点采集 ## When to Use - 需要了解当前各平台的热点话题 - 为选题分析提供数据基础 ## Input - 用户指定来源类型(默认全量采集所有平台) ## Output - `hotspot/榜单/{日期}/{来源}.md`(各来源原始榜单,按日期分目录存放) - `hotspot/榜单/{日期}/融合榜单.md`(跨平台聚合后的 TOP 榜单) ## Procedure ### 0. 采集通道优先级(bsk 优先,2026-08-07 定版) 按以下优先级选择采集通道,前序不可用时逐级降级: 1. **bsk 浏览器(首选)**:驱动用户真实 Edge/Chrome(BrowserSkill 扩展),可读 **JS 渲染 + 登录态**页面(知乎/微博/抖音/B站等此前不可达源)。依赖:`bsk` CLI(`~/.local/bin/bsk.exe`)+ 浏览器扩展已连接。前置自检:`bsk doctor -v`(全部 ok)、`bsk browsers`(有已连接浏览器)。**详细命令手册见 `./references/adapter-bsk.md`**。 2. **Python urllib 直连**:SSR 静态源(百度/IT之家/网易/澎湃/品玩)快速通道;`open('wb')` 落盘 `%TEMP%`(curl -o 在本环境会被拦截,勿用)。 3. **WebSearch + 聚合站**:兜底(JS 源且无登录态时),参考 `rebang.today` / `hotdata.aipromptnav.com` / `tophub.app` 取快照。 **bsk 会话生命周期(强制)**:`bsk session start` → 所有命令带 `--session <id>` → 任务结束(含出错路径)必须 `bsk session stop <id>`。 ### 1. 确定采集来源 用户可指定,默认全量。支持来源: | 来源 | 适配器文件 | |------|-----------| | **bsk 采集手册** | `./references/adapter-bsk.md` | | 微博热搜榜 | `./references/adapter-weibo.md` | | 百度热搜榜 | `./references/adapter-baidu.md` | | 知乎问题热榜 | `./references/adapter-zhihu-q.md` | | 知乎推荐问题 | `./references/adapter-zhihu-recommend.md` | | 知乎邀请问题 | `./references/adapter-zhihu-invited.md` | | 知乎想法话题 | `./references/adapter-zhihu-idea.md` | | 知乎想法热榜 | `./references/adapter-zhihu-p.md` | | 头条热榜 | `./references/adapter-toutiao.md` | | B站热门 | `./references/adapter-bilibili.md` | | 抖音热点 | `./references/adapter-douyin.md` | | 百度指数 | `./references/adapter-baidu-index.md` | | **知微事见** | `./references/adapter-zhiwei.md` | | **IT之家热榜** | `./references/adapter-ithome.md` | | **澎湃新闻热榜** | `./references/adapter-thepaper.md` | | **网易新闻热点排行** | `./references/adapter-163news.md` | | **InfoQ中国热点** | `./references/adapter-infoq.md` | | **虎嗅48h热文** | `./references/adapter-huxiu.md` | | **品玩一周精选** | `./references/adapter-pingwest.md` | | **小红书热榜/话题(2026-08-11 新增源)** | 适配器待建:小红书搜索热词/话题页(需登录态),用于捕捉种草趋势与平台风向 | | **视频号热门(2026-08-11 新增源)** | 适配器待建:视频号热门内容(需登录态),用于捕捉深度叙事内容风向 | > **平台矩阵扩展说明(2026-08-11)**:小红书与视频号是知识库方法论资产最厚的两个平台(小红书 20+ 资料、视频号 8+ 报告),也是 2025-2026 增长最确定的平台。新增这两个热榜源为 deai-topic 提供"种草趋势/深度叙事"类选题输入。**适配器未建前**,可用 WebSearch + 聚合站兜底采集(rebang.today 等),或标记"待适配"。此两源采集成功后,打卡表由 19 源扩展为 21 源。 ### 2. 按来源采集 对每个来源,按对应适配器说明访问页面、提取字段、标准化输出。 **知乎来源特别要求**:知乎问题热榜、推荐问题、邀请问题的输出表中必须包含「链接」列,格式为 `[去回答](https://www.zhihu.com/question/{id})`,方便后续回到对应问题页面答题。 #### 登录处理规则 某些来源可能需要登录才能完整访问(如微博、知乎、抖音等)。**规则:先尝试访问,检测到被重定向到登录页才询问,不预设"需登录"。** 具体流程: 1. **直接尝试访问页面**,打开目标 URL 2. **检测是否被重定向到登录页**: - 等待页面加载(约 3 秒) - 检查页面 URL 是否包含 `/signin`、`/login`、`/passport` 等关键词 - 检查页面标题是否包含「登录」「注册」「Sign in」等关键词 - 检查页面主体是否包含明显的登录表单(如用户名/密码输入框) 3. **判断结果**: - **未被重定向,页面正常加载** → 继续采集 - **被重定向到登录页** → 暂停该来源采集,使用 `vscode_askQuestions` 询问用户是否已登录该平台 4. 如果用户确认已登录,刷新页面继续采集 5. 如果用户未登录,告知用户需要先登录并提供登录 URL,等待用户登录确认后刷新重试 6. **如果同一来源在同一个会话中再次被访问且发现仍处于登录状态**(之前已验证过),应直接使用当前已登录的页面继续采集,不再重复询问 注意: - 很多平台的登录态保存在 cookie 中,新的浏览器页面可能继承已有登录态,**必须真实验证是否被重定向**,不能假设 - 有 `status: ❌ **不可用**` 标记的适配器(如知乎想法话题、知乎想法热榜)属于已知无法提取的接口,即使登录也无法采集,应直接跳过并标注原因 ### 3. 执行融合 ```text ① 读取 `hotspot/榜单/{日期}/` 目录下当日所有 `{来源}.md` 文件 ② 对标题做模糊相似度匹配(>0.80 视为同一热点) ③ 合并热度值(不同来源量纲归一化后加权平均) ④ 按融合热度排序,去重后输出 TOP 20 ⑤ 标注"覆盖来源数"(如"微博+知乎"双平台上榜) ``` **⚠️ 融合口径强制规范(2026-08-08 修订,禁止再犯)**: - **禁止以"内容定位"(如科技/产品/互联网)为由压制政经话题权重**。政经话题是流量放大器(见 deai-topic 技能:S 级政经话题 ×1.4 流量放大系数,天然流量远超纯科技话题)。 - 融合榜单 TOP 输出须标注话题级别(S 级政经 / A 级科技 / B 级交叉 / C 级娱乐),排序规则:**S 级政经话题(通过政经三条测试:利益/连接/视角)按 ×1.4 放大后参与排名**;C 级娱乐/气象/体育等话题标注但自然排后,不得因"定位契合"人为前置。 - 政经→行业的转换是选题环节职责(deai-topic),**融合环节不得预先替选题环节做"定位过滤"**。 - 判定政经话题是否够格 S 级的三条测试(引自 deai-topic):①利益测试(直接影响从业者钱袋子/饭碗)②连接测试(政经→科技产业 ≤2 步)③视角测试(能提供行业洞察);通过两条即 S 级。 ### 4. 输出文件 每个输出文件**必须包含 YAML frontmatter**,格式为 `---` 包裹的键值对,放在文件最顶部。 **单个来源文件的 YAML 规范:** ```yaml --- title: 微博热搜榜 · 2026-07-20 # 榜单标题 date: 2026-07-20 # 采集日期 source: 微博热搜榜 # 来源平台名称 collectTime: 2026-07-20 09:50 # 具体采集时间 --- ``` **融合榜单的 YAML 规范:** ```yaml --- title: 融合热点榜单 · 2026-07-20 date: 2026-07-20 collectTime: 2026-07-20 09:50 sources: # 所有参与融合的来源列表 - 微博热搜榜 - 百度热搜榜 - 知乎问题热榜 --- ``` 输出原始榜单(各来源独立文件)和融合榜单(聚合文件),按日期组织在子目录下: ``` hotspot/榜单/ ├── {日期}/ ← 按采集日期分组 │ ├── 融合榜单.md ← 当日跨平台融合 TOP 榜单 │ ├── 微博热搜榜.md ← 各来源原始榜单 │ ├── 百度热搜榜.md │ ├── 知乎问题热榜.md │ └── ... ├── {另一日期}/ │ └── ... ``` 融合榜单格式(**H1 省略,由 YAML `title` 替代**): ```markdown --- title: 融合热点榜单 · {日期} date: {日期} collectTime: {时间} sources: - 微博热搜榜 - 百度热搜榜 - 知乎问题热榜 - 头条热榜 --- ## TOP 20 跨平台热点 | 排名 | 热点标题 | 融合热度 | 覆盖来源 | 时效性 | 最佳切入点 | |------|----------|----------|----------|--------|-----------| | 1 | xxx | 92.5 | 微博+百度+知乎 | 2h内 | 深度分析 | ## 各平台独立 TOP 10 速览 ### 微博热搜榜 ...(简略引用) ### 知乎问题热榜 ...(简略引用) ``` ## Calling Examples ```text @deai-hotspot 全量采集所有来源 @deai-hotspot 只采知乎问题热榜 仅采集知乎 @deai-hotspot 采微博和百度 指定来源 ```
View on GitHub