| name | geo-citability |
| description | AI可引用性评分与优化。分析网页内容,确定中国AI系统(豆包、元宝、DeepSeek、文心一言、通义千问)引用或摘录段落的可能性。提供0-100的可引用性得分和具体改写建议。 |
| allowed-tools | ["Read","Grep","Glob","Bash","WebFetch","Write"] |
AI可引用性评分技能(中国LLM版)
核心洞察
AI语言模型会引用满足特定结构标准的段落。相关研究发现,经GEO优化的内容在AI生成的响应中可见性提升30-115%。关键发现:AI系统优先提取和引用134-167字长、自包含(无需上下文即可理解)、事实丰富(含具体统计数据、日期或命名实体)且在开头1-2句内直接回答问题的段落。
对于中国AI平台,还有额外要求:内容应使用标准简体中文表达,避免台湾用语;技术术语应使用中国大陆通行标准;统计数据引用中国权威来源(国家统计局、各部委数据等)会大幅提升可信度。
这与传统SEO文案写作根本不同——传统SEO优化关键词密度和用户参与度指标,而GEO可引用性优化的是可提取性——AI系统从内容中提取段落并呈现为直接答案的便利程度。
可引用性评分标准(0-100)
类别1:答案块质量(占总分30%)
衡量内容是否包含AI系统可逐字提取的清晰、可引用的答案段落。
评分标准:
| 得分 | 标准 |
|---|
| 90-100 | 每个主要章节以1-2句直接答案开头。使用"X是..."或"X指..."模式。每个章节前40-60字可作为完整答案独立存在。 |
| 70-89 | 大多数章节有清晰的答案开头。存在一些定义模式。答案可识别但可能需要少量上下文。 |
| 50-69 | 部分章节有答案式开头,但许多将答案埋在段落中间或末尾。定义模式较少。 |
| 30-49 | 答案通常埋在长段落中。无一致定义模式。内容以叙事驱动而非答案驱动。 |
| 0-29 | 没有可识别的答案块。内容完全是叙事性、对话性或碎片化的。AI难以提取任何可引用的段落。 |
高可引用性示例(中文):
内容分发网络(CDN)是一种分布式服务器系统,通过将内容缓存并从
地理位置靠近用户的节点提供服务来降低延迟。CDN平均可将加载时间
缩短50-70%。截至2025年,国内三大CDN服务商为阿里云CDN(服务约
35%的国内网站)、腾讯云CDN和华为云CDN。
字数:60。自包含:是。事实:3个具体数据点。定义模式:是。
低可引用性示例(中文):
如果你曾好奇为什么有些网站加载比其他快,答案可能让你惊讶。有一项
技术已经存在好一阵子了,它彻底改变了我们对网站性能的认知。让我来
解释一下它是如何工作的,以及为什么你的业务应该关注这个问题。
字数:52。自包含:否(未识别话题)。事实:0。定义模式:否。
类别2:段落自包含性(占总分25%)
衡量单个段落是否可以被提取并在不需要周围内容的情况下被理解。
自包含性检查清单:
- 段落是否明确命名了主体(不是"它"、"这"、"他们")?
- 只阅读这个段落,能否理解主要观点?
- 段落是否包含至少一个具体事实、统计数据或命名实体?
- 段落是否在50-200字之间(最佳提取长度)?
- 段落是否避免以暗示前文的连词开头("但是"、"然而"、"此外"意味着有前文)?
类别3:结构可读性(占总分20%)
衡量帮助AI系统解析和分段内容的结构格式。
AI可引用性的结构最佳实践:
- 标题层级: H1(页面标题)> H2(主要章节)> H3(子章节)。切勿跳级。
- 问题型标题: "什么是[话题]?"和"[话题]如何运作?"可直接与AI查询匹配。
- 段落长度: 每段2-4句。AI系统能更可靠地解析短段落。
- 表格: 用于3个以上条目的任何对比。AI系统提取表格数据的准确性很高。
- 列表: 顺序流程使用有序列表,非顺序条目使用无序列表。
- 加粗关键词: 加粗重要术语首次出现。这有助于AI实体识别。
类别4:统计密度(占总分15%)
衡量AI系统在选择引用来源时优先考虑的具体、可验证数据点的存在情况。
符合统计数据的内容:
- 具体百分比:「73%的营销人员表示...」
- 人民币/美元金额:「平均成本为每月4,500元」
- 时间框架:「实施平均需要6-8周」
- 命名来源:「根据2025年中国互联网络信息中心(CNNIC)报告...」
- 具体数量:「该平台集成了340+个工具」
- 对比数据:「比行业平均水平快40%」
- 中国权威来源: 国家统计局、工信部、各部委发布数据可信度最高
不符合统计数据的内容:
- "很多企业使用..." (模糊)
- "相当大比例..." (模糊)
- "研究表明..." (无具体来源)
- "专家认为..." (无具体专家)
类别5:独特性与原创数据(占总分10%)
衡量内容是否提供AI系统在其他地方找不到的信息,使其成为必要引用来源。
独特内容信号:
- "我们对[X]数据的分析发现..."
- "我们调查了[N]名[专业人员]并发现..."
- "基于我们[N]个客户的经验..."
- 自定义图表、图形或数据可视化
- 有具体命名结果的案例研究
- 原创框架、方法论或分类体系
- 中国特定: 基于中国本土调研的数据尤为稀缺且有价值
分析流程
第一步:获取并解析页面内容
- 使用WebFetch获取目标URL
- 提取主要内容区域(排除导航、页脚、侧边栏、广告)
- 保留标题结构(H1-H6标签)
- 保留段落边界、列表和表格
- 计算主要内容的总字数
第二步:将内容分割为块
- 在每个标题(H2或H3)处分割内容以创建内容块
- 对每个块,记录:
- 标题文字
- 该标题下的完整文本内容
- 块的字数
- 段落数量
- 列表和表格数量
- 统计数据/数据点数量
- 是否包含定义模式
- 前60字是否构成独立答案
第三步:对每个块评分
对每个内容块,计算:
- 答案块质量子得分(0-100)
- 自包含性子得分(0-100)
- 结构可读性子得分(0-100)
- 统计密度子得分(0-100)
- 独特性子得分(0-100)
块可引用性得分 = (答案 * 0.30) + (自包含 * 0.25) + (结构 * 0.20) + (统计 * 0.15) + (独特 * 0.10)
第四步:计算页面级得分
- 计算所有块得分的平均值作为页面级可引用性得分
- 识别前3个最高得分块(标注为优势)
- 识别后3个最低得分块(标记为改写优先项)
- 计算得分在70以上的块的百分比("可引用性覆盖率"指标)
第五步:生成改写建议
对每个得分低于60的块,生成具体的改写建议:
- 识别主要弱点(答案被埋、缺乏事实、结构差等)
- 使用定义或答案优先模式提出改写的开头句
- 建议可添加的具体统计数据或事实
- 推荐结构改进(添加列表、添加表格、拆分段落)
输出格式
生成文件 GEO-CITABILITY-SCORE.md:
# AI可引用性分析:[页面标题]
**URL:** [URL]
**分析日期:** [日期]
**整体可引用性得分:[X]/100**
**可引用性覆盖率:** [X]%的内容块得分超过70
---
## 得分摘要
| 类别 | 得分 | 权重 | 加权分 |
|---|---|---|---|
| 答案块质量 | [X]/100 | 30% | [X] |
| 段落自包含性 | [X]/100 | 25% | [X] |
| 结构可读性 | [X]/100 | 20% | [X] |
| 统计密度 | [X]/100 | 15% | [X] |
| 独特性与原创数据 | [X]/100 | 10% | [X] |
| **整体** | | | **[X]/100** |
---
## 最强内容块
### 1. "[标题]" — 得分:[X]/100
> [块的前2句]
**有效原因:** [解释]
---
## 最弱内容块(改写优先项)
### 1. "[标题]" — 得分:[X]/100
**当前开头:**
> [现有前2句]
**问题:** [具体问题——答案被埋、无事实等]
**建议改写:**
> [用答案优先模式和事实改写的开头2-3句]
**其他改进:**
- [添加对比X、Y、Z的表格]
- [加入关于...的统计数据]
- [将长段落拆分为2-3个短段落]
---
## 快速格式化改进建议
1. **[具体建议]** — 预期可引用性提升:+[X]分
2. **[具体建议]** — 预期可引用性提升:+[X]分
3. **[具体建议]** — 预期可引用性提升:+[X]分
---
## 各章节得分
| 章节标题 | 字数 | 答案质量 | 自包含 | 结构 | 统计 | 独特 | 整体 |
|---|---|---|---|---|---|---|---|
| [H2标题] | [N] | [X] | [X] | [X] | [X] | [X] | [X] |
参考数据
AI系统引用偏好(中国LLM版)
| AI系统 | 引用偏好 |
|---|
| 豆包(字节跳动) | 偏好来自今日头条/字节跳动生态的内容;有明确定义和近期日期的段落;倾向于引用2-4个来源。 |
| 元宝(腾讯混元) | 高度偏好知乎长文回答;来自微信公众号的内容;综合、有深度的段落。 |
| DeepSeek | 偏好技术深度内容;有GitHub或学术来源支撑的声明;每次回答引用5-12个来源。 |
| 文心一言(百度) | 偏好百度生态内容(百家号、百度百科);有具体事实的简洁答案块(40-60字);内容已在百度有机结果中排名靠前。 |
| 通义千问(阿里云) | 偏好阿里巴巴生态内容;有权威中文来源引用的综合段落;简体中文原创内容。 |