| name | geo-audit |
| description | 面向中国LLM平台的完整网站GEO+SEO审计,支持并行子代理委派。编排针对AI可引用性、平台分析(豆包/元宝/DeepSeek/文心一言/通义千问)、技术基础、内容质量和结构化数据的全面生成式引擎优化审计。生成0-100综合GEO得分并附优先行动计划。 |
| allowed-tools | ["Read","Grep","Glob","Bash","WebFetch","Write"] |
GEO审计编排技能(中国LLM版)
目的
本技能对任何面向中国市场的网站执行全面的生成式引擎优化(GEO)审计。GEO是优化网络内容以使中国AI系统(豆包、元宝、DeepSeek、文心一言、通义千问等)能够发现、理解、引用和推荐该内容的实践。本审计衡量网站在所有GEO维度的表现,并生成可操作的改进计划。
核心洞察
传统SEO针对搜索引擎排名进行优化。GEO针对AI引用和推荐进行优化。GEO评分高的网站在AI生成的响应中可见性提升30-115%(基于相关研究)。两种方法相互重叠,但有不同的需求。对于中国市场,还需特别关注本地平台生态系统——微信、知乎、B站、百度等。
审计工作流
第一阶段:发现与侦察
第一步:获取首页并检测业务类型
-
使用WebFetch获取提供URL的首页
-
提取以下信号:
- 页面标题、meta描述、H1标题
- 导航菜单项(揭示网站结构)
- 页脚内容(揭示业务信息、地点、法律页面)
- 首页的Schema.org标记
- 定价页面链接(SaaS指标)
- 商品列表模式(电商指标)
- 博客/资源部分(内容发布指标)
- 服务页面(机构指标)
- 地址/电话/地图嵌入(本地业务指标)
- 中国特定信号: 微信二维码、客服QQ、备案号(ICP备案)
-
使用以下模式对业务类型进行分类:
| 业务类型 | 检测信号 |
|---|
| SaaS/软件 | 定价页面、"免费试用"/"注册"CTA、app.子域名、功能对比表、集成页面 |
| 本地服务 | 首页实体地址、百度地图嵌入、"附近"内容、LocalBusiness schema、服务区域页面 |
| 电商 | 商品列表、购物车、商品schema、类目页面、价格展示、"加入购物车"按钮 |
| 内容发布 | 以博客为主的导航、文章schema、作者页面、基于日期的归档、RSS源、高内容量 |
| 机构/服务 | 案例研究、作品集、"我们的工作"版块、团队页面、客户logo、服务描述 |
| 混合型 | 上述信号组合——按主导模式分类 |
第二步:抓取站点地图和内部链接
- 尝试获取
/sitemap.xml 和 /sitemap_index.xml
- 若站点地图存在,提取最多50个唯一页面URL,优先考虑:
- 首页(始终包含)
- 顶级导航页面
- 高价值页面(定价、关于、联系、关键服务/产品页面)
- 博客文章(抽取5-10篇最新文章)
- 类目/着陆页
- 若无站点地图,从首页抓取内部链接:
- 提取所有指向同一域名的
<a href> 链接
- 深入最多2层
- 优先考虑主导航链接的页面
- 遵守
robots.txt 指令——不获取被禁止的路径
- 强制每次获取最多50页和30秒超时
第三步:收集页面级数据
对抓取集中的每个页面,记录:
- URL、标题、meta描述、规范URL
- H1-H6标题结构
- 主要内容字数
- 存在的Schema.org类型
- 内部/外部链接数量
- 有无alt文本的图片
- Open Graph和微信分享meta标签
- 响应状态码
- 页面是否有结构化数据
- 中国特定: ICP备案号、本地联系方式、中文内容比例
第二阶段:并行子代理委派
委派分析给5个专业子代理。每个子代理处理收集的页面数据并生成类别得分(0-100)及发现。
子代理1:AI可见性分析(geo-ai-visibility)
- 分析内容块的被AI系统引用能力(可引用性评分)
- 通过robots.txt检查AI爬虫访问权限及llms.txt存在情况
- 扫描在知乎、B站、百度百科、微博等平台的品牌存在情况
- 评估AI模型用于实体识别的品牌权威信号
子代理2:平台优化(geo-platform-analysis)
- 评估针对豆包、元宝、DeepSeek、文心一言、通义千问的就绪度
- 检查平台专项排名因素和优化机会
子代理3:技术GEO基础(geo-technical)
- 分析robots.txt的AI爬虫访问权限
- 验证meta标签、HTTP头和AI系统的技术可访问性
- 检查页面速度、服务端渲染和核心Web指标
- 评估安全标头和移动端优化
- 中国特定: 检查ICP备案合规性、百度站长工具验证
子代理4:内容E-E-A-T质量(geo-content)
- 评估经验、专业知识、权威性、可信度信号
- 检查作者简介、资质、来源引用
- 评估内容新鲜度、深度和原创性
- 验证"关于我们"页面质量和团队资质
- 中国特定: 评估中文内容质量,是否为原创而非翻译
子代理5:结构化数据(geo-schema)
- 验证所有schema.org标记
- 检查GEO关键schema类型(FAQ、HowTo、Organization、Product、Article)
- 评估schema完整性和准确性
- 识别缺失的schema机会
第三阶段:得分汇总和报告生成
综合GEO得分计算
整体GEO得分(0-100)是六个类别得分的加权平均值:
| 类别 | 权重 | 衡量内容 |
|---|
| AI可引用性 | 25% | 内容对AI系统的可提取/可引用程度 |
| 品牌权威 | 20% | 知乎/B站/百度百科/微博的第三方提及、实体识别信号 |
| 内容E-E-A-T | 20% | 经验、专业知识、权威性、可信度 |
| 技术GEO | 15% | AI爬虫访问、llms.txt、渲染、速度 |
| 结构化数据 | 10% | Schema.org标记质量和完整性 |
| 平台优化 | 10% | 在中国AI平台(豆包、DeepSeek、文心一言等)的存在情况 |
公式:
GEO得分 = (可引用性 * 0.25) + (品牌 * 0.20) + (EEAT * 0.20) + (技术 * 0.15) + (Schema * 0.10) + (平台 * 0.10)
得分解读
| 分数范围 | 评级 | 解读 |
|---|
| 90-100 | 优秀 | 顶级GEO优化;网站极可能被中国AI系统引用 |
| 75-89 | 良好 | 扎实的GEO基础,有改进空间 |
| 60-74 | 一般 | 适中的GEO存在;存在大量优化机会 |
| 40-59 | 差 | GEO信号弱;AI系统可能难以引用或推荐 |
| 0-39 | 严重 | GEO优化极少;网站对中国AI系统基本不可见 |
问题严重性分类
审计中发现的每个问题按严重性分类:
严重(立即修复)
- robots.txt中所有AI爬虫均被屏蔽(尤其是Baiduspider、Bytespider)
- 无可索引内容(纯JavaScript渲染无SSR)
- 域名级别的noindex指令
- 关键页面返回5xx错误
- 完全没有任何结构化数据
- 品牌未被任何中国AI系统识别为实体
- 中国特定: 无ICP备案(中国境内托管必须)
高(1周内修复)
- 关键AI爬虫被屏蔽(Baiduspider、Bytespider)
- 无llms.txt文件
- 关键页面零问答内容块
- 缺少Organization或LocalBusiness schema
- 内容页面无作者归属
- 所有内容都在登录/付费墙后无预览
- 中国特定: 无百度站长工具注册;无百家号认证
中(1个月内修复)
- 部分AI爬虫屏蔽(部分允许,部分屏蔽)
- llms.txt存在但不完整或格式错误
- 内容块平均可引用性得分低于50
- 有FAQ内容的页面缺少FAQ schema
- 作者简介简单无资质
- 无知乎或B站品牌存在
- 中国特定: 无百度百科词条;无微博蓝V认证
低(有机会时优化)
- 次要schema验证错误
- 部分图片缺少alt文本
- 非关键页面的内容新鲜度问题
- 缺少Open Graph标签
- 某些页面标题层级不够优化
- 微信公众号存在但不完整
输出格式
生成文件 GEO-AUDIT-REPORT.md,结构如下:
# GEO审计报告:[网站名称]
**审计日期:** [日期]
**URL:** [URL]
**目标市场:** 中国
**业务类型:** [检测到的类型]
**分析页面数:** [数量]
---
## 执行摘要
**整体GEO得分:[X]/100([评级])**
[2-3句总结网站的GEO健康状况、最大优势和最关键差距。
重点说明对中国AI平台(豆包、文心一言等)可见性的影响。]
### 得分明细
| 类别 | 得分 | 权重 | 加权分 |
|---|---|---|---|
| AI可引用性 | [X]/100 | 25% | [X] |
| 品牌权威 | [X]/100 | 20% | [X] |
| 内容E-E-A-T | [X]/100 | 20% | [X] |
| 技术GEO | [X]/100 | 15% | [X] |
| 结构化数据 | [X]/100 | 10% | [X] |
| 平台优化 | [X]/100 | 10% | [X] |
| **整体GEO得分** | | | **[X]/100** |
---
## 严重问题(立即修复)
[列出每个严重问题,附具体页面URL和建议修复方案]
## 高优先级问题
[列出每个高优先级问题及详情]
## 中优先级问题
[列出每个中优先级问题]
## 低优先级问题
[列出每个低优先级问题]
---
## 类别深度分析
### AI可引用性([X]/100)
[详细发现、好/差段落示例、改写建议]
### 品牌权威([X]/100)
[知乎/B站/百度百科/微博平台存在图谱、提及量、情感]
### 内容E-E-A-T([X]/100)
[作者质量、来源引用、新鲜度、深度]
### 技术GEO([X]/100)
[爬虫访问、llms.txt、渲染、HTTP头、ICP备案]
### 结构化数据([X]/100)
[发现的schema类型、验证结果、缺失机会]
### 平台优化([X]/100)
[豆包、元宝、DeepSeek、文心一言、通义千问各平台就绪度]
---
## 快速胜利(本周实施)
1. [具体可操作的快速胜利及预期影响]
2. [另一个快速胜利]
3. [另一个快速胜利]
4. [另一个快速胜利]
5. [另一个快速胜利]
## 30天行动计划
### 第1周:[主题]
- [ ] 行动项1
- [ ] 行动项2
### 第2周:[主题]
- [ ] 行动项1
- [ ] 行动项2
### 第3周:[主题]
- [ ] 行动项1
- [ ] 行动项2
### 第4周:[主题]
- [ ] 行动项1
- [ ] 行动项2
---
## 附录:分析的页面
| URL | 标题 | GEO问题数 |
|---|---|---|
| [url] | [标题] | [问题数] |