GEO 网站分析:AI 搜索可见度检测
输入你的网址,检测网站在 AI 搜索引擎眼中的「可引用程度」。2025 年以来的大规模实证研究彻底改变了 GEO 的优先级:AI 引用中 53-95% 来自第三方权威来源(Earned Media),品牌自有内容仅占 5-10%(多伦多大学,arXiv:2509.08919);纯格式化改写基本无效,甚至可能负效(C-SEO Bench 2025);而「可爬取性 + 可验证的证据密度 + 品牌实体信号」是真正起作用的三层结构。分析会告诉你:哪些做对了,哪些正在拖后腿。
评分体系(v2)
总分 = 各类别得分 × 权重加权。类别得分为其下检测项通过率的加权平均:PASS 计 1 分、WARN 计 0.55 分、FAIL 计 0 分。v2 权重依据证据等级重新分配:可达性(证据等级 9.5/10)与第三方权威信号(决定 53-95% 的引用来源)权重最高,纯格式化策略权重下调。
| 检测类别 | 权重 | 检测类别 | 权重 |
|---|---|---|---|
| 01 可爬取性 | 15% | 07 新鲜度 | 7% |
| 02 可理解性 | 8% | 08 GEO 内容优化(论文实证) | 9% |
| 03 答案就绪度 | 7% | 09 竞争力 GEO(论文实证) | 8% |
| 04 可引用性 | 9% | 10 国内 AI 生态 | 7% |
| 05 可信度与权威度 | 12% | 11 AI 原生特性 | 5% |
| 06 内容深度 | 6% | 12 性能 | 7% |
A90-100 优秀 · B80-89 良好 · C70-79 中等 · D60-69 较差 · F0-59 危险
12 大检测维度
01 可爬取性
robots.txt 是否放行 AI 爬虫(GPTBot / ClaudeBot / Bytespider 等)、noindex/nosnippet 排除声明、站点地图、重定向链。Zyppy 54 项研究元分析中,这是唯一证据等级 9.5/10 的因素——AI 抓不到,一切归零。
02 可理解性
语义化标题层级、JSON-LD 结构化数据、语言与编码声明——GEO-16 实证中与引用关联最强的三类页内信号之二。
03 答案就绪度
FAQ 问答格式 + 可提取证据体裁(定义、数字事实、对比、步骤)+ 结论前置 + 摘要。注意:2026 年 Citation Absorption 研究发现纯问答包装反而是负效(-5.7%),必须配合证据密度;语言模型对页面中部内容检索准确率仅 45-60%(Stanford「Lost in the Middle」),核心结论要前置。
04 可引用性
作者署名、日期标注、来源引用、具体数据支撑——被引用页的统计数字数量是未引用页的 2.0 倍(17M 引用元分析)。
05 可信度与权威度
HTTPS、品牌实体标记(Organization schema)、关于/联系页、权威外链、E-E-A-T。这是权重最高的类别之一:AI 引用 53-95% 来自它已信任的第三方权威来源,品牌实体可识别性是被引用的前置条件。
06 内容深度
正文字量、H2 小节结构、信息密度、图片 alt、站内链接。被引用页的 H2 数量是未引用页的 2.3 倍,远高于字数差异(1.4 倍)——结构比篇幅重要。
07 新鲜度
内容日期、近期更新时间戳、版权年份、站点地图 lastmod。GEO-16 实证中 Metadata & Freshness 是引用关联前三强;Competitive GEO(25.2 万次试验)证实近期时间戳能持续稳定提升被引用概率。
08 GEO 内容优化(论文实证)
KDD 2024 九策略中仍有效的部分:专家引语 +41%、统计数据 +30~40%、来源引用(低排名 +115%)、流畅度。但注意 C-SEO Bench 2025 的修正:纯格式化改写基本无效甚至负效——这些策略必须配合真实证据与权威信号才起作用。
09 竞争力 GEO(论文实证)
社会证明、第三方权威提及(Earned Media)、价格透明度、营销语言浓度、价值主张。关键事实:ChatGPT 引用的 90-95%、Claude 82-93% 来自第三方来源;明确价格信息与近期时间戳是 2026 年实证中少数"持续稳定"起作用的因素。
10 国内 AI 生态
ICP 备案、百度/字节/360 等国内 AI 爬虫适配、中文内容占比、微信/知乎生态联动。
11 AI 原生特性
llms.txt / llms-full.txt 部署、无 AI 反爬误伤、摘要友好区块。
12 性能
TTFB、页面体积、传输压缩、渲染阻塞资源——慢站点连人都留不住,何况爬虫。