总览:4大类16项全景

大类权重包含项性质
一、爬虫可访问性20分robots放行/llms.txt/IndexNow/静态正文技术,一次性配置
二、内容可引用性30分首段结论/FAQ/列表表格/数据来源/标题句式/正文质量内容,逐页优化
三、语义匹配度30分问题覆盖/回答直给/关键词自然内容+AI评估
四、权威信号20分作者与时间/Schema/外链引用混合

一、爬虫可访问性(20分)——先让AI抓到你

第1项:robots.txt放行AI爬虫(8分)

为什么重要:这是GEO的第零步。豆包、Kimi、智谱等平台的爬虫UA各异,robots.txt若写了"只允许Baiduspider,禁止其余爬虫",AI就永远抓不到你,后面15项全部白做。

怎么检查:访问 yoursite.com/robots.txt,看User-agent和Disallow规则;或用页面GEO检测工具自动判断。

怎么改:为AI爬虫单独放行,示例:

User-agent: *
Allow: /

# 常见AI爬虫无需单独声明,不屏蔽即可
# 若有严格风控需求,至少放行内容目录:
# User-agent: Bytespider  (豆包/字节系)
# Allow: /articles/

第2项:llms.txt文件(5分)

为什么重要:llms.txt是2024年提出的新标准,放在根目录,专门向AI说明站点结构——有哪些内容、分别讲什么、哪些最值得引用。相当于给AI递了一份"站点说明书"。

怎么检查:访问 yoursite.com/llms.txt 看是否存在。

怎么改:用Markdown格式列出核心内容:

# 网站名称
> 一句话说明网站提供什么

## 核心内容
- [文章标题](URL): 一句话简介

第3项:IndexNow支持(3分)

为什么重要:IndexNow协议让内容发布/更新时主动通知搜索引擎,缩短AI检索源里你内容的滞后时间。

怎么检查/改:接入IndexNow(微软必应等支持),发布内容时调用其API推送URL。

第4项:正文在静态HTML中(4分)

为什么重要:如果页面正文靠JavaScript渲染,部分AI爬虫抓到的是空壳,等于你的内容对AI不存在。

怎么检查:查看网页源代码(Ctrl+U),搜索正文中的某句话——能搜到说明是静态的;搜不到说明是JS渲染。

怎么改:服务端渲染(SSR)或静态生成(SSG);至少保证核心内容和标题在静态HTML里。

二、内容可引用性(30分)——让AI能摘录你

第5项:首段100字内给结论(8分)

为什么重要:AI筛选片段时,最需要"能直接回答问题的句子"。首段铺垫背景、结尾才给结论的写法,AI很难准确摘录。结论前置的内容被引用率显著更高。

怎么改:把"直接回答"放在第一段:用户问"XX怎么选",首段就写"XX选型看三点:A场景选X,B场景选Y";把背景、原理、过程放到后面。

第6项:FAQ问答板块(7分)

为什么重要:用户向AI提的问题,和FAQ的问题高度重合。一问一答的格式天然就是"可摘录片段"。

怎么改:每篇核心内容底部加FAQ,问题来自真实用户(客服记录、评论区、搜索下拉词),每个答案50-150字、直接给答案不绕弯。

第7项:列表与表格(6分)

为什么重要:对比、排名、步骤类信息,表格和列表是最不容易被AI转述错的形式,也是AI最爱的引用素材。

怎么改:凡是并列信息(对比/参数/步骤),一律表格化或列表化,不用大段文字描述。

第8项:数据来源标注(5分)

为什么重要:"加载提升40%"和"加载提升40%(来源:XX实验室2026年测试)"的可信度完全不同。AI在可信度筛选环节明显偏好有出处的数据。

怎么改:每个关键数字后面标注来源(机构名+年份),或在文末统一列参考资料。

第9项:标题句式贴近提问(4分)

为什么重要:AI做查询改写后检索,问句式标题("免费建站工具哪个好?")比陈述式("建站工具指南")命中率更高。

怎么改:H2/H3标题尽量用用户会问的问句或带明确答案的句式。

第10项:正文质量与深度(影响全局)

为什么重要:GEO奖励"能直接回答问题的好内容",低质拼凑内容在AI的可信度筛选里首先被淘汰。字数不是关键,信息密度和准确度才是。

三、语义匹配度(30分)——让AI判断你答得准

这一类靠人眼难判,需要AI评估(AI评估AI),三项核心:

我们用大模型对页面做这三维评估(在页面GEO检测里对应"语义匹配度30分"),人工自查的替代办法:把自己当成提问用户通读全文,问自己"我的问题被直接回答了吗?答案在第几句?"

四、权威信号(20分)——让AI信任你

第14项:作者与时间信息(6分)

为什么重要:有作者、有发布时间、有更新时间的页面,AI判定为"可追溯内容",可信度加分。无署名无日期的内容天然减分。

怎么改:每篇内容显示作者(真实姓名或机构名)、发布日期、最近更新日期。

第15项:Schema结构化数据(8分)

为什么重要:Schema(JSON-LD)把文章/FAQ/产品信息变成机器可读的标准格式,AI解析成本最低、理解最准。FAQPage和Article是最基础的两个。

怎么检查:查看网页源代码搜"application/ld+json"。

怎么改:至少加两段JSON-LD:Article(标题/作者/日期)+ FAQPage(问题和答案)。

第16项:站外权威引用(6分)

为什么重要:引用官方文档、论文、权威机构数据的页面,会被AI判定为信息节点;全部自说自话的页面可信度低。同时,被知乎、行业站等外部平台引用(反向),是权威性的最强信号。

怎么改:文中关键论点链接/标注权威来源;持续在知乎等专业平台发布内容并指向你的网站。

执行顺序建议

  1. 第1周(技术地基):第1/2/3/4项全站配置,1-2天;
  2. 第2-3周(内容改造):流量Top10页面按第5-10项逐篇改,每篇30-60分钟;
  3. 第4周(权威补强):第14/15/16项,加Schema、署名、权威引用;
  4. 持续:每周用真实引用检测复测,对照检测方法看趋势。
数据来源:本清单综合自:GEO原始论文(arXiv:2311.09735)的优化实验结论、各AI平台爬虫与检索的公开文档、Schema.org官方规范、llms.txt提案(llmstxt.org),以及GEO Monitor的实测数据。