一、先搞清楚:你要测的是哪个口径

向AI提问有两种问法,得到的是完全不同的数据:

知识库认知检测联网引用检测
典型问法"你知道XX品牌吗?""XX工具推荐几个?"(开启联网)
AI行为凭训练记忆回答真实搜索后回答
衡量什么品牌历史沉淀当下获客能力
能否运营难(等模型更新)能(内容优化立即影响)

做GEO,主战场是联网引用。知识库认知可以顺手看,但别把它当成优化效果的指标——你优化了内容,知识库不会马上变(它只在模型重新训练时更新),而联网引用会在内容被收录后开始变化。

二、方法一:手动提问法(零成本,10分钟入门)

适合:刚开始了解GEO、想快速感受现状的站长。

  1. 打开豆包/Kimi/智谱/千问的网页版,确认联网搜索开关已打开;
  2. 用一个真实用户会问的问题提问,比如你是卖建站工具的,就问"免费建站工具哪个好用?"——注意,不要问"你知道XX建站工具吗",那是认知口径;
  3. 检查AI回答:正文里有没有提到你的品牌?引用列表里有没有你的域名?
  4. 记录:品牌是否被提及、是否被引用、引用排第几位;
  5. 换3-5个核心关键词重复,每个平台都过一遍。

优点:免费、直观、能看到AI回答的完整原文。

局限:费时间;结果没法结构化保存,难以跟踪趋势;各平台UI的联网开关位置不一,容易漏开导致误测成认知口径。

三、方法二:工具自动化检测(推荐,标准化+可持续)

适合:认真做GEO、需要持续跟踪效果的所有人。

自动化工具(比如我们在做的GEO Monitor)的做法是:调用各AI平台的官方联网搜索API,让AI真实检索你的关键词,然后自动比对返回的引用URL列表里有没有你的域名。

一次检测能得到:

标准化的价值在于可比性:同一口径下,上周40分这周55分,就是优化见效;手动提问很难做出这种对比。

四、方法三:API联测法(开发者专属)

适合:有开发能力、想深度定制检测的团队。

各家API的联网检索参数不同,核心差异参考:

# Kimi: 内置工具
tools: [{ type: "builtin_function", function: { name: "$web_search" } }]
# 引用在 choices[0].message.annotations

# 智谱: web_search 工具
tools: [{ type: "web_search", web_search: { enable: true } }]

# 豆包(火山方舟): 联网插件
plugins: [{ type: "web_search", web_search: { enable: true } }]

# 通义千问(百炼):
enable_search: true

拿到响应后,提取引用URL列表(不同平台字段不同:annotations/search_result/tool_calls参数),与你的域名做匹配。注意处理超时(联网检索耗时10-40秒)、随机性(建议同关键词跑多次取出现率)、和API费用。

数据来源:各参数格式来自月之暗面Platform、智谱BigModel、火山方舟、阿里云百炼的官方API文档(2026年8月版)。API迭代较快,接入前请以官方文档为准。

五、检测的四个最佳实践

  1. 先定关键词组:核心业务词+品牌词+对比词,3-6个起步,别贪多;
  2. 固定周期复测:每周同一天测同一组词,单次结果只当快照;
  3. 记录AI引用的URL:知道AI引用的是你哪个页面,才知道哪个内容有效,放大它;
  4. 检测+优化闭环:检测发现问题(未被引用)→用页面GEO检测找结构短板→按16项清单优化→下周复测验证。