一、先搞清楚:你要测的是哪个口径
向AI提问有两种问法,得到的是完全不同的数据:
| 知识库认知检测 | 联网引用检测 | |
|---|---|---|
| 典型问法 | "你知道XX品牌吗?" | "XX工具推荐几个?"(开启联网) |
| AI行为 | 凭训练记忆回答 | 真实搜索后回答 |
| 衡量什么 | 品牌历史沉淀 | 当下获客能力 |
| 能否运营 | 难(等模型更新) | 能(内容优化立即影响) |
做GEO,主战场是联网引用。知识库认知可以顺手看,但别把它当成优化效果的指标——你优化了内容,知识库不会马上变(它只在模型重新训练时更新),而联网引用会在内容被收录后开始变化。
二、方法一:手动提问法(零成本,10分钟入门)
适合:刚开始了解GEO、想快速感受现状的站长。
- 打开豆包/Kimi/智谱/千问的网页版,确认联网搜索开关已打开;
- 用一个真实用户会问的问题提问,比如你是卖建站工具的,就问"免费建站工具哪个好用?"——注意,不要问"你知道XX建站工具吗",那是认知口径;
- 检查AI回答:正文里有没有提到你的品牌?引用列表里有没有你的域名?
- 记录:品牌是否被提及、是否被引用、引用排第几位;
- 换3-5个核心关键词重复,每个平台都过一遍。
优点:免费、直观、能看到AI回答的完整原文。
局限:费时间;结果没法结构化保存,难以跟踪趋势;各平台UI的联网开关位置不一,容易漏开导致误测成认知口径。
三、方法二:工具自动化检测(推荐,标准化+可持续)
适合:认真做GEO、需要持续跟踪效果的所有人。
自动化工具(比如我们在做的GEO Monitor)的做法是:调用各AI平台的官方联网搜索API,让AI真实检索你的关键词,然后自动比对返回的引用URL列表里有没有你的域名。
一次检测能得到:
- 总分:综合引用评分(0-100);
- 平台明细:每个平台是"被引用·第N位"还是"正文提及"还是"未推荐";
- 引用URL:AI具体引用了你的哪个页面;
- 竞品列表:AI这次引用了哪些别的网站(你的位置在谁前面谁后面);
- 时间戳:每次检测存档,可看趋势。
标准化的价值在于可比性:同一口径下,上周40分这周55分,就是优化见效;手动提问很难做出这种对比。
四、方法三:API联测法(开发者专属)
适合:有开发能力、想深度定制检测的团队。
各家API的联网检索参数不同,核心差异参考:
# Kimi: 内置工具
tools: [{ type: "builtin_function", function: { name: "$web_search" } }]
# 引用在 choices[0].message.annotations
# 智谱: web_search 工具
tools: [{ type: "web_search", web_search: { enable: true } }]
# 豆包(火山方舟): 联网插件
plugins: [{ type: "web_search", web_search: { enable: true } }]
# 通义千问(百炼):
enable_search: true
拿到响应后,提取引用URL列表(不同平台字段不同:annotations/search_result/tool_calls参数),与你的域名做匹配。注意处理超时(联网检索耗时10-40秒)、随机性(建议同关键词跑多次取出现率)、和API费用。
数据来源:各参数格式来自月之暗面Platform、智谱BigModel、火山方舟、阿里云百炼的官方API文档(2026年8月版)。API迭代较快,接入前请以官方文档为准。