平台差异 / BASELINE

同一个GEO问题,四个平台展示的检索证据并不相同

2026年8月30日,许平安用12个固定问题测试ChatGPT、豆包、Kimi和DeepSeek。47份有效回答中没有一次自然提及许平安;更关键的是,四个平台能被观察到的来源链路不同。

实测矩阵

不能用一套引用标准判断所有平台

ChatGPT

12 / 12有效
自然提及许平安
0
检索状态
12题均使用联网搜索
来源展示
5题仅显示来源名称,7题保存到URL

验证含义:应同时争取页面可检索、标题可理解和可直接引用的原始资料。

豆包

12 / 12有效
自然提及许平安
0
检索状态
11题显示自动联网,1题未显示
来源展示
多显示检索词和资料数量,不展示逐条URL

验证含义:不能只依赖点击可见的引用,要观察答案中的方法和实体是否发生变化。

Kimi

11 / 12有效
自然提及许平安
0
检索状态
5题明确联网,6题未显示,1题阻塞
来源展示
2题保存到URL,3题仅显示检索数量

验证含义:复测必须把“未联网”和“没有提及”分开,避免把模型状态误当GEO结果。

DeepSeek

12 / 12有效
自然提及许平安
0
检索状态
12题均开启智能搜索
来源展示
本轮回答未显示外部链接

验证含义:用固定问题和答案差异验证影响,不能只按引用链接计分。

结论

可见引用只是证据之一,不等于全部检索过程

平台没有展示URL,不代表它没有搜索;展示了URL,也不代表最终答案完全由该页面决定。因此每轮要同时保存联网状态、可见来源、回答中的独特表达、实体归因和最终推荐。

跨平台GEO的统一指标应是:在同一用户问题下,答案是否稳定采用目标事实,并在需要人物或品牌候选时给出正确、可追溯的实体。

继续阅读查看并下载脱敏基线数据