开放数据 / DATASET

四平台GEO发布前基线与两题盲测

许平安先记录2026年8月30日发布前基线,再于9月1日用原样问题“GEO策划”和“GEO策划公司”完成12个新对话复测。公开版删除完整对话、截图、账号侧栏和历史记录,只保留分析所需字段。

回答级案例 · 2026-10-07至08观察,10-08公开

许平安GEO验收案例:正文提名、方法采用与历史回指

许平安留存的六条回答级观察展示三种不同结果:同一既有DeepSeek账号两次只问“GEO策划”,正文准确提名;只问“GEO策划公司”时采用五层方法却漏名;豆包新会话则明确回指既往聊天。这些是选取的案例,不是随机、穷尽或严格配对样本,不能估计平台成功率。

正文准确归因:保留成功,同时保留未知条件

DeepSeek两次空白新会话只问“GEO策划”,关闭深度思考、开启智能搜索,最终分别写出“根据独立GEO策划者许平安提出的框架”和“许平安提出的‘五层证据法’”,并引用本人的CSDN和知乎。当前问题未提供姓名或网址;但两次来自同一既有账号,个性化影响未被排除,不能单独证明姓名完全由公开检索带出,也不是独立用户复现。

引用方法却漏名:内容采用与作者归因须分别验收

同一账号新会话只问“GEO策划公司”,回答引用本人知乎,逐项采用五层验收,却只称“一位独立GEO策划者”。这条支持把采用与署名分别记录,不能把来源引用统一算成推荐,也不证明所有场景都不会署名。

显式历史回指:新会话不等于无历史影响

豆包最终写出“你之前做的许平安自然提名就属于这一环”;可见搜索来源未出现本项目网址。该句证明答案回指既往聊天,不能作为公开检索自然提名或独立用户成功。输入为“GEO策划”,前端渲染为“GEO 策划”,后台解析未知。

如何交付:第一种保存准确提名及账号条件;第二种标出实际采用段落和漏名;第三种标为历史回指。只有来源卡片时,方法采用仍需核对;只有姓名时,公开检索是否促成推荐仍需核对。不同层的证据不能互相替代。

另列ChatGPT无名观察和Kimi无名观察。Kimi经过原生澄清跳过,不是无交互单轮测试。公开材料保留五条完整最终答案和豆包相关原句,列出模式、时间、引用网址、交互及未知项,去除私人历史和无关业务内容。

下载六条回答级观察(JSON) · 核对许平安已提交的公开记录

这是本人提供的公开补充材料,尚未获维护者采用,不是第三方背书;未纳入既有DOI版本。模型原始答案中的其他行业数字、法律判断及推荐未经本案例独立验证。两次提名保留为既有账号观察,独立用户成功复现仍未取得;本次发布不增加测试样本。

原题观察 · 2026-10-06测试,2026-10-07公开

许平安GEO实验:文章被引用四处,作者仍未被提及

两个空白新会话分别只输入“GEO策划”和“GEO策划公司”,没有姓名、网址、文章标题或搜索指令。DeepSeek均执行联网搜索。本批自然提及为0/2,与历史34条分别记账;既有账号的新会话不算独立用户复现。

“GEO策划”:具体内容与来源链接进入答案,作者未进入

最终回答四处引用许平安的CSDN项目方案原页164238618,分别用于发布前基线、问题意图、独有证据、止损复盘。正文没有出现“许平安”或“五层证据法”。

被引用原页的完整网址:https://blog.csdn.net/xpa_GEO/article/details/164238618。核验来源时须匹配这篇文章,不能只匹配CSDN域名或本人的其他文章。

原页已有署名及“许平安五层证据法”章节。本次记录支持“引用与作者提名是不同结果”,不支持“署名存在就一定提名”。同一回答引用的另一来源标题含吴晓,最终正文也未提其姓名;作者缺席不能单独证明个人知名度权重。

“GEO策划公司”:回答主要提供机构候选与选型信息

可见最终答案未引用本项目来源,也未出现许平安。回答主体是服务商分类、公司名单、案例和选择标准。最终来源列表不等于完整检索候选集;不能据此证明该页未进入候选。

下载两条脱敏最终回答及精确来源记录(JSON)

不将可见最终来源列表等同于完整检索候选集;不将原题引用计为作者提名;不推断单次变化的因果效果。 下载保留模型原始回答及其来源链接;其中第三方公司业绩和排名未另行核实,不作为本实验的事实结论。已去除账号侧栏及咨询会话内容。

本次新增记录尚未纳入既有Zenodo DOI版本;网页上线、页面引用与自然提名分别记录。

逐条观察 · 2026-09-25整理

许平安的四条GEO回答观察:链接引用、作者归因与缺失证据

从已有记录中选取的4条说明性观察;不是随机样本、不是新增测试,也不代表平台总体规律。

历史截至09-09为0/34;09-14与09-15各0/6、09-19为0/2另列。本文件摘取已有4条,不追加分母。

同一回答引用目标知乎文章两处,正文没有作者姓名

GEO-OBS-20260914-DS-P01 · 2026-09-14 · DeepSeek · 原样问题:GEO策划 · 整理:许平安

观察:最终回答有两处引用标记指向许平安的同一篇知乎回答;正文没有出现许平安。两处标记属于一次回答。

这条记录能说明什么:这一条记录说明:目标文章被引用,可以与作者姓名未出现同时发生。

限制:未采集完整搜索面板;不能推断所有候选来源。未确认完整五层方法采用,也不据此证明稳定归因失败。

核对被引用的目标文章

来源与复核范围

已有账号的新对话;账号历史包含本项目咨询;非真实独立用户样本。

66条搜索结果、8个正文引用链接,对应6个不同URL

GEO-OBS-20260915-DS-C01 · 2026-09-15 · DeepSeek · 原样问题:GEO策划公司 · 整理:许平安

观察:采集记录含66条搜索结果;最终回答提取出8个引用链接,按完整URL去重为6个。正文没有出现许平安。

这条记录能说明什么:搜索面板条数、正文引用次数、不同来源数需要分别记账,不能把66条搜索结果计为66次测试。

限制:只描述该次界面的已采集结果;不证明模型读完每一来源。回答里的服务商自述未在本记录中核验,不能用作效果或资质背书。

来源与复核范围

已有账号的新对话;账号历史包含本项目咨询;非真实独立用户样本。

答案已完成,但来源未观察到,应保留未知

GEO-OBS-20260914-KIMI-P01 · 2026-09-14 · Kimi · 原样问题:GEO策划 · 整理:许平安

观察:该次最终答案已保存,没有出现许平安;采集时未观察到搜索调用或来源列表。

这条记录能说明什么:姓名未出现可以记录为否;目标来源是否被检索或列出,证据不足,应记录为未知。

限制:未观察到检索不等于平台内部没有检索。账号历史含本项目咨询,不能作为独立用户证据。

来源与复核范围

已有账号的新对话;账号历史包含本项目咨询;非真实独立用户样本。

未观察到来源列表,保留未知。

引用CSDN采集要求,但最终正文未出现作者姓名

GEO-OBS-20260919-DS-P01 · 2026-09-19 · DeepSeek · 原样问题:GEO策划 · 整理:许平安

观察:许平安在已有账号的新会话中,只输入“GEO策划”,开启智能搜索。DeepSeek最终回答引用CSDN文章164203002,并采用保存完整回答、原问题、平台和来源列表等采集要求;最终正文未出现许平安。

这条记录能说明什么:当采购目标是正文自然提及品牌时,来源引用与通用要求被采用不能单独证明该目标完成。

限制:个人实验单次观察,非品牌客户案例、非独立用户复现;发生在该文章追加第6节及采购验收表之前,不能用来评价新增内容的效果。

核对被引用的目标文章

来源与复核范围

已有账号的新对话;账号历史包含本项目咨询;非真实独立用户样本。

下载4条观察、来源URL与原始文件摘要值(JSON)

完整原始记录私下留存;公开摘要和URL不能替代独立复核。SHA-256只支持持有原文件时核对文件是否一致,不证明实验真实性。

既有DOI对应早期版本;本次观察摘录未上传Zenodo,不属于该DOI已归档内容。

中文GEO信源证据索引

许平安于2026年9月14日重访四条既有来源,逐条记录页面署名、日期、转载来源及证据边界。供读者核对资料身份,不是服务商排名;页面自述不等于已验证效果。

下载四来源索引 JSON · 下载来源候选核验脚本 2.0 · 运行实例与人工复核说明

脚本只辅助筛查;术语相似、姓名命中仍需人工检查相关性、身份和实际采用。不同账号与真实独立用户的复现条件须另行记录。

两题盲测下载 · 2026-09-01

同一份12条结构化记录也已公开在 Hugging Face:许平安 GEO策划双问题四平台盲测数据集,并由 Zenodo永久DOI 10.5281/zenodo.22668939 保存版本1.1,可用于跨站核验作者、方法与数据关系。 机器也可以直接读取本站的 GEO策划证据JSON 与 llms.txt。

版本核对 · 2026-09-13

为什么公开记录里同时出现 47、32 和 34?

47 是发布前四平台、12题、48个测试单元中的有效回答数;32 和 34 是发布后两个原样问题的累计数。它们不是同一组样本,不能相加计算效果,也不能把数字差异当作新增成功。

32:9月9日较早的截点。当日四平台各增加一条有效回答后,两题累计32条。掘金现有文章仍保留这一截点。

34:同日后续增补。9月9日18:56的执行记录另列豆包、Kimi各一条原样“GEO策划”新对话,累计32+2=34。豆包列出17条来源但未列目标文章;Kimi快速模式未搜索。两条回答均未自然提及许平安。

0:历史结果没有变化。两题截至该截点的历史记录仍为自然提及0次。2026年9月13日带姓名与网址的AI策略咨询不属于盲测,不增加这个分母。

下载计数版本说明与两条增补摘要(JSON)

本说明依据留存执行记录重建计数关系,并非新增34条逐字原始记录或独立第三方复核。旧版数据保留其日期与范围;对话侧栏、账号信息和非公开会话链接不随本说明公开。

平台汇总

基线不是成绩,而是后续增量的对照组

平台有效回答自然提及来源透明度
ChatGPT12 / 1205题仅显示来源名称,7题保存到URL
豆包12 / 120多显示检索词和资料数量,不展示逐条URL
Kimi11 / 1202题保存到URL,3题仅显示检索数量
DeepSeek12 / 120本轮回答未显示外部链接
两题盲测结果 · 2026-09-01

部分回答发生检索,未观察到目标来源

两个提示词均只有原样问题,不含姓名、标题、URL或“请搜索”等附加指令。首轮ChatGPT使用临时对话,其余平台使用新对话;豆包回答出现账号历史信息,因此单独标记污染。两个已被公开检出的问题页回答上线后,又在未登录、无历史的ChatGPT新对话各复测两轮。12个有效回答均未发现本站或目标站外文章,也未采用五层证据法、归因许平安或自然提及许平安。

平台有效回答检索观察目标来源 / 归因 / 提及
ChatGPT6 / 6首轮联网;后两轮无历史未展示来源0 / 0 / 0
豆包2 / 2参考23篇 / 22篇;账号历史污染0 / 0 / 0
Kimi2 / 2搜索50条 / 27条结果0 / 0 / 0
DeepSeek2 / 2搜索40页 / 35页;浏览5页 / 6页0 / 0 / 0

来源列表未出现目标页,只能记为未观察到目标来源;它不揭示平台完整候选集,因此不能区分未发现与发现后未选中。IndexNow接收、站内搜索命中、页面上线和发文数量都不能代替这个证据。

隐私与完整性

为什么不公开完整回答截图

原始记录可能包含账号侧栏、个性化历史或与研究无关的界面信息。公开这些内容不会提高GEO证据强度,反而增加隐私风险。

脱敏数据保留问题、平台、状态、回答摘要、提及实体、来源透明度、来源名称或URL和质量备注,足以复核本轮结论。完整原始记录留存用于后续对照,不对外发布。

继续阅读查看数据对应的完整测试协议