两个 GEO 实验,775 次 AI 引用:真正驱动 AI 可见性的是什么
引言
在过去两年里,几乎所有关于生成式引擎优化(GEO)的文章都在重复同样的建议:发布全面的内容、添加 schema、争取在榜单中被提及,然后 AI 模型就会引用你。
SEO 与 AI 搜索顾问 Zeeshan Yaseen 决定去检验这个建议,而不是重复它。他的文章由 Search Engine Land 于 2026 年 9 月 14 日发布,记录了两个结构化实验,共记录到 775 次引用事件,覆盖 ChatGPT、Claude、Gemini、Perplexity、Google AI Mode 和 Grok——而在结尾处,他撤回了自己其中一个结论。
正是这最后一个细节,让这项研究值得你关注。网上大多数 GEO 建议都建立在单张截图或单次活动之上。而这一项在两个不同垂直领域的两个不同品牌上把同一套打法跑了两次,只保留通过两次测试的发现。
核心结果:AI 可见性的形成,较少取决于你掌控的内容,更多取决于还有谁提及你、你和谁一同出现,以及这些关联被强化的时间有多近。
The News / Trend
实验一:四个平台,数月,775 次事件
第一个实验与一个已有品牌合作了数月。它追踪了15 个商业意图关键词,覆盖四个 AI 平台——ChatGPT、Claude、Gemini 和 Perplexity——每个查询都人工运行,分别在有 VPN 和无 VPN 的情况下进行,以捕捉基于地域的差异。
策略是把榜单放置在模型已经为这些关键词呈现出来的来源上,并辅以 PR、客座文章和自然 LinkedIn 活动。最终,该品牌在15 个关键词中约 10 到 12 个上出现,在4 月 29 日达到 37.01% 的关键词出现率峰值。
引用量在各平台间分布不均:ChatGPT 148、Claude 96、Gemini 87、Perplexity 64。榜单占全部引用的 72.4%,PR 占 24.1%——客座文章、自有网站和 LinkedIn 瓜分了剩余部分。
有一个投放压倒了一切。一篇关于 Indeed SEO 的全面榜单产生了190 次提及——比所有其他来源加起来还多。
实验二:30 天冷启动
第二个实验是难度大得多的测试。它选取了一家完全没有可衡量 AI 曝光的 SaaS 外链建设机构,从零开始运行了一个 30 天项目,这次覆盖六个平台(新增 Google AI Mode 和 Grok)和 15 个购买意图关键词。
结果是:从零起步,30 天内获得 298 次出现。Gemini 以 104 领先,Google AI Mode 以 95 紧随其后,然后是 Claude 59、ChatGPT 32、Grok 4 和 Perplexity 4。Gemini 与 AI Mode 合计贡献了大约全部出现次数的三分之二——这与实验一形成相反的分布,实验一中是 ChatGPT 领先。
这在商业上很重要。在 30 天窗口期内,18.5% 的新用户通过推荐流量到来,另有 3.25% 通过 GA4 的 AI Assistant 渠道——合计略超过全部新用户的五分之一。来自测试中流量最低平台 Perplexity 的一次推荐,转化成了一个付费客户。
为什么时机很重要
这项研究与 Google 确认正在运行 "AI contribution pilot" 处于同一周,该试点会在出版商的内容对 AI Overviews、AI Mode 和 Gemini 的回答有实质性贡献时向其付费。被 AI 引用的经济学正于此刻被正式确立。这让"究竟什么才能赢得引用?"这个问题突然变成了收入问题,而非学术问题。
为什么这很重要
你的关键词列表不再是你的目标列表
最有用的操作性发现是:**你应该根据观察到的引用来构建你的外联列表,而不是根据 domain rating 或传统潜在客户数据。**在任何外联之前,第二个实验把全部 15 个关键词跑遍了每个平台,记录出现了哪些来源,并按引用频率排序。那份排序后的列表就成了投放目标列表。
八个目标中有五个后来出现在最终的引用组合里。Indie Hackers 从**潜在客户调研期间的 44 次提及攀升到投放后的 146 次——提升 232%。**Bruce Jones SEO 从 26 升到 69(提升 165%),TechBullion 从 15 升到 37(提升 147%)。
引用量不等于业务成果
实验二中引用最多的来源 Indie Hackers 的推荐流量持平。TechBullion 产生的引用较少,但把会话数从 1 提升到 64。Claude.ai 的推荐翻了三倍,ChatGPT 的推荐上升了 166%。
换句话说,按原始引用数量给来源排序,可能会把你引向错误的投资方向。
自有内容是基础,不是增长杠杆
研究作者正是在这里修正了自己的立场。实验一之后,他建议在自己的网站上发布榜单。实验二推翻了这个说法:自有榜单是最慢被引用的来源——18 天,比每一个第三方投放都慢——只产生了 14% 的提及,而赚取的投放占 85.8%(PR 贡献了 0.2%)。
但有一个值得借鉴的转折。当自有榜单被改写得不那么宣传化、更具比较性时——加入主要竞争对手,而不是只呈现品牌自己——提及从 4 跳升到 49,增长 12.25 倍,而每日可见性曲线在四天内从 22 升到 95 的峰值。同样的域名、同样的作者、同样的关键词目标。只有内容范围变了。
完全匹配仍然重要——比你想的更重要
该品牌在 "Best LLM SEO Consultant" 上有排名,但在几乎完全相同的 "Best AI SEO Consultant" 上几乎不出现。前一个短语有专门的榜单;后一个没有。更广泛的语义覆盖并未弥合差距。
来源衰减很快
**大约一半的来源在 30 天内停止被引用。**有一个投放逐周从 29 次提及降到 11 次;另一个在没有任何干预的情况下也在下滑。一次性发布无法维持 AI 可见性。
如何调整你的策略
**1. 先把你的关键词跑一遍平台。**在购买任何一个投放之前,先在 ChatGPT、Gemini、Claude、Perplexity 和 AI Mode 中查询你的目标关键词,并记录返回了哪些域名。那份列表——而不是你的竞品外链导出——就是你的外联计划。
**2. 优先选择模型已经引用的来源。**在已被引用的来源上投放会快速叠加。Indeed SEO 的榜单在外联前大约出现过 10 次;之后它连续数月成为最大的引用来源。
**3. 选择深度而非频率。**五篇简短的榜单几乎没有带来可见性;一篇全面的内容持续赢得引用。
4. 让页面以答案开头。当答案出现在前 100 个词内时,页面表现更好。靠近顶部的关键要点区块胜过所有其他被测试的页面内改动。默认可见的 FAQ 胜过隐藏在折叠面板中的 FAQ,而基于问题的标题("How is AI SEO different from traditional SEO?")胜过名词短语标题。
5. 让各章节自成一体。"What to look for when hiring an LLM SEO expert" 和 "Where to hire one" 作为独立章节比合并成一节效果更好。
**6. 别再只写你自己。**12.25 倍的增长来自加入竞争对手和知名名字。与此同时,当一篇把该品牌与 Lily Ray 和 Aleyda Solis 并列的榜单移除了这些名字后,表现在几天内就下降了。模型似乎在评估周围的实体,而不仅仅是单个提及。
**7. 为高价值词条保留专门的资产。**整个研究中最强的两个关键词是 "Best SaaS Link Building Agency in USA" 和加上 "2026" 的同一短语——各出现 18 次。高价值商业关键词似乎需要自己的页面,包括完全匹配。
**8. 让投放类型与查询类型匹配。**软件和工具类查询偏好高权威的评测网站;服务类查询更常返回榜单。
**9. 为维护预留预算。**既然一半的来源会在 30 天内衰减,就把 AI 可见性当作订阅,而不是一次性购买。
**10. 反复测量并追踪推荐。**引用所需时间从 1 到 18 天不等,而有四个在线投放到窗口结束时仍未被引用。在发布一周后只检查一次,不是一次测量——而是抛硬币。
关键要点
- 两个 GEO 实验记录了 775 次引用事件;作者在第二轮之后撤回了自己其中一个结论。
- 赚取的投放产生了 85.8% 的提及,自有内容仅 14%——而且自有页面是最慢被引用的(18 天)。
- 根据观察到的 AI 引用构建你的投放列表,而不是 domain rating 或传统潜在客户调研。
- 在前 100 个词内作答;让 FAQ 保持可见、标题基于问题、各章节自成一体。
- 完全匹配关键词仍然重要——几乎相同的短语产生了截然不同的可见性。
- **大约一半被引用的来源在 30 天内衰减。**持续性的工作是维护,而非发布。
- 被引用最多的来源并不是最好的流量来源;单凭引用量是糟糕的投资信号。
FAQ
Q: 什么是 GEO(生成式引擎优化)?
GEO 是在 AI 生成的答案中获得可见性和引用的实践——包括 AI Overviews、Google AI Mode、ChatGPT、Gemini、Claude、Perplexity 以及类似系统——而不仅仅是排名在经典的十条蓝色链接列表中。
Q: 如果 AI 答案取代了点击,关键词还重要吗?
重要,而且比以前更精确。在这项研究中,完全匹配的定向决定了一个品牌是否会出现在答案中:它在 "Best LLM SEO Consultant" 上有排名,但在 "Best AI SEO Consultant" 上几乎没有。高价值商业短语仍然值得拥有专门的、完全匹配的资产。
Q: 我应该优先哪个 AI 平台?
你的数据指向哪一个就优先哪一个。在实验一中,ChatGPT 以 148 次引用领先。在实验二中,Gemini 和 Google AI Mode 产生了大约三分之二的出现在次数。平台优先级因细分领域而异——把你的关键词跑遍每个平台并测量。
Q: 赢得 AI 引用需要多长时间?
在这项研究中,是发布后的 1 到 18 天之间,波动很大。有些投放在一夜之间就被引用;最慢的是一篇自有榜单,用了 18 天,而有四个投放在窗口期内从未转化。
Q: 在自己的网站上发布值得吗?
作为基础,值得——但不该作为你主要的增长引擎。自有内容被引用耗时最长,只产生了 14% 的提及。当它不再宣传化、转而把品牌与竞争对手进行比较时,表现大幅提升(从 4 次提及到 49 次)。
结论
这两个实验最有价值的地方不是某个战术。而是方法:定义你的关键词,把它们跑遍 AI 平台,记录模型已经引用了什么,并依据观察到的结果而非继承来的建议来构建你的策略。
在两个品牌和两个垂直领域上都成立的模式是关联。哪些来源提及你、谁与你一同出现,以及这些关系被强化的时间有多近——这就是 2026 年 AI 可见性的构成。
最快的入门方式是别再猜哪些关键词和话题值得定向。生成一套由数据支撑的关键词集,在 AI 平台上测试它,让引用数据告诉你下一步该在哪里投资,就在 SocialKeywordGenerator.com。
由 Social Keyword Generator 编辑团队撰写和审阅,该团队构建并维护本文中描述的工具。请参阅我们的 编辑政策 和 我们的工具如何运作.