博客

2026 年如何出现在 AI 回答中:ChatGPT、Perplexity、Google 和 Copilot 官方文档到底说了什么

想出现在 ChatGPT、Perplexity、Google AI 概览或 Copilot 的回答里,并没有一个开关可用。本文梳理各平台关于被引用的官方说明,以及如何不靠猜测来衡量效果。

作者: Nicolás Cerón ·

昏暗的图书馆大厅里,木质卡片目录柜的一个抽屉被拉开,在一排白色索引卡中,有一张深红色的卡片格外醒目。

简短回答

想出现在 AI 回答中,平台的官方文档提到三个条件:它们的搜索爬虫能访问你的页面,页面已被收录进索引,页面内容有值得引用的价值。Google 表示,AI 概览和 AI 模式不需要任何特殊优化:页面只需已被索引、有资格显示摘要,且网站没有在 Search Console 中选择退出。OpenAI 和 Perplexity 都说明了应当允许哪个爬虫。Microsoft 给出的写作建议最具体,还提供带有页面级细节和抽样 grounding 查询的引用报告。

没有哪家平台记录过什么捷径,也没有人能向你保证一定会被引用。本指南只采用 Google、Microsoft、OpenAI、Anthropic 和 Perplexity 公开发布的内容,核对日期为 2026 年 10 月 8 日。凡是加入我们自己的方法之处,都会明确说明。

Google AI 概览与 AI 模式:本质上仍是 SEO

Google 的AI 功能文档指出,AI 概览和 AI 模式没有额外要求,也不需要特殊优化。页面只需已被索引,并有资格在搜索中以摘要形式显示。这些功能带来的点击和展示,会计入常规效果报告中的“网页搜索”类型。

2026 年 5 月 15 日,Google 发布了生成式 AI 功能优化指南,最近一次更新为 2026 年 7 月 10 日。指南解释说,这些功能建立在 Google 的核心排名系统之上:它们从搜索索引中检索页面,并在后台运行相关搜索,Google 称之为查询扩散(query fan-out)。从 Google 的角度看,针对 AI 搜索做优化仍然是 SEO,而“AEO”或“GEO”之类的建议,应当和其他第三方 SEO 建议一样去审视。

Google 的要求

  • 非同质化内容。Google 把基于常识拼凑的通用技巧清单,与超越常识的第一手经验和专家见解作了对比。请写你在实际工作中真正掌握的东西。
  • 不要为每种变体都做一个页面。主要为了影响排名或 AI 回答,而针对每种措辞或扩散查询单独制作页面,违反了规模化内容滥用政策。
  • 为读者构建结构。用段落、章节和标题,让页面易于阅读。
  • 技术基础。内容可被抓取、页面体验良好、减少重复内容,以及不会隐藏内容的 JavaScript。
  • 商家信息。Google 商家资料和 Merchant Center 的数据可能出现在 AI 回答中。

Google 表示可以忽略的事项

同一份指南还列出了对 Google 搜索可以忽略的事项:llms.txt 等 AI 专用文件、把内容拆成小“块”(并不存在理想的页面长度)、专为 AI 改写内容(其系统能理解同义词)、专为 AI 设置的特殊 schema 标记(结构化数据仍有助于获得富媒体搜索结果),以及追求不真实的提及。2026 年 5 月 15 日,Google 还澄清,其垃圾内容政策同样适用于生成式 AI 回答。

检查 Search Console 中的一项设置

Search Console 的“设置”下现在有一项搜索生成式 AI 控制。网站默认包含在内。排除某个网站后,其链接和内容通常会在几天内从 AI 概览、AI 模式以及 Discover 的生成式 AI 功能中移除。Google 表示,这项设置不是搜索其他部分的排名或收录信号。它已于 2026 年 8 月 31 日向全球所有网站开放。

有两个细节值得注意。其一,Google 的指南把“包含在此设置中”列为符合资格的条件。其二,Google-Extended 是用于 Gemini 的 robots.txt 标记,并不控制 AI 概览;它管的是 Gemini 的训练以及其他场景下的 grounding。若要限制 Google 展示某个页面的哪些内容,文档中记载的控制方式有 nosnippet、data-nosnippet、max-snippet 和 noindex。

放行正确的爬虫

每个 AI 平台都把构建搜索索引的爬虫、收集训练数据的爬虫,以及在回答用户时访问页面的代理区分开来。下表汇总了各公司的官方说明:

平台User agent用途robots.txt
GoogleGooglebotGoogle 搜索,包括 AI 概览和 AI 模式遵循
GoogleGoogle-Extended搜索之外的 Gemini 训练和 grounding;不影响搜索收录或排名仅为控制标记,没有独立的爬虫
OpenAIOAI-SearchBot被收录进 ChatGPT 搜索回答遵循;约 24 小时生效
OpenAIGPTBot模型训练遵循
OpenAIChatGPT-User在用户对话过程中访问页面可能不适用
AnthropicClaude-SearchBotClaude 的搜索索引遵循
AnthropicClaudeBot模型训练遵循
AnthropicClaude-User在用户向 Claude 提问时访问页面屏蔽后将无法为用户提问检索内容
PerplexityPerplexityBotPerplexity 搜索结果;不用于训练遵循;最长 24 小时
PerplexityPerplexity-User在用户提问过程中访问页面通常忽略

来源:Google、OpenAI、Anthropic、Perplexity。Anthropic 表示其三个爬虫都遵循 robots.txt,并且每一个都可以单独允许或屏蔽。

如果你希望被人找到,就应允许所有搜索爬虫和用户代理。训练爬虫则是另一个独立的决定,官方文档并未说明它会影响搜索收录。之后请用真实请求来测试:CDN 上的机器人防护规则,可能会拒绝 robots.txt 本来允许的请求。我们自己的 CDN 就曾拒绝默认的 Python 和 Perl 客户端,直到我们修改了一条规则;详情见面向智能体的网站需要什么。

ChatGPT 和 Perplexity:官方文档讲的是访问权限

OpenAI 建议,如果你希望出现在 ChatGPT 搜索中,请允许 OAI-SearchBot 及其公布的 IP 段访问。选择退出的网站不会出现在搜索回答中,但仍可能以导航链接的形式出现。OpenAI 还表示,ChatGPT-User 不用于决定内容是否出现在搜索中。

Perplexity 建议允许 PerplexityBot 以及来自其公布 IP 段的请求,并表示 robots.txt 的更改最长可能需要 24 小时才能生效。

它们的官方文档到此为止。两家的爬虫页面都没有说明回答如何选择来源,我们也没有找到任何一家公司可供引用的排名指引。因此,我们不在这里复述第三方的各种猜测。本指南的其余部分(实用的页面、证据、真实的提及、效果衡量)对它们而言属于通用的做法,而不是有官方记录的排名因素。

Copilot 和 Bing:最明确的建议,以及真正的引用报告

2026 年 2 月 10 日,微软以公开预览的形式推出了 Bing 网站管理员工具中的 AI Performance。它会报告你的网站在 Microsoft Copilot、Bing 的 AI 生成摘要以及部分合作伙伴集成中被引用的情况:

  • Total Citations(总引用次数):你的页面在 AI 回答中作为来源出现的频率。
  • Average Cited Pages(平均被引用页面数):每天被引用的网站独立页面数。
  • Grounding queries(检索依据查询):AI 用来检索你的内容的短语样本。
  • Page-level citations(页面级引用):按 URL 统计的次数,并显示随时间变化的趋势。

2026 年 6 月 16 日,Bing 新增了 Intents、Topics、Citation Share 和 Compare。Bing 称 Citation Share 是一项观察性指标,而不是排名系统,也不代表流量份额。两篇文章都没有提到点击数据。

Bing 关于如何被引用的建议

微软的发布文章给出了所有平台中最具体的指引:

  • 在相关主题上深入挖掘,以展示专业能力。
  • 使用清晰的标题、表格和常见问题板块。
  • 用案例、数据和有出处的来源来支撑观点。
  • 保持内容更新。
  • 让文字、图片和视频对相同的事物保持一致的描述。
  • 使用 IndexNow 通知新增、更新和删除的页面。
  • 本地商家请保持 Bing Places 的信息为最新。

IndexNow 可一次性通知 Bing、Yandex、Seznam、Naver、Yep 和 Amazon;向其中一家提交,其他家也会同步收到。Google 不在其中。你可以提交新增、更新和已删除的 URL,包括现在返回 404 或 410 的页面。提交并不保证被收录。

有一处分歧值得了解:Google 在 2026 年 5 月弃用了 FAQ 富媒体搜索结果,并在 6 月移除了相关文档(Search Central 更新),而 Bing 仍然推荐使用常见问题板块。请在读者确实有这些疑问的地方撰写常见问题,而不是为了标记而写。

第三方提及为什么重要

Google 的指南指出,其 AI 功能可以展示网络上对产品和服务的评价,包括博客、视频和论坛讨论。它还表示,刻意追求不真实的提及并不像看上去那样有帮助:其 AI 功能既依赖注重质量的核心排名系统,也依赖单独的垃圾内容拦截系统。

我们在自己的名字上就看到了实际的情况。2026 年 10 月 2 日我们检查时,"dardo studio" 的搜索结果排在前面的是名称相近但毫不相关的企业。我们的结构化数据现在包含了备用名称和一段简短的消歧说明,llms.txt 中也列出了与我们无关的那些企业。这有助于机器区分我们,但长久的解决办法在网站之外:真实的档案页面、项目介绍,以及来自这些索引已经信任的网站的链接。同一天,对我们域名进行的匿名 Bing site: 搜索没有返回任何结果,尽管没有任何设置阻止 Bingbot。可被抓取不等于已被收录。

如何衡量

没有任何单一工具能显示 AI 可见度。请结合使用以下方式:

来源能显示什么不能显示什么
Search Console,Generative AI performance report按页面、国家/地区、设备和日期统计的 AI Overviews 与 AI Mode 展示次数没有点击数据;两项功能合并统计;Discover 单独报告;展示次数较少的网站可能不会显示
Search Console,Performance report点击和展示次数,AI 功能包含在 Web 之内不单独区分 AI 功能
Bing Webmaster Tools,AI Performance引用次数、被引用页面、抽样的检索依据查询、单页详情未提及点击数据;仍处于预览阶段
服务器日志来自 OAI-SearchBot、Claude-SearchBot 和 PerplexityBot 的访问,以及来自 ChatGPT-User、Claude-User 和 Perplexity-User 的实时抓取抓取不等于引用。请对照 OpenAI、Anthropic 和 Perplexity 公布的 IP 段核对 IP
分析工具中的引荐来源来自 chatgpt.com 和 perplexity.ai 等助手域名的访问并非每次点击都带有引荐来源
你的联系表单用户自己说是通过什么渠道找到你的;我们的表单中有“AI 助手”这一选项由用户自行填写
每月一次的提示词测试(我们自己的方法)一组固定的买家问题是否会引用你回答会因人、地点和日期而异

提示词测试是我们自己的做法,而不是平台提供的工具。请写出买家会问的问题,覆盖你销售所用的每种语言,并保持问题清单固定不变。每个月在相同的平台上运行这些问题,并记录日期、平台、你是否被引用、引用的是哪个 URL,以及出现了哪些竞争对手。请把它当作带日期的观察记录,而不是排名。

没有人能承诺的事

Google 表示,满足所有要求也不能保证被抓取、收录或展示,并且没有任何第三方工具能够访问其内部排名系统或 AI 系统。Bing 称 Citation Share 是观察性指标。任何承诺能让你在 ChatGPT 或 AI Overviews 中被引用的服务,承诺的都是平台自己都不会承诺的事。

简短清单

  1. 在 Search Console 中验证你的网站,并确认已包含 Search generative AI 设置。
  2. 在 robots.txt 中允许 Googlebot、OAI-SearchBot、Claude-SearchBot、PerplexityBot 以及各用户代理,然后在你的 CDN 上进行测试。
  3. 在 Bing Webmaster Tools 中验证网站,并在页面变化时发送 IndexNow 通知。
  4. 发布体现第一手知识的页面:每个真实需求对应一个页面,而不是每种说法一个页面。
  5. 使用清晰的标题,在需要对比时使用表格,提供带链接的佐证,并标注真实的更新日期。
  6. 在人们已经信任的网站上获得提及。
  7. 每月参照上述来源进行一次评估。

这正是我们AI 搜索优化服务背后的工作,与我们的 SEO 工作建立在相同的基础之上。如果你想了解自己网站目前的状况,欢迎告诉我们。