简短回答
想出现在 AI 回答中,平台的官方文档提到三个条件:它们的搜索爬虫能访问你的页面,页面已被收录进索引,页面内容有值得引用的价值。Google 表示,AI 概览和 AI 模式不需要任何特殊优化:页面只需已被索引、有资格显示摘要,且网站没有在 Search Console 中选择退出。OpenAI 和 Perplexity 都说明了应当允许哪个爬虫。Microsoft 给出的写作建议最具体,还提供带有页面级细节和抽样 grounding 查询的引用报告。
没有哪家平台记录过什么捷径,也没有人能向你保证一定会被引用。本指南只采用 Google、Microsoft、OpenAI、Anthropic 和 Perplexity 公开发布的内容,核对日期为 2026 年 10 月 8 日。凡是加入我们自己的方法之处,都会明确说明。
Google AI 概览与 AI 模式:本质上仍是 SEO
Google 的AI 功能文档指出,AI 概览和 AI 模式没有额外要求,也不需要特殊优化。页面只需已被索引,并有资格在搜索中以摘要形式显示。这些功能带来的点击和展示,会计入常规效果报告中的“网页搜索”类型。
2026 年 5 月 15 日,Google 发布了生成式 AI 功能优化指南,最近一次更新为 2026 年 7 月 10 日。指南解释说,这些功能建立在 Google 的核心排名系统之上:它们从搜索索引中检索页面,并在后台运行相关搜索,Google 称之为查询扩散(query fan-out)。从 Google 的角度看,针对 AI 搜索做优化仍然是 SEO,而“AEO”或“GEO”之类的建议,应当和其他第三方 SEO 建议一样去审视。
Google 的要求
- 非同质化内容。Google 把基于常识拼凑的通用技巧清单,与超越常识的第一手经验和专家见解作了对比。请写你在实际工作中真正掌握的东西。
- 不要为每种变体都做一个页面。主要为了影响排名或 AI 回答,而针对每种措辞或扩散查询单独制作页面,违反了规模化内容滥用政策。
- 为读者构建结构。用段落、章节和标题,让页面易于阅读。
- 技术基础。内容可被抓取、页面体验良好、减少重复内容,以及不会隐藏内容的 JavaScript。
- 商家信息。Google 商家资料和 Merchant Center 的数据可能出现在 AI 回答中。
Google 表示可以忽略的事项
同一份指南还列出了对 Google 搜索可以忽略的事项:llms.txt 等 AI 专用文件、把内容拆成小“块”(并不存在理想的页面长度)、专为 AI 改写内容(其系统能理解同义词)、专为 AI 设置的特殊 schema 标记(结构化数据仍有助于获得富媒体搜索结果),以及追求不真实的提及。2026 年 5 月 15 日,Google 还澄清,其垃圾内容政策同样适用于生成式 AI 回答。
检查 Search Console 中的一项设置
Search Console 的“设置”下现在有一项搜索生成式 AI 控制。网站默认包含在内。排除某个网站后,其链接和内容通常会在几天内从 AI 概览、AI 模式以及 Discover 的生成式 AI 功能中移除。Google 表示,这项设置不是搜索其他部分的排名或收录信号。它已于 2026 年 8 月 31 日向全球所有网站开放。
有两个细节值得注意。其一,Google 的指南把“包含在此设置中”列为符合资格的条件。其二,Google-Extended 是用于 Gemini 的 robots.txt 标记,并不控制 AI 概览;它管的是 Gemini 的训练以及其他场景下的 grounding。若要限制 Google 展示某个页面的哪些内容,文档中记载的控制方式有 nosnippet、data-nosnippet、max-snippet 和 noindex。
放行正确的爬虫
每个 AI 平台都把构建搜索索引的爬虫、收集训练数据的爬虫,以及在回答用户时访问页面的代理区分开来。下表汇总了各公司的官方说明:
| 平台 | User agent | 用途 | robots.txt |
|---|---|---|---|
| Googlebot | Google 搜索,包括 AI 概览和 AI 模式 | 遵循 | |
| Google-Extended | 搜索之外的 Gemini 训练和 grounding;不影响搜索收录或排名 | 仅为控制标记,没有独立的爬虫 | |
| OpenAI | OAI-SearchBot | 被收录进 ChatGPT 搜索回答 | 遵循;约 24 小时生效 |
| OpenAI | GPTBot | 模型训练 | 遵循 |
| OpenAI | ChatGPT-User | 在用户对话过程中访问页面 | 可能不适用 |
| Anthropic | Claude-SearchBot | Claude 的搜索索引 | 遵循 |
| Anthropic | ClaudeBot | 模型训练 | 遵循 |
| Anthropic | Claude-User | 在用户向 Claude 提问时访问页面 | 屏蔽后将无法为用户提问检索内容 |
| Perplexity | PerplexityBot | Perplexity 搜索结果;不用于训练 | 遵循;最长 24 小时 |
| Perplexity | Perplexity-User | 在用户提问过程中访问页面 | 通常忽略 |
来源:Google、OpenAI、Anthropic、Perplexity。Anthropic 表示其三个爬虫都遵循 robots.txt,并且每一个都可以单独允许或屏蔽。
如果你希望被人找到,就应允许所有搜索爬虫和用户代理。训练爬虫则是另一个独立的决定,官方文档并未说明它会影响搜索收录。之后请用真实请求来测试:CDN 上的机器人防护规则,可能会拒绝 robots.txt 本来允许的请求。我们自己的 CDN 就曾拒绝默认的 Python 和 Perl 客户端,直到我们修改了一条规则;详情见面向智能体的网站需要什么。
ChatGPT 和 Perplexity:官方文档讲的是访问权限
OpenAI 建议,如果你希望出现在 ChatGPT 搜索中,请允许 OAI-SearchBot 及其公布的 IP 段访问。选择退出的网站不会出现在搜索回答中,但仍可能以导航链接的形式出现。OpenAI 还表示,ChatGPT-User 不用于决定内容是否出现在搜索中。
Perplexity 建议允许 PerplexityBot 以及来自其公布 IP 段的请求,并表示 robots.txt 的更改最长可能需要 24 小时才能生效。
它们的官方文档到此为止。两家的爬虫页面都没有说明回答如何选择来源,我们也没有找到任何一家公司可供引用的排名指引。因此,我们不在这里复述第三方的各种猜测。本指南的其余部分(实用的页面、证据、真实的提及、效果衡量)对它们而言属于通用的做法,而不是有官方记录的排名因素。
Copilot 和 Bing:最明确的建议,以及真正的引用报告
2026 年 2 月 10 日,微软以公开预览的形式推出了 Bing 网站管理员工具中的 AI Performance。它会报告你的网站在 Microsoft Copilot、Bing 的 AI 生成摘要以及部分合作伙伴集成中被引用的情况:
- Total Citations(总引用次数):你的页面在 AI 回答中作为来源出现的频率。
- Average Cited Pages(平均被引用页面数):每天被引用的网站独立页面数。
- Grounding queries(检索依据查询):AI 用来检索你的内容的短语样本。
- Page-level citations(页面级引用):按 URL 统计的次数,并显示随时间变化的趋势。
2026 年 6 月 16 日,Bing 新增了 Intents、Topics、Citation Share 和 Compare。Bing 称 Citation Share 是一项观察性指标,而不是排名系统,也不代表流量份额。两篇文章都没有提到点击数据。
Bing 关于如何被引用的建议
微软的发布文章给出了所有平台中最具体的指引:
- 在相关主题上深入挖掘,以展示专业能力。
- 使用清晰的标题、表格和常见问题板块。
- 用案例、数据和有出处的来源来支撑观点。
- 保持内容更新。
- 让文字、图片和视频对相同的事物保持一致的描述。
- 使用 IndexNow 通知新增、更新和删除的页面。
- 本地商家请保持 Bing Places 的信息为最新。
IndexNow 可一次性通知 Bing、Yandex、Seznam、Naver、Yep 和 Amazon;向其中一家提交,其他家也会同步收到。Google 不在其中。你可以提交新增、更新和已删除的 URL,包括现在返回 404 或 410 的页面。提交并不保证被收录。
有一处分歧值得了解:Google 在 2026 年 5 月弃用了 FAQ 富媒体搜索结果,并在 6 月移除了相关文档(Search Central 更新),而 Bing 仍然推荐使用常见问题板块。请在读者确实有这些疑问的地方撰写常见问题,而不是为了标记而写。
第三方提及为什么重要
Google 的指南指出,其 AI 功能可以展示网络上对产品和服务的评价,包括博客、视频和论坛讨论。它还表示,刻意追求不真实的提及并不像看上去那样有帮助:其 AI 功能既依赖注重质量的核心排名系统,也依赖单独的垃圾内容拦截系统。
我们在自己的名字上就看到了实际的情况。2026 年 10 月 2 日我们检查时,"dardo studio" 的搜索结果排在前面的是名称相近但毫不相关的企业。我们的结构化数据现在包含了备用名称和一段简短的消歧说明,llms.txt 中也列出了与我们无关的那些企业。这有助于机器区分我们,但长久的解决办法在网站之外:真实的档案页面、项目介绍,以及来自这些索引已经信任的网站的链接。同一天,对我们域名进行的匿名 Bing site: 搜索没有返回任何结果,尽管没有任何设置阻止 Bingbot。可被抓取不等于已被收录。
如何衡量
没有任何单一工具能显示 AI 可见度。请结合使用以下方式:
| 来源 | 能显示什么 | 不能显示什么 |
|---|---|---|
| Search Console,Generative AI performance report | 按页面、国家/地区、设备和日期统计的 AI Overviews 与 AI Mode 展示次数 | 没有点击数据;两项功能合并统计;Discover 单独报告;展示次数较少的网站可能不会显示 |
| Search Console,Performance report | 点击和展示次数,AI 功能包含在 Web 之内 | 不单独区分 AI 功能 |
| Bing Webmaster Tools,AI Performance | 引用次数、被引用页面、抽样的检索依据查询、单页详情 | 未提及点击数据;仍处于预览阶段 |
| 服务器日志 | 来自 OAI-SearchBot、Claude-SearchBot 和 PerplexityBot 的访问,以及来自 ChatGPT-User、Claude-User 和 Perplexity-User 的实时抓取 | 抓取不等于引用。请对照 OpenAI、Anthropic 和 Perplexity 公布的 IP 段核对 IP |
| 分析工具中的引荐来源 | 来自 chatgpt.com 和 perplexity.ai 等助手域名的访问 | 并非每次点击都带有引荐来源 |
| 你的联系表单 | 用户自己说是通过什么渠道找到你的;我们的表单中有“AI 助手”这一选项 | 由用户自行填写 |
| 每月一次的提示词测试(我们自己的方法) | 一组固定的买家问题是否会引用你 | 回答会因人、地点和日期而异 |
提示词测试是我们自己的做法,而不是平台提供的工具。请写出买家会问的问题,覆盖你销售所用的每种语言,并保持问题清单固定不变。每个月在相同的平台上运行这些问题,并记录日期、平台、你是否被引用、引用的是哪个 URL,以及出现了哪些竞争对手。请把它当作带日期的观察记录,而不是排名。
没有人能承诺的事
Google 表示,满足所有要求也不能保证被抓取、收录或展示,并且没有任何第三方工具能够访问其内部排名系统或 AI 系统。Bing 称 Citation Share 是观察性指标。任何承诺能让你在 ChatGPT 或 AI Overviews 中被引用的服务,承诺的都是平台自己都不会承诺的事。
简短清单
- 在 Search Console 中验证你的网站,并确认已包含 Search generative AI 设置。
- 在 robots.txt 中允许 Googlebot、OAI-SearchBot、Claude-SearchBot、PerplexityBot 以及各用户代理,然后在你的 CDN 上进行测试。
- 在 Bing Webmaster Tools 中验证网站,并在页面变化时发送 IndexNow 通知。
- 发布体现第一手知识的页面:每个真实需求对应一个页面,而不是每种说法一个页面。
- 使用清晰的标题,在需要对比时使用表格,提供带链接的佐证,并标注真实的更新日期。
- 在人们已经信任的网站上获得提及。
- 每月参照上述来源进行一次评估。
这正是我们AI 搜索优化服务背后的工作,与我们的 SEO 工作建立在相同的基础之上。如果你想了解自己网站目前的状况,欢迎告诉我们。
