简答:AI Overviews 用的是 Google 常规索引,所以没有另一个需要放行的爬虫。Google 文档里唯一的那个开关叫 Google-Extended,而它压根不是爬虫,是一项使用控制。
Google-Extended 是各厂商里分离得最干净的一处
Google 文档说明 Google-Extended 控制的是:已被抓取的内容能否用于训练 Gemini 模型、以及在 Gemini Apps 与 Vertex AI 中为回答提供 grounding——并明确说明它不影响 Google 搜索的收录与排名。这让它成为整个品类里唯一一个可以真正权衡、而不是靠猜的地方。
两个常被忽略的后果:
- 你无法通过服务器日志验证它。它管的是使用而不是抓取,所以不会有任何请求出现。把它当成一条明示的策略决定记录下来,然后在答案侧衡量效果。
- 禁用它的代价是有边界的——只影响 grounded 的 Gemini 回答——而不是人们想当然的那种模糊的全站代价。
真正能进 Overview 的是什么
因为索引是共用的,常规功课照旧算数:页面得可抓取、服务端渲染、已被收录。除此之外,Overview 是用段落拼出来的,所以重点落在抽取上:
- 一个标题一个问题,用人真实提问的说法写。
- 答案就在那个标题下的第一句,并且点明主语——不要用依赖标题才成立的代词。
- 事实放进表格,带真实单位和明确日期。「最近」「目前」没法被引用。
- FAQ 内容要写进 HTML,不能只写进结构化数据。「给 schema 却藏着内容」是这里最常见的自伤。
按「有没有出现」衡量,不按位置
Overview 里没有第十位。只有被点名、被顺带提到、完全缺席——以及另一条独立的轴:被引用还是没被引用。
Overview 还会因运行时机和账号语境而变化,所以单次检查什么也证明不了。用一组固定问题,记录哪些轮次压根没出现 Overview,并且永远不要把失败的那一轮画成 0。