定义
大模型用于抓取网页的爬虫,如 GPTBot、PerplexityBot、ClaudeBot。放行它们是被引用的前提。
为什么重要
可被抓取是其他一切的前提。封锁了检索型机器人的站点,无论内容多好,在回答时都不可能被引用。
如何衡量
用真实的 User-Agent 去实测,而不是只读 robots.txt。robots.txt 写着放行,但 CDN 规则或防火墙对这些 UA 返回 403,实际就是封锁。
大模型用于抓取网页的爬虫,如 GPTBot、PerplexityBot、ClaudeBot。放行它们是被引用的前提。
可被抓取是其他一切的前提。封锁了检索型机器人的站点,无论内容多好,在回答时都不可能被引用。
用真实的 User-Agent 去实测,而不是只读 robots.txt。robots.txt 写着放行,但 CDN 规则或防火墙对这些 UA 返回 403,实际就是封锁。
两者在技术访问与内容质量上重叠;但 GEO 衡量的是答案本身——品牌是否被点名、被推荐、被引用——而不是排名位置。
保持问题集稳定并按固定频率复测,再做同口径比较;同时改问题和频率会让结果失去可比性。
不等于。页面可能只是作为背景被引用,而真正被推荐的是竞品;两者使用独立口径报告。
草稿可以由 AI 生成,但发布的每一篇都经过人工审阅 —— 没有内容会自动上线。
有重叠但不相同。两者都奖励清晰可信的内容;但只有一边的衡量标准是「模型是否在答案里点名你」。
来自产品里衡量的真实做法 —— 官网的说法和工作台里的数字指的是同一件事。