简答:按闸的顺序体检——取得到、读得懂、抽得出、有印证。这个品类里多数体检从第四道闸开始,所以它们产出很长的报告和零进展。
第一闸 —— 每个点名代理都取得到页面吗
不是「robots.txt 允许吗」——而是用每个代理的身份请求页面,比对状态码和返回的字节数。按 User-Agent 拦截的 CDN 规则或 WAF 会在这一关失败,而 robots.txt 读起来很宽容。至少要查 GPTBot、OAI-SearchBot、PerplexityBot、ClaudeBot、Claude-SearchBot、Applebot,并且注意「取不到」和「页面不存在」不是一回事。
第二闸 —— 不执行 JavaScript 时内容还在吗
关掉 JS 按纯 HTML 取一次。如果实质内容只在 hydration 之后才出现,多数检索代理看到的是一个空壳。在现代技术栈上,这一关拦下的故障比其它任何一关都多,而且它在浏览器里完全看不见。
第三闸 —— 答案能被抽出来吗
找到那个对应真实问题的标题,脱离上下文读它下面的头两句。如果它们本身就是一个完整、正确、点明了主语的答案,这张页面过关;如果你必须往上翻才看得懂,就没过——而且这个问题靠外链修不好。
顺便看看:事实是放在带单位和日期的表格里,还是散落在正文中?有没有重要内容藏在折叠块或标签页里?在竞品写出数字的地方,这张页面是不是在打太极?
第四闸 —— 论断在你不拥有的地方有印证吗
把你希望引擎替你重复的论断列出来——你面向谁、价格多少、覆盖什么。对每一条,找一个不是自有域名的来源。找不到的地方就是缺口,而且是最慢补上的那一类。
然后去衡量,并且留住基线
改任何东西之前先把原始基线保存下来,改完再跑同一组问题。没有前后对照的体检,只是一份附了清单的意见。
体检查不出来的东西
你在优化的那些问题,是不是买家真正会问的。这要从你自己 Search Console 的查询和真实提示词数据里来,不是从页面级体检里来——而它恰恰是「技术上完美的站点依然缺席」最常见的原因。