要取得可复查的状态证据,核心是让每一次检查都能留下“时间、对象、原始返回、判断依据”四要素。对 www 域名配置而言,最实用的证据是 DNS 解析记录、HTTP 响应头、TLS 证书信息、重定向链和搜索引擎抓取反馈。只截图结论页不够,因为别人无法确认你查的是哪个域名、从哪台机器查、当时返回了什么。
www 域名配置通常涉及三类状态:解析是否生效、访问是否可达、搜索引擎看到的是哪个版本。三类状态对应不同证据,不能互相替代。时间有限时,先处理影响面最大的一项:如果 www 无法访问或与裸域互相跳转混乱,优先固定访问链证据;如果访问正常但收录异常,再转向抓取与索引证据。
要查什么:www 主机名的 A、AAAA 或 CNAME 记录。怎么查:在命令行执行 dig www.example.com A +noall +answer,需要 IPv6 时把 A 换成 AAAA,怀疑别名时查 CNAME。结果说明什么:有记录且 TTL 合理,说明解析层已配置;返回 NXDOMAIN 或空答案,说明该主机名尚未解析。注意不同递归解析器可能有缓存,复查时应记录查询时间和使用的解析器。
要查什么:www 地址返回的状态码、Location 头和最终落地 URL。怎么查:执行 curl -I -L https://www.example.com,-I 只看响应头,-L 跟随跳转。结果说明什么:如果第一条返回 301 或 308 且 Location 指向裸域,说明 www 被永久重定向;如果返回 200,说明 www 是直接提供内容的版本;如果出现 302,说明是临时跳转,长期配置应进一步确认意图。重定向链越长,越容易在复查时出现不一致,建议记录完整链条而不是只看最终状态。
要查什么:证书是否包含 www 主机名、有效期到何时、由哪个证书链签发。怎么查:执行 openssl s_client -connect www.example.com:443 -servername www.example.com,在输出中查看 Subject 和 Subject Alternative Name。结果说明什么:SAN 中包含 www.example.com,说明该主机名被证书覆盖;只包含裸域则访问 www 时可能出现证书名称不匹配。HTTPS 只证明传输加密,不证明站点无漏洞,也不直接保证排名,因此证书证据只回答“覆盖与有效期”问题。
要查什么:robots.txt 是否允许抓取 www 版本,站点地图中列出的 URL 是 www 还是裸域。怎么查:直接请求 https://www.example.com/robots.txt 和站点地图地址,保存原始文本与响应码。结果说明什么:robots.txt 的 Disallow 只限制抓取,不等于可靠的索引移除;站点地图提交也不保证收录。若 robots.txt 屏蔽了 www,而站点地图又提交 www URL,这两份证据互相矛盾,应先解决矛盾再判断索引问题。
要查什么:搜索引擎抓取 www URL 时看到的状态码和最终 URL。怎么查:使用各搜索引擎提供的网址检查或抓取工具,分别测试 www 与裸域,并记录测试时间与返回的 HTML 首部。结果说明什么:如果工具显示“已重定向到裸域”,说明搜索引擎认可该跳转;如果显示“已屏蔽”或“无法访问”,则与前面的 curl 结果对照,排查是否针对搜索引擎的抓取被单独限制。不同搜索引擎的支持情况须分别核查,不能用一个平台的结果推断另一个平台。
建议每条记录包含:检查时间、执行命令或工具、目标 URL、原始返回摘要、判断结论。例如:
curl -I -L https://www.example.com,返回 301 → https://example.com/,判定 www 永久跳转至裸域。dig www.example.com CNAME +noall +answer,返回空,判定未配置 CNAME,需继续查 A 记录。假设某站点同时存在 www 和裸域两个 200 响应,且没有互相跳转,那么搜索引擎可能分别抓取两个版本。此时应优先确认期望的主版本,再用重定向或 canonical 统一信号。这里的“假设”仅用于说明判断逻辑,不代表任何真实站点结果。
先查 www 是否可访问并返回预期状态码,再查重定向链是否唯一且稳定,然后查证书覆盖,最后查 robots.txt 与站点地图一致性。原因是访问层故障会掩盖解析和索引问题;如果 www 本身无法建立连接,继续查索引证据没有意义。每完成一项,保留原始命令输出,而不是只写“已检查”。
下一步:选一个当前正在使用的 www 域名,按上面的五项清单各执行一次,把命令输出和判断结论写进同一份记录,再对照是否存在互相矛盾的证据。