检查二级域名设置的前后依赖,核心是沿着“解析→服务器→应用→抓取与索引”这条链,逐环节确认上一环的输出是否被下一环正确接收。任何一环的输出缺失或格式不符,都会让后续环节失败。下面是一份可执行清单,每项包含查什么、怎么查、结果说明什么。
二级域名设置的依赖关系通常是:DNS 解析把主机名指向某个 IP 或 CNAME 目标;服务器接收该主机名的请求并返回内容;应用或站点配置根据主机名决定路由、证书和重定向;搜索引擎抓取该 URL 并决定是否索引。检查时不要跳环,先确认最前面一环的输出,再看下一环是否消费成功。
dig 或 nslookup 查询该二级域名,例如 dig sub.example.com A。结果说明什么:返回预期 IP 或 CNAME 说明解析已生效;返回 NXDOMAIN 说明记录不存在或未传播;返回旧 IP 说明缓存或记录未更新。解析正确不代表服务器会正确响应这个主机名。很多故障出在服务器只配置了主域名,没把二级域名加入监听或虚拟主机。
curl -I https://sub.example.com。结果说明什么:返回 200 或 301/302 说明服务器接收了请求;返回 404 可能是应用路由未匹配该主机名;连接被拒绝说明没有服务监听该地址或端口。openssl s_client -connect sub.example.com:443 -servername sub.example.com,看证书的 SAN 是否包含该主机名。结果说明什么:证书不覆盖时,浏览器和部分抓取会报错,后续环节无法正常进行。注意 HTTPS 只解决传输加密,不保证站点无漏洞,也不保证排名。服务器通了之后,下一环是应用怎么处理这个主机名。常见依赖包括重定向规则、路径路由、以及页面内资源是否使用正确的协议和主机名。
curl -IL https://sub.example.com,跟踪每一跳。结果说明什么:如果重定向到主域名或其他路径,要确认这是有意设置;若出现循环重定向,抓取会失败。站点能正常访问后,才轮到搜索引擎抓取。这一环的依赖是:URL 可访问、robots.txt 允许抓取、站点地图或内链能发现该 URL。注意 robots.txt 的抓取限制不等于可靠的索引移除;站点地图也不保证收录。
https://sub.example.com/robots.txt,查看 Disallow 规则。结果说明什么:若目标路径被禁止,抓取会被阻止;若只是不想索引,应使用其他方式而不是依赖 robots.txt 做移除。按上述顺序逐环检查后,把每一环的结果标记为“通过”“失败”或“未验证”。第一个失败环节就是当前最可能的根因;未验证的环节说明证据不足,需要补查。例如,解析返回预期 IP、curl -I 返回 404,那么问题更可能在服务器或应用路由,而不是 DNS。如果解析就失败,后续环节无需继续,先解决解析。
下一步:从 DNS 解析开始跑一遍上面的命令,记录每一环的实际输出,再对照预期值定位第一个不一致的环节。