检查访问状态与错误页,核心是让每一次请求都留下可判断的记录:先用工具取得HTTP状态码,再区分是整站不可达、单页404还是服务端5xx,最后决定是立即修复还是纳入例行监控。两种常见处理方案——人工逐页抽查与自动化批量探测——适用条件不同,选错会浪费大量时间。
在动手之前先明确三件事。第一,列出需要检查的URL集合,至少覆盖首页、栏目页、内容页、表单提交后的跳转页。第二,确认正常状态的基准:一个可正常访问的页面应返回200,被永久移除的页面应返回301或302到有效地址,不存在的页面应返回404而不是200。第三,准备记录表,字段包括URL、状态码、响应时间、检查时间。
如果站点刚改版或更换服务器,基准状态可能已经变化,此时应先抓取一份当前全量状态作为对照,而不是凭记忆判断哪个页面“本来就有”。
两种方案的关键差异在于覆盖面和发现时机。
判断依据可以简化为:如果URL总数在几十个以内且变动不频繁,人工抽查加浏览器开发者工具的网络面板即可;如果URL上百或每天都有新内容发布,应优先建立自动探测。两者也可以并用:自动探测负责日常告警,人工抽查负责改版后的内容核对。
拿到状态码后不要直接下结论,同一现象可能有多种解释。
验证时建议对同一URL重复请求两次以上,排除偶发网络抖动造成的误判。如果两次结果不一致,应记录为待观察项而非确定故障。
访问状态检查不是一次性任务。建议在以下时点各执行一次:内容发布后、服务器配置变更后、域名解析调整后、以及每周固定时间。自动探测可设置告警阈值,例如连续两次返回5xx才通知,减少误报干扰。
维护时同步更新URL清单:新增页面及时加入,已确认下线的页面从清单移除或标记为预期404。清单本身失准,后续所有检查结果都不可靠。
下一步可以直接做的动作是:打开浏览器开发者工具的网络面板,刷新首页和两个内页,记录每个请求的状态码;如果发现非200的条目,按上面的分类逐项确认原因,再决定是否需要引入自动探测。