如果检查只来自一个地点,「网站正常」这句话没有任何意义。运营商、骨干路由、本地对等互联,乃至 CDN 配置都因地区而异;一次在你办公室里完全看不到的故障,对地球另一端的用户来说可能已经持续了好几个小时。下面说明为什么需要从多个国家监控网站、为什么这类任务用便宜的数据中心地址就够,以及每次检查该记录哪些内容。

为什么从一个地点看「网站正常」毫无意义

可用性并不是「正常」或「宕机」这样单一的整体状态,而是从地图上不同位置、沿不同路由得到的一系列局部状态的总和。CDN 从离用户最近的节点分发内容,某个节点故障只影响一部分受众。某家运营商的骨干网出问题,只会切断它自己用户的路由,不影响其他人。不同地区的 DNS 服务器因解析记录传播延迟,可能还保留旧记录,于是部分用户访问到旧地址,部分访问到新地址。

从单台服务器发起的检查,只能回答「从那个地点能不能访问」,回答不了「网站到底能不能被访问」。对拥有国际用户群的服务来说,这是实质性的差别:某地区的局部故障,对收入的打击和全局故障一样重,只是在没有对应监控点时它不会被发现。

从多个地区核实可用性与响应速度

从不同国家监控可以同时解决两个问题。第一是可用性本身:服务器有没有响应、是否被本地防火墙拦截、上一次 DNS 或 CDN 配置变更后路由是否中断。第二是响应速度:即便网站本身完全正常,响应时间和页面完整加载时间在近距离和远距离地区之间也可能相差数倍,原因单纯是物理距离和中间跳数不同。

对于拥有本地化版本、按地区使用不同分发架构的网站,这一点尤其重要:某个国家加载缓慢,可能不是整个网站的问题,而是某个区域 CDN 节点的问题——只从总部所在地检查,这类问题根本看不到。

这里数据中心地址就足够——而且更便宜

与那些需要看清真实用户在家庭或移动 IP 下实际看到什么的任务不同,可用性监控和内容个性化无关,它关心的是网络路径与响应时间。网站并不在意谁在请求它,重要的只是连接确实来自正确的地理节点。数据中心地址正好适合这类任务:按月固定价格计费,而不是按流量计费,对于频繁的短请求来说,这比任何流量套餐都划算。关于何时数据中心地址够用、何时不够用,详见移动代理与住宅代理的对比

唯一的例外是网站采用了按地理位置过滤的机制,通过 ASN 区分主机服务商流量与普通用户流量,给数据中心地址返回占位页面或验证码。这种情况下,可用性监控本身就变成了一项需要住宅通道的任务,可参考什么是 ASN 及其重要性

轮询频率与流量消耗

检查频率应与宕机代价相匹配:对直接产生销售的商城页面,每个地区每一到五分钟检查一次比较合理;对次要板块,十五到三十分钟一次即可。每次轮询通常是一个不含媒体的纯文本页面,约 0.3–1 MB,因此每天监控一百个端点,一个月大约消耗 1.5–3 GB 流量——与需要加载图片和视频的检查相比,成本很低。

流量节省来自请求方式,而不是选择最便宜的通道:如果目标只是确认服务器有响应,而不是渲染整个页面,就应跳过静态资源和媒体文件。使用不稳定的廉价地址导致的失败检查,代价远高于通道之间的价格差。

报告中该记录什么

每条记录必须包含三个字段。响应代码——不只是「200 还是非 200」:3xx 可能是未被察觉、跳转到错误域名的重定向,5xx 意味着服务器错误,没有代码的超时则意味着路由中断。首字节时间反映服务器在传输内容前的响应速度,能清晰区分后端问题与网络问题。完整加载时间是页面就绪的总时长,也是真实用户实际感受到的指标,它不只取决于服务器,还取决于 CDN、脚本和页面上的外部资源。

每条记录都应标注地区、日期和时间——没有随时间积累的历史数据,就无法区分某条路由上一次性的网络抖动,与某个国家需要处理的系统性劣化。

常见问题

只监控一两个国家而不是十几个,够用吗?

如果受众集中在少数几个地区,在这些地区设置监控点,再加一个用于对比的中性点就足够了。随着受众增长,或收到来自尚未监控地区的用户投诉,再逐步扩展列表。

每次检查都要用不同的地址,还是每个国家用一个就够?

可用性监控只需每个国家一个稳定地址——正是地址的稳定,才能让你在时间维度上对比数据、看清趋势,而不是被地址变化带来的噪声干扰。

如果某个国家的网站速度一直比其他国家慢,该怎么办?

先排除偶然因素:用同一国家的另一个地址重复检查。如果结果一致,问题多半出在该地区的 CDN 节点,或通往该节点的路由,而不是主服务器本身。

按国家划分的网站监控数据中心地址,见代理专区