SiteOps 的告警与监控频率是怎样的?
SiteOps 的监控分两个节奏:可用性检查默认每 5 分钟一次,部分检查可达到每 30 秒一次;探测从 8 个全球位置发出。告警支持邮件、Slack、Telegram、SMS 等 9 个渠道(页面写“Email, Slack, Telegram, SMS et 5 autres”)。如果你需要的是“故障发生后几分钟内收到通知”,这套频率和渠道组合基本够用;如果要求秒级发现并自动切换流量,则超出它的定位。
监控频率:两个数字要分清
SiteOps 页面上同时出现“Monitoring toutes les 30s”和“Checks toutes les 5 min”,它们对应不同层面:
| 项目 | 频率 | 说明 |
|---|---|---|
| 可用性 / Uptime 检查 | 每 5 分钟 | 判断站点在线或离线,触发宕机告警 |
| 部分检查 | 每 30 秒 | 页面标题中的“30s”指这一类更高频的检测 |
| 每日截图 | 每天 1 次 | 保留 48 小时可视化历史,用于回看故障时的页面状态 |
也就是说,最坏情况下从故障发生到被检测到,可能接近一个 5 分钟周期;告警发出后还要加上你所在渠道的送达时间。对博客、企业展示站、中小电商这类场景,这个延迟通常可以接受。
探测位置:8 个全球节点
检查从 8 个全球位置发出(页面注明经由 Cloudflare)。多节点探测的意义在于区分“你的站点真的挂了”和“某个地区网络抖动”。如果只有单一探测点,一次本地网络故障就可能造成误报;8 个位置同时失败,才更可能是真实宕机。
告警渠道:9 种方式
页面列出的渠道包括:
- 邮件
- Slack
- Telegram
- SMS
- 以及另外 5 种(页面未逐一列出名称)
选择建议很直接:个人站长用邮件 + Telegram 就够;团队协作把告警打进 Slack 频道,避免只落在某一个人的收件箱;对电商或对可用性敏感的业务,再加 SMS,因为短信在手机静音或断网时仍可能送达。
辅助排查:截图与 48 小时历史
告警告诉你“出问题了”,截图和 48 小时可视化历史告诉你“当时页面长什么样”。这对区分几种情况很有用:服务器返回 500、页面白屏、CDN 返回错误页、还是被替换成了其他内容。每日截图配合 48 小时历史,足够覆盖大多数短时故障的回看需求;更长时间的取证需要另找日志或归档工具。
怎么判断这套配置是否适合你
- 适合:Joomla、WordPress、PrestaShop 站点,需要宕机、SSL、DNS、SEO 回归的持续监测,且能接受分钟级发现延迟。
- 需要额外方案:要求秒级检测、自动故障转移、或多地负载均衡联动。
- 起步方式:页面写明注册后 10 天免费试用(Discovery 计划,无立即扣款),添加站点约 2 分钟,官方称从注册到收到第一条告警在 5 分钟内。价格信息页面提到“À partir de 10€/mois”,具体档位以官网当前价目为准。