解决方案

用于监控的 VPS:Prometheus、Grafana 和可用性检查

Cutter 8 · $34/moCutter 16 · $62/mo
简短回答

监控栈受内存和磁盘限制。Prometheus 以 15 秒间隔抓取 50 个目标并保留 90 天,大约需要 8 GB 内存和 200 GB NVMe 存储。将其放置在与所监控基础设施不同的位置 — 与生产环境共享故障域的监控,在您最需要它时,无法提供任何信息。

你需要什么

监控与可观测性 的规格下限
资源你实际需要的东西
CPU2–4 核
RAM8 GB 约可处理 100 万个活跃序列
磁盘NVMe,160–320 GB 用于 90 天保留
放置位置与所监控对象使用不同的提供商或区域

推荐套餐

Cutter

Cutter 8

$ 32.3 /month

总计 US$96.90 · 节省 5%

vCPU
4 × 专用
RAM
8 GB
存储
160 GB NVMe SSD
流量
10 TB
IPv4 / IPv6
1 / /64 routed
配置
Cutter

Cutter 16

$ 58.9 /month

总计 US$176.70 · 节省 5%

vCPU
6 × 专用
RAM
16 GB
存储
320 GB NVMe SSD
流量
15 TB
IPv4 / IPv6
1 / /64 routed
配置

推荐位置

对于此工作负载,位置通常是影响最大的决定——要么因为延迟至关重要,要么因为司法管辖区至关重要。

为什么选择OnionVPS

  • 在独立司法管辖区使用廉价实例可实现真正的故障域隔离。
  • NVMe 使 Prometheus 的压缩操作不会成为机器上最响亮的噪音。
  • 覆盖 40 多个国家的实例让您可以从用户实际所在的位置运行黑盒探测。
  • 统一价格,因此保留期是存储决策,而非按指标计费。

如何设置

  1. 在生产区域之外部署 Cutter 8

    不同的国家,最好不同的提供商。

  2. 安装 Prometheus、Alertmanager 和 Grafana

    Docker Compose 是最快的可靠途径。

  3. 从多个区域添加黑盒探测

    每个区域一台运行 blackbox_exporter 的 Skiff 1 就足够了。

  4. 将警报路由到您能看到的地方

    使用 Alertmanager 发送到聊天频道,外加第二条路径以应对完全中断。

  5. 刻意测试警报路径

    未测试的警报管道只是装饰。

常见问题

Prometheus 需要多少磁盘?

压缩后每个样本大约 1–2 字节。100 万个活跃序列以 15 秒抓取间隔保留 90 天,大约需要 200 GB。

监控应该与生产环境使用同一提供商吗?

不应该。如果共享故障域,它会在您最需要时宕机。使用独立的提供商,或至少独立的地域和司法管辖区。

我可以从多个国家/地区进行监控吗?

Yes. A $4 Skiff instance per region running blackbox_exporter gives you real geographic probe coverage cheaply.