Решение

VPS для мониторинга: Prometheus, Grafana и проверки аптайма

Cutter 8 · $34/moCutter 16 · $62/mo
Краткий ответ

Стек мониторинга ограничен памятью и диском. Prometheus со скрейпами каждые 15 секунд по 50 целям и хранением за 90 дней требует около 8 ГБ ОЗУ и 200 ГБ NVMe. Размещайте его не там, где наблюдает за инфраструктурой — мониторинг, разделяющий домен отказа с продакшеном, ничего не скажет вам в самый нужный момент.

Что вам нужно

Минимальные характеристики для мониторинг и наблюдаемость
РесурсЧто вам нужно на самом деле
CPU2–4 ядра
RAM8 ГБ для ~1 млн активных серий
ДискNVMe, 160–320 ГБ для хранения за 90 дней
РазмещениеДругой провайдер или регион, нежели у наблюдаемого

Рекомендуемые тарифы

Cutter

Cutter 8

$ 32.3 /month

Итого 96,90 $ · Скидка 5%

vCPU
4 × dedicated
RAM
8 GB
Диск
160 GB NVMe SSD
Трафик
10 TB
IPv4 / IPv6
1 / /64 routed
Настроить
Cutter

Cutter 16

$ 58.9 /month

Итого 176,70 $ · Скидка 5%

vCPU
6 × dedicated
RAM
16 GB
Диск
320 GB NVMe SSD
Трафик
15 TB
IPv4 / IPv6
1 / /64 routed
Настроить

Рекомендуемые местоположения

Местоположение обычно является решающим фактором для этой нагрузки — либо из-за задержек, либо из-за юрисдикции.

Почему OnionVPS для этого

  • Дешёвый инстанс в другой юрисдикции даёт настоящую изоляцию доменов отказа.
  • NVMe не даёт компакции Prometheus стать самым шумным процессом на машине.
  • Инстансы в 40+ странах позволяют запускать blackbox-пробы оттуда, где реально находятся ваши пользователи.
  • Фиксированные тарифы, поэтому хранение — это вопрос диска, а не счёт за метрики.

Как настроить

  1. Разверните Cutter 8 вдали от вашего продакшен-региона

    Другая страна, в идеале другой провайдер.

  2. Установите Prometheus, Alertmanager и Grafana

    Docker Compose — самый быстрый надёжный путь.

  3. Добавьте blackbox-пробы из нескольких регионов

    Skiff 1 в каждом регионе с blackbox_exporter достаточно.

  4. Направьте алерты туда, где вы их увидите

    Alertmanager в чат-канал, плюс второй путь на случай полного отказа.

  5. Намеренно протестируйте путь алертов

    Непротестированный пайплайн алертов — это украшение.

Часто задаваемые вопросы

Сколько диска нужно Prometheus?

Примерно 1–2 байта на сэмпл после сжатия. Один миллион активных серий с интервалом скрейпа 15 секунд за 90 дней — это около 200 ГБ.

Должен ли мониторинг работать у того же провайдера, что и продакшен?

Нет. Если он разделяет домен отказа, он упадёт ровно в тот момент, когда он нужен. Отдельный провайдер или как минимум отдельный регион и юрисдикция.

Могу ли я вести мониторинг из нескольких стран?

Yes. A $4 Skiff instance per region running blackbox_exporter gives you real geographic probe coverage cheaply.