Solution

VPS pour la surveillance : Prometheus, Grafana et les contrôles de disponibilité

Cutter 8 · $34/moCutter 16 · $62/mo
Réponse courte

Une pile de surveillance est limitée par la mémoire et le disque. Prometheus avec des scrapes toutes les 15 secondes sur 50 cibles et 90 jours de rétention nécessite environ 8 Go de RAM et 200 Go de NVMe. Placez-la ailleurs que sur l'infrastructure qu'elle surveille — une surveillance qui partage un domaine de panne avec la production ne vous dit rien au moment où vous en avez le plus besoin.

Ce dont vous avez besoin

Plancher de spécifications pour surveillance et observabilité
RessourceCe dont vous avez réellement besoin
CPU2–4 cœurs
RAM8 Go pour ~1M de séries actives
DisqueNVMe, 160–320 Go pour 90 jours de rétention
EmplacementUn fournisseur ou une région différent de ce qu'il surveille

Plans recommandés

Cutter

Cutter 8

$ 34 /month
vCPU
4 × dédié
RAM
8 GB
Stockage
160 GB SSD NVMe
Transfert
10 TB
IPv4 / IPv6
1 / /64 routed
Configurer
Cutter

Cutter 16

$ 62 /month
vCPU
6 × dédié
RAM
16 GB
Stockage
320 GB SSD NVMe
Transfert
15 TB
IPv4 / IPv6
1 / /64 routed
Configurer

Emplacements recommandés

L'emplacement est généralement la décision la plus importante pour ce type de charge de travail — soit parce que la latence domine, soit parce que la juridiction en fait partie.

Pourquoi OnionVPS pour cela

  • Une instance bon marché dans une juridiction distincte offre une véritable isolation du domaine de panne.
  • Le NVMe empêche la compaction de Prometheus de devenir l'élément le plus bruyant sur la machine.
  • Des instances dans plus de 40 pays vous permettent d'exécuter des sondes blackbox depuis l'endroit où vos utilisateurs se trouvent réellement.
  • Tarification forfaitaire, donc la rétention est une décision de stockage plutôt qu'une facture par métrique.

Comment le configurer

  1. Déployez un Cutter 8 loin de votre région de production

    Pays différent, idéalement un fournisseur différent.

  2. Installez Prometheus, Alertmanager et Grafana

    Docker Compose est le chemin le plus rapide et fiable.

  3. Ajoutez des sondes blackbox depuis plusieurs régions

    Un Skiff 1 dans chaque région avec blackbox_exporter suffit.

  4. Acheminez les alertes vers un endroit où vous les verrez

    Alertmanager vers un canal de discussion, plus un second chemin pour une panne totale.

  5. Testez délibérément le chemin d'alerte

    Un pipeline d'alertes non testé n'est que de la décoration.

Questions fréquemment posées

De combien d'espace disque Prometheus a-t-il besoin ?

Environ 1 à 2 octets par échantillon après compression. Un million de séries actives avec un intervalle de scrape de 15 secondes pendant 90 jours représente environ 200 Go.

La surveillance doit-elle être exécutée chez le même fournisseur que la production ?

Non. Si elle partage un domaine de panne, elle tombera exactement au moment où vous en avez besoin. Fournisseur distinct ou au minimum région et juridiction distinctes.

Puis-je surveiller depuis plusieurs pays ?

Oui. Une instance Skiff à 4 $ par région exécutant blackbox_exporter offre une couverture géographique réelle à moindre coût.