Cutter 8
- vCPU
- 4 × dédié
- RAM
- 8 GB
- Stockage
- 160 GB SSD NVMe
- Transfert
- 10 TB
- IPv4 / IPv6
- 1 / /64 routed
Solution
Une pile de surveillance est limitée par la mémoire et le disque. Prometheus avec des scrapes toutes les 15 secondes sur 50 cibles et 90 jours de rétention nécessite environ 8 Go de RAM et 200 Go de NVMe. Placez-la ailleurs que sur l'infrastructure qu'elle surveille — une surveillance qui partage un domaine de panne avec la production ne vous dit rien au moment où vous en avez le plus besoin.
| Ressource | Ce dont vous avez réellement besoin |
|---|---|
| CPU | 2–4 cœurs |
| RAM | 8 Go pour ~1M de séries actives |
| Disque | NVMe, 160–320 Go pour 90 jours de rétention |
| Emplacement | Un fournisseur ou une région différent de ce qu'il surveille |
L'emplacement est généralement la décision la plus importante pour ce type de charge de travail — soit parce que la latence domine, soit parce que la juridiction en fait partie.
Pays différent, idéalement un fournisseur différent.
Docker Compose est le chemin le plus rapide et fiable.
Un Skiff 1 dans chaque région avec blackbox_exporter suffit.
Alertmanager vers un canal de discussion, plus un second chemin pour une panne totale.
Un pipeline d'alertes non testé n'est que de la décoration.
Environ 1 à 2 octets par échantillon après compression. Un million de séries actives avec un intervalle de scrape de 15 secondes pendant 90 jours représente environ 200 Go.
Non. Si elle partage un domaine de panne, elle tombera exactement au moment où vous en avez besoin. Fournisseur distinct ou au minimum région et juridiction distinctes.
Oui. Une instance Skiff à 4 $ par région exécutant blackbox_exporter offre une couverture géographique réelle à moindre coût.