Cutter 8
- vCPU
- 4 × dedicado
- RAM
- 8 GB
- Armazenamento
- 160 GB NVMe SSD
- Transferência
- 10 TB
- IPv4 / IPv6
- 1 / /64 routed
Solução
Uma stack de monitorização é limitada pela memória e pelo disco. O Prometheus com recolhas de 15 segundos em 50 alvos e 90 dias de retenção precisa de cerca de 8 GB de RAM e 200 GB de NVMe. Coloque-a noutro sítio que não a infraestrutura que vigia — uma monitorização que partilha o domínio de falha com a produção não lhe diz nada no momento em que mais precisa.
| Recurso | O que realmente precisa |
|---|---|
| CPU | 2–4 núcleos |
| RAM | 8 GB para ~1M de séries ativas |
| Disco | NVMe, 160–320 GB para retenção de 90 dias |
| Localização | Um fornecedor ou região diferente do que monitoriza |
A localização é geralmente a decisão que mais importa para esta carga de trabalho — seja porque a latência domina, seja porque a jurisdição domina.
País diferente, idealmente fornecedor diferente.
Docker Compose é o caminho fiável mais rápido.
Um Skiff 1 em cada região a executar blackbox_exporter chega.
Alertmanager para um canal de chat, mais um segundo caminho para uma indisponibilidade total.
Um pipeline de alertas não testado é decoração.
Cerca de 1–2 bytes por amostra após compressão. Um milhão de séries ativas com intervalo de recolha de 15 segundos durante 90 dias são cerca de 200 GB.
Não. Se partilhar um domínio de falha, cairá exatamente no momento em que precisa dela. Fornecedor separado ou, no mínimo, região e jurisdição separadas.
Sim. Uma instância Skiff de $4 por região a executar o blackbox_exporter dá-lhe uma cobertura geográfica real e barata.