Solução

VPS para monitorização: Prometheus, Grafana e verificações de uptime

Cutter 8 · $34/moCutter 16 · $62/mo
Resposta curta

Uma stack de monitorização é limitada pela memória e pelo disco. O Prometheus com recolhas de 15 segundos em 50 alvos e 90 dias de retenção precisa de cerca de 8 GB de RAM e 200 GB de NVMe. Coloque-a noutro sítio que não a infraestrutura que vigia — uma monitorização que partilha o domínio de falha com a produção não lhe diz nada no momento em que mais precisa.

O que precisa

Especificações mínimas para monitorização e observabilidade
RecursoO que realmente precisa
CPU2–4 núcleos
RAM8 GB para ~1M de séries ativas
DiscoNVMe, 160–320 GB para retenção de 90 dias
LocalizaçãoUm fornecedor ou região diferente do que monitoriza

Planos recomendados

Cutter

Cutter 8

$ 34 /month
vCPU
4 × dedicado
RAM
8 GB
Armazenamento
160 GB NVMe SSD
Transferência
10 TB
IPv4 / IPv6
1 / /64 routed
Configurar
Cutter

Cutter 16

$ 62 /month
vCPU
6 × dedicado
RAM
16 GB
Armazenamento
320 GB NVMe SSD
Transferência
15 TB
IPv4 / IPv6
1 / /64 routed
Configurar

Localizações recomendadas

A localização é geralmente a decisão que mais importa para esta carga de trabalho — seja porque a latência domina, seja porque a jurisdição domina.

Porquê a OnionVPS para isto

  • Uma instância barata numa jurisdição separada dá um verdadeiro isolamento de domínio de falha.
  • O NVMe impede que a compactação do Prometheus se torne no elemento mais ruidoso da máquina.
  • Instâncias em mais de 40 países permitem-lhe executar sondas blackbox a partir de onde os seus utilizadores realmente estão.
  • Preço fixo, portanto a retenção é uma decisão de armazenamento, não uma fatura por métrica.

Como configurar

  1. Implemente um Cutter 8 longe da sua região de produção

    País diferente, idealmente fornecedor diferente.

  2. Instale Prometheus, Alertmanager e Grafana

    Docker Compose é o caminho fiável mais rápido.

  3. Adicione sondas blackbox de várias regiões

    Um Skiff 1 em cada região a executar blackbox_exporter chega.

  4. Encaminhe alertas para onde os vá ver

    Alertmanager para um canal de chat, mais um segundo caminho para uma indisponibilidade total.

  5. Teste o caminho de alerta deliberadamente

    Um pipeline de alertas não testado é decoração.

Perguntas frequentes

Quanto disco precisa o Prometheus?

Cerca de 1–2 bytes por amostra após compressão. Um milhão de séries ativas com intervalo de recolha de 15 segundos durante 90 dias são cerca de 200 GB.

A monitorização deve correr no mesmo fornecedor que a produção?

Não. Se partilhar um domínio de falha, cairá exatamente no momento em que precisa dela. Fornecedor separado ou, no mínimo, região e jurisdição separadas.

Posso monitorizar a partir de vários países?

Sim. Uma instância Skiff de $4 por região a executar o blackbox_exporter dá-lhe uma cobertura geográfica real e barata.