解決策

監視用VPS:Prometheus、Grafana、アップタイムチェック

Cutter 8 · $34/moCutter 16 · $62/mo
短い回答

監視スタックはメモリとディスクに制約されます。50ターゲットの15秒スクレイプ間隔、90日間保持のPrometheusは、約8 GBのRAMと200 GBのNVMeが必要です。監視対象のインフラと同じ失敗ドメインに置かないでください — 本番環境と失敗ドメインを共有する監視は、最も必要とする瞬間に何も教えてくれません。

必要なもの

監視と可観測性の仕様の下限
リソース実際に必要なもの
CPU2~4コア
RAM約100万アクティブシリーズで8 GB
ディスクNVMe、90日間保持で160~320 GB
配置監視対象とは異なるプロバイダーまたはリージョン

推奨プラン

Cutter

Cutter 8

$ 32.3 /month

合計$96.90 · 5%割引

vCPU
4 × 専用
RAM
8 GB
ストレージ
160 GB NVMe SSD
転送量
10 TB
IPv4 / IPv6
1 / /64 routed
設定
Cutter

Cutter 16

$ 58.9 /month

合計$176.70 · 5%割引

vCPU
6 × 専用
RAM
16 GB
ストレージ
320 GB NVMe SSD
転送量
15 TB
IPv4 / IPv6
1 / /64 routed
設定

推奨ロケーション

このワークロードでは、通常ロケーションの選択が最も重要です—レイテンシが支配的になるか、管轄権が支配的になるかのどちらかだからです。

これにOnionVPSを選ぶ理由

  • 別の管轄区域の安価なインスタンスで、真の失敗ドメイン分離が得られます。
  • NVMeにより、Prometheusの圧縮がボックス上で最も大きなノイズになるのを防ぎます。
  • 40か国以上のインスタンスにより、ユーザーが実際にいる場所からブラックボックスプローブを実行できます。
  • フラットな価格設定なので、保持期間はメトリクスごとの料金ではなくストレージの決定です。

設定方法

  1. 本番リージョンから離れた場所にCutter 8をデプロイ

    別の国、理想的には別のプロバイダー。

  2. Prometheus、Alertmanager、Grafanaをインストール

    Docker Composeが最も速く信頼できる方法です。

  3. 複数のリージョンからブラックボックスプローブを追加

    各リージョンのSkiff 1でblackbox_exporterを実行すれば十分です。

  4. 確実に確認できる場所にアラートをルーティング

    Alertmanagerをチャットチャネルへ、さらに完全停止用の第2パスも設定。

  5. アラートパスを意図的にテスト

    テストされていないアラートパイプラインは単なる飾りです。

よくある質問

Prometheusにはどのくらいのディスクが必要ですか?

圧縮後、サンプルあたりおおよそ1~2バイトです。15秒のスクレイプ間隔、90日間、100万アクティブシリーズで約200 GBです。

監視は本番環境と同じプロバイダーで実行すべきですか?

いいえ。失敗ドメインを共有すると、最も必要な瞬間にダウンします。プロバイダーを分けるか、少なくともリージョンと管轄区域を分けてください。

複数の国からモニタリングできますか?

Yes. A $4 Skiff instance per region running blackbox_exporter gives you real geographic probe coverage cheaply.