指標を監視し異常を通知する
「落ちたらすぐ知りたい」
この目的で選ぶときに見る軸
- 収集間隔
- アラート経路
- 保持期間
下の表の「主要制約」は各ツールで最も先に当たる制約。軸ごとの値はツール詳細の制約表で確認する。
この目的に使える手段(3件)
| ツール | 分類 | 種別 | 学習 | 料金 | 成熟 | 主要制約 | 検証 |
|---|---|---|---|---|---|---|---|
| Sentry アプリで起きた例外をスタックトレース付きで集め、発生源を特定するエラー追跡サービス | 監視・可観測性 | マネージドサービス | 低 | 無料枠あり | 安定 | 無料プランのエラーイベント数:5,000 errors / 月(Developer)。ほかに 5M spans、50 replays、1 ユーザー、cron・uptime モニタ各 1 | |
| Datadog インフラ指標・ログ・APM・エラーを一つの画面に集約する、ホスト課金の SaaS 監視基盤 | 監視・可観測性 | マネージドサービス | 中 | 従量課金 | 安定 | インフラ監視のホスト単位課金:Pro $15 / ホスト / 月、Enterprise $23 / ホスト / 月(年契約。月次のオンデマンドはそれぞれ $18、$27) | |
| Prometheus + Grafana 時系列メトリクスを収集する Prometheus と、可視化・通知を担う Grafana の定番の組み合わせ | 監視・可観測性 | ツール | 中 | 無料 | 安定 | ローカルストレージの既定保持期間:15 日(--storage.tsdb.retention.time の既定 15d。サイズ上限 retention.size は既定 0 = 無効) |