🎯 レッスンの目的__HTMLTAG_68___
- ✅ kube-prometheus-stack (Prometheus + Grafana + Alertmanager) のデプロイ
- ✅ サービス検出用の ServiceMonitor と PodMonitor
- ✅ 事前に計算されたメトリクスの記録ルール__HTMLTAG_75___
- ✅ アラート ルールとアラート マネージャー ルーティング__HTMLTAG_77___
- ✅ 長期保管用のThanos__HTMLTAG_79___
- ✅ カスタム アプリケーション メトリクス__HTMLTAG_81___
パート 1: 観測可能アーキテクチャ
コードブロック_0
パート 2: KUBE-POMETHEUS-STACK のインストール
コードブロック_1
コードブロック_2
コードブロック_3
パート 3: サービスモニターとポッドモニター
コードブロック_4
パート 4: 警告ルール
コードブロック_5
パート 5: GRAFANA ダッシュボード
コードブロック_6
コードブロック_7
パート 6: THANOS (長期保管)
コードブロック_8
💡 重要なポイント
- kube-prometheus-stack: 1 つの Helm チャートで完全なモニタリング
- ServiceMonitor: 自動検出ターゲット、手動スクレイピング構成なし
- RED メソッド: すべてのサービスのレート、エラー、期間
- Alertmanager: アラートを重大度ごとに Slack/PagerDuty にルーティングします
- 記録ルール: 負荷の高いクエリを事前計算
- Thanos: オブジェクト ストレージでの長期保存 (月/年)
🎯 演習__HTMLTAG_132___
演習 1: モニタリングの設定__HTMLTAG_134___
- kube-prometheus-stack をデプロイ
- アプリの ServiceMonitor を作成
- RED メソッド Grafana ダッシュボードを構築__HTMLTAG_141___
演習 2: アラート
- アラート ルールの作成 (エラー率、レイテンシー、ポッドの再起動)
- アラートマネージャー→Slackの設定
- アラートをトリガー、通知を確認
📚 次の投稿
__HTMLTAG_157___レッスン 33: Loki — 集中ログでは、Grafana Loki を使用して集中ログ集約をセットアップします。