監視とアラート
Terraform で DataDog を統合
DataDog は、クラウド規模のアプリケーション向けの監視およびセキュリティプラットフォームです。サーバー、データベース、アプリケーション、サービスに対するリアルタイムの可視性を提供します。DataDog を使用して、PhoenixAI Cloud クラスターのパフォーマンスを追跡し、ボトルネックを特定し、最適な運用を確保することで、クラスターの健全性と効率を維持できます。
一般的なモニタリングメトリクス
このトピックでは、StarRocks の重要な一般メトリクスを紹介します。
既存の Prometheus サービスとの統合
PhoenixAI は、さまざまな監視ソリューションを提供しています。推奨される DataDog の統合 に加えて、既存の Prometheus サービスと統合することで、クラスターや仮想マシンを監視することもできます。
非同期マテリアライズドビューの監視メトリクス
v3.1以降、StarRocksは非同期マテリアライズドビューのメトリクスをサポートしています。
PagerDuty との統合
PhoenixAI は、インシデント管理のために PagerDuty との統合をサポートしています。PagerDuty はデータベースシステムを監視し、技術的な問題が検出された場合に、適切なオンコール担当者へ自動的に通知します。
共有データクラスタの監視メトリクス
StarRocks は、共有データクラスタ用に 2 つのダッシュボードテンプレートを提供しています。
ウェアハウスのモニタリングメトリクス
StarRocksは、ウェアハウスの管理とクエリキューの監視のために、様々なメトリクスを提供します。
ウェアハウス CNGroup メトリクス
StarRocks はウェアハウス内の Compute Node Group (CN Group) を監視および管理するためのさまざまなメトリクスを提供しています。
General metrics
4項目
アラート
PhoenixAI Cloud のアラートシステムは、クラスタのステータスを監視し、設定したアラートポリシーに従って通知を送信します。