メトリクスリファレンス
Zilliz Cloud はメトリクスを以下のレベルに整理しています。
-
組織レベルのメトリクス: すべてのプロジェクトにわたるアカウント全体のステータス(ライセンスクレジット、使用量など)を反映します。
-
クラスターレベルのメトリクス: 個々のクラスター内のリソース使用量、パフォーマンス、データを反映します。
-
コレクションレベルのメトリクス: クラスターメトリクスの一部をコレクションごとに分類したもので、個々のコレクションのパフォーマンス問題の特定や容量計画に役立ちます。
ほとんどのメトリクスはアラートに対応しています。アラートは、ある時間枠においてメトリクスを条件(演算子 + しきい値)に照らして評価し、条件を満たしたときに通知します。設定については、組織アラートの管理 および プロジェクトアラートの管理 を参照してください。
組織レベルのメトリクス
組織レベルのメトリクスは、組織内のすべてのプロジェクトにわたる請求関連の問題を追跡するのに役立ちます。
| メトリクス | 説明 | 推奨アクション |
|---|---|---|
| Usage Amount in the Past Day ($) | 過去 1 日間に発生した累積の使用料金。 | 予算と比較して監視し、必要に応じて使用量を最適化するか予算を調整します。 |
| Credit Validity (day) | 無料クレジットの有効期限が切れるまでの残り日数。 | 有効期限が切れる前にクレジットを使用するか延長します。 |
| Remaining Credits ($) | 無料クレジットの残高。 | アカウントの機能を維持するため、残高が少なくなったら補充します。 |
| Credit Card Validity (day) | 保存されたカードの有効期限が切れるまでの日数。 | 支払いの失敗を避けるため、有効期限が切れる前にカードを更新または交換します。 |
| Advance Pay Balance ($) | 前払い済み資金の残高。 | サービスの中断を防ぐため、残高が少なくなったら資金を追加します。 |
クラスターとコレクションのメトリクス
これらのメトリクスは、個々のクラスター内のリソース使用量、パフォーマンス、データを表します。✦ が付いたメトリクスは、コレクションレベルでも利用できます。コレクションレベルのメトリクスには、Console のコレクション詳細ページ、Prometheus エンドポイント、または RESTful API からアクセスできます。
利用可否 列には、各メトリクスをサポートするコンピュートリソースが示されています。
-
Serving クラスターのみ: このメトリクスは、Serving クラスターでのみ利用できます。この値には、サポートされる Serving クラスターのデプロイオプションが示されます。All は、すべての Serving クラスターのデプロイオプションを意味します。詳細については、デプロイとプランの比較 を参照してください。
-
On-Demand Compute データベース: 利用できるのは、コレクションレベルのメトリクスの一部のみです。サポートされるメトリクスには、QPS (Read)、Search NQ per Second、Latency (Read)、Request Failure Rate (Read)、Entity Count が含まれます。これらのメトリクスは Console で利用できます。このリリースでは、On-Demand Compute データベースのメトリクスに対する Prometheus エクスポートはサポートされていません。
リソース
| メトリクス | 説明 | 利用可否 | 推奨アクション |
|---|---|---|---|
| Read vCUs (count) | 検索およびクエリ操作で消費される vCU の指標です。 注: このメトリクスはアラートをサポートしていません。 | Serving クラスターのみ: Free / Serverless | 読み取りのコスト/throughput. を把握するために傾向を監視します。 |
| Write vCUs (count) | 挿入、削除、および upsert 操作で消費される vCU の指標です。 注: このメトリクスはアラートをサポートしていません。 | Serving クラスターのみ: Free / Serverless | 書き込みのコスト/throughput. を把握するために傾向を監視します。 |
| Query CU Computation (%) | クエリ実行が CPU リソースをどの程度使用しているかを測定します。QueryNode の CPU 使用率とその CPU 上限との比率から算出されます。 | Serving クラスターのみ: Dedicated / BYOC | 高い値が継続する場合は、クエリ実行が CPU バウンドであることを意味します。Zilliz Cloud は、並列クエリ処理能力を高めるために レプリカをスケールアウト することがあります。 |
| Query CU Capacity (%) | 現在の Query CU が容量上限にどの程度近づいているかを測定します。ロード済みデータが使用するメモリと、クラスターのストレージクォータに対する保存データサイズという 2 つのシグナルのうち、高い方の値を使用します。 | Serving クラスターのみ: Dedicated / BYOC | 高い値が継続する場合は、現在の Query CU サイズでは容量が不足している可能性があります。オートスケーリングが有効な場合、Zilliz Cloud は容量を増やすために Query CU をスケールアップ することがあります。 |
| Total Query CU (count) | 現在のクラスターにおける Query CU の合計です。クラスターの Query CU 数とレプリカ数の積として計算されます。(例: クラスターに 2 つの Query CU と 2 つのレプリカがある場合、ここに表示される Total Query CU は 4 です。) | Serving クラスターのみ: Dedicated / BYOC | Query CU のスケーリングイベントを特定するために追跡します。 |
| Replica (count) | クラスターのレプリカ数。 | Serving クラスターのみ: Dedicated / BYOC | レプリカのスケーリングイベントを特定するために追跡します。 |
| Storage (GB) | データとインデックスが消費する永続ストレージの総量。 | Serving クラスターのみ: All | ストレージ使用量を監視するために アラートを設定 します。 |
パフォーマンス
メトリクス | 説明 | 利用可否 | 推奨アクション |
|---|---|---|---|
QPS (Read) ✦ | 1 秒あたりの読み取りリクエスト(search および query)の数。 |
| システムパフォーマンスの監視については、benchmark を参照してください。 |
QPS (Write) ✦ | 1 秒あたりの書き込みリクエスト(insert、bulk insert、upsert、および delete)の数。 | Serving クラスターのみ: All | システムパフォーマンスの監視については、benchmark を参照してください。 |
Search NQ per Second ✦ | 各検索リクエストが 1 秒あたりに含むクエリベクトルの数。 |
| システムパフォーマンスの監視については、benchmark を参照してください。 |
Write Throughput (Entities/sec) ✦ | すべての書き込み操作(insert、upsert、bulk insert、および delete)を通じて 1 秒あたりに書き込まれるエンティティ数を測定します。 | Serving クラスターのみ: All | システムパフォーマンスの監視については、benchmark を参照してください。 |
Latency (Read) (ms) ✦ | クライアントが読み取りリクエスト(search および query リクエスト)をサーバーに送信してから、クライアントが応答を受信するまでの経過時間です。平均レイテンシと P99 レイテンシが含まれます。 |
| |
Latency (Write) (ms) ✦ | クライアントが書き込みリクエスト(insert および upsert リクエスト)をサーバーに送信してから、クライアントが応答を受信するまでの経過時間です。平均レイテンシと P99 レイテンシが含まれます。 | Serving クラスターのみ: All | |
Request Failure Rate (Read) (%) ✦ | 1 秒あたりのすべてのリクエストに占める、失敗した読み取りリクエストの割合。 |
| 読み取りリクエストの失敗率を監視するために アラートを設定 します。 |
Request Failure Rate (Write) (%) ✦ | 1 秒あたりのすべてのリクエストに占める、失敗した書き込みリクエストの割合。 | Serving クラスターのみ: All | 書き込みリクエストの失敗率を監視するために アラートを設定 します。 |
Slow Query Count (counts/min) ✦ | 実行に異常に長い時間がかかるクエリの数。 デフォルトでは、レイテンシが 5 秒を超えるクエリはスロークエリと見なされます。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | 問題のあるクエリを特定し、必要に応じてクラスター構成を調整してパフォーマンスをチューニングします。 |
クラスター Write Performance Capacity (%) | クラスターの書き込みパフォーマンス容量 = 現在の書き込み操作レート/write レート上限。80% を超える場合は、書き込み操作(insert および upsert)のレートを下げることを推奨します。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | 現在のレートが高すぎる場合(80% を超えている場合)、書き込みレートを下げることを推奨します。 |
Number of Flush Operations (counts/min) | クラスターにおける flush 操作の数。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | flush 操作を頻繁に実行しすぎると、クラスター全体のパフォーマンスに悪影響を及ぼす可能性があります。詳細については、Zilliz Cloud の制限事項 を参照してください。 |
Cache Hit Rate (%) | クラスター内のすべてのクエリにおける平均キャッシュヒット率。計算式: クエリごとのキャッシュヒット率 = (総スキャンデータ − コールドデータのスキャン量) / 総スキャンデータ。 | Serving クラスターのみ: Dedicated (Tiered-storage) / BYOC *このメトリクスは、Milvus 2.6.x と互換性のある tiered-storage クラスターでのみ利用できます。このメトリクスにアクセスするには、クラスターの Milvus バージョンをアップグレードするため、お問い合わせください。 | クラスターのクエリパフォーマンスを把握するために追跡します。 |
データ
メトリクス | 説明 | 利用可否 | 推奨アクション |
|---|---|---|---|
コレクション Count | クラスター内に作成されたコレクションの数。 | Serving クラスターのみ: All | 増加を監視し、必要に応じてプロジェクトごとの上限を適用します。 |
Entity Count ✦ | 単一の insert と bulk insert の両方を含め、クラスターまたはコレクションに挿入されたエンティティの総数。 |
| 想定外の増加を調査し、ストレージとインデックス作成を計画します。 |
Loaded Entities (Approx.) ✦ | ロード済み(アクティブに提供中)のエンティティの概算数。 | Serving クラスターのみ: Dedicated / BYOC | より正確でリアルタイムな値については、コレクション概要ページの「Loaded Entities」の値を参照するか、count(*) を使用してください。 |
Number of Unloaded コレクション | クラスター内のアンロードされたコレクションの数。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | 重要なコレクションをロードし、メモリの余裕を確認します。 |
その他
| メトリクス | 説明 | 利用可否 | 推奨アクション |
|---|---|---|---|
| クラスター is Abnormal | 対象クラスターのステータスが異常である場合。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | クラスターのステータスを調査し、それに応じた対策を講じます。 |
| CMEK is Unavailable | Zilliz Cloud に追加した KMS キーのいずれかが利用できなくなった場合。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | 報告されたキーが引き続き利用可能かどうかを確認するため、KMS キーを確認します。 |
| Writes to クラスター Are Disabled | エラーまたは保護メカニズムにより、対象クラスターへの書き込みが無効化された場合。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) / BYOC | クラスターのステータス、最近の設定変更やメンテナンス操作、関連するアラートを確認し、根本原因を解決して書き込み機能を復旧します。 |
| Access Logs Forwarding is Abnormal | アクセスログを設定済みのストレージ統合に正常に転送できない場合。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) | ログ転送の設定、転送先サービスのステータス、ネットワーク接続、関連する認証情報や権限を確認し、問題を解決してログ転送が再開することを確認します。 |
| Audit Logs Forwarding is Abnormal | 監査ログを設定済みのストレージ統合に正常に転送できない場合。 | Serving クラスターのみ: Dedicated (Enterprise or Business Critical) | ログ転送の設定、転送先サービスのステータス、ネットワーク接続、関連する認証情報や権限を確認し、問題を解決してログ転送が再開することを確認します。 |