メインコンテンツまでスキップ

メトリクスリファレンス

Zilliz Cloud はメトリクスを以下のレベルに整理しています。

  • 組織レベルのメトリクス: すべてのプロジェクトにまたがる、アカウント全体のステータス(例: ライセンスクレジット、使用状況)を反映します。

  • クラスターレベルのメトリクス: 個々のクラスター内のリソース使用量、パフォーマンス、およびデータを反映します。

  • コレクションレベルのメトリクス: クラスターメトリクスの一部をコレクションごとに分解したもので、個々のコレクションのパフォーマンス問題の特定や容量計画に役立ちます。

📘注意

ほとんどのメトリクスはアラートに対応しています。アラートは、ある時間枠においてメトリクスを条件(演算子 + しきい値)に照らして評価し、条件を満たした場合に通知します。設定については、組織アラートの管理 および プロジェクトアラートの管理 を参照してください。

組織レベルのメトリクス

組織レベルのメトリクスは、組織内のすべてのプロジェクトにまたがる請求関連の問題を追跡するのに役立ちます。

MetricDescriptionRecommended action
Usage Amount in the Past Day ($)過去 1 日間の累積使用料金。予算との比較を監視し、必要に応じて使用量を最適化するか予算を調整します。
Credit Validity (day)無料クレジットの有効期限までの残り日数。有効期限が切れる前にクレジットを使用するか延長します。
Remaining Credits ($)無料クレジットの残高。アカウント機能を維持するため、残高が少なくなったら補充します。
Credit Card Validity (day)保存済みカードの有効期限までの日数。支払い失敗を避けるため、有効期限前にカードを更新または差し替えます。
Advance Pay Balance ($)残りの前払い資金。サービス中断を防ぐため、残高が少なくなったら資金を追加します。

クラスターおよびコレクションメトリクス

これらのメトリクスは、個々のクラスター内のリソース使用量、パフォーマンス、およびデータを表します。 が付いたメトリクスはコレクションレベルでも利用できます。コレクションレベルのメトリクスには、Console のコレクション詳細ページ、Prometheus endpoint、または RESTful API からアクセスできます。

📘注意

Availability 列には、各メトリクスをサポートするコンピュートリソースが示されています。

  • Serving Clusters only: このメトリクスは Serving Clusters でのみ利用できます。値には、サポートされる Serving Cluster のデプロイオプションが表示されます。All は、すべての Serving Cluster デプロイオプションを意味します。詳細は、デプロイメントとプランの比較 を参照してください。

  • On-Demand Compute databases: 利用できるのはコレクションレベルのメトリクスの一部のみです。サポートされるメトリクスには、QPS (Read)Search NQ per SecondLatency (Read)Request Failure Rate (Read)、および Entity Count が含まれます。これらのメトリクスは Console で利用できます。このリリースでは、On-Demand Compute database メトリクスの Prometheus エクスポートはサポートされていません。

リソース

MetricDescriptionAvailabilityRecommended action
Read vCUs (count)検索およびクエリ操作の vCU 消費量の指標。
注: このメトリクスではアラートはサポートされていません。
Serving Clusters only: Free / Serverless傾向を監視して、読み取りコスト/スループットを把握します。
Write vCUs (count)挿入、削除、および upsert 操作の vCU 消費量の指標。
注: このメトリクスではアラートはサポートされていません。
Serving Clusters only: Free / Serverless傾向を監視して、書き込みコスト/スループットを把握します。
Query CU Computation (%)クエリ実行が CPU リソースをどの程度使用しているかを測定します。これは QueryNode の CPU 使用率をその CPU 制限に対して相対化して計算されます。Serving Clusters only: Dedicated / BYOC高い値が継続する場合、クエリ実行が CPU ボトルネックになっていることを意味します。Zilliz Cloud は並列クエリ処理能力を高めるために レプリカをスケールアウト する場合があります。
Query CU Capacity (%)現在の Query CU が容量上限にどれだけ近いかを測定します。これは、ロード済みデータが使用するメモリと、クラスターのストレージクォータに対する保存データサイズという 2 つのシグナルのうち高い方を使用します。Serving Clusters only: Dedicated / BYOC高い値が継続する場合、現在の Query CU サイズでは十分な容量がない可能性があります。自動スケーリングが有効な場合、Zilliz Cloud はより多くの容量を提供するために Query CU をスケールアップ する場合があります。
Total Query CU (count)現在のクラスターにおける合計 Query CU 数。これは、クラスターの Query CU 数とレプリカ数の積として計算されます。(例: クラスターに 2 つの Query CUs と 2 つの Replicas がある場合、ここに表示される Total Query CU は 4 です。)Serving Clusters only: Dedicated / BYOCQuery CU のスケーリングイベントを特定するために追跡します。
Replica (count)クラスターのレプリカ数。Serving Clusters only: Dedicated / BYOCレプリカのスケーリングイベントを特定するために追跡します。
Storage (GB)データとインデックスが消費する永続ストレージの総量。Serving Clusters only: Allストレージ使用量を監視するために アラートを設定 します。

パフォーマンス

Metric

Description

Availability

Recommended action

QPS (Read) ✦

1 秒あたりの読み取りリクエスト(検索およびクエリ)の数。

  • Serving Clusters: All

  • On-Demand Compute databases: Managed collections, external collections

システムパフォーマンスの監視については benchmark を参照してください。

QPS (Write) ✦

1 秒あたりの書き込みリクエスト(insert、bulk insert、upsert、および delete)の数。

Serving Clusters only: All

システムパフォーマンスの監視については benchmark を参照してください。

Search NQ per Second ✦

各検索リクエストが 1 秒あたりに運ぶクエリベクトルの数。

  • Serving Clusters: All

  • On-Demand Compute databases: Managed collections, external collections

システムパフォーマンスの監視については benchmark を参照してください。

Write Throughput (Entities/sec) ✦

すべての書き込み操作(insert、upsert、bulk insert、および delete)において、1 秒あたりに書き込まれるエンティティ数を測定します。

Serving Clusters only: All

システムパフォーマンスの監視については benchmark を参照してください。

Latency (Read) (ms) ✦

クライアントが読み取りリクエスト(検索およびクエリリクエスト)をサーバーに送信してから、クライアントが応答を受信するまでの経過時間です。平均レイテンシと P99 レイテンシが含まれます。

  • Serving Clusters: All

  • On-Demand Compute databases: Managed collections, external collections

-

Latency (Write) (ms) ✦

クライアントが書き込みリクエスト(insert および upsert リクエスト)をサーバーに送信してから、クライアントが応答を受信するまでの経過時間です。平均レイテンシと P99 レイテンシが含まれます。

Serving Clusters only: All

-

Request Failure Rate (Read) (%) ✦

1 秒あたりの全リクエストに占める、失敗した読み取りリクエスト全体の割合。

  • Serving Clusters: All

  • On-Demand Compute databases: Managed collections, external collections

読み取りリクエスト失敗率を監視するために アラートを設定 します。

Request Failure Rate (Write) (%) ✦

1 秒あたりの全リクエストに占める、失敗した書き込みリクエスト全体の割合。

Serving Clusters only: All

書き込みリクエスト失敗率を監視するために アラートを設定 します。

Slow Query Count (counts/min) ✦

実行に異常に長い時間がかかるクエリの数。

デフォルトでは、レイテンシが 5 秒を超えるクエリはスロークエリと見なされます。

Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOC

問題のあるクエリを特定し、必要に応じてクラスター構成を調整してパフォーマンスを最適化します。

Cluster Write Performance Capacity (%)

クラスターの書き込みパフォーマンス容量 = 現在の書き込み操作率 / 書き込みレート上限。80% を超える場合は、書き込み操作(insert および upsert)のレートを下げることを推奨します。

Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOC

現在のレートが高すぎる場合(80% 超が目安)、書き込みレートを下げることを推奨します。

Number of Flush Operations (counts/min)

クラスターに対する flush 操作の数。

Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOC

flush 操作を頻繁に実行しすぎると、クラスター全体のパフォーマンスに悪影響を及ぼす可能性があります。詳細は Zilliz Cloud Limits を参照してください。

Cache Hit Rate (%)

クラスター内のすべてのクエリにおける平均キャッシュヒット率で、次のように計算されます: クエリごとのキャッシュヒット率 = (総スキャンデータ量 − コールドデータのスキャン量) / 総スキャンデータ量。

Serving Clusters only: Dedicated (Tiered-storage) / BYOC

*このメトリクスは、Milvus 2.6.x と互換性のある tiered-storage クラスターでのみ利用可能です。このメトリクスにアクセスするには、クラスターの Milvus バージョンをアップグレードするために お問い合わせください

クラスターのクエリパフォーマンスを特定するために追跡します。

データ

Metric

Description

Availability

Recommended action

Collection Count

クラスター内に作成されたコレクションの数。

Serving Clusters only: All

増加を監視し、必要に応じてプロジェクトごとの上限を適用します。

Entity Count ✦

単一 insert と bulk insert の両方を含む、クラスターまたはコレクションに挿入されたエンティティの総数。

  • Serving Clusters: All

  • On-Demand Compute databases: Managed collections, external collections

想定外の増加を調査し、ストレージとインデックス作成を計画します。

Loaded Entities (Approx.) ✦

ロード済み(アクティブに提供中)のエンティティの概算数。

Serving Clusters only: Dedicated / BYOC

より正確でリアルタイムな値については、コレクション概要ページの「Loaded Entities」の値を参照するか、count(*) を使用してください。

Number of Unloaded Collections

クラスター内の未ロードコレクション数。

Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOC

重要なコレクションをロードし、メモリの余裕を見直します。

その他

MetricDescriptionAvailabilityRecommended action
Cluster is Abnormal対象クラスターのステータスが異常な場合。Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOCクラスターのステータスを調査し、それに応じた対策を講じます。
CMEK is UnavailableZilliz Cloud に追加した KMS キーの 1 つが利用不可になった場合。Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOC報告されたキーがまだ利用可能かどうかを判断するために、KMS キーを確認します。
Writes to Cluster Are Disabledエラーまたは保護メカニズムにより、対象クラスターへの書き込みが無効化された場合。Serving Clusters only: Dedicated (Enterprise or Business Critical) / BYOCクラスターのステータス、最近の設定またはメンテナンス操作、および関連するアラートを確認し、根本原因を解決して書き込み機能を復旧します。
Access Logs Forwarding is Abnormalアクセスログを設定済みのストレージ統合先へ正常に転送できない場合。Serving Clusters only: Dedicated (Enterprise or Business Critical)ログ転送設定、送信先サービスのステータス、ネットワーク接続、および関連する認証情報または権限を確認し、問題を解決してログ転送が再開されたことを確認します。
Audit Logs Forwarding is Abnormal監査ログを設定済みのストレージ統合先へ正常に転送できない場合。Serving Clusters only: Dedicated (Enterprise or Business Critical)ログ転送設定、送信先サービスのステータス、ネットワーク接続、および関連する認証情報または権限を確認し、問題を解決してログ転送が再開されたことを確認します。
Ctrl I