メインコンテンツまでスキップ

メトリクスリファレンス

Zilliz Cloud はメトリクスを以下のレベルに整理しています。

  • 組織レベルのメトリクス: すべてのプロジェクトにまたがる、アカウント全体のステータス(例: ライセンスクレジット、使用状況)を反映します。

  • クラスターレベルのメトリクス: 個々のクラスター内のリソース使用量、パフォーマンス、およびデータを反映します。

  • コレクションレベルのメトリクス: クラスターメトリクスの一部をコレクションごとに分解したもので、個々のコレクションのパフォーマンス問題の特定や容量計画に役立ちます。

Notes

ほとんどのメトリクスはアラートに対応しています。アラートは、ある時間枠においてメトリクスを条件(演算子 + しきい値)に照らして評価し、条件を満たした場合に通知します。設定については、組織アラートの管理 および プロジェクトアラートの管理 を参照してください。

組織レベルのメトリクス​

組織レベルのメトリクスは、組織内のすべてのプロジェクトにまたがるライセンス関連の問題を追跡するのに役立ちます。

Metric

Description

Recommended action

License Validity (day)

組織ライセンスが期限切れになるまでの残り日数。

  • < 60 日: 更新手続きを開始します。

  • Expired: 完全な機能(例: クラスターの作成/scale-up). を回復するために、ただちに更新(renew/upgrade)してください。

License Core Usage (%)

ライセンスされた総コア数に対する使用済み CPU コアの割合。

  • > 70%: 将来のニーズを評価し、更新またはアップグレード(renewal/upgrade.)を計画してください。

  • 100%: サービス中断を避けるために、ただちに更新(renew/upgrade)してください。

Usage Amount in the Past Day ($)

過去 1 日間の累積使用料金。

予算との比較を監視し、必要に応じて使用量を最適化するか予算を調整します。

Credit Validity (day)

無料クレジットの有効期限までの残り日数。

有効期限が切れる前にクレジットを使用するか延長します。

Remaining Credits ($)

無料クレジットの残高。

アカウント機能を維持するため、残高が少なくなったら補充します。

Credit Card Validity (day)

保存済みカードの有効期限までの日数。

支払い失敗を避けるため、有効期限前にカードを更新または差し替えます。

Advance Pay Balance ($)

残りの前払い資金。

サービス中断を防ぐため、残高が少なくなったら資金を追加します。

クラスターおよびコレクションメトリクス​

これらのメトリクスは、個々のクラスター内のリソース使用量、パフォーマンス、およびデータを表します。✦ が付いたメトリクスはコレクションレベルでも利用できます。コレクションレベルのメトリクスには、Console のコレクション詳細ページ、Prometheus endpoint、または RESTful API からアクセスできます。

Notes

Availability 列には、各メトリクスをサポートするコンピュートリソースが示されています。

  • Serving クラスター only: このメトリクスは Serving クラスターでのみ利用できます。値には、サポートされる Serving クラスターのデプロイオプションが示されます。All は、すべての Serving クラスターのデプロイオプションを意味します。詳細は、デプロイメントとプランの比較 を参照してください。

  • On-Demand Compute データベース: 利用できるのはコレクションレベルのメトリクスの一部のみです。サポートされるメトリクスには、QPS (Read)、Search NQ per Second、Latency (Read)、Request Failure Rate (Read)、および Entity Count が含まれます。これらのメトリクスは Console で利用できます。このリリースでは、On-Demand Compute データベース メトリクスの Prometheus エクスポートはサポートされていません。

Pod とコンテナのリソース​

MetricDescriptionAvailabilityRecommended action
CPU Usage (core)Pod が使用する CPU コア数。BYOC傾向を追跡し、継続的な増加やスパイクを調査します。
CPU Usage Rate for Limit (%)limit の値に対する Pod の CPU 使用量の割合。BYOC上昇傾向にある場合は、ワークロードを最適化するか limit を引き上げます。
Memory Usage (MB)Pod 内のコンテナのメモリ使用量(キャッシュを除く)。BYOC着実な増加やリークの疑いがある場合は調査します。
Memory Usage Rate for Limit (%)limit の値に対する Pod のメモリ使用量の割合。BYOC継続的に高い場合は、メモリを最適化するか limit を引き上げます。
Network Inbound Flow (Mbps)Pod のネットワーク受信フロー。BYOC輻輳を監視し、帯域幅のサイジングを検証します。
Network Outbound Flow (Mbps)Pod のネットワーク送信フロー。BYOC輻輳を監視し、帯域幅のサイジングを検証します。

リソース​

MetricDescriptionAvailabilityRecommended action
Query CU Computation (%)クエリの実行が CPU リソースをどれだけ使用しているかを測定します。これは、QueryNode の CPU 使用量をその CPU limit に対する相対値として計算されます。Serving クラスター only: Dedicated / BYOC高い値が継続する場合、クエリの実行が CPU 律速であることを意味します。Zilliz Cloud は、並列クエリ処理能力を高めるために レプリカをスケールアウト する場合があります。
Query CU Capacity (%)現在の Query CU が容量上限にどれだけ近いかを測定します。これは、ロード済みデータが使用するメモリと、クラスターのストレージクォータに対する保存データサイズという 2 つのシグナルのうち高い方を使用します。Serving クラスター only: Dedicated / BYOC高い値が継続する場合、現在の Query CU サイズでは十分な容量がない可能性があります。自動スケーリングが有効な場合、Zilliz Cloud はより多くの容量を提供するために Query CU をスケールアップ する場合があります。
Total Query CU (count)現在のクラスターにおける合計 Query CU 数。これは、クラスターの Query CU 数とレプリカ数の積として計算されます。(例: クラスターに 2 つの Query CUs と 2 つの Replicas がある場合、ここに表示される Total Query CU は 4 です。)Serving クラスター only: Dedicated / BYOCQuery CU のスケーリングイベントを特定するために追跡します。
Replica (count)クラスターのレプリカ数。Serving クラスター only: Dedicated / BYOCレプリカのスケーリングイベントを特定するために追跡します。
Storage (GB)データとインデックスが消費する永続ストレージの総量。Serving クラスター only: Allストレージ使用量を監視するために アラートを設定 します。

パフォーマンス​

Metric

Description

Availability

Recommended action

QPS (Read) ✦

1 秒あたりの読み取りリクエスト(検索およびクエリ)の数。

  • Serving クラスター: All

  • On-Demand Compute データベース: Managed コレクション, external コレクション

システムパフォーマンスの監視については benchmark を参照してください。

QPS (Write) ✦

1 秒あたりの書き込みリクエスト(insert、bulk insert、upsert、および delete)の数。

Serving クラスター only: All

システムパフォーマンスの監視については benchmark を参照してください。

Search NQ per Second ✦

各検索リクエストが 1 秒あたりに含むクエリベクトルの数。

  • Serving クラスター: All

  • On-Demand Compute データベース: Managed コレクション, external コレクション

システムパフォーマンスの監視については benchmark を参照してください。

Write Throughput (Entities/sec) ✦

すべての書き込み操作(insert、upsert、bulk insert、および delete)において、1 秒あたりに書き込まれるエンティティ数を測定します。

Serving クラスター only: All

システムパフォーマンスの監視については benchmark を参照してください。

Latency (Read) (ms) ✦

クライアントが読み取りリクエスト(検索およびクエリリクエスト)をサーバーに送信してから、クライアントが応答を受信するまでの経過時間です。平均レイテンシと P99 レイテンシが含まれます。

  • Serving クラスター: All

  • On-Demand Compute データベース: Managed コレクション, external コレクション

Latency (Write) (ms) ✦

クライアントが書き込みリクエスト(insert および upsert リクエスト)をサーバーに送信してから、クライアントが応答を受信するまでの経過時間です。平均レイテンシと P99 レイテンシが含まれます。

Serving クラスター only: All

Request Failure Rate (Read) (%) ✦

1 秒あたりの全リクエストに占める、失敗した読み取りリクエスト全体の割合。

  • Serving クラスター: All

  • On-Demand Compute データベース: Managed コレクション, external コレクション

読み取りリクエスト失敗率を監視するために アラートを設定 します。

Request Failure Rate (Write) (%) ✦

1 秒あたりの全リクエストに占める、失敗した書き込みリクエスト全体の割合。

Serving クラスター only: All

書き込みリクエスト失敗率を監視するために アラートを設定 します。

Slow Query Count (counts/min) ✦

実行に異常に長い時間がかかるクエリの数。

デフォルトでは、レイテンシが 5 秒を超えるクエリはスロークエリと見なされます。

Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOC

問題のあるクエリを特定し、必要に応じてクラスター構成を調整してパフォーマンスを最適化します。

クラスター Write Performance Capacity (%)

クラスターの書き込みパフォーマンス容量 = 現在の書き込み操作レート/write レート上限。80% を超える場合は、書き込み操作(insert および upsert)のレートを下げることを推奨します。

Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOC

現在のレートが高すぎる場合(80% 超が目安)、書き込みレートを下げることを推奨します。

Number of Flush Operations (counts/min)

クラスターに対する flush 操作の数。

Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOC

flush 操作を頻繁に実行しすぎると、クラスター全体のパフォーマンスに悪影響を及ぼす可能性があります。詳細は Zilliz Cloud Limits を参照してください。

Cache Hit Rate (%)

クラスター内のすべてのクエリにおける平均キャッシュヒット率で、次のように計算されます: クエリごとのキャッシュヒット率 = (総スキャンデータ量 − コールドデータのスキャン量) / 総スキャンデータ量。

Serving クラスター only: Dedicated (Tiered-storage) / BYOC

*このメトリクスは、Milvus 2.6.x と互換性のある tiered-storage クラスターでのみ利用可能です。このメトリクスにアクセスするには、クラスターの Milvus バージョンをアップグレードするために お問い合わせください。

クラスターのクエリパフォーマンスを特定するために追跡します。

データ​

Metric

Description

Availability

Recommended action

コレクション Count

クラスター内に作成されたコレクションの数。

Serving クラスター only: All

増加を監視し、必要に応じてプロジェクトごとの上限を適用します。

Entity Count ✦

単一 insert と bulk insert の両方を含む、クラスターまたはコレクションに挿入されたエンティティの総数。

  • Serving クラスター: All

  • On-Demand Compute データベース: Managed コレクション, external コレクション

想定外の増加を調査し、ストレージとインデックス作成を計画します。

Loaded Entities (Approx.) ✦

ロード済み(アクティブに提供中)のエンティティの概算数。

Serving クラスター only: Dedicated / BYOC

より正確でリアルタイムな値については、コレクション概要ページの「Loaded Entities」の値を参照するか、count(*) を使用してください。

Number of Unloaded コレクション

クラスター内の未ロードコレクション数。

Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOC

重要なコレクションをロードし、メモリの余裕を見直します。

その他​

MetricDescriptionAvailabilityRecommended action
クラスター is Abnormal対象クラスターのステータスが異常な場合。Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOCクラスターのステータスを調査し、それに応じた対策を講じます。
CMEK is UnavailableZilliz Cloud に追加した KMS キーの 1 つが利用不可になった場合。Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOC報告されたキーがまだ利用可能かどうかを判断するために、KMS キーを確認します。
Writes to クラスター Are Disabledエラーまたは保護メカニズムにより、対象クラスターへの書き込みが無効化された場合。Serving クラスター only: Dedicated (Enterprise or Business Critical) / BYOCクラスターのステータス、最近の設定またはメンテナンス操作、および関連するアラートを確認し、根本原因を解決して書き込み機能を復旧します。
Access Logs Forwarding is Abnormalアクセスログを設定済みのストレージ統合先へ正常に転送できない場合。Serving クラスター only: Dedicated (Enterprise or Business Critical)ログ転送設定、送信先サービスのステータス、ネットワーク接続、および関連する認証情報または権限を確認し、問題を解決してログ転送が再開されたことを確認します。
Audit Logs Forwarding is Abnormal監査ログを設定済みのストレージ統合先へ正常に転送できない場合。Serving クラスター only: Dedicated (Enterprise or Business Critical)ログ転送設定、送信先サービスのステータス、ネットワーク接続、および関連する認証情報または権限を確認し、問題を解決してログ転送が再開されたことを確認します。