メインコンテンツまでスキップ

Global Cluster のスケール

この機能は、Business Critical (SaaS) と BYOC デプロイメントでのみ利用できます。

この機能は、すべての AWS リージョンと、次の Google Cloud リージョンで利用できます: gcp-us-central1 および gcp-us-east4。Microsoft Azure では利用できません。

Global Cluster のスケーリングは、通常の Dedicated cluster のスケーリングとは異なります。一部のリソース設定は primary cluster から一元的に制御され、その他は cluster ごとに個別に設定されます。

このページでは、Global Cluster のスケーリング動作と、各リソースタイプをスケールする方法について説明します。

開始前に

  • Project Admin であることを確認してください。

スケーリング動作の概要

次の表は、Global Cluster でサポートされるスケーリング動作の概要を示しています。

ResourcePrimary ClusterSecondary cluster
Query CUサポートされています。
すべてのスケーリング方法(手動、動的、スケジュール)が利用可能です。
primary に自動追従します。個別にスケールすることはできません。
Replicaサポートされています。
すべてのスケーリング方法(手動、動的、スケジュール)が利用可能です。
サポートされています。
すべてのスケーリング方法(手動、動的、スケジュール)が利用可能です。
cluster ごとに個別に設定されます。

Query CU のスケール

Query CU のスケーリングは primary cluster レベルで制御されます。primary の query CU 数を変更すると、Zilliz Cloud は新しい query CU 数をすべての secondary cluster に自動的に適用します。secondary cluster の query CU を個別にスケールすることはできず、常に primary と一致します。

Primary cluster の query CU のスケーリングは、通常の Dedicated cluster と同じ手順に従います。詳細については、以下を参照してください。

注意事項

  • 通常の Dedicated clusters と同じ resource limits が適用されます(例: query CU × Replica ≤ 10,240)。

  • Query CU のスケーリング中、cluster のステータスは Modifying に変わります。スケーリングの進行中は Switchover はブロックされます。

  • Query CU のスケーリング中でも、緊急オペレーションとして Failover をトリガーできますが、スケーリングタスクは失敗し、failover 完了後に再試行されます。

Replica のスケール

Replica のスケーリングは cluster ごとに個別に制御されます。Global Cluster 内の各 cluster(primary と secondary)は、それぞれのリージョンのワークロードに合わせて異なる replica 数を設定できます。これにより、トラフィックの多いリージョンにより多くのリソースを割り当てつつ、他のリージョンで過剰にプロビジョニングすることを避けられます。

以下は、各 cluster の replica 構成例です。

ClusterRegionReplicaReason
Primaryus-west-22中程度の読み取り + すべての書き込みトラフィック
Secondary_01eu-west-14ヨーロッパでの高い読み取りトラフィック
Secondary_02ap-southeast-11低トラフィック、災害復旧のスタンバイ専用

Primary または secondary cluster の replica のスケーリングは、通常の Dedicated cluster と同じ手順に従います。詳細については、以下を参照してください。

注意事項

  • 通常の Dedicated clusters と同じ replica limits が適用されます。

    • マルチ replica を有効にするには最小 8 CUs が必要です

    • 最大 10 replicas

    • CU × Replica ≤ 10,240

  • Replica のスケーリング中は、Global Cluster での switchover はブロックされます。

  • Replica のスケーリング中でも Failover をトリガーできますが、スケーリングタスクは失敗し、failover 完了後に再試行されます。

FAQs

  1. Primary と secondary clusters で異なる query CU 数を設定できますか?

    いいえ。CU のスケーリングは常に primary で開始され、すべての secondary が自動的に追従します。これにより、Global Cluster 全体で一貫したキャパシティが確保されます。

  2. 異なる cluster に異なる replica 数を設定できますか?

    はい。Replica のスケーリングは cluster ごとに完全に独立しています。これは、リージョンごとにトラフィックパターンが異なる場合に便利です。たとえば、高トラフィックのリージョンでは replica を多くし、スタンバイ専用のリージョンでは少なくできます。

  3. Switchover 後、スケーリング設定はどうなりますか?

    Switchover 後は、新しい primary cluster が query CU スケーリングの対象になります。各 cluster の replica 構成は変更されません。

Ctrl I