メインコンテンツまでスキップ

Global Cluster のスケール

この機能は、Business Critical(SaaS)および BYOC デプロイメントでのみ利用できます。

この機能は、すべての AWS リージョン、および次の Google Cloud リージョンで利用できます: gcp-us-central1 と gcp-us-east4。Microsoft Azure では利用できません。

global cluster のスケーリングは、通常の Dedicated cluster のスケーリングとは異なります。一部のリソース設定は primary cluster から一元的に制御され、その他は cluster ごとに個別に設定されます。

このページでは、global cluster のスケーリング動作と、各リソースタイプをスケールする方法について説明します。

始める前に

  • Project Admin であることを確認してください。

スケーリング動作の概要

次の表は、global cluster でサポートされるスケーリング動作の概要を示しています。

ResourcePrimary ClusterSecondary cluster
Query CUサポートされています。
すべてのスケーリング方法(手動、動的、スケジュール)を利用できます。
primary に自動追従します。個別にスケールすることはできません。
Replicaサポートされています。
すべてのスケーリング方法(手動、動的、スケジュール)を利用できます。
サポートされています。
すべてのスケーリング方法(手動、動的、スケジュール)を利用できます。
cluster ごとに個別に設定されます。

Query CU のスケール

Query CU のスケーリングは、primary cluster レベルで制御されます。primary の query CU 数を変更すると、Zilliz Cloud は新しい query CU 数をすべての secondary cluster に自動的に適用します。secondary cluster の query CU を個別にスケールすることはできません。常に primary と一致します。

primary cluster の query CU のスケーリングは、通常の Dedicated cluster と同じ手順に従います。詳細は次を参照してください。

考慮事項

  • 通常の Dedicated clusters と同じリソース制限が適用されます(例: query CU × Replica ≤ 10,240)。

  • query CU のスケーリング中は、cluster のステータスが Modifying に変わります。スケーリングの進行中はスイッチオーバーはブロックされます。

  • フェイルオーバーは、緊急操作として query CU のスケーリング中でも引き続きトリガーできますが、スケーリングタスクは失敗し、フェイルオーバー完了後に再試行されます。

Replica のスケール

Replica のスケーリングは、cluster ごとに個別に制御されます。global cluster 内の各 cluster(primary と secondary)は、そのリージョンのワークロードに合わせて異なる replica 数を設定できます。これにより、高トラフィックのリージョンにはより多くのリソースを割り当てつつ、他のリージョンでの過剰プロビジョニングを避けることができます。

以下は、各 cluster に対する replica 構成の例です。

ClusterRegionReplicaReason
Primaryus-west-22中程度の読み取り + すべての書き込みトラフィック
Secondary_01eu-west-14ヨーロッパでの高い読み取りトラフィック
Secondary_02ap-southeast-11低トラフィック、災害復旧用スタンバイのみ

primary または secondary cluster の replica のスケーリングは、通常の Dedicated cluster と同じ手順に従います。詳細は次を参照してください。

考慮事項

  • 通常の Dedicated clusters と同じreplica 制限が適用されます。

    • マルチ replica を有効にするには最小 8 CUs が必要です

    • 最大 10 replicas

    • CU × Replica ≤ 10,240

  • replica のスケーリング中は、global cluster 上のスイッチオーバーがブロックされます。

  • フェイルオーバーは replica のスケーリング中でも引き続きトリガーできますが、スケーリングタスクは失敗し、フェイルオーバー完了後に再試行されます。

FAQs

  1. primary cluster と secondary cluster で異なる数の query CUs を設定できますか?

    いいえ。CU のスケーリングは常に primary で開始され、すべての secondary が自動的に追従します。これにより、global cluster 全体で一貫した容量が確保されます。

  2. 異なる cluster ごとに異なる replica 数を設定できますか?

    はい。replica のスケーリングは cluster ごとに完全に独立しています。これは、リージョンごとにトラフィックパターンが異なる場合に便利です。たとえば、高トラフィックのリージョンではより多くの replicas を、スタンバイ専用リージョンではより少ない replicas を設定できます。

  3. スイッチオーバー後、スケーリング設定はどうなりますか?

    スイッチオーバー後、query CU のスケーリング対象は新しい primary cluster になります。各 cluster の replica 構成は変更されません。

Ctrl I