FAQ: Collection
このトピックでは、Zilliz Cloud collection の使用中に発生する可能性のある問題と、その対応する解決策を一覧表示します。
目次
- 1 つの cluster で許可される collection 数はいくつですか?
- collection 作成時に dynamic field を無効にしていた場合、後から有効にできますか?
- Zilliz Cloud でサポートされているインデックス作成メトリックタイプは何ですか?
- 作成済み collection の TTL(time to live)プロパティを設定するにはどうすればよいですか?
- collection のロードリクエストの同時実行数はどのくらいですか?同時リクエスト数を増やすにはどうすればよいですか?
- collection のロードに失敗するのはなぜですか?どうすればよいですか?
- collection に追加できる field 数に制限はありますか?
- partition と partition key の違いは何ですか?
- collection の shard 数を変更できますか?
- partition 名にルールはありますか?
FAQs
1 つの cluster で許可される collection 数はいくつですか?
cluster で許可される collection 数は、cluster の CU サイズによって異なります。詳細については、Zilliz Cloud Limits を参照してください。
serving cluster で許可される collection の最大数に達した場合は、次の対応が可能です。
-
serving cluster をより大きい query CU 数にスケールします。
-
使用していない collection を削除します。
-
collection の代わりに partition を作成してみてください。
collection 作成時に dynamic field を無効にしていた場合、後から有効にできますか?
はい。collection 作成後でも dynamic field を有効にできます。詳細については、Modify Collection を参照してください。
Zilliz Cloud でサポートされているインデックス作成メトリックタイプは何ですか?
Zilliz Cloud は以下の種類のメトリックをサポートしています。
-
Euclidean (L2) は、平面上の 2 つの vector 間の距離を測定します。結果が小さいほど、2 つの vector はより類似しています。
-
Inner Product (IP) は、2 つの vector を乗算します。結果がより正であるほど、2 つの vector はより類似しています。
-
Cosine は、2 つの vector 間の角度のコサイン値を測定します。
-
Jaccard は、データセット間の非類似度を測定し、JACCARD 類似度係数を 1 から引くことで求められます。
-
Hamming は、バイナリデータ文字列を測定します。同じ長さの 2 つの文字列間の距離は、ビットが異なるビット位置の数です。
作成済み collection の TTL(time to live)プロパティを設定するにはどうすればよいですか?
SDK を使用して、パラメータ collection.ttl.seconds の値を指定することで、collection の TTL を設定できます。詳細については、Set Collection TTL を参照してください。
次の例では、TTL を 1800 秒に設定しています。
collection.set_properties(properties={"collection.ttl.seconds": 1800})
collection のロードリクエストの同時実行数はどのくらいですか?同時リクエスト数を増やすにはどうすればよいですか?
現在、Zilliz Cloud における collection ロードリクエストのレート制限は 1 秒あたり 1 件です。これは 1 CU cluster に対する推奨値です。同時リクエスト数を増やす必要がある場合は、リクエストを送信してください。
collection のロードに失敗するのはなぜですか?どうすればよいですか?
この失敗は、cluster のメモリ不足が原因です。cluster をより大きい CU サイズにスケールアップしてみてください。
collection に追加できる field 数に制限はありますか?
はい。1 つの collection には最大 64 個の field を持てます。
partition と partition key の違いは何ですか?
partition は collection のサブセットです。各 partition は親 collection と同じデータ構造を共有しますが、collection 内のデータの一部だけを含みます。partition は、特定の基準に基づいてデータを整理するために使用されます。
Partition Key は、partition に基づく検索最適化ソリューションです。特定の scalar field を Partition Key として指定し、検索時に Partition Key に基づくフィルタリング条件を指定することで、検索範囲を複数の partition に絞り込み、検索効率を向上させることができます。
違いは、partition ではデータが物理的に分離される一方、partition key ではデータが論理的にグループ化される点です。また、partition は手動で作成および管理する必要がありますが、partition key を有効にすると 16 個の partition が自動的に作成され、同じ partition key 値を持つデータは同じ partition にルーティングされます。
詳細については、Manage Partitions および Use Partition Key を参照してください。
collection の shard 数を変更できますか?
はい。shard 数を変更するには、"clone collection" 機能を使用します。
-
対象 collection の Overview ページに移動します。
-
Actions ドロップダウンで Clone を選択します。
-
ダイアログで、以下を行います。
-
collection 名を入力します
-
Clone scope を Collection schema and data に設定します。
-
Settings を展開し、必要な shard 数を指定します。
-
Clone をクリックします。
-
-
クローンされた collection が作成されたら、新しくクローンした collection を使用するようにアプリケーションコードを更新します。
partition 名にルールはありますか?
はい。partition 名には、文字、数字、アンダースコア(“_”)、ハイフン(“-”)のみを使用でき、数字またはハイフンで始めることはできません。