メインコンテンツまでスキップ

FAQ: Collection

このトピックでは、Zilliz Cloud collection の使用中に発生する可能性のある問題と、それに対応する解決策を示します。

Contents

FAQs

1 つの cluster では何個の collection が許可されていますか?

無料 cluster では最大 5 個の collection を作成できます。上限に達していて、さらに collection を作成する必要がある場合は、cluster のデプロイオプションをアップグレードしてください。

Serverless cluster では最大 100 個の collection を作成できます。

Dedicated cluster で許可される collection 数は、cluster の CU サイズによって異なります。詳細については、Zilliz Cloud Limits を参照してください。

serving cluster で許可される collection 数の上限に達した場合は、次の方法を実行できます。

  1. serving cluster を、より大きい query CU 数にスケールします。

  2. 使用していない collection を削除します。

  3. collection の代わりに partition を作成してみてください。

collection 作成時に dynamic field を無効化していた場合、後から有効にできますか?

はい。collection 作成後でも dynamic field を有効にできます。詳細については、Modify Collection を参照してください。

Zilliz Cloud がサポートする indexing metric type は何ですか?

Zilliz Cloud は以下の metric type をサポートしています。

  1. Euclidean (L2) は、平面上の 2 つの vector 間の距離を測定します。結果が小さいほど、2 つの vector はより類似しています。

  2. Inner Product (IP) は、2 つの vector を乗算します。結果がより正であるほど、2 つの vector はより類似しています。

  3. Cosine は、2 つの vector 間の角度の cosine 値を測定します。

  4. Jaccard は、データセット間の非類似度を測定し、JACCARD 類似度係数を 1 から引くことで得られます。

  5. Hamming は、バイナリデータ文字列を測定します。同じ長さの 2 つの文字列間の距離は、ビットが異なるビット位置の数です。

作成済み collection の TTL(time to live)プロパティを設定するにはどうすればよいですか?

SDK を使用して、パラメータ collection.ttl.seconds の値を指定することで collection の TTL を設定できます。詳細については、Set Collection TTL を参照してください。

以下の例では、TTL を 1800 秒に設定しています。

python
collection.set_properties(properties={"collection.ttl.seconds": 1800})

collection のロードリクエストにおける同時実行数はいくつですか?同時リクエスト数を増やすにはどうすればよいですか?

現在、Zilliz Cloud における collection ロードリクエストのレート制限は 1 秒あたり 1 件です。これは 1 CU cluster に対する推奨値です。同時リクエスト数を増やす必要がある場合は、リクエストを送信してください。

collection のロードに失敗するのはなぜですか?どうすればよいですか?

この失敗は、cluster のメモリ不足が原因です。cluster をより大きい CU サイズにスケールアップしてみてください。

collection に追加できる field 数に制限はありますか?

はい。1 つの collection に追加できる field は最大 64 個です。

partition と partition key の違いは何ですか?

partition は collection のサブセットです。各 partition は親 collection と同じデータ構造を共有しますが、collection 内のデータの一部だけを含みます。partition は、特定の基準に基づいてデータを整理するために使用されます。

Partition Key は、partition に基づく検索最適化ソリューションです。特定の scalar field を Partition Key として指定し、検索時に Partition Key に基づくフィルタリング条件を指定することで、検索範囲をいくつかの partition に絞り込み、検索効率を向上させることができます。

違いは、データが partition では物理的に分離される一方で、partition key では論理的にグループ化されることです。さらに、partition は手動で作成および管理する必要がありますが、partition key を有効にすると 16 個の partition が自動的に作成され、同じ partition key 値を持つデータは同じ partition にルーティングされます。

詳細については、Manage Partitions および Use Partition Key を参照してください。

collection 内の shard 数を変更できますか?

はい。shard 数を変更するには、"clone collection" 機能を使用します。

  1. 対象 collection の Overview ページに移動します。

  2. Actions ドロップダウンで、Clone を選択します。

  3. ダイアログで以下を行います。

    • collection 名を入力します

    • Clone scopeCollection schema and data に設定します。

    • Settings を展開し、希望する shard 数を指定します。

    • Clone をクリックします。

  4. clone された collection が作成されたら、アプリケーションコードを更新して新しく clone された collection を使用します。

partition 名に関するルールはありますか?

はい。partition 名に使用できるのは英字、数字、アンダースコア(“_”)、ハイフン(“-”)のみで、数字またはハイフンで始めることはできません。

異なる model provider ごとにカスタムパラメータを設定できますか?

はい。異なる model provider に対してカスタムパラメータがサポートされています。サポートされているパラメータの完全な一覧については、各 provider の公式ドキュメントを参照してください。

Ctrl I