ハイブリッド検索 (V2)
この操作は、ベクトル類似性とスカラー フィルタリングに基づいてエンティティを検索し、指定された戦略を使用して結果を再ランキングします。
https://{cluster-id}.{region}.vectordb.zillizcloud.com:19530
- サービングクラスターを使用している場合は、クラスターエンドポイントを使用してください。
Free & Serverless
https://{cluster-id}.serverless.{region}.vectordb.zillizcloud.comDedicated
https://{cluster-id}.{region}.vectordb.zillizcloud.com:19530
${CLUSTER_ENDPOINT}を、あなたのZilliz Cloudクラスターのエンドポイントに置き換える必要があります。- エンドポイントを取得するには、Describe Cluster V2 APIを使用してレスポンスから値を抽出してください。
export CLUSTER_ENDPOINT="https://{cluster-id}.{region}.vectordb.zillizcloud.com:19530"
認証トークンは、適切な権限を持つ API key、または username:password のようにコロンで連結されたユーザー名とパスワードの組み合わせである必要があります。project endpoint を使用している場合は、十分な権限を持つ有効な API key のみが適用されます。
データベースの名前。
この操作が適用されるコレクションの名前。
この操作が適用されるパーティションの名前です。このパラメータを設定すると、検索は指定されたパーティション内で実行されます。それ以外の場合、検索はコレクション内のすべてのパーティションを対象に実行されます。
パーティション名。
検索パラメータ
ベクトル フィールドの検索パラメータ。
ベクトル埋め込みのリスト。Zilliz Cloud は、指定されたベクトル埋め込みに最も類似したベクトル埋め込みを検索します。
ベクトル埋め込み
ベクトル フィールドの名前。
ブール式フィルタ。
集計条件として機能するフィールドの名前。
現在の検索に適用されるメトリック タイプの名前です。値は対象コレクションのメトリック タイプと同じである必要があります。
返されるエンティティの数。
返されるエンティティからスキップするエンティティ数。
growing segments で見つかったエンティティを無視するかどうか。
追加の検索パラメータ。
最小類似度のしきい値を決定します。metric_type を L2 に設定する場合、この値が range_filter の値より大きいことを確認してください。それ以外の場合、この値は range_filter の値より小さい必要があります。
特定の類似度範囲内のベクトルに検索を絞り込みます。metric_type を IP または COSINE に設定する場合、この値が radius の値より大きいことを確認してください。それ以外の場合、この値は radius の値より小さい必要があります。
パラメータ化されたフィルタ式用の式テンプレート パラメータ値。
再ランキング戦略。
再ランキング戦略の名前。
指定された戦略に関連するパラメータのセット
RRF アルゴリズムにおける調整可能な定数です。これは strategy が rrf に設定されている場合にのみ適用されます。
返されるエンティティの総数。 ページネーションを有効にするには、このパラメータを param 内の offset と組み合わせて使用できます。 この値と param 内の offset の合計は 16,384 未満である必要があります。
各グループについて返されるエンティティの数。このパラメータは groupingField が指定されている場合にのみ有効です。
各グループについて top k エンティティのみを返すかどうか。このパラメータは groupingField が指定されている場合にのみ有効です。
検索結果とともに返すフィールドの配列。
フィールド名
検索操作の整合性レベル。値は対象コレクションの整合性レベルと同じである必要があります。
現在の検索リクエストの関数設定。
適用する関数の名前。
適用する関数の説明。
適用する関数のタイプ。
関数への入力として使用するスカラー フィールドのリスト。
関数への入力として使用するスカラー フィールド。
関数の出力として使用するベクトル フィールドのリスト。
関数の出力として使用するベクトル フィールド。
関数用の追加パラメータ(キーと値のペア)。
検索結果でスキップするレコード数。
検索結果をグループ化する対象のフィールド名。
export TOKEN="db_admin:xxxxxxxxxxxxx"
curl --request POST \
--url "${CLUSTER_ENDPOINT}/v2/vectordb/entities/hybrid_search" \
--header "Authorization: Bearer ${TOKEN}" \
--header "Request-Timeout: 5" \
--header "Content-Type: application/json" \
-d '{
"collectionName": "test_collection",
"search": [
{
"data": [
[
0.673437956701697,
0.739243747672878
]
],
"annsField": "float_vector_1",
"limit": 10,
"outputFields": [
"*"
]
},
{
"data": [
[
0.075384179256879,
0.9971545645073111
]
],
"annsField": "float_vector_2",
"limit": 10,
"outputFields": [
"*"
]
}
],
"rerank": {
"strategy": "rrf",
"params": {
"k": 10
}
},
"limit": 3,
"outputFields": [
"user_id",
"word_count",
"book_describe"
]
}'
検索結果を返します。
レスポンスコード。
この操作のコスト。 これは free および serverless clusters にのみ適用され、現在のリクエストの vCU 使用量を示します。
検索結果
エンティティ オブジェクト。
各クエリ ベクトルに対して返される top-K 結果の数。
デプロイメントが usage tracking を有効にした tiered storage を使用しており、操作が remote/disk storage から読み取る場合に返されます。すべてのデータが local cache から提供される場合は省略されます。
デプロイメントが usage tracking を有効にした tiered storage を使用しており、操作が remote/disk storage から読み取る場合に返されます。すべてのデータが local cache から提供される場合は省略されます。
デプロイメントが usage tracking を有効にした tiered storage を使用しており、操作が remote/disk storage から読み取る場合に返されます。すべてのデータが local cache から提供される場合は省略されます。
エラーメッセージを返します。
レスポンスコード。
エラーメッセージ。
{
"code": 0,
"cost": 0,
"data": [
{
"book_describe": "book_105",
"distance": 0.09090909,
"id": 450519760774180800,
"user_id": 5,
"word_count": 105
},
{
"book_describe": "book_246",
"distance": 0.09090909,
"id": 450519760774180900,
"user_id": 46,
"word_count": 246
},
{
"book_describe": "book_367",
"distance": 0.08333333600000001,
"id": 450519760774181060,
"user_id": 67,
"word_count": 367
}
]
}