メインコンテンツまでスキップ

Pinecone から Zilliz Cloud への移行

このトピックでは、Pinecone から移行する際に、Zilliz Cloud がデータ型マッピング、フィールド変換、namespace 処理、コレクションの命名規則をどのように処理するかについて説明します。

事前準備​

Pinecone から Zilliz Cloud への移行を開始する前に、以下の要件を満たしていることを確認してください。

Pinecone の要件​

要件詳細
インデックスタイプPinecone Serverless インデックスからの移行のみをサポート
API アクセスアクセス権限を持つ Pinecone API キー
データの可用性Pinecone のソースインデックスにはデータが含まれている必要があります。空のインデックスは移行できません。
ベクトル次元次元は 1 より大きい必要があります。単一次元のベクトルは移行失敗の原因になります

Zilliz Cloud の要件​

要件詳細
ユーザーロールOrganization Owner または Project Admin
クラスター容量十分なストレージおよびコンピューティングリソース(CU サイズの見積もりには CU calculator を使用)
ネットワークアクセスネットワーク制限を使用している場合は、Zilliz Cloud IPs を許可リストに追加します

データ型マッピング​

移行計画を立てるうえで、Pinecone のデータ型が Zilliz Cloud にどのようにマッピングされるかを理解することは重要です。

Pinecone フィールド型Zilliz Cloud フィールド型備考
プライマリキーVARCHAR (primary key)自動的にマッピングされます。新しい ID を生成するには Auto ID を有効にします(元の値は破棄されます)。
Dense ベクトルFLOAT_VECTOR次元は正確に保持され、変更は不要です
Sparse ベクトルSPARSE_FLOAT_VECTORサンプルデータ内で空でない場合にのみマッピングされます。
メタデータ動的フィールドデフォルトでは動的スキーマとしてマッピングされます。固定フィールドに変換することもできます。
詳細は Dynamic Field を参照してください。
namespaceパーティションキー / パーティションパフォーマンス最適化のために推奨されます。
詳細は Namespace processing を参照してください。

メタデータフィールドの変換​

Notes

Zilliz Cloud はメタデータスキーマを検出するために 100 行をサンプリングします。必要に応じて、フィールドを手動で追加できます。

Pinecone のメタデータは、最大限の柔軟性を得るために、最初は Zilliz Cloud の動的スキーマにマッピングされます。必要に応じてメタデータフィールドを固定フィールドに変換することで、次の利点を得られます。

  • より強力な検証のためのデータ型の強制

  • より優れたクエリパフォーマンスのための最適化されたインデックス

  • 一貫したデータ管理のための構造化されたスキーマ

メタデータを固定フィールドに変換する場合:

Pinecone メタデータ型Zilliz 固定フィールド型備考
StringVARCHAR最大 65,535 バイトをサポート
Number (int/float)DOUBLEすべての数値型は DOUBLE になります
BooleanBOOL直接マッピングされます
文字列のリストARRAY<VARCHAR>ネストされた配列をサポート

固定フィールドに変換されたメタデータフィールドについては、追加の属性を設定できます。

  • Nullable: フィールドが null 値を受け入れられるかどうかを決定します。この機能はデフォルトで有効です。詳細は Nullable attribute を参照してください。

  • Default Value: データが存在しない場合のフォールバック値を設定します。詳細は Default values を参照してください。

Pinecone 固有の処理ルール​

namespace の処理​

Pinecone の namespace は、次の 2 つの戦略で移行できます。

戦略実装パフォーマンスへの影響ユースケース
namespace をパーティションキーとして使用 (推奨)namespace がパーティションキーフィールドの値になります検索パフォーマンスの自動最適化複数の namespace を持つほとんどのシナリオ
namespace をパーティションとして使用各 namespace が個別のパーティションになります手動でのパーティション管理が必要namespace が少なく安定しているシンプルなシナリオ
Notes

Pinecone の default namespace の処理:

  • パーティションとして使用: Zilliz Cloud では _default パーティションになります

  • パーティションキーとして使用: 空の文字列 "" の値になります

パーティションおよびパーティションキーの概念の詳細については、Manage Partitions および Use Partition Key を参照してください。

コレクションの命名規則​

Pinecone のインデックス名は、Zilliz Cloud との互換性のために自動的に処理されます。

Pinecone インデックス名Zilliz Cloud コレクション名適用されるルール
my-vector-indexmy_vector_indexZilliz Cloud のコレクション命名規則に準拠するため、ハイフン(-)はアンダースコア(_)に変換されます
product_searchproduct_search変更は不要です

命名の競合: ターゲットデータベースに同じ名前のコレクションがすでに存在する場合は、次のいずれかを行う必要があります。

  • 既存のコレクションを削除する、または

  • 別のターゲットデータベースを選択する、または

  • 移行設定時にターゲットコレクションの名前を変更する