本トピックでは、API をデータソースとして使用する場合にテーブルを追加する方法について説明します。
テーブルの追加
[インスタンス詳細] > [テーブル管理] ページで、[テーブルの追加] をクリックします。
テーブルの基本情報を入力し、[次へ] をクリックします。
設定の説明:
[テーブル名]:カスタム名を入力します。
[シャード数]:256 以下の正の整数を入力します。 この設定により、フルビルドの速度と個々のクエリのパフォーマンスが向上します。 既存の一部のインスタンスでは、すべてのインデックステーブルでシャード数を同じにする必要があります。 または、1 つのインデックステーブルに 1 つのシャードを設定し、他のすべてのインデックステーブルでシャード数を同じにすることもできます。
[データ更新リソース]:データ更新に使用されるリソースの数です。 デフォルトでは、各インデックスに 4 コア 8 GB の更新リソースが 2 つ無料で含まれています。 無料クォータを超えるリソースは課金対象となります。 詳細については、または「Vector Search Edition 国際サイト課金ドキュメント」をご参照ください。
[シナリオテンプレート]:Vector Search Edition は、「General」、「Vector - Image Search」、「Vector - Text Semantics」の 3 つの組み込みテンプレートを提供します。
データ同期用のデータソースを設定し、[次へ] をクリックします。
パラメーターの説明:
[データソースタイプ]:API を選択します。 これは、API を使用してインスタンスにデータがプッシュされることを意味します。
フィールドを設定し、[次へ] をクリックします。
説明プライマリキーフィールドとベクトルフィールドは必須です。 プライマリキーフィールドは INT 型または STRING 型とし、[プライマリキー] オプションを選択する必要があります。 ベクトルフィールドは FLOAT 型とし、[ベクトルフィールド] オプションを選択する必要があります。
デフォルトでは、ベクトルフィールドは複数値の FLOAT 型です。 デフォルトの複数値の区切り文字である ha3 区切り文字
^](UTF-8 エンコードで\x1D) は、値の分割に使用されます。 カスタムの複数値の区切り文字を指定することもできます。データ内のフィールドが欠落しているか、空の場合、システムは自動的にデフォルト値を設定します。 デフォルト値は、数値型の場合は 0、STRING 型の場合は空の文字列です。 [カスタムデフォルト値] を指定することもできます。
インデックススキーマを設定し、[次へ] をクリックします。
このセクションでは、ベクトルインデックスを設定します:
プライマリキーフィールドとベクトルフィールドは必須です。 namespace フィールドはオプションであり、空にすることができます。
これらの 3 つの固定フィールドからのみ選択できます。 新しいフィールドは追加できません。
ベクトル次元:モデルが生成するベクトルに基づいて次元数を選択します。
距離メトリック:モデルが生成するベクトルに基づいて距離メトリックを選択します。 システムでは、SquareEuclidean と InnerProduct の 2 種類の距離メトリックをサポートしています。
ベクトルインデックスアルゴリズム:モデルが生成するベクトルに基づいてアルゴリズムを選択します。 システムでは、量子化クラスタリング、リニア、HNSW (Hierarchical Navigable Small World) のベクトルインデックスアルゴリズムをサポートしています。
リアルタイムインデックス:API からの増分データにリアルタイムのベクトルインデックスを構築するかどうかを指定します。 デフォルト値は true です。
その他の高度な設定については、セクションを展開してください。 パラメーターの説明については、「ベクトルインデックスの一般的な設定」をご参照ください。
設定を確認します。 [確認] をクリックすると、指定内容に基づいてシステムが自動的にテーブルを作成します。
作成の進行状況は、変更履歴で確認できます。
テーブルのステータスが [使用中] に変わると、[クエリテスト] ページでクエリをテストできます。
注意事項
API データソースでフルビルドを実行すると、以前にプッシュされたすべてのデータがクリアされます。 その後、システムは指定されたタイムスタンプからリアルタイムデータの同期を開始します。 したがって、API データソースでフルビルドを実行する際は、注意が必要です。