OpenSearch Retrieval Engine Edition インスタンスでベクターインデックスを設定し、SDK を使用してベクタークエリでデータを取得します。
OpenSearch Retrieval Engine Edition インスタンスの購入
詳細については、「OpenSearch Retrieval Engine Edition インスタンスの購入」をご参照ください。
テーブルの設定
新しいインスタンスを購入すると、製品ページでインスタンスステータスが「設定待ち」になります。購入したクエリノードとデータノードの数と仕様に一致する空のクラスターが自動的にデプロイされます。検索を実行する前に、[テーブルの基本情報] > [データ同期] > [インデックススキーマ] > [インデックスの再構築] を完了してクラスターを設定します。
-
テーブルの基本情報を設定するには、[テーブル名] をカスタマイズし、[シャード数] を決定し、[データ更新リソース数] を指定します。
-
テーブルの最大シャード数は 256 です。インスタンス内のデータノード数の 3 倍を超える値に設定しないことを推奨します。
-
デフォルトでは、2 つのデータ更新リソースが無料で提供されます。追加のリソースは n-2 に基づいて課金されます (n は単一テーブルのデータ更新リソースの総数です)。
-
完全データソースを設定します。サポートされるデータソースタイプには、MaxCompute データソース、API プッシュデータソース、Object Storage Service (OSS)、Data Lake Formation (DLF) データソース があります。たとえば、MaxCompute を使用するには、[データソースを追加] を選択し、タイプとして [MaxCompute] を選択し、プロジェクト、accesskeyID、accesskeySecret、テーブル、パーティションキーを入力します。自動再インデックス を有効にすることもできます。
-
データソースを設定した後、[インデックススキーマ] を設定します。
少なくとも 2 つのフィールド ([プライマリキーフィールド] と [ベクターフィールド]) を定義します。ベクターフィールドは複数値のフロート型として設定します。
ベクターをカテゴリに関連付けるには、カテゴリフィールドを追加し、単一値または複数値の整数型に設定します。
プロパティとフィールドコンテンツの圧縮:
-
属性フィールドは圧縮をサポートしています。フォームモードでは、非圧縮と圧縮のいずれかを選択します。開発者モードでは、no_compressor または file_compressor を選択します。
-
フィールドコンテンツはデフォルトで非圧縮です。複数値のフィールドと文字列型のフィールドはデフォルトで uniq 圧縮になり、単一値の数値型はデフォルトで equal 圧縮になります。