このトピックでは、Vector Retrieval Service for Milvus インスタンスを迅速に作成する方法を説明します。
使用上の注意
Milvus には、Standard Edition と StandalonePro Edition があります。
Standard Edition:エンタープライズグレードのアプリケーションと大規模な本番環境向けに設計された分散ベクトル検索ソリューションです。マルチアベイラビリティゾーンクラスターとしてデプロイされ、本番レベルの高可用性 SLA を提供し、コンピューティングリソースとストレージリソースの独立した水平スケーリングをサポートします。このエディションは、高い信頼性、高い同時実行性、大規模なデータ処理を必要とする本番シナリオに最適です。
StandalonePro Edition:個人開発者や小規模チーム向けに設計された軽量ベクトル検索ソリューションです。単一プロセスとしてデプロイされ、水平スケーリングはサポートされていません。このエディションは、開発、学習、機能検証、初期テストにのみ推奨され、本番環境には推奨されません。
機能 | StandalonePro Edition | Standard Edition |
主な用途 | 開発、テスト、機能検証 | 本番環境と大規模アプリケーション |
デプロイアーキテクチャ | 単一アベイラビリティゾーンでの単一プロセスデプロイ | マルチアベイラビリティゾーン高可用性をサポートする分散クラスター |
サービスレベルアグリーメント (SLA) | StandalonePro Edition の SLA は Standard Edition よりも低く、本番レベルの可用性保証は含まれません。 | 本番レベルの高可用性 SLA を提供 |
スケーラビリティ | 水平スケーリングはサポートされず、垂直スケーリングのみサポート | コンピューティングリソースとストレージリソースの独立した水平スケーリングをサポート |
インスタンスのアップグレード | Standard Edition に直接アップグレードすることはできず、データ移行が必要です。 | クラスターエディション内でのスムーズなスケーリングをサポート |
前提条件
Alibaba Cloud アカウントが必要です。Alibaba Cloud アカウントをお持ちでない場合は、まず登録を完了してください。詳細については、「Alibaba Cloud アカウント登録プロセス」をご参照ください。
初回購入時には、対応するクラウドリソースにアクセスするための権限を Milvus に付与する必要があります。詳細については、「クラウドリソースへのアクセス権限の付与」をご参照ください。
RAM ユーザーを使用する場合は、RAM ユーザー認証を完了する必要があります。詳細については、「RAM ユーザーへの権限付与」をご参照ください。
手順
Alibaba Cloud Milvus ページに移動します。
Alibaba Cloud Milvus コンソールにログインします。
左側のナビゲーションペインで、Instances をクリックします。
Instances ページで、Create Instance をクリックし、次のパラメーターを設定します。
構成項目
説明
[Billing Method]
サブスクリプションと従量課金の課金方法をサポートします。
[Duration]
サブスクリプション課金方法の場合、デフォルトの購入期間は 1 か月です。サポートされる購入期間は、実際のコンソールページでご確認ください。
[Region]
インスタンスが配置される物理的な場所です。
重要インスタンスの作成後、リージョンは変更できません。慎重に選択してください。
[Network]
仮想プライベートクラウド (VPC) は、Alibaba Cloud 上で定義する独立したネットワーク環境です。ご自身の VPC を完全に制御できます。
既存の VPC を選択します。新しい VPC を作成するには、[コンソールで作成] をクリックします。詳細については、「VPC を作成する」をご参照ください。
vSwitch は、VPC を構成する基本的なネットワークモジュールであり、異なるクラウドリソースを接続するために使用されます。
既存の vSwitch を選択します。新しい vSwitch を作成するには、[コンソールで作成] をクリックします。詳細については、「vSwitch の作成」をご参照ください。
[Deployment Model]
[Single-zone]:開発およびテスト環境に適しています。コストが低く、デプロイが簡単ですが、クロスゾーンディザスタリカバリーは提供されません。
[Multi-zone Deployment (Basic)]:コンピューティングリソースのコピーを 1 つのみ提供するため、障害発生時には一定の復旧時間が必要です。RTO は 1 時間以内で、コストパフォーマンスに優れています。
[Multi-zone Deployment (HA)]:コンピューティングリソースのコピーを 2 つ提供します。サービス異常が発生した場合、プライマリクラスターとセカンダリクラスター間で直接切り替えることができ、RTO は 3 分以内です。
マルチ AZ の Basic エディションと HA エディションの違い、適用シナリオ、アーキテクチャ特性の詳細については、「マルチゾーンデプロイ」をご参照ください。
[Version]
バージョン 2.4、2.5、2.6 をサポートします。
[Instance Series]
Standard Edition:エンタープライズグレードのアプリケーションと大規模な本番環境向けに設計された分散ベクトル検索ソリューションです。マルチアベイラビリティゾーンクラスターとしてデプロイされ、本番レベルの高可用性 SLA を提供し、コンピューティングリソースとストレージリソースの独立した水平スケーリングをサポートします。このエディションは、高い信頼性、高い同時実行性、大規模なデータ処理を必要とする本番シナリオに最適です。
StandalonePro Edition:個人開発者や小規模チーム向けに設計された軽量ベクトル検索ソリューションです。単一プロセスとしてデプロイされ、水平スケーリングはサポートされていません。このエディションは、開発、学習、機能検証、初期テストにのみ推奨され、本番環境には推奨されません。
[Service Node]
このパラメーターは、Standard Edition インスタンスを作成するときに設定する必要があります。
主にクライアントリクエストの処理とクラスター状態の管理を担当します。クエリリクエストを適切なコンピューティングノードに分散し、結果を収集して返します。また、クラスターメタデータを維持して、リクエストが対応するコンピューティングノードに正しくルーティングされるようにします。
[ストリーミングノード]:主にリアルタイム書き込みと増分データ消費を担当します。
書き込みが頻繁で、「書き込みから検索可能になるまで」のレイテンシー要件が高い場合は、ノード数を増やすか仕様をアップグレードして、リアルタイムデータ処理能力を向上させることを強く推奨します。
[データノード]:主にデータの書き込み、永続化、管理を担当します。
データ書き込み量が多く、インポートが頻繁な場合は、ノード数を増やすか仕様をアップグレードして、全体的な書き込み帯域幅と安定性を向上させることを強く推奨します。
[Proxy]:主にクライアントリクエストの受信とルーティングを担当します。
クライアント接続が多く、同時リクエストが多い場合は、ノード数を増やすか仕様をアップグレードして、リクエストアクセスと転送能力を向上させることを強く推奨します。
[Metadata Service]:リソーススケジューリングとタスク調整を担当します。
クラスターが大規模で、データパーティションが多い場合は、スケジューリングの安定性を確保するために仕様をアップグレードすることを強く推奨します。
[Compute Node]
[クエリノード]:ベクトル検索とフィルタリングを担当します。
メモリ使用率が 70% を超える場合は、クエリパフォーマンスと安定性を確保するために、ノード数を増やすか仕様をアップグレードする必要があります。ノードの詳細については、「ノードタイプ」をご参照ください。
[Data Replicas]
データレプリカを有効にすると、クラスターの可用性を効果的に確保できます。本番ワークロードでは、この機能を有効にすることを推奨します。
[Data Storage]
デフォルトでゾーン冗長ストレージが使用されます。実際に保存されたデータ量に基づいて課金され、実際に使用したストレージ容量 (GB) に基づいて 1 時間ごとに料金が計算されます。
[Automatic Backup]
重要バックアップ機能の使用にはストレージ料金が発生します。詳細については、「課金」をご参照ください。
自動バックアップ機能はデフォルトで有効になっています。この機能は、インスタンスのデータセキュリティを確保し、サービス SLA を保証するための機能です。データが誤って失われた場合、この機能を使用してデータを復旧できます。
説明この機能を無効にする必要がある場合は、インスタンスを作成した後、Backup Snapshot タブに移動して無効にします。詳細については、「バックアップと復元」をご参照ください。
[Password]
データベースにログインするための Milvus インスタンスの root (管理者) アカウントのパスワードを設定します。
説明パスワードを忘れた場合は、「FAQ」を参照してください。
[OSS Data Encryption]
OSS データ暗号化には Key Management Service (KMS) が必要です。Key Management Service コンソールに移動して有効にしてください。
[Resource Group]
既存のリソースグループを選択します。新しい専用リソースグループを作成するには、Create Resource Group をクリックします。リソースグループは、目的、権限、所有権などのディメンションによってクラウドリソースをグループ化するものです。詳細については、「リソースグループ」をご参照ください。
[Tag]
インスタンスの作成時にタグをバインドすることも、インスタンスの作成後にタグを追加することもできます。これにより、インスタンスリソースの識別と管理が容易になります。タグの詳細については、「タグ」をご参照ください。
設定が正しいことを確認したら、サービス契約を読んで選択し、Create Instance をクリックします。
インスタンスのステータスが Running になると、インスタンスの作成は完了です。