Este tópico descreve como criar rapidamente uma instância do .
Observações de uso
O está disponível nas edições Standard e StandalonePro:
A Standard Edition é uma solução distribuída de recuperação vetorial projetada para aplicações empresariais e ambientes de produção em grande escala. Implantada como cluster multizona de disponibilidade, oferece SLA de alta disponibilidade de nível de produção e permite dimensionamento horizontal independente de recursos de computação e armazenamento. Esta edição é ideal para cenários de produção que exigem alta confiabilidade, alta concorrência e processamento de dados em grande escala.
A StandalonePro Edition é uma solução leve de recuperação vetorial voltada para desenvolvedores individuais e pequenas equipes. Implantada como processo único, não permite dimensionamento horizontal. Esta edição é adequada para desenvolvimento, aprendizado, validação de recursos e testes iniciais, mas não é recomendada para ambientes de produção.
|
Recurso |
StandalonePro Edition |
Standard Edition |
|
Caso de uso principal |
Desenvolvimento, testes e validação de recursos |
Ambientes de produção e aplicações em grande escala |
|
Arquitetura de implantação |
Implantação de processo único em uma única zona de disponibilidade |
Cluster distribuído com suporte a alta disponibilidade multizona |
|
Acordo de nível de serviço (SLA) |
O SLA da StandalonePro Edition é inferior ao da Standard Edition e não inclui garantia de disponibilidade de nível de produção. |
Oferece SLA de alta disponibilidade de nível de produção |
|
Escalabilidade |
Não permite dimensionamento horizontal; apenas o dimensionamento vertical é suportado |
Permite dimensionamento horizontal independente de recursos de computação e armazenamento |
|
Atualização de instância |
Não pode ser atualizada diretamente para a Standard Edition; requer migração de dados |
Permite atualizações contínuas no local dentro da Standard Edition |
Pré-requisitos
Tenha uma conta Alibaba Cloud. Caso ainda não tenha, conclua o registro primeiro. Para mais informações, consulte o processo de registro de conta Alibaba Cloud.
Na primeira compra, conceda ao Milvus as permissões necessárias para acessar os recursos de nuvem requeridos. Para mais informações, consulte Conceder funções a uma conta Alibaba Cloud.
Se utilizar um usuário RAM, certifique-se de que ele esteja autorizado. Para mais informações, consulte Conceder permissões a um usuário RAM.
Procedimento
-
Acesse a página do Milvus no Alibaba Cloud.
Faça login no console do Vector Retrieval Service for Milvus.
No painel de navegação à esquerda, clique em Instances.
-
Na página Instances, clique em Create Instance e configure os seguintes parâmetros.
Parâmetro
Descrição
Billing Method
Os métodos de faturamento por assinatura e pagamento conforme o uso são suportados.
Duration
Ao adquirir uma instância com faturamento por assinatura, a duração padrão é de um mês. As durações de compra disponíveis dependem do console.
Region
Localização física da instância.
ImportanteNão é possível alterar a região após a criação da instância. Proceda com cautela.
Network
-
Uma virtual private cloud (VPC) é um ambiente de rede isolado definido por você no Alibaba Cloud. Você tem controle total sobre sua VPC.
Selecione uma VPC existente ou clique em Go to Console to Create para criar uma nova. Para mais informações, consulte Criar e gerenciar uma VPC.
-
Um vSwitch é um componente básico de rede de uma VPC, utilizado para conectar diferentes recursos de nuvem.
Selecione um vSwitch existente ou clique em Go to Console to Create para criar um novo. Para mais informações, consulte Criar e gerenciar vSwitches.
Deployment Model
-
Single-zone: Adequado para ambientes de desenvolvimento e teste. Esta opção apresenta custos menores e implantação mais simples, mas não oferece recuperação de desastres entre zonas.
-
Multi-zone Deployment (Basic): Mantém apenas uma cópia dos recursos de computação. Requer tempo de recuperação em caso de falha, com RTO de até 1 hora. Esta opção é mais econômica.
-
Multi-zone Deployment (HA): Mantém duas cópias dos recursos de computação. Em caso de falha, os clusters primário e em espera podem alternar diretamente, com RTO de até 3 minutos.
Para mais informações sobre diferenças, cenários aplicáveis e arquitetura do Multi-zone Deployment (Basic) e Multi-zone Deployment (HA), consulte Comparação entre as edições básica e HA multizona.
Version
As versões 2.4, 2.5 e 2.6 são suportadas.
Instance Series
-
A Standard Edition é uma solução distribuída de recuperação vetorial projetada para aplicações empresariais e ambientes de produção em grande escala. Implantada como cluster multizona de disponibilidade, oferece SLA de alta disponibilidade de nível de produção e permite dimensionamento horizontal independente de recursos de computação e armazenamento. Esta edição é ideal para cenários de produção que exigem alta confiabilidade, alta concorrência e processamento de dados em grande escala.
-
A StandalonePro Edition é uma solução leve de recuperação vetorial voltada para desenvolvedores individuais e pequenas equipes. Implantada como processo único, não permite dimensionamento horizontal. Esta edição é adequada para desenvolvimento, aprendizado, validação de recursos e testes iniciais, mas não é recomendada para ambientes de produção.
Service Node
Este parâmetro é obrigatório ao criar uma instância da Standard Edition.
Responsável principalmente por processar solicitações do cliente e gerenciar o estado do cluster. Distribui as requisições de consulta para os nós de computação apropriados e coleta os resultados para retornar aos usuários. Também mantém os metadados do cluster para garantir o roteamento correto das solicitações para os nós de computação correspondentes.
-
Streaming Node: Responsável principalmente por gravações em tempo real e consumo incremental de dados.
Quando as gravações de dados são frequentes ou a latência entre a gravação e a disponibilidade para busca é crítica, recomendamos fortemente aumentar o número de nós ou atualizar as especificações para melhorar a capacidade de processamento de dados em tempo real.
-
Datanode: Responsável principalmente pela gravação, flush e gerenciamento de dados.
Caso os volumes de gravação de dados sejam grandes ou as importações frequentes, recomendamos fortemente aumentar o número de nós ou atualizar as especificações para melhorar a largura de banda geral de gravação e a estabilidade.
-
Proxy: Responsável principalmente por receber e rotear solicitações do cliente.
Se o número de conexões de clientes for alto ou houver muitas solicitações simultâneas, recomendamos fortemente aumentar o número de nós ou atualizar as especificações para melhorar a capacidade de ingestão e encaminhamento de requisições.
-
Metadata Service: Responsável pelo agendamento de recursos e coordenação de tarefas.
Quando o cluster é grande ou possui muitas partições de dados, recomendamos fortemente atualizar as especificações para garantir a estabilidade do agendamento.
Compute Node
Querynode: Responsável pela busca vetorial e filtragem.
Quando a utilização de memória exceder 70%, aumente o número de nós ou atualize as especificações para garantir o desempenho e a estabilidade das consultas. Para mais informações sobre nós, consulte Especificações de nós de computação e comparação de desempenho.
Data Replicas
Ative réplicas de dados melhora significativamente a disponibilidade do cluster. Recomendamos ativar este recurso para cargas de trabalho de produção.
Data Storage
O armazenamento redundante entre zonas é usado por padrão. O faturamento baseia-se na quantidade real de dados armazenados, e as taxas são cobradas por hora com base no espaço de armazenamento (GB) efetivamente utilizado.
Automatic Backup
ImportanteO uso do recurso de backup gera taxas de armazenamento. Para mais informações, consulte Itens faturáveis.
O recurso de backup automático vem ativado por padrão. Ele foi projetado para garantir a segurança dos dados das instâncias e assegurar o SLA. Se houver perda acidental de dados, utilize este recurso para restaurá-los.
NotaPara desativar este recurso, acesse a aba Backup Snapshot após a criação da instância. Para mais informações, consulte Backup e recuperação.
Password
Defina a senha da conta root (administrador) da instância do Milvus para fazer login no banco de dados.
NotaCaso esqueça a senha, consulte as Perguntas frequentes.
OSS Data Encryption
A criptografia de dados do OSS requer o Key Management Service (KMS). Acesse o console do KMS para ativar o serviço.
Resource Group
Selecione um grupo de recursos existente ou clique em Create Resource Group para criar um novo grupo dedicado. Os grupos de recursos permitem categorizar seus recursos de nuvem por finalidade, permissão e propriedade. Para mais informações, consulte O que é Resource Group?.
Tag
É possível vincular tags durante a criação da instância ou adicioná-las posteriormente. Isso ajuda a identificar e gerenciar os recursos da sua instância. Para mais informações sobre tags, consulte O que é Tag?.
-
-
Após confirmar as configurações, leia e selecione o acordo de serviço e clique em Create Instance.
A instância será criada quando seu status mudar para Running.