Visão geral
O DashVector foi desenvolvido com base no núcleo do mecanismo vetorial Proxima da Alibaba Cloud. Ele fornece serviços eficientes de recuperação vetorial totalmente gerenciados em uma arquitetura cloud-native e pode ser escalado horizontal e verticalmente para atender às necessidades do negócio. O DashVector fornece avançados recursos de gerenciamento e recuperação vetorial por meio de APIs e SDKs simples, permitindo integrá-lo facilmente à aplicativos em diversos cenários, como perguntas e respostas inteligentes e pesquisa multimodal.
Como funciona
-
Aplicativos
Aplicativos de diversos cenários, como pesquisa multimodal, perguntas e respostas inteligentes e serviços baseados em LLM, podem ser integradas ao DashVector por meio de APIs de baixo código e SDKs simples.
-
DashVector
Com base na arquitetura cloud-native, o DashVector pode ser implantado em vários clusters e regiões, permitindo ajustar a capacidade e o desempenho do serviço (como o QPS) escalando os clusters e os serviços (searchers) para responder com flexibilidade às mudanças do negócio. Você pode gerenciar e configurar o serviço de pesquisa vetorial (como clusters, coleções, chaves de API etc.) no console do DashVector. Fornecemos SDKs para as principais linguagens de programação para que você possa começar rapidamente com pouco código.
-
Infraestrutura em nuvem
A Alibaba Cloud fornece recursos robustos de computação, armazenamento e rede, além de serviços avançados de processamento de dados e gerenciamento de contêineres, para oferecer suporte a uma arquitetura flexível, confiável e cloud-native.
Benefícios
-
Serviço totalmente gerenciado
Integre rapidamente um serviço totalmente gerenciado de recuperação vetorial cloud-native ao seu negócio, com baixos custos de O&M em uma arquitetura serverless, pagando apenas pelo consumo de dados
-
Desenvolvido para pesquisa vetorial
Atenda a diversas necessidades de pesquisa em diferentes cenários de negócios com recursos avançados que oferecem suporte a filtragem condicional, particionamento de dados, diferentes tipos de pesquisa, recuperação de dados multimodais e muito mais
-
Equilíbrio entre escala e desempenho
Ajuste de forma flexível a capacidade do serviço e o QPS de acordo com as necessidades do seu negócio escalando clusters ou serviços de pesquisa em etapas simples para alcançar o equilíbrio entre escala, precisão e desempenho
-
Pouco código
Comece facilmente a gerenciar e pesquisar dados vetoriais com APIs fáceis de usar que exigem pouca codificação e SDKs prontos para uso
Características
Serviços totalmente gerenciados de recuperação vetorial na nuvem
Pesquisa altamente precisa e eficiente
O DashVector integra o mecanismo de pesquisa vetorial Proxima da Alibaba Cloud, que fornece algoritmos de alto desempenho para realizar pesquisas de baixa latência em grandes volumes de dados.
Baixos custos de O&M
O serviço de pesquisa vetorial totalmente gerenciado e cloud-native, com escalabilidade horizontal e vertical, reduz os custos de O&M, permitindo que você se concentre apenas nas necessidades do seu negócio, sem se preocupar com a infraestrutura subjacente.
Design minimalista do SDK
APIs de baixo código e SDKs fáceis de usar oferecem suporte à rápida integração com aplicativos de IA em diversos cenários de negócios.
Indexação em tempo real de dados vetoriais
Indexação com dados em streaming
O DashVector adota uma arquitetura de índice plano e oferece suporte à indexação online de grandes volumes de dados em streaming desde o início.
Atualização online em tempo real
Quando dados vetoriais são adicionados, excluídos ou modificados, o status dos vetores entra em vigor imediatamente. Os dados vetoriais são verificados imediatamente após serem adicionados e gravados em discos rígidos em tempo real. Status dos dados vetoriais atualizado em tempo real.
Indexação rápida de grandes volumes de dados
O DashVector otimiza a estrutura e o método de carregamento dos índices de diversas maneiras e oferece suporte à importação de dados vetoriais em larga escala com dimensões de 2 a 20.000.
Pesquisa filtrada
Esquema personalizável
Para pesquisas com filtros, o DashVector utiliza campos predefinidos para proporcionar maior velocidade de recuperação e menor consumo de recursos computacionais.
Pesquisa filtrada com múltiplas expressões
Você pode realizar pesquisas combinadas utilizando operadores de comparação, lógica e texto, incluindo "<", "<=", "=", "!=", ">=", ">", "and", "or" e "like".
Vetor esparso
Pesquisa por palavras-chave e pesquisa híbrida
Você pode realizar pesquisas por palavras-chave, pesquisas vetoriais ou pesquisas híbridas (palavra-chave + vetor) com o DashVector, que oferece suporte tanto a vetores esparsos quanto a vetores densos para equilibrar semântica e palavras-chave.
Gerador de vetores esparsos
Recomendamos utilizar o DashText do DashVector para codificação de vetores esparsos. O DashText utiliza o algoritmo BM25 para converter texto bruto em dados vetoriais esparsos, simplificando significativamente o processo de pesquisa vetorial baseada em palavras-chave.
Cenários
Você pode usar as APIs do DashVector para criar rapidamente serviços de pesquisa semântica do zero com base em indexação de texto e recursos de pesquisa vetorial para oferecer suporte a aplicativos de IA generativa, como o Qwen. Esses aplicativos podem gerar conteúdo baseado em texto (incluindo tradução, reescrita, resumo etc.), escrever código e realizar interpretação de papéis.
Benefícios
-
Altamente eficiente
Você pode adicionar, excluir, pesquisar e modificar dados vetoriais em tempo real, além de realizar sincronização incremental ou completa de dados provenientes de várias fontes.
-
Rápido e preciso
Você pode realizar pesquisas filtradas utilizando combinações de diversos operadores e personalizar campos de dados compatíveis com o design Schema Free para acelerar o processo de pesquisa vetorial.
O DashVector abstrai arquivos individuais de imagens, vídeos e textos em características vetoriais de alta dimensão e, em seguida, constrói um índice vetorial eficiente com base em todas essas características. Os usuários precisam apenas inserir texto ou fazer upload de fotos ou vídeos para pesquisar arquivos semelhantes. Esse serviço de pesquisa multimodal melhora significativamente a experiência do usuário.
Benefícios
-
Flexível
Você pode definir várias coleções e partições para os dados e gerenciá-los facilmente
-
Sem esquema
Você pode personalizar campos de dados para aumentar a flexibilidade e a precisão da pesquisa vetorial.
-
Prático
Você pode configurar rapidamente um serviço de pesquisa multimodal por meio de APIs de baixo código e SDKs fáceis de usar.
Você pode combinar os serviços do DashVector com Large Language Models (LLMs) para criar sistemas de perguntas e respostas baseados em conhecimento específico de um domínio. Primeiro, converta tanto a entrada do usuário quanto o conteúdo da base de conhecimento em vetores de alta qualidade. Em seguida, transforme o processo de correspondência em uma pesquisa semântica com o DashVector para extrair o conhecimento relevante com mais precisão e eficiência. Por meio de prompts apropriados, esse serviço compreende a intenção do usuário e fornece respostas com informações da base de conhecimento.
Benefícios
-
Cloud-native
A arquitetura cloud-native separa os recursos de computação dos recursos de armazenamento, permitindo aumentar a capacidade e escalar horizontalmente com facilidade.
-
Fácil de integrar
Você pode integrar bases de conhecimento específicas do seu domínio ao DashVector para fornecer serviços precisos de perguntas e respostas.
-
Ampla cobertura
O Vector Retrieval Service oferece suporte à recuperação rápida de dados vetoriais em larga escala para aumentar a precisão da pesquisa vetorial.
Em cenários como pesquisa inteligente e envio de anúncios, informações dos usuários, como histórico de compras, são transformadas em dados vetoriais, e o DashVector pesquisa informações relevantes de produtos com base na similaridade em bancos de dados vetoriais para recomendá-las a potenciais compradores, aumentando a taxa de conversão e melhorando a experiência do usuário.
Benefícios
-
Alta compatibilidade
O Vector Retrieval Service oferece suporte a uma ampla variedade de tipos de dados e diversos métodos de pesquisa.
-
Alto desempenho
O mecanismo de pesquisa vetorial da DAMO Academy para dados vetoriais e textuais em larga escala, combinado com a arquitetura de alta disponibilidade da Alibaba Cloud, oferece alto desempenho para diversos cenários de pesquisa.
-
Personalizável
Você pode personalizar a distância de pesquisa e definir valores-limite de similaridade (os dados vetoriais com similaridade superior ao valor-limite serão filtrados).
Inicie o DashVector em 5 etapas simples
