Uma base de conhecimento complementa um LLM com dados privados e informações atualizadas. Por meio da geração aumentada por recuperação (RAG), o LLM melhora a precisão das respostas ao recuperar primeiro o conteúdo relevante da base de conhecimento antes de gerar uma resposta.
O recurso de base de conhecimento está disponível apenas na região China (Beijing), não estando presente em outras regiões como Singapore e Germany (Frankfurt).
-
Restrições de acesso ao console: Apenas usuários que criaram aplicações do Alibaba Cloud Model Studio na região de Singapore antes de 21 de abril de 2025 podem acessar a aba Application Development.
Esta aba contém os seguintes recursos: Applications ( agent application e workflow application ), Components ( prompt engineering e plug-in ) e Data ( knowledge base e application data ). Todos estes são recursos de prévia. Use-os com cautela em ambientes de produção.
Restrições de chamada de API: Apenas usuários que criaram aplicações do Alibaba Cloud Model Studio na região de Singapore antes de 21 de abril de 2025 podem chamar as APIs de dados de aplicação, base de conhecimento e engenharia de prompt.
|
Aplicação sem base de conhecimento dedicada Sem uma base de conhecimento dedicada, um LLM não consegue responder com precisão a perguntas específicas de domínio. Por exemplo, quando um usuário envia "Por favor, ajude-me a escolher o melhor celular com câmera do Alibaba Cloud Model Studio, com orçamento de 3.000 yuans" na interface de chat, o assistente de IA não pode fornecer recomendações precisas de produtos devido à falta de uma base de conhecimento relevante. |
Aplicação com base de conhecimento dedicada Com uma base de conhecimento dedicada, um LLM responde com precisão a perguntas específicas de domínio.
|
Modelos suportados
Os modelos a seguir podem ser usados com uma base de conhecimento. Configurar o Qwen para usar uma base de conhecimento
Qwen-Max/Plus/Turbo
QwenVL-Max/Plus
Versão open-source do Qwen (por exemplo, Qwen2,5)
Para obter uma lista atualizada dos modelos disponíveis, consulte a página Application Management ao criar uma aplicação.
Início rápido
Este guia de início rápido mostra como criar uma aplicação de perguntas e respostas com LLM sem código para responder a questões específicas de domínio, usando "celulares do Alibaba Cloud Model Studio" como exemplo.
1. Criar uma base de conhecimento
Acesse a página Knowledge Base e clique em Create Knowledge Base. Insira um Name e uma Description, mantenha as demais configurações com os valores padrão e clique em Next Step.
Selecione a Default Category e faça upload do arquivo Alibaba Cloud Model Studio Phone Series Product Introduction.docx. Clique em Next Step e, em seguida, clique em Complete.
2. Integrar com aplicações empresariais
Após criar uma base de conhecimento, associe-a a uma aplicação do Alibaba Cloud Model Studio ou a uma aplicação externa dentro do mesmo workspace para processar solicitações de recuperação.
Agent application
Acesse a página App Center, localize sua agent application, clique em Configure no cartão correspondente e selecione um modelo para a aplicação.
-
Clique no ícone + ao lado de Document Knowledge Base para adicionar a base de conhecimento recém-criada. Mantenha os valores padrão para o limiar de similaridade e peso.
-
Na caixa de entrada à direita, insira uma pergunta. O LLM usará a base de conhecimento para gerar uma resposta.
Por exemplo: "Ajude-me a escolher o celular do Alibaba Cloud Model Studio com a melhor câmera por menos de 3.000 CNY."
Workflow application
Acesse a página App Center, localize sua workflow application e clique em Configure no cartão correspondente. Arraste um nó Knowledge Base para o canvas e conecte-o após o nó Start.
-
Configure o nó Knowledge Base:
Input: Na lista suspensa Value à direita da variável
content, selecione . A lista suspensa possui estrutura de árvore; talvez seja necessário expandir o grupo "Built-in Variable" para selecionar a variável query.-
Select Knowledge Base: Selecione uma base de conhecimento para o nó de duas maneiras possíveis.
Selecionar uma base de conhecimento fixa: Escolha a base de conhecimento criada na etapa anterior no menu suspenso. Utilize este método quando a mesma base de conhecimento for necessária para cada chamada.
Seleção dinâmica: Configure a variável
CodeListpara especificar dinamicamente uma base de conhecimento com base na saída de um nó upstream. Indicado para cenários onde é preciso recuperar diferentes bases de conhecimento conforme entradas distintas.
-
Definir TopK (Opcional): Esta configuração determina o número de trechos retornados aos nós downstream, que geralmente são nós LLM.
Aumentar este valor normalmente melhora a precisão das respostas do LLM, mas também eleva o consumo de tokens de entrada.
Arraste um nó LLM para o canvas e conecte-o após o nó Knowledge Base e antes do nó End.
-
Configure o nó LLM:
Na lista Model configuration, selecione um modelo para o nó.
-
No campo Prompt, insira um prompt que instrua o LLM a usar a base de conhecimento. Digite "/" para inserir a variável
result(que representa os resultados retornados pela recuperação da base de conhecimento).Por exemplo, insira o título do prompt como
# Knowledge Basee o corpo comoPlease remember the following materials {Knowledge Base 1/result}, they may be helpful for answering questions.
Configure o nó End: Insira
/e selecione para emitir o resultado do LLM.-
Clique em Test no canto superior direito da página. Na caixa de entrada à direita, insira uma pergunta. O LLM utilizará a base de conhecimento para gerar uma resposta.
Por exemplo: "Ajude-me a escolher o celular do Alibaba Cloud Model Studio com a melhor câmera por menos de 3.000 CNY."
External application
Além de criar aplicações dentro do Alibaba Cloud Model Studio, utilize o Model Studio SDK para recuperar dados de uma base de conhecimento destinada a aplicações externas de IA.
Para etapas detalhadas de integração, consulte o Guia da API da Base de Conhecimento.
3. Otimizar o desempenho de RAG (Opcional)
Caso receba resultados incompletos ou imprecisos durante o processo de perguntas e respostas, consulte Otimização de desempenho de RAG.
Guia prático
Na página de base de conhecimento, visualize e gerencie todas as bases de conhecimento no workspace atual.
ID da base de conhecimento: O ID de cada base de conhecimento, utilizado para chamadas de API.
Criar uma base de conhecimento
Ao clicar em Create Knowledge Base, crie a base de conhecimento em três etapas: forneça informações básicas e selecione um tipo de base de conhecimento, configure uma fonte de dados e defina parâmetros de índice.
Na página de base de conhecimento, clique em Create Knowledge Base.
-
Informações básicas
Selecione um Knowledge Base Type conforme seu caso de uso. Uma única base de conhecimento suporta apenas um tipo. Se escolher o tipo document search, selecione também um caso de uso: Basic document Q&A, Rich-text Reply.
Basic document Q&A: Ideal para busca semântica em documentos de texto simples.
Rich-text Reply: Recomendado para casos de uso que exigem respostas contendo texto e imagens.
Não é possível alterar o tipo da base de conhecimento após sua criação.
-
Document search
-
Casos de uso:
Projetado para recuperar informações de dados não estruturados, como documentos corporativos internos e manuais de produtos. Dados não estruturados são informações não organizadas em um modelo ou esquema predefinido, podendo incluir texto, tabelas e imagens.
Se seus arquivos contiverem imagens que devem ser incluídas nas respostas da aplicação, selecione document search.
-
Fonte de dados: Faça upload de arquivos locais ou importe-os do Object Storage Service (OSS).
-
-
Data query
-
Casos de uso:
Ideal para construir sistemas de Q&A baseados em dados estruturados (dados organizados de acordo com um esquema de tabela predefinido), como assistentes para consultar FAQs, dados de produtos ou informações de pessoal.
-
Se seus dados consistem em pares completos de perguntas e respostas de FAQ, selecione Data Query. Por exemplo, se um arquivo Excel contiver duas colunas,
QuestioneAnswer, uma base de conhecimento Data Query pode usar a colunaQuestionpara recuperação e a colunaAnswercomo contexto para a resposta do LLM.Este processamento específico por coluna não está disponível no tipo de base de conhecimento de busca de documentos.
É possível importar vários arquivos Excel, mas seus esquemas de tabela devem ser idênticos.
-
Integração de fonte de dados: Faça upload de arquivos XLS ou XLSX locais .
-
-
Q&A de Imagens
-
Casos de uso:
Ideal para construir aplicações de recuperação multimodal que suportam busca por imagem e busca por imagem mais texto, como assistentes de descoberta de produtos ou assistentes de Q&A visual.
-
Integração de fonte de dados: Faça upload de arquivos XLS ou XLSX locais .
Arquivos XLS e XLSX devem conter URLs de imagens publicamente acessíveis para criar índices de imagem. Para detalhes, veja as instruções de criação abaixo.
-
Selecione um caso de uso com base em seus requisitos, como Q&A Básica de Documentos, Resposta Rich-text.
Durante horários de pico, a criação da base de conhecimento pode levar várias horas, dependendo do volume de dados.
Atualizar uma base de conhecimento
As alterações em uma base de conhecimento são sincronizadas em tempo real com todas as aplicações que a referenciam.
Busca de documentos
-
Atualização automática (recomendada)
Configure atualizações automáticas integrando OSS, FC e as APIs da base de conhecimento do Model Studio. Siga estas etapas:
Criar um bucket: Acesse o console do OSS e crie um bucket do OSS para armazenar seus arquivos source.
Criar uma base de conhecimento: Crie uma base de conhecimento não estruturada para armazenar seu conteúdo privado.
Criar uma função definida pelo usuário: Acesse o console do FC e crie uma função para lidar com eventos de alteração de arquivos, como criação e exclusão de arquivos. Para mais informações, consulte Criar uma função. A função chama as APIs relevantes do Guia da API da Base de Conhecimento para sincronizar sua base de conhecimento com as alterações de arquivos no OSS.
Criar um gatilho do OSS: No FC, associe um gatilho do OSS à função definida pelo usuário criada na etapa anterior. Quando ocorrer um evento de alteração de arquivo, como o upload de um novo arquivo para o OSS, o gatilho executa a função no FC.
-
Atualização manual
Na página Base de Conhecimento, localize a base de conhecimento que deseja atualizar e clique em View Details em seu cartão.
Para adicionar novos arquivos: Clique em Upload Data e selecione arquivos existentes no conector de dados.
Para excluir um arquivo: Localize o arquivo que deseja remover e clique em Delete à sua direita.
-
Para modificar o conteúdo do arquivo: Não há suporte para atualizações no local e uploads de substituição. Exclua primeiro a versão antiga do arquivo da base de conhecimento e, em seguida, importe a nova versão.
Observação: Falhar em excluir a versão antiga pode fazer com que conteúdo desatualizado apareça nas respostas.
Consulta de dados e Q&A de imagens
Observação : A página de detalhes de uma base de conhecimento de Q&A de imagens não possui um botão direto de Upload Data . Clique no link View Data Source para abrir a página de detalhes do conector de dados e atualizar os dados.
-
Atualização automática
Não suportado.
-
Atualização manual
Se a fonte de dados da sua base de conhecimento for uma tabela de dados em Dados da Aplicação, atualize-a manualmente em duas etapas.
-
Etapa 1: Atualizar a tabela de dados
Acesse a aba Dados da Aplicação. No painel à esquerda, selecione a tabela de dados alvo e clique em Upload Data.
-
Para inserir novos dados: Selecione Incremental Upload como tipo de importação. Faça o upload de um arquivo Excel que contenha apenas a linha de cabeçalho e as novas linhas de dados.
O cabeçalho do arquivo deve corresponder ao esquema atual da tabela. Clique em Download Template para obter um arquivo de modelo com o cabeçalho padrão e, em seguida, adicione seus novos dados a ele.
-
Para excluir dados: Selecione Upload and Overwrite como tipo de importação. Faça o upload de um arquivo Excel que contenha a linha de cabeçalho e apenas os registros de dados que deseja manter.
Para obter o conjunto de dados completo, clique no ícone
para baixar os dados no formato XLSX. Para modificar dados: Selecione Upload and Overwrite como tipo de importação. Faça o upload de um arquivo Excel que contenha a linha de cabeçalho e o conjunto de dados completo e modificado.
-
-
Etapa 2: Sincronizar as alterações com a base de conhecimento
Retorne à lista de Base de Conhecimento, localize a base de conhecimento alvo e clique em View Details em seu cartão. Clique no ícone
no canto superior esquerdo da tabela de dados e confirme o prompt para sincronizar o conteúdo mais recente da tabela de dados com a base de conhecimento.Repita essas etapas para cada atualização manual.
-
Busca de áudio e vídeo
-
Atualização automática
Não suportado.
-
Atualização manual
Na página Base de Conhecimento, localize uma base de conhecimento que deseja atualizar e clique em View Details em seu cartão.
Para adicionar novos arquivos: Clique em Upload Data e selecione arquivos existentes em Dados da Aplicação.
-
Para excluir um arquivo: Localize o arquivo que deseja remover e clique em Delete à sua direita.
Esta ação remove o arquivo apenas da base de conhecimento. Ela não exclui o arquivo source em Dados da Aplicação .
-
Para modificar o conteúdo do arquivo: Não há suporte para atualizações no local e uploads de substituição. Exclua primeiro a versão antiga do arquivo da base de conhecimento e, em seguida, importe a nova versão.
Observação: Falhar em excluir a versão antiga pode fazer com que conteúdo desatualizado apareça nas respostas.
Editar base de conhecimento
Após criar uma base de conhecimento, modifique apenas seu nome da base de conhecimento, descrição da base de conhecimento e limiar de similaridade. Para alterar quaisquer outras configurações, exclua e recrie a base de conhecimento. Esta operação está disponível apenas no console e não possui uma API correspondente.
Procedimento: Na página Base de Conhecimento, localize a base de conhecimento alvo, clique no ícone
em seu cartão e, em seguida, clique em Edit. Observação: Modifique a configuração de uma base de conhecimento apenas uma vez por dia civil. Tentativas subsequentes serão rejeitadas silenciosamente.
Excluir uma base de conhecimento
Esta ação é irreversível.
Antes de excluir uma base de conhecimento, recomendamos desassociá-la de todas as aplicações do Model Studio publicadas.
Ainda é possível excluir uma base de conhecimento associada a aplicações não publicadas.
Alterar configuração
A Enterprise Edition usa RCUs para garantir alto desempenho de recuperação com alto QPS e suporta maior capacidade de armazenamento. A Standard Edition é adequada para desenvolvimento, testes ou cenários de baixa concorrência.
Alterne entre a Standard Edition e a Enterprise Edition e modifique a contagem de RCU para a Enterprise Edition.
Altere a configuração de uma base de conhecimento apenas uma vez por dia civil.
RCU: Uma Unidade de Computação de Recuperação (RCU) é uma medida da concorrência de recuperação para uma base de conhecimento. 1 RCU suporta até aproximadamente 50 QPS para recuperação online. Uma contagem maior de RCU suporta maior concorrência.
-
Observação:
-
Se uma base de conhecimento Enterprise Edition usar o armazenamento da plataforma, reduza seu espaço de armazenamento utilizado para abaixo de 80 GB antes de fazer o downgrade para a Standard Edition.
Libere espaço de armazenamento excluindo arquivos ou dados da base de conhecimento.
-
-
Procedimento:
Na página Base de Conhecimento, localize a base de conhecimento a ser reconfigurada. Clique no ícone
em seu cartão e, em seguida, clique em Edit.-
Na caixa de diálogo, selecione uma ação com base na edição atual:
Standard Edition: Selecione Upgrade.
Enterprise Edition: Selecione Downgrade ou Change RCU Count.
Siga as instruções na tela para concluir o processo. A nova configuração entra em vigor imediatamente após clicar em OK.
Teste de acerto
Utilize testes de acerto para verificar se sua base de conhecimento fornece contexto preciso para sua aplicação de IA. Esse processo envolve simular consultas de usuários, avaliar resultados de recuperação e ajustar o limiar de similaridade.
O modelo de reranking no teste de acerto suporta três modos: Modo Q&A (padrão), projetado para consultas que não correspondem perfeitamente ao conteúdo do documento; modo de similaridade, ideal para consultas altamente semelhantes ao conteúdo do documento; e modo avançado personalizado. As pontuações de classificação para a mesma consulta podem variar significativamente dependendo do modo selecionado. Por exemplo, o mesmo segmento de texto pode pontuar 47% no modo Q&A, mas até 69% no modo de similaridade.
Com o teste de acerto, você pode:
Verificar se a base de conhecimento fornece contexto eficaz para sua aplicação de IA
Ajustar o limiar de similaridade para equilibrar taxa de recuperação e precisão
Identificar lacunas de conteúdo ou problemas de qualidade em sua base de conhecimento
Casos de uso
-
Cenário 1: Consultar preços de produtos
Test input: "How much does your Model Studio phone cost?" Expected result: Retrieve relevant text segments that contain price information. -
Cenário 2: Solucionar um problema técnico
Test input: "What should I do if my device can't connect to Wi-Fi?" Expected result: Retrieve relevant text segments about troubleshooting Wi-Fi connection issues. -
Cenário 3: Recuperação com compreensão visual
A visual understanding knowledge base supports three query modes: text-only, image-only, and image+text. Mode 1 (text-only): Enter "Object Storage Service" to retrieve relevant segments from documents and images. Mode 2 (image-only): Upload a product screenshot. The system uses visual understanding to match semantically similar segments. Mode 3 (image+text): Upload an image and enter descriptive text. This combined query can improve retrieval relevance. -
Cenário 4: Q&A Expressa
An Express Q&A knowledge base supports text-only queries (image input is not supported) and is ideal for fast retrieval from structured documents: Test input: "What is the price of the Qwen Pro 8?" Expected result: Quickly retrieve relevant FAQ segments that include price information.
Procedimento
Na página de base de conhecimento, clique em Hit Test no cartão da base de conhecimento alvo.
-
Na interface de teste, insira uma pergunta — idealmente uma comum entre seus usuários — e revise os resultados da recuperação.
Resultados da recuperação: Esta seção exibe os resultados da recuperação do teste atual, classificados por similaridade em ordem decrescente. Clique em qualquer segmento de texto para visualizar seu conteúdo.
Ícone: Para uma base de conhecimento de Q&A de imagens, o sistema primeiro converte a imagem de entrada em um vetor e recupera segmentos relevantes. Em seguida, envia esses segmentos junto com a pergunta para um LLM gerar uma resposta. Para bases de conhecimento de busca de documentos, consulta de dados , o sistema não usa a imagem carregada para recuperação. No entanto, uma base de conhecimento de busca de documentos configurada para "compreensão visual" usa a imagem para recuperação, suportando modos de consulta apenas texto, apenas imagem e imagem+texto. Essa consulta combinada pode melhorar a relevância da recuperação.
Verifique se os segmentos de texto relevantes foram recuperados. Caso contrário, ajuste o limiar de similaridade e repita a etapa anterior.
Clique em View Recall History para comparar o desempenho de recuperação entre diferentes configurações de limiar.
Cotas e limites
Para informações sobre fontes de dados suportadas, capacidade e outros limites para uma base de conhecimento, consulte Cotas e limites da base de conhecimento.
-
Os seguintes limites se aplicam ao associar bases de conhecimento a uma aplicação do Model Studio:
Busca de documentos: Até 5
Consulta de dados: Até 5
Q&A de Imagens: Até 1
O limite total entre vários tipos de base de conhecimento é 11.
Faturamento
O uso do recurso de base de conhecimento é gratuito, mas podem ser aplicadas cobranças ao chamar uma aplicação do Alibaba Cloud Model Studio que utilize esse recurso.
|
Etapa |
Faturamento |
|
|
|
Gratuito. |
|
|
|
Ao chamar uma aplicação do Alibaba Cloud Model Studio, os trechos de texto recuperados da base de conhecimento aumentam a contagem de tokens de entrada do LLM, o que eleva as taxas de inferência do modelo. Para mais informações, consulte Itens faturáveis e preços. Nota: Não há cobrança se você utilizar apenas a Retrieve API para recuperação, sem usar uma aplicação do Alibaba Cloud Model Studio para gerar uma resposta. |
|
|
|
Gratuito. |
|
Referência da API
Consulte o diretório de APIs (Base de Conhecimento) para obter a lista completa de APIs da base de conhecimento e seus parâmetros.
Veja o guia da API da Base de Conhecimento para instruções detalhadas de uso e exemplos de código.




