Este tópico descreve como criar e usar uma base de conhecimento RAGFlow com o Data Transmission Service (DTS).
Pré-requisitos
-
Crie um banco de dados vetorial que atenda aos seguintes requisitos:
Bancos de dados vetoriais compatíveis
Requisitos
AnalyticDB for PostgreSQL instância
-
Versão do mecanismo: 7,0 Standard.
-
Versão do kernel: Deve ser atualizada para 7.2.1.2 ou posterior.
-
Otimização do mecanismo vetorial: Deve estar ativada.
PolarSearch cluster
Um cluster PolarDB for MySQL com o recurso PolarSearch ativado.
Lindorm instância
O tipo de mecanismo deve incluir Search Engine e Vector Engine.
PolarDB for PostgreSQL cluster
O plug-in PGVector deve estar instalado.
-
Crie um bucket do OSS com classe de armazenamento Standard na mesma região do banco de dados vetorial. Para o tipo de redundância de armazenamento, recomendamos Zone-redundant Storage (Recommended).
Região: Este recurso está disponível apenas nas regiões China (Hangzhou), China (Shanghai), China (Beijing), China (Shenzhen), China (Hong Kong), Singapura e Indonésia (Jacarta).
Precauções
Não é possível desativar o endpoint público de uma base de conhecimento RAGFlow após a ativação.
Uma conta RAGFlow registrada é válida apenas para a base de conhecimento RAGFlow correspondente.
Faturamento
Para mais informações, consulte Faturamento para Preparação de Dados.
Procedimento
Criar uma base de conhecimento RAGFlow
-
Acesse a página da lista de bases de conhecimento RAGFlow da região de destino.
Faça login no console do Data Transmission Service (DTS).
No painel de navegação à esquerda, clique em Data Preparation.
No canto superior esquerdo, selecione a região onde reside a instância de preparação de dados.
Clique em RAGFlow knowledge base.
Clique em Create Knowledge Base para abrir a página de configuração da tarefa.
-
Configure a base de conhecimento RAGFlow.
Na seção Deployment Scope, insira um Instance Name para a base de conhecimento RAGFlow.
Na seção Network and Zone, selecione uma VPC, uma Primary Zone and vSwitch e uma Secondary Zone and vSwitch para a base de conhecimento RAGFlow.
-
Na seção RAGFlow Knowledge Base Configuration, insira o Number of Knowledge Base Services.
NotaNeste exemplo, o Configuration Plan permanece como Default.
-
Na seção Vector Database Configuration, configure o banco de dados vetorial.
NotaSe selecionar Import from Existing Instance, insira o Database Name, Database Schema Name e Database Account da instância existente.
ADB PostgreSQL
Defina Engine como AnalyticDB for PostgreSQL. No campo Database, selecione a instância de destino do AnalyticDB for PostgreSQL e insira o Database Name, Database Schema Name, Database Account e Password dessa instância.
PolarSearch
Defina Engine como PolarSearch. No campo Database, selecione um cluster PolarDB for MySQL com PolarSearch ativado e insira o Database Account e Password desse cluster.
PolarDB PostgreSQL
Defina Engine como PolarDB PostgreSQL. No campo Database, selecione o cluster de destino do PolarDB for PostgreSQL e insira o Database Name, Database Schema Name, Database Account e Password desse cluster.
Lindorm
Defina Engine como Lindorm. No campo Database, selecione a instância Lindorm de destino e insira o Database Account e Password dessa instância.
Na seção OSS Configuration, selecione o bucket de destino e insira o caminho de armazenamento de dados.
Após concluir a configuração, clique em Buy Now no lado direito da página.
-
Retorne à página da lista de bases de conhecimento RAGFlow e aguarde a inicialização da instância. O Status muda para Running.
NotaClique em
no canto superior direito para visualizar o status mais recente da base de conhecimento RAGFlow.
Configurar uma lista de permissões de IP
Na coluna Actions da base de conhecimento RAGFlow desejada, clique em Set up a white list.
-
No painel Set up a white list, adicione endereços IP à lista de permissões conforme o método de acesso.
Método de Acesso
Cenário de Exemplo
Lista de permissões de IP
Descrição
Rede interna
O cliente e a base de conhecimento RAGFlow estão na mesma VPC.
Endereço IP privado ou bloco CIDR do cliente.
-
Separe vários endereços IP ou blocos CIDR com vírgulas (,).
-
Para obter o endereço IP público do cliente, execute o comando
curl ipinfo.io/ip(recomendado) oucurl ifconfig.me.
Internet
O cliente está em seu servidor local.
Endereço IP público ou bloco CIDR do cliente.
-
Clique em Yes.
Fazer login no RAGFlow
-
Na coluna Actions da base de conhecimento RAGFlow desejada, clique em Manage.
NotaVocê também pode clicar em Actions na coluna Login to Knowledge Base e escolher fazer login pela rede interna ou pela internet.
-
Na seção Endpoint, clique em Login external network address ou Login Intranet Address.
NotaPara acessar a base de conhecimento RAGFlow pela internet, ative o endpoint público da instância.
Na página de login, insira o endereço de e-mail e a senha da sua conta e clique em Login.
-
Na página do RAGFlow, gerencie bases de conhecimento e execute outras operações.
NotaPara mais informações, consulte a documentação oficial do RAGFlow.
(Opcional) Configuração de rede
Por padrão, o RAGFlow não acessa redes externas. Para adicionar provedores de modelos no RAGFlow, configure um gateway NAT na VPC que hospeda o banco de dados vetorial usado pelo RAGFlow. Isso permite que a base de conhecimento RAGFlow acesse modelos externos.
-
Conectar via rede privada (Alibaba Cloud Model Studio)
O acesso ao Alibaba Cloud Model Studio por rede privada aumenta a segurança e a eficiência da transferência de dados. Use o PrivateLink para estabelecer uma conexão de rede entre sua VPC e o Alibaba Cloud Model Studio. Para instruções detalhadas, consulte Acessar modelos do Model Studio e APIs de aplicativos via rede privada.
-
Conectar via internet
Configure um gateway NAT na VPC que hospeda o banco de dados vetorial usado pelo RAGFlow para permitir o acesso a modelos externos. Para mais informações sobre gateways NAT, consulte Gateway NAT público.
Apêndice
Preparar um par de AccessKey
-
Acesse a página RAM Users para criar um usuário RAM.
Clique em Create User.
-
Defina o Logon Name.
Por exemplo, insira dts_testuser.
Para Access Mode, selecione Programmatic Access.
Clique em OK.
Após criar o usuário RAM, salve o AccessKey ID e o AccessKey secret.
-
Conceda permissões ao usuário RAM.
Retorne à página RAM Users. Na coluna Actions do usuário RAM desejado, clique em Add Permissions.
Selecione a política AliyunOSSFullAccess.
Clique em OK.
Após conceder a permissão, clique em Close.
Ativar o endpoint público
Na coluna Actions da base de conhecimento RAGFlow desejada, clique em Manage.
Na seção Endpoint, clique em Open external network address.
Na caixa de diálogo Open external network address exibida, clique em OK.
Aguarde a ativação do endpoint público. O Status na seção Basic Information muda para Running.
Registrar uma conta RAGFlow
Acesse a página de login do RAGFlow da base de conhecimento RAGFlow desejada.
Na página de login do RAGFlow, clique em Register.
Insira o endereço de e-mail, o nome e a senha da conta.
-
Clique em Continue.
Uma mensagem
aparece na parte superior da página indicando que a conta foi registrada com sucesso.