Todos os produtos
Search
Central de documentação

DataWorks:Criar uma base de conhecimento

Última atualização: Sep 06, 2026

O Context Graph (base de conhecimento) é um módulo independente do DataWorks para gerenciamento unificado de conhecimento. Ele descobre automaticamente a semântica dos dados, integra conhecimentos de negócios de múltiplas fontes e constrói uma rede de conhecimento unificada e governável. Após criar uma base de conhecimento, você pode compilar informações de workspaces, fontes de dados e arquivos enviados, além de controlar o escopo de uso por meio de administradores e autorizações de compartilhamento. Uma base de conhecimento compilada com sucesso pode ser utilizada pelo AI Assistant e pelo Data Agent.

Visão geral

O Context Graph (base de conhecimento) é o módulo de gerenciamento unificado de conhecimento do DataWorks. Ele fornece uma base unificada para aplicações inteligentes, como Data Agent e AI Assistant. O sistema organiza informações dispersas em metadados de workspace, fontes de dados e documentos de negócios em um conhecimento navegável, pesquisável e controlado por autorização. Isso permite que as aplicações inteligentes mantenham um contexto de negócios consistente durante sessões de perguntas e respostas, recuperação de dados e análises.

As bases de conhecimento são gerenciadas como instâncias independentes. Uma única base pode ser reutilizada por várias aplicações inteligentes, eliminando a necessidade de construção redundante em cada aplicação.

Principais capacidades e casos de uso

  • Construção automática de conhecimento de metadados: Examina workspaces do DataWorks e compila automaticamente conhecimentos de domínio de negócios e semântica para metadados, como tabelas, campos, tarefas, métricas e linhagem.

  • Geração e gerenciamento de modelos semânticos: Gera modelos semânticos baseados em fontes de dados que descrevem entidades de negócios, dimensões, métricas e seus relacionamentos, unificando as definições de negócios.

  • Integração de documentos de negócios de múltiplas fontes: Permite o envio de documentos, planilhas, páginas da web, imagens e outros arquivos para incluir materiais não estruturados — como políticas, manuais de products e dicionários de dados — na pesquisa unificada.

  • Capacitação de aplicações inteligentes: Serve como base de conhecimento para o Data Agent e o AI Assistant, permitindo que compreendam termos de negócios e forneçam respostas mais precisas durante perguntas e respostas em linguagem natural, exploração de dados e geração de código.

  • Atualizações automatizadas e autorização unificada: Mantém o conhecimento sincronizado por meio de tarefas de compilação agendadas e controla o escopo de uso através de autorizações refinadas.

Relação com o AI Assistant e o Data Agent

O Context Graph (base de conhecimento) é um módulo independente. No painel de navegação à esquerda do console do DataWorks, ele está no mesmo nível do Data Agent e do AI Assistant. Crie e gerencie instâncias de base de conhecimento neste módulo. As bases criadas no Context Graph (base de conhecimento) podem ser utilizadas no AI Assistant e no Data Agent.

Se você criou bases de conhecimento anteriormente no AI Assistant, as bases existentes serão exibidas como bases de conhecimento locais na interface. Novas instâncias do AI Assistant Service não suportam mais a criação de bases de conhecimento locais. Para criar uma base de conhecimento, acesse o Context Graph (base de conhecimento) para criação e gerenciamento unificados. Para mais informações, consulte Bases de conhecimento locais (para usuários existentes do AI Assistant).

Pré-requisitos

Conclua as seguintes preparações antes de usar uma base de conhecimento:

  1. Ative o DataWorks e acesse o tenant onde deseja criar a base de conhecimento.

  2. Para compilar conhecimento a partir de workspaces, certifique-se de que a conta atual possui permissões de leitura nos workspaces a serem coletados e nos ativos de dados relacionados.

  3. Prepare um grupo de recursos serverless e seu workspace associado capazes de executar tarefas de compilação de conhecimento. O grupo de recursos selecionado precisa ter conectividade de rede e permissões de acesso às fontes de dados ou services cloud necessários para a compilação, além de reservar pelo menos 4 CUs de capacidade disponível.

Conceitos principais

Conceito

Descrição

Tipo de base de conhecimento

  • Base de conhecimento pessoal: Por padrão, apenas o proprietário pode utilizá-la. O proprietário ou um administrador pode usar a opção Share para autorizar usuários específicos a usar a base de conhecimento e usar Administrator Settings para adicionar administradores.

  • Base de conhecimento empresarial: Todos os membros sob o mesmo tenant do DataWorks podem visualizar e pesquisar por padrão. Apenas o proprietário e os administradores podem gerenciar a base de conhecimento.

Base de conhecimento local

Base de conhecimento criada anteriormente no AI Assistant por usuários existentes. Ela continua sendo exibida na interface e suporta regeneração, exportação e limpeza. Novas instâncias do AI Assistant Service não geram mais bases de conhecimento locais.

Gerenciamento de fontes

Configure os workspaces e fontes de dados disponíveis para a compilação de conhecimento.

Compilação de conhecimento

Processo de conversão de metadados de workspace, fontes de dados ou arquivos enviados em conhecimento navegável e pesquisável.

Definição de tarefa

Descreve a configuração de longo prazo de uma tarefa de compilação, incluindo nome da tarefa, escopo de compilação, método de acionamento e ambiente de execução.

Instância de execução

Execução real de uma definição de tarefa. Uma única definição de tarefa pode gerar múltiplas instâncias de execução, cada uma com status e log independentes.

Modelo semântico

Modelo que descreve entidades de negócios, dimensões, métricas e seus relacionamentos de maneira estruturada, com suporte a gerenciamento de versões e publicação.

Documento de negócios

Materiais de negócios enviados manualmente para a base de conhecimento, como glossários, documentos de design e guias operacionais. Após a análise, esses materiais são incluídos na pesquisa unificada.

Domínio de negócios

Grupo de ativos de dados classificados por assunto de negócios.

Conhecimento semântico

Conteúdo organizado a partir de metadados e materiais de negócios, incluindo nomes de negócios, definições, relacionamentos, dicas, sinônimos e exemplos de consulta.

Etapa 1: Criar uma base de conhecimento

  1. Faça login no console do DataWorks. Na barra de navegação superior, alterne para a região de destino.

  2. No painel de navegação à esquerda, clique em Context Graph (knowledge base). Na página de lista de bases de conhecimento, clique em Create Knowledge Base.

  3. Na caixa de diálogo Create Knowledge Base, configure as informações da base de conhecimento.

    Parâmetro

    Descrição

    Name

    Obrigatório. Insira um nome identificável com até 128 caracteres após a remoção de espaços iniciais e finais. Recomendamos o uso de um nome que reflita o escopo de negócios, como "Base de Conhecimento de Varejo".

    Type

    Obrigatório. Selecione Personal ou Enterprise: Uma base de conhecimento Personal é visível e gerenciável apenas pelo criador. Uma base de conhecimento Enterprise é visível para todos os usuários sob o mesmo tenant, mas apenas usuários autorizados podem gerenciá-la. Para mais informações, consulte Tipos de base de conhecimento e escopos de acesso.

    Description

    Opcional. Descreva o escopo de negócios, usuários-alvo e método de atualização da base de conhecimento. A descrição pode ter até 1.024 caracteres.

  4. Clique em Create Knowledge Base. Após a criação da base de conhecimento, atribua administradores ou compartilhe a base com outras contas sob o tenant. Para mais informações, consulte Manage permissions.

Importante

Ao excluir uma base de conhecimento, todo o conhecimento contido nela também é excluído simultaneamente. Proceda com cautela.

Etapa 2: Configurar fontes

Uma source é um limite de dados opcional para a compilação de conhecimento. Ela determina quais workspaces ou fontes de dados podem ser usados pelas tarefas de compilação subsequentes. Você também pode selecionar fontes de conhecimento diretamente ao compilar a base de conhecimento. As fontes dividem-se em dois tipos:

  • Workspace: Utilizado para examinar tabelas, tarefas, linhagem e metadados relacionados por workspace.

  • Fonte de dados: Utilizada para selecionar dados por mecanismo e conexão. Os tipos suportados incluem MaxCompute, Hologres, StarRocks e DLF. Os tipos disponíveis dependem da lista exibida na página.

Gerencie as fontes da seguinte maneira:

  1. Acesse a base de conhecimento de destino e clique em Source Management no canto superior direito da página de detalhes. No painel lateral exibido, clique em Add Source.

  2. Selecione workspaces ou objetos de fonte de dados conforme necessário. É possível fazer seleções múltiplas.

  3. Clique em Save. Após salvar as configurações, a página retorna à tela de compilação e a lista de fontes é atualizada.

Após a remoção de uma source, novas tarefas não poderão mais selecioná-la. No entanto, os resultados de conhecimento gerados por tarefas históricas não são excluídos.

Etapa 3: Compilar conhecimento

Acesse a base de conhecimento de destino e clique em Knowledge Building na parte superior da página de detalhes. Primeiro, selecione um método de compilação. O sistema oferece três métodos:

  • Compilar por workspace: Selecione um workspace para criar diretamente uma nova tarefa de compilação de conhecimento.

  • Compilar por fonte de dados: Selecione uma fonte de dados para compilar conhecimento com seleção refinada do escopo de tabelas.

  • Envio manual: Envie diretamente arquivos locais e crie uma tarefa de compilação de conhecimento.

O método de acionamento é um atributo configurado durante a criação da tarefa. Tarefas de compilação por workspace e por fonte de dados podem ser acionadas manualmente ou executadas periodicamente. Tarefas de envio manual iniciam a compilação imediatamente após o envio e não suportam execuções periódicas.

Compilar por workspace

Indicado para realizar uma varredura completa e compilação inicial a partir de um workspace configurado.

Parâmetro

Obrigatório

Descrição

Nome da tarefa

Sim

Especifique um nome exclusivo e facilmente identificável para esta tarefa de compilação visando facilitar o gerenciamento futuro. O nome pode ter até 128 caracteres.

Escopo de varredura

Sim

Selecione um workspace do DataWorks como source de conhecimento. O sistema analisa as tarefas e tabelas no workspace. Após selecionar um workspace, a página exibe o número estimado de tarefas e tabelas a serem analisadas.

Perfil de dados

Não

Opção de alternância. Recomendamos fortemente ativar esta opção para melhorar a qualidade do conhecimento.

  • Desativado: Realiza apenas a análise básica de metadados, incluindo análise de esquema de metadados, integração de informações de modelagem de dados e análise de código de tarefa e linhagem.

  • Ativado (padrão): Além da análise básica, o sistema realiza uma análise aprofundada, incluindo:

    • Amostragem de dados e estatísticas de perfil: Por exemplo, distribuição de valores distinct/null para auxiliar na identificação de PII.

    • Enriquecimento semântico profundo baseado em LLM: Por exemplo, geração automática de descrições de tabelas/colunas, classificação de domínios de negócios, identificação de métricas derivadas e agregação de sinônimos e glossários.

Workspace de execução

Sim

Especifique o workspace onde esta tarefa de compilação será executada. Isso define o ambiente de execução e pode diferir do workspace de varredura (o workspace sendo analisado).

Grupo de recursos de execução

Sim

Selecione um grupo de recursos serverless para executar a tarefa de compilação. Certifique-se de que o grupo de recursos atenda aos seguintes requisitos:
1. O grupo de recursos possui conectividade de rede com as fontes de dados no workspace de varredura.
2. A compilação de conhecimento consome 4 CUs do grupo de recursos selecionado. Certifique-se de que o grupo de recursos tenha pelo menos 4 CUs disponíveis.




LLM

Sim

Selecione o modelo de linguagem grande (LLM) usado para realizar o aprimoramento semântico profundo via LLM. Modelos diferentes podem variar em capacidade e consumo de tokens. Esta seleção afeta diretamente a qualidade e o custo da construção do conhecimento.

Método de atualização

Sim

Esta seção define como a tarefa é acionada e inclui as seguintes configurações:

  • Política de execução: Define como a tarefa é acionada.

    • Manual: A tarefa não é executada automaticamente após a criação. Acione-a manualmente no Gerenciamento de Compilação.

    • Periódica: A tarefa é executada automaticamente no intervalo e horário especificados.

  • Intervalo de execução: Obrigatório quando a política de execução é definida como Periódica. Especifica a frequência da execução automática. Valores válidos: Mensal, Semanal, Diário e Horário.

  • Horário de execução: Obrigatório quando a política de execução é definida como Periódica. Especifica o horário exato de início dentro de cada intervalo de execução.

Nota
  • A varredura de conhecimento invoca um LLM para análise semântica, o que consome tokens. Inicie tarefas de compilação com base nas suas necessidades reais.

  • Ao compilar semântica por workspace, a coleta de tabelas de dados não distingue entre tipos de fonte de dados. A maioria das fontes de dados no workspace selecionado pode ser compilada em conhecimento estruturado.

Compilar por fonte de dados

Recomendado para compilar conhecimento com base em fontes de dados específicas. Selecione precisamente um escopo de tabelas para gerar um modelo semântico.

Parâmetro

Obrigatório

Descrição

Nome da tarefa

Sim

Nome personalizado da tarefa usado para identificar e pesquisar a tarefa no Gerenciamento de Compilação. Formato: 2 a 64 caracteres, começando e terminando com uma letra ou dígito.

Objetivo e foco de negócios

Sim

Descreva o objetivo e o foco de negócios usando termos de negócios. O sistema usa essas informações para planejar o escopo de varredura e a saída do modelo. Exemplo: Analisar receita e desempenho de renovação entre regiões de forma unificada e garantir que as métricas de receita usem uma definição consistente.

Escopo de dados

  1. Selecione os objetos a serem analisados:

    1. Tipo de fonte de dados: Selecione o mecanismo de fonte de dados a ser analisado, como MaxCompute, Hologres, StarRocks ou DLF.

    2. Fonte de dados: Selecione uma fonte de dados configurada sob o tipo selecionado. Se nenhuma opção estiver disponível, configure uma source primeiro. Para mais informações, consulte gerenciamento de fontes.

  2. Configure o ambiente de execução e a conectividade:

    1. Workspace: Workspace onde as tarefas são executadas. Selecione manualmente um workspace ao escolher o tipo MaxCompute ou DLF. Ao selecionar o tipo Hologres ou StarRocks, o workspace é determinado automaticamente com base na fonte de dados selecionada e não requer seleção manual.

    2. Grupo de recursos: Selecione o grupo de recursos serverless para execução da tarefa. Reserve um mínimo de 4 CUs.

    3. Teste de conectividade: Este teste deve ser aprovado para garantir que o grupo de recursos possa acessar a fonte de dados.

  3. Defina o escopo de análise:

    1. Escopo de análise: Selecione o escopo da análise por projeto ou esquema. Apenas tabelas dentro do escopo selecionado participam da geração do modelo semântico.

    2. Tabelas semente: Selecione tabelas semente como ponto de partida para a análise ou importe um modelo de esquema como entrada semente para ajudar o sistema a determinar de quais tabelas começar a analisar e expandir.

Importação de métricas

Não

Importe arquivos de definição de métricas usando um modelo fixo do Excel para complementar fórmulas de métricas e campos dependentes, melhorando a precisão dos resultados gerados. Após a importação, a página exibe o número de métricas validadas. Durante a execução da tarefa, o escopo final da tabela determina os resultados de admissão.

Preferências

Não. Todas as opções são selecionadas por padrão.

Configure regras de filtragem de dados. Tabelas correspondentes às regras são excluídas da análise. Todas as regras são habilitadas por padrão e podem ser desmarcadas conforme necessário:

  • Excluir tabelas temporárias (tabelas cujos nomes contêm tokens independentes como tmp, temp, bak, backup ou old).

  • Excluir cópias de versão (tabelas cujos nomes terminam com _v seguido por um número, _new ou _copy).

  • Excluir tabelas de teste (tabelas cujos nomes contêm tokens independentes como test, demo, sandbox ou mock). Excluir tabelas em ambientes de teste (tabelas são excluídas quando o catálogo, banco de dados ou esquema corresponde a um identificador de ambiente de teste).

  • Excluir tabelas com descrições de teste (tabelas cujos comentários contêm palavras-chave como test, joint debugging, sample ou sandbox). Manter apenas as tabelas periódicas mais recentes (identificar sufixos de data ou período e manter apenas as três tabelas com os nomes mais recentes em cada família de tabelas por ordem alfabética).

Arquivos de referência

Não

Envie arquivos locais ou adicione URLs como materiais de referência de negócios para auxiliar na geração semântica e ajudar o sistema a entender o contexto de negócios. Os formatos de arquivo suportados incluem PDF, Word, Markdown, texto simples e yaml.

Método de atualização

Sim

Esta seção define o método de acionamento para tarefas e inclui as seguintes configurações:

  • Política de execução: Define como a tarefa é acionada.

    • Manual: A tarefa não é executada automaticamente após a criação. Acione-a manualmente no Gerenciamento de Compilação.

    • Agendada: A tarefa é executada automaticamente com base no cronograma e horário especificados.

  • Intervalo de execução: Obrigatório quando a Política de execução é definida como Agendada. Especifica a frequência da execução automática. Valores válidos: Mensal, Semanal, Diário e Horário.

  • Horário de execução: Obrigatório quando a Política de execução é definida como Agendada. Especifica o horário exato de início dentro de cada intervalo de execução.

Envio manual

Este método é adequado quando documentos são a principal source de conhecimento e você deseja incluir materiais de negócios locais na base de conhecimento. Tarefas de envio não suportam execução agendada. A compilação começa imediatamente após o envio da tarefa.

Parâmetro

Obrigatório

Descrição

Enviar arquivos

Sim

Entrada principal para compilar conhecimento. Arraste e solte arquivos ou pastas, ou clique em Upload Files ou Upload Folder para enviar. Ao enviar uma pasta, a estrutura original de diretórios é mantida. Limites de envio:

  • Quantidade: Máximo de 100 arquivos por vez.

  • Tamanho: Cada arquivo não pode exceder 10 MB.

  • Formato: Quatro tipos de arquivos são suportados: documentos, dados estruturados, texto técnico e imagens. Para a lista detalhada, veja a tabela abaixo. Arquivos compactados (.zip, .rar) e arquivos legados do Office (.doc, .xls) não são suportados. Para enviar múltiplos arquivos de uma vez, utilize o recurso de envio de pasta.

Após o envio, o sistema marca ou ignora automaticamente arquivos com formatos não suportados, que excedem o limite de tamanho ou que são arquivos de sistema.

Workspace de execução

Sim

Workspace onde esta tarefa de compilação será executada.

Grupo de recursos de execução

Sim

Grupo de recursos usado para executar a tarefa. A compilação de conhecimento ocupa 4 CUs do grupo de recursos selecionado. Certifique-se de que o grupo de recursos tenha pelo menos 4 CUs de capacidade disponível e possua conectividade de rede para acessar o service de modelo grande.

Modelo grande

Sim

Modelo de linguagem grande usado para analisar os documentos enviados. Os modelos disponíveis estão listados na página.

O envio manual suporta os seguintes formatos de arquivo:

Categoria de arquivo

Formatos suportados

Documentos

.md, .txt, .pdf, .docx, .xlsx, .pptx, .html, .htm

Dados estruturados

.csv, .tsv, .json, .jsonl, .yaml, .yml, .xml

Texto técnico

.sql, .log, .conf, .properties

Imagens

.png, .jpg, .jpeg, .gif, .bmp, .tif, .tiff, .webp

Nota

Se os arquivos enviados contiverem imagens, selecione um modelo de linguagem grande que suporte capacidades multimodais para a compilação. [A confirmar: lista de modelos que atualmente suportam capacidades multimodais]

Etapa 4: Gerenciamento de compilação

Após iniciar uma compilação de conhecimento, visualize as tarefas de compilação no gerenciamento de compilação. Na página de detalhes da base de conhecimento, clique na aba Build Management para gerenciar definições de tarefas e instâncias de execução. Cada execução de tarefa gera uma instância de execução.

  • Definições de tarefa

    Cada definição de tarefa contém o nome da tarefa, tipo de tarefa, escopo de compilação, método de acionamento, grupo de recursos e status da tarefa. Pesquise por nome da tarefa, filtre por tipo de tarefa, método de acionamento e status de ativação, além de atualizar as definições de tarefa.

    Operações disponíveis:

    • Run Now: Aciona manualmente uma compilação.

    • Edit: Modifica o nome da tarefa, método de acionamento e outras configurações.

    • Enable / Disable: Controla o acionamento automático de tarefas agendadas.

    • Delete: Remove uma definição de tarefa. Não é possível excluir uma tarefa enquanto ela estiver em execução.

  • Instâncias de execução

    A lista de instâncias exibe o nome da tarefa, tipo, método de acionamento, status de execução, horário de início e ações disponíveis para cada execução. Filtre por status de execução, tipo de tarefa e método de acionamento. Ações disponíveis:

    Importante

    O tempo necessário para a execução da instância depende do tamanho do conteúdo de conhecimento a ser compilado. Isso pode levar algum tempo.

    • View: Abre os detalhes da instância.

    • Source File: Visualize os arquivos de entrada usados nesta compilação.

    • Cancel: Cancela instâncias que ainda podem ser encerradas.

    • Retry: Reinicia a execução para instâncias falhas ou encerradas que permitem reexecução.

  • Detalhes da instância

    Quando o status de uma instância for Failed, execute as seguintes etapas:

    1. Identifique o problema: Na lista de instâncias, clique em View para a tarefa falha. Na página de detalhes, localize a etapa falha vermelha no gráfico de execução.

    2. Analise os logs: Abra o log da etapa falha e solucione o problema com base na mensagem de erro, consultando a tabela a seguir.

    3. Corrija e tente novamente: Após corrigir o problema, volte para a página de definição da tarefa e clique em Run Now.

Categoria de erro

Indício típico no log

Ação

Formato de arquivo

O log indica que formatos como .doc, .xls e arquivos compactados (como .zip e .rar) não são suportados, ou que um único arquivo excede o limite de 10 MB.

Consulte a lista de formatos de arquivo na seção Envio manual, converta os arquivos para um formato suportado ou divida arquivos muito grandes e envie-os novamente.

Grupo de recursos

O log indica que o grupo de recursos serverless está indisponível, excedeu sua cota ou não está associado ao workspace.

Verifique o status do grupo de recursos e o workspace associado. Consulte a seção Pré-requisitos para verificar a configuração do grupo de recursos.

Permissões de workspace

O log indica que o acesso a metadados, ativos de dados ou ao workspace foi negado.

Entre em contato com o administrador do workspace para conceder as permissões de leitura necessárias no workspace e nos ativos de dados de destino.

Conectividade de rede

O log indica timeout ou falha de conexão ao acessar uma fonte de dados ou service cloud.

Verifique se o grupo de recursos consegue acessar os caminhos de rede das fontes de dados e services cloud necessários.

Acesso a dados de source

A tabela ou ativo de source não existe ou retorna resultados vazios

Verifique se os dados de source ainda existem e se os caminhos e credenciais são válidos. Se necessário, restrinja o escopo de coleta e tente novamente.

Após corrigir o problema, clique em Run Now novamente na definição da tarefa.

Etapa 5: Usar a base de conhecimento

Grafo de conhecimento

O grafo de conhecimento utiliza um modelo de linguagem grande (LLM) para extrair entidades conceituais de objetos de conhecimento e construir relacionamentos entre elas, convertendo conteúdo não estruturado em uma rede estruturada. Seu principal objetivo é fornecer capacidades profundas de raciocínio de conhecimento para AI Agents, com foco específico em cenários de engenharia de ETL de big data. Em particular, ele pode suportar raciocínio complexo de linhagem de dados, como rastrear os nós de processamento upstream de uma tabela e avaliar com precisão o impacto downstream quando nós ou métricas upstream mudam. Isso melhora significativamente a precisão da resolução de problemas em cenários de negócios especializados.

Página

Descrição

Visão geral do domínio de negócios

Visualize o número de domínios de negócios, escala de tabelas e tarefas, camadas de ativos, cobertura semântica, visão geral de dados sensíveis, tags populares e escopo de coleta.

Detalhes do domínio de negócios

Visualize tabelas, tarefas, métricas, tabelas lógicas, proprietários, riscos e dicas de análise em um domínio de negócios especificado.

Base de conhecimento semântico

Visualize termos de negócios, métricas, tabelas lógicas, exemplos de consultas entre tabelas, semântica de campos, exemplos de consultas, padrões de dados e sinônimos.

Detalhes do ativo

Visualize a definição de negócios, descrições de campos, fontes semânticas, níveis de confiança, recomendações de uso, dados sensíveis, regras de qualidade, linhagem e conhecimentos relacionados de um único ativo.

O conteúdo nestas páginas pode vir do sistema de source, metadados da plataforma DataWorks ou inferência do sistema. O sistema retém fontes semânticas e níveis de confiança sempre que possível. Verifique definições importantes de negócios e conteúdos com baixa confiança com os ativos de source e os proprietários de negócios.

Uso no AI Assistant e Data Agent

Bases de conhecimento criadas e compiladas com sucesso no Context Graph (base de conhecimento) podem ser usadas no AI Assistant e no Data Agent para fornecer conhecimento de negócios.

As bases de conhecimento disponíveis dependem do tipo de base de conhecimento e da autorização:

  • Base de conhecimento empresarial: Disponível para todos os membros dentro do mesmo tenant.

  • Base de conhecimento pessoal: Disponível apenas para o proprietário por padrão. Para torná-la disponível para o Data Agent ou AI Assistant, o proprietário ou um administrador deve conceder autorização à instância correspondente por meio de compartilhamento.

O Data Agent e o AI Assistant não podem atuar como administradores de base de conhecimento. Eles só podem usar uma base de conhecimento após receberem autorização através de compartilhamento. Para mais informações, consulte Compartilhar uma base de conhecimento.

Configuração e permissões

Após configurar uma base de conhecimento, adicione vários administradores para o gerenciamento diário. Compartilhe a base de conhecimento com usuários, instâncias do AI Assistant ou instâncias do Data Agent para fornecer capacidades de raciocínio de conhecimento para o contexto do Agent.

Gerenciamento de configuração

Acesse a base de conhecimento de destino e clique em Configuration Management na parte superior da página de detalhes para modificar informações básicas, administradores e o escopo de compartilhamento. O Configuration Management está disponível apenas quando você possui pelo menos uma permissão de configuração. As abas de configuração visíveis são determinadas pelas suas permissões, e nem todas as abas estarão necessariamente visíveis para todos os usuários.

  1. Informações básicas

    Modifique o nome, tipo e descrição da base de conhecimento. As regras de salvamento são as mesmas da criação de uma base de conhecimento. Operações de fechamento podem ser restritas durante o salvamento para evitar perda de resultados.

  2. Configurações de administrador

    Em Administrator Settings, adicione usuários do tenant para manter colaborativamente a base de conhecimento. Administradores podem manter colaborativamente a base de conhecimento, mas apenas o proprietário pode excluí-la ou limpá-la. Execute as seguintes etapas:

    1. Insira um nome ou conta para pesquisar usuários dentro do mesmo tenant.

    2. Selecione um usuário e confirme a adição. O novo administrador aparece na lista de administradores, que também exibe o proprietário.

    3. Para revogar permissões, clique em Remove e confirme novamente. Após a remoção, o usuário perde imediatamente as permissões de gerenciamento da base de conhecimento. O proprietário não pode ser removido.

  3. Configurações de compartilhamento

    Sharing Settings aparece apenas quando o tipo de base de conhecimento e suas permissões permitem. Use este recurso para autorizar outros objetos a usar a base de conhecimento. Tipos de objeto suportados: usuários, instâncias do Data Agent e instâncias do AI Assistant.

    1. Alterne o tipo de objeto de autorização: User, Data Agent ou AI Assistant.

    2. Pesquise o objeto de destino por nome ou ID.

    3. Selecione o objeto e confirme a autorização. Objetos autorizados são exibidos na lista Authorized.

    4. Para revogar a autorização, clique em Remove e confirme.

    A autorização de compartilhamento permite que o objeto de destino use a base de conhecimento para pesquisa de conhecimento. Ela não concede permissões de gerenciamento da base de conhecimento.

Permissões de função

Operação

Proprietário

Administrador

Membro regular da base de conhecimento empresarial

Objeto apenas com autorização de compartilhamento

Visualizar e pesquisar conhecimento

Suportado

Suportado

Suportado

Apenas pesquisa

Modificar configurações da base de conhecimento

Suportado

Suportado

Não suportado

Não suportado

Configurar e executar compilações

Suportado

Suportado

Não suportado

Não suportado

Enviar e excluir documentos de negócios

Suportado

Suportado

Não suportado

Não suportado

Administração e autorização de compartilhamento

Suportado

Suportado

Não suportado

Não suportado

Limpar dados semânticos da base de conhecimento

Suportado

Não suportado

Não suportado

Não suportado

Excluir uma instância de base de conhecimento

Suportado

Não suportado

Não suportado

Não suportado

Idioma do conteúdo

O conteúdo da base de conhecimento suporta chinês simplificado e inglês. Cada base de conhecimento mantém apenas um idioma de conteúdo.

  • Durante a primeira compilação, o sistema determina o idioma do conteúdo da base de conhecimento com base na configuração de idioma no canto superior direito do console do DataWorks. [A confirmar: se a regra de que o idioma é bloqueado na primeira compilação e não pode ser alterado permanece inalterada]

  • Após a determinação do idioma, todas as compilações subsequentes usam o mesmo idioma. Alternar o idioma do console altera apenas a exibição da interface e não muda o idioma do conhecimento existente.

  • Não é possível modificar diretamente o idioma do conteúdo de uma base de conhecimento existente. Para usar um idioma diferente, crie uma nova base de conhecimento e inicie a primeira compilação com o idioma de página desejado.

  • Nomes físicos de tabelas, nomes de campos, SQL, códigos, IDs, tags originais e evidências de citação não são traduzidos. Portanto, uma base de conhecimento em inglês ainda pode conter texto em chinês proveniente dos dados de source.

Bases de conhecimento locais (para usuários existentes do AI Assistant)

A base de conhecimento foi separada do AI Assistant em um módulo independente. Para usuários existentes do AI Assistant, as bases de conhecimento criadas anteriormente no AI Assistant são exibidas como bases de conhecimento locais na interface e permanecem funcionais. Quando o módulo de base de conhecimento é incorporado ao AI Assistant, as bases de conhecimento locais aparecem na seção de base de conhecimento pessoal da lista de bases de conhecimento. Clique em uma base de conhecimento local para ir à página de gerenciamento de base de conhecimento no AI Assistant.

  • Operações suportadas para bases de conhecimento locais: Os recursos existentes de bases de conhecimento locais permanecem disponíveis, incluindo regeneração, exportação e limpeza.

  • Diferenças em relação ao módulo de base de conhecimento

    Item

    Base de conhecimento local (existente)

    Módulo de base de conhecimento

    Ponto de entrada

    A aba Knowledge Base na página de detalhes da instância do AI Assistant

    Knowledge Base no painel de navegação à esquerda do console

    Suporte à criação

    Não é mais gerada para novas instâncias do AI Assistant

    Suportado

    Propriedade

    Pertence a uma única instância do AI Assistant

    Instância independente que pode ser reutilizada por múltiplas aplicações inteligentes

    Tipo de base de conhecimento

    Sem distinção de tipo

    Suporta bases de conhecimento pessoais e empresariais

    Método de compartilhamento

    Disponível apenas dentro da instância atual

    Suporta autorização através de Share para usuários, Data Agent ou AI Assistant

  • Diferenças em relação a novas instâncias do AI Assistant: Novas instâncias do AI Assistant não geram mais bases de conhecimento locais. Isso significa que não é mais possível criar bases de conhecimento no AI Assistant. Para criar uma base de conhecimento, acesse o módulo de base de conhecimento para criação e gerenciamento unificados e utilize a base de conhecimento no AI Assistant ou Data Agent conforme necessário.

FAQ

  • P: Por que as opções de gerenciamento de fontes ou compilação de conhecimento não são clicáveis?

    R: Você pode ter apenas permissões de somente leitura ou de uso compartilhado. Entre em contato com o proprietário ou administrador da base de conhecimento para verificar suas permissões.

  • P: Por que não consigo ver todas as seções no gerenciamento de configuração?

    R: O sistema exibe apenas as seções que você tem permissão para manter. Por exemplo, ter permissão para editar informações básicas não significa necessariamente que você possa gerenciar o escopo de compartilhamento.

  • P: Por que não há workspaces ou fontes de dados disponíveis na página de compilação?

    R: A source não foi adicionada à base de conhecimento. Adicione-a no gerenciamento de fontes e retorne à página. As opções disponíveis serão atualizadas.

  • P: Por que a exclusão da tarefa falhou?

    R: A tarefa pode estar em execução, sendo excluída ou tendo dependências de outras tarefas. Pare as instâncias ativas, remova as dependências e tente excluir novamente.

  • P: Por que não consigo criar uma base de conhecimento no AI Assistant?

    R: As bases de conhecimento foram separadas em um módulo independente para gerenciamento unificado. Novas instâncias do AI Assistant Service não suportam mais a criação de bases de conhecimento locais. Crie uma base de conhecimento no módulo Context Graph (base de conhecimento). Após a criação, a base de conhecimento pode ser usada no AI Assistant e no Data Agent.

  • P: As bases de conhecimento locais existentes ainda podem ser usadas?

    R: Sim. Bases de conhecimento criadas anteriormente no AI Assistant são exibidas como bases de conhecimento locais na interface para usuários existentes. Você ainda pode regenerá-las, exportá-las e limpá-las. Seu uso existente não é afetado.

  • P: Qual é a diferença entre administrador e autorização de compartilhamento?

    R: Administradores podem configurar, enviar e compilar uma base de conhecimento. Usuários, Data Agents ou instâncias do AI Assistant Service autorizados através de compartilhamento podem apenas usar o conhecimento para pesquisa ou perguntas e respostas, e não podem modificar a base de conhecimento.

Melhores práticas

  • Planeje o escopo das fontes antes da primeira compilação para evitar a varredura de workspaces irrelevantes.

  • Atribua um proprietário claro para a base de conhecimento e configure um administrador reserva.

  • Ative o perfil de dados para bases de conhecimento que exigem alta qualidade semântica e monitore a amostragem SQL e o consumo de tokens.

  • Após uma compilação bem-sucedida, verifique conjuntamente as instâncias de execução, a cobertura do grafo de conhecimento e os resultados da pesquisa de conhecimento para validar a disponibilidade.

  • Versões não publicadas de modelos semânticos não substituem automaticamente a versão publicada atual. Revise-as antes de publicar.

  • Desativar uma tarefa pausa acionamentos subsequentes, enquanto excluir uma tarefa remove a definição da tarefa. Não confunda as duas operações.

  • Melhore a qualidade da compilação automática enriquecendo comentários de tabelas e campos de source, padrões de dados, proprietários, linhagem e regras de qualidade. Revise manualmente métricas principais, campos sensíveis e consultas-chave.

  • Limpe regularmente documentos expirados e ativos de teste para reduzir ruído nas pesquisas.

  • Siga o princípio do menor privilégio e revogue prontamente a autorização quando o acesso à base de conhecimento não for mais necessário.