Todos os produtos
Search
Central de documentação

DataWorks:Manage ChatBI datasets

Última atualização: Aug 14, 2026

Antes de iniciar uma sessão interativa no ChatBI, use um dataset para definir o escopo dos dados a serem analisados. Um dataset pode ser uma tabela de uma fonte de dados de destino ou um arquivo local.

Pré-requisito

Um serverless resource group deve ter sido criado na região onde você utiliza o ChatBI.

Observações de uso

  • Para datasets provenientes de uma fonte de dados, apenas as fontes Hologres, MaxCompute, StarRocks e MySQL são suportadas.

  • No caso de datasets baseados em arquivos locais, somente os formatos xls, xlsx e csv são aceitos. O limite máximo é de 10 arquivos, com tamanho individual de até 1 GB cada.

  • Membros do workspace com qualquer função podem criar e utilizar datasets a partir de fontes de dados do DataWorks. Anteriormente, essa capacidade era restrita aos administradores do workspace.

Criar um dataset

  1. Acesse a página do ChatBI.

    Faça login no Alibaba Cloud e abra a página ChatBI Intelligent Data Insights. Selecione o ponto de acesso correspondente à região dos seus recursos do DataWorks, como seu dataset e grupo de recursos serverless.

    China (Hangzhou) ChatBI entry point

    China (Shanghai) ChatBI entry point

    China (Shenzhen) ChatBI entry point

    China (Beijing) ChatBI entry point

    China (Chengdu) ChatBI entry point

    China (Zhangjiakou) ChatBI entry point

    China (Ulanqab) ChatBI entry point

    China (Hong Kong) ChatBI entry point

    Singapore ChatBI entry point

    Indonesia (Jakarta) ChatBI entry point

    Japan (Tokyo) ChatBI entry point

  2. No painel de navegação à esquerda, clique em Dataset para acessar a página de Datasets. Em seguida, clique em Create Dataset.

  3. Na página Create Dataset, configure os seguintes parâmetros:

    • Se o tipo de dataset for Data Source:

      Parameter

      Description

      Basic Information

      Name

      Insira um nome personalizado para o dataset.

      Type

      Tipo do dataset. Valores válidos:

      • Data Source

      • Local File

      Selecione Data Source.

      Data Source Type

      Tipo da fonte de dados. Valores válidos:

      • Hologres

      • MaxCompute

      • StarRocks

      • MySQL

      Informações da fonte de dados

      Os parâmetros de configuração variam conforme o tipo da fonte de dados.

      Por exemplo, para Hologres, configure Region, Hologres Instance e Database Name.

      Resource Group

      Selecione um grupo de recursos serverless do DataWorks, utilizado para acessar a fonte de dados nas consultas de dados das sessões subsequentes.

      Test Network Connectivity

      Teste a conectividade de rede entre o grupo de recursos serverless do DataWorks selecionado e a fonte de dados.

      Semantic Analysis

      (Exibido apenas quando o tipo de fonte de dados é MaxCompute) Define se a análise semântica será ativada para o dataset. Ao selecionar Enable Semantic Analysis, a plataforma cria ou atualiza automaticamente uma tarefa semântica para analisar as tabelas de dados do dataset sempre que você salvar a criação ou edição do dataset. Isso permite o recall de conhecimento semântico nas sessões do ChatBI, melhorando a precisão das respostas de perguntas e respostas. Após ativar esse recurso, uma aba Semantic Analysis aparece na página de detalhes do dataset. Esta opção vem selecionada por padrão durante a criação do dataset.

      Select Destination Table

      Selecionar tabelas de destino

      Após concluir a configuração de Basic Information, clique em Next para avançar à etapa Select Destination Table.

      Na lista To Be Selected, selecione as tabelas de destino e clique em image para adicioná-las à lista Selected. As tabelas selecionadas serão incluídas no dataset atual.

    • Caso o tipo de dataset seja Local File:

      Parameter

      Description

      Basic Information

      Name

      Insira um nome personalizado para o dataset.

      Type

      Tipo do dataset. Valores válidos:

      • Data Source

      • Local File

      Selecione Local File.

      Upload de arquivos locais

      Somente os formatos xls, xlsx e csv são suportados. É permitido enviar no máximo 10 arquivos, sendo que cada um não pode exceder 1 GB.

  4. Ao finalizar a configuração do dataset, clique em Next para prosseguir à etapa Data Insight. O sistema examina automaticamente o dataset para extrair características dos valores de dados, o que aumenta a precisão da análise durante as sessões.

  5. O processamento do Data insight pode levar algum tempo. Se preferir, clique diretamente em Completed e visualize os resultados no dataset posteriormente.

Visualizar um dataset

  1. No painel de navegação à esquerda, clique em Dataset para acessar a página de Datasets.

  2. Localize o cartão do dataset desejado e clique nele para abrir a página de detalhes.

    Para datasets do MaxCompute com Semantic Analysis ativado, o cartão exibe o status da análise semântica, que pode ser Waiting for Semantic Parsing, Semantic Parsing in Progress, Semantic Parsing Completed ou Semantic Parsing Failed.

  3. Na página de detalhes do dataset, a parte superior mostra as informações básicas (como tipo, quantidade de tabelas/arquivos e criador). O lado esquerdo apresenta a lista de tabelas/arquivos, enquanto o lado direito exibe informações básicas e uma prévia dos dados de cada tabela/arquivo (com visualização de até 20 registros).

Visualizar resultados da análise semântica

Em datasets do MaxCompute com Semantic Analysis habilitado, ao acessar a página de detalhes, clique na aba Semantic Analysis para verificar o status da tarefa semântica e os resultados da análise.

Nota

A aba Semantic Analysis só é exibida quando o dataset atende simultaneamente às seguintes condições: utiliza uma fonte de dados MaxCompute e a opção Enable Semantic Analysis foi selecionada durante a criação ou edição do dataset.

A aba Semantic Analysis possui a seguinte estrutura:

  • Barra de status (superior): Mostra o status atual da análise semântica e da sincronização. Os status possíveis incluem Semantic Parsing in Progress, Semantic Parsing Completed e Semantic Parsing Failed.

  • Result Files (painel esquerdo): Lista os arquivos de resultado gerados pela análise semântica, incluindo o arquivo de índice (_index.json) e os arquivos YAML do modelo semântico. Clique no nome de um arquivo para visualizar seu conteúdo no painel direito.

  • Visualizador de conteúdo (painel direito): Exibe o conteúdo detalhado do arquivo selecionado. Para arquivos YAML de modelo semântico, o visualizador oferece duas opções de visualização:

    • Semantic Graph: Apresenta graficamente as relações entre tabelas de dados e métricas do modelo semântico, além de estatísticas como a quantidade de tabelas e métricas.

    • YAML Source: Mostra o conteúdo bruto do arquivo YAML do modelo semântico com numeração de linhas, permitindo revisar definições de campos, fórmulas de métricas e descrições de negócios presentes no modelo.

As seguintes operações estão disponíveis na aba Semantic Analysis:

Button

Description

Rerun

Aciona novamente a tarefa de análise semântica. Utilize esta opção quando a estrutura das tabelas no dataset for alterada e o modelo semântico precisar de atualização.

Refresh

Atualiza o status da análise semântica e a lista de arquivos de resultado.

Download

Baixe o arquivo YAML do modelo semântico selecionado para sua máquina local. Este botão fica disponível apenas após a conclusão da análise semântica.

Para obter informações detalhadas sobre a análise semântica (incluindo a estrutura YAML dos modelos semânticos e como utilizar os gráficos semânticos), consulte Data Agent semantic analysis.

Editar um dataset

  1. No painel de navegação à esquerda, clique em Dataset para acessar a página de Datasets.

  2. Encontre o cartão do dataset desejado. Utilize um dos métodos abaixo para acessar a página de edição do dataset.

    • Passe o mouse sobre o cartão do dataset e, no canto superior direito, clique em image > Edit.

    • Clique no cartão do dataset para abrir a página de detalhes e, em seguida, clique no botão Edit localizado no canto superior direito.

  3. Modifique a configuração do dataset. As descrições dos parâmetros seguem o mesmo padrão apresentado em Create a dataset.

    Nota

    Ao editar a configuração de um dataset existente, não é possível modificar o tipo nem o tipo da fonte de dados.

  4. Após concluir a edição do dataset, clique em Next para avançar à etapa Data Insight. O processo de Data insight será executado novamente sobre os dados do dataset.

Excluir um dataset

  1. No painel de navegação à esquerda, clique em Dataset para acessar a página de Datasets.

  2. Passe o mouse sobre o cartão do dataset desejado e, no canto superior direito, clique em image > Delete. Após a exclusão do dataset, as sessões e gráficos associados deixarão de exibir os dados corretamente.

Próximos passos: Iniciar uma sessão baseada em um dataset

  1. Utilize um dos métodos a seguir para iniciar uma sessão com base em um dataset específico.

    • No painel de navegação à esquerda, clique em Dataset para acessar a página de Datasets. Passe o mouse sobre o cartão do dataset desejado e, no canto superior direito, clique em image para iniciar a sessão.

    • No painel de navegação à esquerda, clique em New Session para abrir a janela de sessão do ChatBI. Depois, na janela da sessão, clique em Select Dataset.

  2. Na página Chat, insira suas necessidades ou perguntas para começar a análise de dados. Para mais informações, consulte ChatBI sessions.

    Nota

    Se a sessão utilizar um dataset com Semantic Analysis ativado, o ChatBI realiza automaticamente o recall de conhecimento semântico durante as perguntas e respostas para aumentar a precisão da análise. Caso o dataset ainda esteja em processo de análise, você pode começar a fazer perguntas imediatamente. Para questões complexas, recomendamos refazê-las após a conclusão da análise para obter respostas mais precisas.