O catálogo de dados é sua estação de trabalho unificada de metadados no DataAnalysis. Ele integra metadados do MaxCompute, Hologres e Data Lake Formation (DLF), permitindo criar tabelas, gerenciar views e gerar SQL de consulta sem sair do DataWorks.
Acessar o catálogo de dados
Faça login no DataWorks DataAnalysis, mude para a região desejada e clique em Enter Data Analysis.
Caso visualize Go To New DataAnalysis na barra de navegação, clique nessa opção para acessar a nova página do DataAnalysis.
Se a barra de navegação exibir Return To Legacy DataAnalysis, você já está na nova página do DataAnalysis.
Adicionar um catálogo de dados
Os procedimentos variam conforme seu perfil de uso no DataAnalysis (novo ou existente).
Adicionar um catálogo de dados como novo usuário
No catálogo de dados, localize o tipo de source de dados que deseja adicionar. Clique no ícone
ao lado do nome do tipo de source de dados para abrir a página Add Data Catalog.Encontre a instância ou o source de dados a ser adicionado. Na coluna Operation, clique em Add.
Para remover uma instância ou source de dados desnecessário, utilize a mesma coluna Operation.
Adicionar um catálogo de dados como usuário existente
Clique no ícone
no canto superior direito do catálogo e escolha um tipo de catálogo:
|
Tipo de catálogo |
Conteúdo adicionado |
|
DataMap - Metadata |
Metadados de tabelas coletados no Data Map. Cada source de dados ou recurso computacional é adicionado como um conjunto de dados. |
|
DataMap - Data Album |
Álbuns de dados do Data Map, que agrupam tabelas por assunto. Cada álbum de dados é adicionado como um conjunto de dados. |
|
My Favorites |
Tabelas marcadas como favoritas por você no catálogo de dados. |
|
My MaxCompute tables |
Todas as tabelas do MaxCompute pertencentes à conta atualmente conectada. |
|
Public Tables |
Conjuntos de dados públicos fornecidos pelo DataWorks, destinados ao uso com EMR Spark SQL, MaxCompute e Hologres. |
O limite máximo é de 12 conjuntos de dados. Caso tenha atingido esse número, remova um conjunto existente antes de adicionar outro.
Gerenciar um catálogo de dados
As instruções abaixo aplicam-se exclusivamente ao catálogo de dados para novos usuários.
Utilize o catálogo de dados para gerenciar objetos como tabelas, views, tabelas externas, recursos e funções. As orientações variam conforme o mecanismo:
|
Mecanismo |
Referência |
|
MaxCompute |
|
|
Hologres |
|
|
DLF |
Gerar SQL de consulta
Gere rapidamente uma instrução SQL de consulta com base em uma tabela de dados e, em seguida, configure e execute a instrução. Para mais informações, consulte Criar uma consulta SQL.
No catálogo de dados, localize o source de dados a ser consultado. Clique no ícone
ao lado do source de dados e encontre a tabela na lista Table.Clique com o botão direito na tabela e selecione Generate SQL Statement. O script SQL gerado será aberto na página de edição de SQL.
Ajuste o script SQL conforme necessário.
Clique em Run Configuration no painel lateral direito. Defina parâmetros como Computing Resource e Script Parameters e execute a consulta.
Apêndice
Autenticação e autorização do MaxCompute
Ao utilizar um usuário do Resource Access Management (RAM) ou uma função RAM para visualizar dados do MaxCompute no catálogo de dados, conceda primeiro as permissões necessárias do MaxCompute. Se o modelo Layer 3 estiver ativado para o source de dados ou projeto do MaxCompute, conceda também permissão para visualizar metadados de schema.
Caso um projeto do MaxCompute contenha múltiplos schemas, conceda permissões de metadados para todos eles, garantindo a exibição completa da lista de schemas na página de detalhes do projeto dentro do catálogo de dados.
Conceder permissões a um usuário RAM:
GRANT DESCRIBE ON SCHEMA <Schema_Name> TO USER RAM$<Alibaba_Cloud_Account_Name>:<RAM_User_Name>;
Conceder permissões a uma função RAM:
GRANT DESCRIBE ON SCHEMA <Schema_Name> TO USER `RAM$<Alibaba_Cloud_Account_Name>:role/<RAM_Role_Name>`;