Todos os produtos
Search
Central de documentação

Hologres:Importe conjuntos de dados públicos com poucos cliques

Última atualização: Sep 18, 2026

O HoloWeb permite importar conjuntos de dados públicos com poucos cliques, facilitando a importação e a consulta rápida de dados. Crie tarefas de importação e verifique o status da tarefa diretamente no console do HoloWeb.

Informações básicas

O HoloWeb oferece suporte à importação com um clique dos conjuntos de dados públicos tpch_10g, tpch_100g, tpch_1t e github_event.

  • Os conjuntos de dados públicos tpch_10g, tpch_100g e tpch_1t são conjuntos de dados de amostra para cenários de varejo. O conjunto de dados público tpch_10g contém 10 GB de dados, o tpch_100g contém 100 GB e o tpch_1t contém 1 TB. Para mais informações, consulte Test plan.

  • O conjunto de dados público github_event está disponível no GitHub. Para mais informações, consulte Introduction to business and data.

Pré-requisitos

  • A versão da sua instância do Hologres é V1.3.13 ou posterior.

  • A instância do Hologres está conectada ao HoloWeb. Para mais informações, consulte Log on to an instance.

Precauções

  • O recurso de importação de conjuntos de dados públicos é compatível com instâncias do Hologres implantadas nas seguintes regiões: China (Beijing), China (Shanghai), China (Hangzhou), China (Shenzhen) e China (Zhangjiakou).

  • A importação de um conjunto de dados público requer permissões para criar schemas, criar tabelas e gravar dados. Para mais informações, consulte Hologres permission models.

  • A importação de um conjunto de dados público leva de 3 a 20 minutos, dependendo das especificações da instância. Planeje seus recursos de computação com antecedência para evitar afetar seus negócios online.

  • A tarefa de importação cria automaticamente dois schemas e várias tabelas externas e internas. Certifique-se de que nenhum schema ou tabela existente na sua instância tenha os mesmos nomes dos criados automaticamente para evitar a exclusão acidental de dados.

Crie uma tarefa de importação de conjunto de dados público

  1. Acesse a página de desenvolvimento do HoloWeb. Para mais informações, consulte Connect to HoloWeb.

  2. Na barra de menu superior da página de desenvolvimento do HoloWeb, clique em Data Solutions.

  3. Na página Data Solutions, clique em Import Public Dataset no painel de navegação à esquerda.

  4. Na página Import Public Dataset, clique em Create Task for Importing Public Dataset.

  5. Na página Create Task for Importing Public Dataset, selecione um Instance Name, um Database e um Public Dataset Name. Em seguida, especifique se deseja ativar a opção Use Serverless Computing Resource to Import Data e clique em Submit.

    Este recurso está disponível apenas no Hologres V1.3.13 ou posterior. O conjunto de dados público consome espaço de armazenamento na sua instância. A tarefa de importação cria automaticamente dois schemas, como hologres_dataset_tpch_100g e hologres_foreign_dataset_tpch_100g, além de várias tabelas externas e internas. Para o conjunto de dados tpch_100g, recomendamos uma instância com pelo menos 32 CUs.

Visualize as informações de uma tarefa de importação de conjunto de dados público

  1. Na página Import Public Dataset, selecione um Instance Name e um Database e, em seguida, clique em Search para visualizar a lista de tarefas de importação de conjuntos de dados públicos.

    A lista de tarefas exibe as seguintes informações e ações:

    • Informações: No., Instance Name, Database, Public Dataset Name, Status, Progress (número de instruções SQL concluídas/número total de instruções SQL), Created At e End Time.

    • Ações: Details, Stop, Rerun, Delete, Execution History e Query.

  2. Quando o Status da tarefa mudar para Successful, a importação estará concluída. Em seguida, clique em Query na coluna Actions para aprofundar a análise dos dados.

Exclua um conjunto de dados público

Execute a seguinte instrução SQL para excluir os schemas que contêm o conjunto de dados público e todas as suas dependências. Este exemplo exclui o conjunto de dados tpch_100g. Tenha cuidado ao executar esta operação.

DROP SCHEMA hologres_dataset_tpch_100g, hologres_foreign_dataset_tpch_100g CASCADE;