O editor Spark é um ambiente de desenvolvimento baseado em navegador no console do AnalyticDB for MySQL para criar, configurar e executar aplicações Spark de processamento em lote, streaming e mecanismo SQL. Essa interface também permite visualizar logs do driver, detalhes de envio e logs de execução de SQL.
Pré-requisitos
Antes de começar, verifique se você tem:
Um cluster do AnalyticDB for MySQL Data Lakehouse Edition Data Lakehouse Edition
Um grupo de recursos de job criado para o cluster. Consulte Data Lakehouse EditionCriar um grupo de recursos
Permissões necessárias concedidas ao seu usuário do Resource Access Management (RAM). Consulte a seção "Conceder permissões a um usuário RAM" em Gerenciar usuários e permissões do RAM
-
Uma conta de banco de dados para o cluster:
Conta Alibaba Cloud: uma conta privilegiada. Consulte a seção "Criar uma conta privilegiada" em Criar uma conta de banco de dados
Usuário RAM: uma conta privilegiada e uma conta padrão, com a conta padrão associada ao usuário RAM. Consulte Criar uma conta de banco de dados e Associar ou desassociar uma conta de banco de dados a/de um usuário RAM
Autorização para o AnalyticDB for MySQL assumir a função AliyunADBSparkProcessingDataRole. Consulte Realizar autorização
Um caminho de armazenamento de log configurado para aplicações Spark
Para configurar o caminho de armazenamento de log: Faça login no console do AnalyticDB for MySQL. Localize o cluster e clique em ID dele. No painel de navegação à esquerda, escolha Job Development > Spark JAR Development e clique em Log Settings. Selecione o caminho padrão ou insira um caminho personalizado. O caminho personalizado não pode ser o diretório raiz do OSS e deve incluir pelo menos um nível de pasta.
Criar e executar uma aplicação Spark
Faça login no console do AnalyticDB for MySQL. No canto superior esquerdo, selecione uma região. No painel de navegação à esquerda, clique em ClustersData Lakehouse Edition. Na aba Data Lakehouse Edition, localize o cluster e clique em ID dele.
No painel de navegação à esquerda, escolha Job Development > Spark JAR Development.
Na página Spark JAR Development, clique em ícone
à direita de Applications.-
No painel Create Application, configure os seguintes parâmetros.
Parâmetro
Descrição
Name
Nome da aplicação ou do diretório. Os nomes de arquivo não diferenciam maiúsculas de minúsculas.
Type
Application: cria um modelo Spark baseado em arquivo. Directory: cria uma pasta para organizar aplicações.
Parent Level
Diretório pai do arquivo ou da pasta.
Job Type
Tipo de job Spark: Batch para processamento em lote, Streaming para aplicações de streaming ou SQL Engine para cargas de trabalho do mecanismo SQL distribuído do Spark.
Clique em OK.
Configure a aplicação no editor Spark. Para obter detalhes sobre a configuração, consulte Visão geral.
-
Antes de executar a aplicação, selecione um grupo de recursos de job e um tipo de aplicação no editor. Em seguida, escolha uma das seguintes ações:
Clique em Save para salvar a aplicação e usá-la posteriormente.
Clique em Run Now para executar a aplicação imediatamente. O status é atualizado em tempo real na aba Applications.
NotaPor padrão, o sistema não tenta executar novamente após uma falha. Para configurar o comportamento de nova tentativa, defina os parâmetros
spark.adb.maxAttemptsespark.adb.attemptFailuresValidityIntervalantes da execução. Para mais detalhes, consulte Parâmetros de configuração de aplicação Spark.
Monitorar uma aplicação Spark
Na aba Applications, pesquise uma aplicação pelo ID dela. Use as ações na coluna Actions conforme a necessidade de investigação.
|
Ação |
O que exibe |
|
Logs |
Logs do driver da aplicação atual ou log de execução de instruções SQL. Útil para depurar erros de tempo de execução. |
|
UI |
Spark UI para análise de desempenho e diagnósticos no nível de tarefa. O acesso tem período de validade. Se expirar, abra a UI novamente. |
|
Details |
Detalhes do envio, incluindo caminho do log, URL da web UI, ID do cluster e nome do grupo de recursos. Útil para verificar como a aplicação foi enviada. |
|
More > Stop |
Interrompe a aplicação em execução. |
|
More > History |
Histórico de novas tentativas da aplicação atual. |
Para visualizar o histórico de novas tentativas de todas as aplicações, clique em aba Execution History.