A página Jobs no console do MaxCompute permite monitorar e gerenciar a execução de jobs em seus projetos. Use-a para acompanhar jobs em execução e históricos, investigar falhas, identificar gargalos de recursos e interromper jobs que consomem recursos excessivos.
Desenvolvedores de dados podem localizar um job específico, verificar seu status, visualizar detalhes de execução no LogView ou interromper um job fora de controle.
Administradores podem analisar a carga de recursos entre grupos de cotas em um determinado momento, identificar quais jobs estão competindo por recursos de computação e ajustar as alocações conforme necessário.
O que você pode fazer
| Ação | Como |
|---|---|
| Filtrar jobs por intervalo de tempo, projeto, cota e tipo de job | Use os filtros globais acima da lista de jobs |
| Refinar resultados na lista de jobs | Use os campos de pesquisa Instance ID, Job Owner, ExtNodeId, ExtNodName ou Signature acima da lista |
| Filtrar por status, prioridade ou tag de diagnóstico | Clique no ícone de filtro ao lado do cabeçalho de uma coluna |
| Ordenar por uma única coluna | Clique no botão de ordenação no cabeçalho de uma coluna |
| Ordenar por múltiplas colunas | Clique em Advanced Sorting, adicione colunas e defina a ordem de cada uma, depois clique em OK. Quando a ordenação avançada está ativa, a ordenação básica por coluna única é desativada. Para retornar à ordenação por coluna única, clique em Advanced Sorting, clique em Reset e depois clique em OK. |
| Visualizar detalhes de execução | Clique em LogView na coluna Actions |
| Analisar consumo de recursos e alocação de cotas | Clique em Insights na coluna Actions |
| Interromper um job em execução | Clique em Terminate ou Batch Terminate para jobs com Latest Status Running |
Por padrão, os jobs são ordenados por hora de término em ordem decrescente, com os jobs em execução listados primeiro.
Notas de uso
Considere os seguintes pontos ao usar a página Jobs:
-
Frequência de coleta de snapshots: Os dados de snapshot são coletados a cada 3 minutos. Jobs iniciados dentro da janela de 3 minutos antes de uma coleta podem não aparecer na Snapshot List.
-
Jobs do PAI: Alguns jobs do MaxCompute iniciados pelo PAI — especialmente aqueles enviados por usuários RAM — não podem ser coletados.
-
Projetos Developer Edition: Jobs em projetos Developer Edition (a serem descontinuados) não podem ser coletados.
-
Status lag: A lista de jobs é atualizada em uma frequência fixa. Um job exibido como
Runningpode já ter sido concluído no LogView, especialmente para jobs de curta duração. O status no LogView é o mais preciso. -
Diagnóstico inteligente: O diagnóstico inteligente é suportado apenas para jobs SQL. Dados de consumo de recursos no nível do job não estão disponíveis para jobs com duração inferior a 2 minutos ou para jobs que não sejam SQL, MapReduce, Spark ou Mars.
Gráfico de estatísticas de jobs
O gráfico de colunas empilhadas acima da lista de jobs exibe a contagem de jobs agrupada por tempo e status, com base nas configurações de filtro atuais. Ele fornece uma visão geral visual rápida da atividade de jobs em um intervalo de tempo.
O intervalo de tempo por coluna depende do Time Range selecionado:
| Time Range | Intervalo por coluna | Máx. de colunas |
|---|---|---|
| Até 24 horas | 2 minutos (mínimo) | 24 |
| Mais de 24 horas, até 48 horas | 2 horas (fixo) | 24 |
| Mais de 48 horas, até 7 dias | 6 horas (fixo) | 29 |
Status exibidos no gráfico:
-
Running: o status do snapshot é Running no momento da coleta
-
Finished: o job foi concluído com sucesso, falhou ou foi encerrado
Arraste sobre o gráfico para selecionar um intervalo de tempo menor e ampliar a visualização.
Lista de jobs
A lista de jobs exibe os jobs que correspondem aos seus critérios de filtro. Duas visualizações estão disponíveis:
-
Regular Job List: Exibe todos os jobs concluídos ou em execução dentro do intervalo de tempo especificado, com métricas acumuladas como uso total de CPU e memória.
-
Snapshot List: Exibe os jobs capturados em um momento específico, com métricas pontuais como uso de CPU e memória no momento do snapshot. Use esta visualização para investigar contenção de recursos em um momento específico ou para ordenar por percentual de uso de recursos.
Parâmetros de filtro globais
Esses filtros afetam tanto o gráfico de estatísticas quanto a lista de jobs.
|
Parâmetro |
Descrição |
|
Time Range |
Obrigatório. Filtra a lista de jobs e o gráfico por tempo. Dois métodos:
O intervalo de tempo tem dois significados:
Padrão: última 1 hora. Intervalo máximo: 7 dias. Intervalo mínimo: 2 minutos. Período de consulta: últimos 45 dias. |
|
Choose Project |
Filtra pelo nome do projeto MaxCompute. Selecione um ou mais projetos. Deixe em branco para incluir todos os projetos. |
|
Select Quota |
Filtra por grupo de cotas — útil ao investigar contenção de recursos dentro de uma cota específica. Apenas grupos de cotas por assinatura são suportados. Deixe em branco ao consultar jobs com pagamento conforme o uso. Para mais informações, consulte Recursos de computação - Gerenciamento de cotas. |
|
Job Type |
Filtra por tipo de job. Tipos disponíveis:
|
Parâmetros de pesquisa na lista de jobs
Esses parâmetros filtram apenas a lista de jobs — não afetam o gráfico de estatísticas. Use-os para localizar um job específico ou um conjunto de jobs relacionados.
| Parâmetro | Descrição |
|---|---|
| Instance ID | Pesquise pelo ID de instância de um job específico do MaxCompute. Para mais informações, consulte Visualizar informações da instância. |
| Job Owner | Filtre pela conta que enviou o job — útil para identificar quem é o responsável por um job que consome muitos recursos. Insira o nome completo da conta no formato ALIYUN$xxx ou RAM$xxx. Pesquisa aproximada não é suportada. |
| ExtNodeId | Pesquise pelo ID do job de origem da ferramenta de orquestração que acionou o job do MaxCompute — por exemplo, um ID de nó do DataWorks. Para mais informações, consulte Configurar propriedades básicas. |
| ExtNodName | Pesquise pelo nome do job de origem da ferramenta de orquestração que acionou o job do MaxCompute. |
| Signature | Pesquise pela assinatura do job SQL para localizar todas as instâncias que executaram a mesma lógica SQL. Disponível apenas para jobs SQL. |
Parâmetros de filtro de itens da lista de jobs
Clique no ícone de filtro
ao lado do cabeçalho de uma coluna para aplicar esses filtros na lista de jobs.
| Parâmetro | Descrição |
|---|---|
| Latest Status | Filtre por status do job para focar em jobs em execução, com falha ou concluídos. Status: Running (ainda não concluído), Success, Failed, Canceled, Submitted (aguardando recursos de computação). Este é o status geral do job; tarefas individuais dentro de um job podem ter sub-status diferentes — verifique o LogView para detalhes. Consulte Usar o LogView 2.0 para visualizar informações de execução do job. |
| Priority | Filtre por prioridade do job (0–9). Valor menor significa prioridade maior. Jobs de alta prioridade recebem recursos de computação primeiro. |
| Intelligent Diagnostics | Filtre por tags de diagnóstico inteligente — útil para localizar rapidamente jobs sinalizados com problemas específicos. Para descrições das tags, consulte Descrição das tags de resultado do diagnóstico inteligente. |
Colunas da Regular Job List
| Coluna | Descrição |
|---|---|
| Instance ID | Cada job do MaxCompute gera uma instância com um ID de instância exclusivo. O projeto, a cota de computação e o tipo de job também são exibidos. Clique em LogView em Actions para visualizar o progresso da execução. Clique em Insights em Actions para abrir a página Job Insights. |
| Latest Status | O status atual do job. |
| Job Owner | A conta Alibaba Cloud que enviou o job. Se um job estiver consumindo recursos excessivos, entre em contato com o responsável ou encerre o job. Consulte Operações de instância. |
| Priority | Prioridade do job de 0 (mais alta) a 9 (mais baixa). Consulte Prioridade do job. |
| Submission Time | Quando o job foi enviado. |
| Start Running Time | Quando o job recebeu seus primeiros recursos de computação. Para jobs com tempo de execução muito curto ou jobs que não consomem recursos de computação (como instruções DDL), a hora de envio é usada em seu lugar. Oculto por padrão — ative nas configurações da lista. |
| Waiting Duration | Tempo desde o envio até o início da execução do job. Se o job não tiver hora de início, a duração desde o envio até o momento do snapshot é exibida. Oculto por padrão — ative nas configurações da lista. |
| Execution Duration | Tempo desde o início até o término do job. Oculto por padrão — ative nas configurações da lista. |
| End Time | Quando o job foi encerrado. |
| Total Duration | Tempo total desde o envio até o encerramento. |
| Total Used CPU Resources | Total de CPU consumido durante o job. Unidade: 100*Core*s. |
| Total Amount of Used Memory Resources | Total de memória consumido durante o job. Unidade: MB*s. |
| CPU Utilization Percentage Snapshot | Percentual de uso de CPU capturado 1 minuto antes do final do intervalo de tempo. Fórmula: CPU Cores in Use / (CPU Lower Limit for Reserved CUs + Elastically Reserved Minimum CPU Utilization). Não disponível para jobs com pagamento conforme o uso ou jobs sem dados de snapshot. Ordenação não suportada — use a Snapshot List para ordenar por essa métrica. |
| Memory Usage Percentage Snapshot | Percentual de uso de memória capturado 1 minuto antes do final do intervalo de tempo. Fórmula: Memory Size Occupied / (Minimum Reserved CU Memory + Minimum Elastically Reserved CU Memory). Não disponível para jobs com pagamento conforme o uso ou jobs sem dados de snapshot. Ordenação não suportada — use a Snapshot List para ordenar por essa métrica. |
| Input Size | Quantidade de dados de entrada processados pelo job. |
| Intelligent Diagnostics | Tags dos resultados do diagnóstico inteligente do job. |
| ExtPlatformId | O cliente que iniciou o job (por exemplo, DataWorks). O solicitante deve passar essa informação ao enviar o job. Consulte Convenções gerais de identificação de jobs. |
| ExtNodeId | O ID da tarefa da ferramenta de orquestração que iniciou o job (por exemplo, um ID de nó de agendamento do DataWorks). O solicitante deve passar essa informação ao enviar o job. Consulte Convenções gerais de identificação de jobs. |
| ExtNodeName | O nome da tarefa da ferramenta de orquestração. O solicitante deve passar essa informação ao enviar o job. Consulte Convenções gerais de identificação de jobs. |
| ExtNodeOnDuty | O responsável pela tarefa da ferramenta de orquestração. O solicitante deve passar essa informação ao enviar o job. Consulte Convenções gerais de identificação de jobs. |
| Signature | A assinatura do job SQL. Use-a para localizar todas as instâncias que executaram a mesma lógica SQL. |
Colunas da Snapshot List
| Coluna | Descrição |
|---|---|
| Instance ID | Cada job do MaxCompute gera uma instância com um ID de instância exclusivo. O projeto, a cota de computação e o tipo de job também são exibidos. Clique em LogView em Actions para visualizar o progresso da execução. Clique em Insights em Actions para abrir a página Job Insights. |
| Snapshot Time | Quando o snapshot foi coletado para o job. |
| Snapshot Status | O status do job no momento do snapshot. |
| Job Owner | A conta Alibaba Cloud que enviou o job. Consulte Operações de instância. |
| Priority | Prioridade do job de 0 (mais alta) a 9 (mais baixa). Consulte Prioridade do job. |
| CPU Cores in Use | Número de núcleos de CPU que o job estava utilizando no momento do snapshot. |
| Requested CPU Cores | Número de núcleos de CPU que o job solicitou no momento do snapshot. |
| CPU Satisfaction Rate | CPU Cores in Use / Requested CPU Cores no momento do snapshot. |
| CPU Utilization Percentage Snapshot | Percentual de uso de CPU capturado 1 minuto antes do final do intervalo de tempo. Fórmula: CPU Cores in Use / (CPU Lower Limit for Reserved CUs + Elastically Reserved Minimum CPU Utilization). Não disponível para jobs com pagamento conforme o uso ou jobs sem dados de snapshot. |
| Memory Size Occupied | Memória que o job estava utilizando no momento do snapshot. A unidade é ajustada automaticamente para exibição. |
| Requested Memory Size | Memória que o job solicitou no momento do snapshot. A unidade é ajustada automaticamente para exibição. |
| Memory Satisfaction Rate | Memory Size Occupied / Requested Memory Size no momento do snapshot. |
| Memory Usage Percentage Snapshot | Percentual de uso de memória no momento de observação. Fórmula: Memória utilizada / (Memória reservada + Memória reservada elástica). Não disponível para jobs com pagamento conforme o uso ou jobs sem dados de snapshot. |
| Submission Time | Quando o job foi enviado. |
| Total Duration | Tempo total desde o envio até o encerramento. |
| ExtPlatformId | O cliente que iniciou o job. Consulte Convenções gerais de identificação de jobs. |
| ExtNodeId | O ID da tarefa da ferramenta de orquestração. Consulte Convenções gerais de identificação de jobs. |
| ExtNodeName | O nome da tarefa da ferramenta de orquestração que iniciou o job (por exemplo, um nome de nó de agendamento do DataWorks). Consulte Convenções gerais de identificação de jobs. |
| ExtNodeOnDuty | O responsável pela tarefa da ferramenta de orquestração. Consulte Convenções gerais de identificação de jobs. |
| Signature | A assinatura do job SQL. Use-a para localizar todas as instâncias que executaram a mesma lógica SQL. |
Cenários comuns de O&M
Visualizar os detalhes de execução de um job específico
Use esta abordagem quando precisar auditar um job específico do MaxCompute ou investigar um job acionado por uma ferramenta de orquestração como o DataWorks.
-
Faça login no console do MaxCompute e selecione uma região.console do MaxCompute
-
No painel de navegação à esquerda, escolha Observation O&M > Jobs.
-
Defina um Time Range e clique em Search.
-
Acima da lista de jobs, selecione ExtNodeId ou Instance ID e insira o valor correspondente.
-
Clique no ícone
para aplicar o filtro. -
Nos resultados, clique em LogView na coluna Actions para abrir a página LogView e visualizar informações detalhadas de execução. Para mais informações, consulte Usar o LogView 2.0 para visualizar informações de execução do job.
Visualizar jobs de um período específico
Use esta abordagem para revisar todos os jobs em múltiplos projetos durante um período passado — por exemplo, para identificar quais jobs falharam no último dia.
-
Faça login no console do MaxCompute e selecione uma região.console do MaxCompute
-
No painel de navegação à esquerda, escolha Observation O&M > Jobs.
-
Defina o Time Range como 1d, ou defina um intervalo personalizado de
00:00:00do dia atual até o horário atual. -
Em Choose Project, selecione os projetos de destino (por exemplo, Projeto_1 e Projeto_2).
-
Clique em Search.
-
Nos resultados, clique em LogView na coluna Actions para visualizar os detalhes de execução de qualquer job. Para mais informações, consulte Usar o LogView 2.0 para visualizar informações de execução do job.
Identificar quais jobs estão consumindo uma cota por assinatura
Use esta abordagem quando o uso de recursos de um grupo de cotas estiver alto e os jobs estiverem em fila — você precisa descobrir quais jobs específicos são responsáveis.
-
Faça login no console do MaxCompute e selecione uma região.console do MaxCompute
-
No painel de navegação à esquerda, escolha Observation O&M > Jobs.
-
Defina o Time Range como 1h ou um intervalo personalizado.
-
Defina Select Quota como o grupo de cotas de destino (por exemplo,
Default Subscription Quota) e clique em Search. -
Nos resultados, verifique o CPU Utilization Percentage Snapshot e o Memory Usage Percentage Snapshot para jobs com Latest Status
Running. Identifique os jobs com maior uso e compare com suas expectativas de negócio para decidir se deve encerrá-los. -
Clique em LogView na coluna Actions para visualizar os detalhes de execução de qualquer job. Para mais informações, consulte Usar o LogView 2.0 para visualizar informações de execução do job.
Visualizar os detalhes de execução de um job de consulta acelerada
Use esta abordagem para verificar o status e os detalhes de execução de jobs SQLRT (Query Acceleration) do último dia.
-
Faça login no console do MaxCompute e selecione uma região.console do MaxCompute
-
No painel de navegação à esquerda, escolha Observation O&M > Jobs.
-
Defina o Time Range como 1d e o Job Type como SQLRT (Query Acceleration), depois clique em Search.
-
Nos resultados, clique em LogView na coluna Actions para visualizar os detalhes de execução. Para mais informações, consulte Usar o LogView 2.0 para visualizar informações de execução do job.
Como os jobs de consulta acelerada aparecem na lista: Para jobs SQLRT, múltiplos comandos SQL podem ser executados na mesma sessão, e uma sessão corresponde a um ID de instância. O LogView desse ID de instância exibe o status de todos os comandos SQL na sessão.
-
Se alguns comandos SQL foram concluídos, mas outros ainda estão em execução (sessão ainda não encerrada), o Latest Status exibe Running.
-
Se a sessão expirou ou a interface foi fechada, o Latest Status exibe Cancelled.
Analisar o consumo de recursos e a alocação de cotas de um job
Use esta abordagem quando um job estiver executando por mais tempo do que o esperado e você suspeitar de um problema no fornecimento de recursos — o job não está recebendo recursos suficientes ou outros jobs estão competindo pela mesma cota.
-
Faça login no console do MaxCompute e selecione uma região.console do MaxCompute
-
No painel de navegação à esquerda, escolha Observation O&M > Jobs.
-
Defina um Time Range e filtre por Select Quota, depois clique em Search.
-
Clique em Insights na coluna Actions da instância de destino para abrir a página Job Insights.
-
Na aba Resource Consumption, revise o uso de recursos ao longo do ciclo de vida do job.
-
O gráfico exibe CUs em uso e CUs em espera tanto no nível do job quanto no nível da cota ao longo do tempo. Se o uso de CUs do job for baixo enquanto o uso de CUs no nível da cota estiver alto ou no limite, a cota está sobrecarregada e outros jobs estão competindo por recursos.
-
Clique em um ponto no eixo horizontal para visualizar a alocação de recursos da cota naquele momento — incluindo a contagem de jobs e a distribuição de prioridade. Clique em um bloco de prioridade para abrir a lista de jobs e identificar quais jobs estavam competindo por recursos de computação. Com base nas suas conclusões, otimize o agendamento de tarefas, ajuste as prioridades dos jobs ou atualize a configuração de recursos de computação. Consulte Prioridade do job e Recursos de computação - Gerenciamento de cotas.
-
Próximos passos
Se o uso de recursos de um job estiver consistentemente alto e outros jobs estiverem em fila:
-
Se o job não atender aos requisitos de negócio, encerre-o.
-
Se o job for legítimo, a configuração de cotas pode precisar de ajustes. Consulte Otimização da configuração de recursos de computação.
Referências
Para verificar o status do job e encerrar jobs usando comandos, consulte Operações de instância.