Todos os produtos
Search
Central de documentação

DataWorks:Nó de lote Flink SQL

Última atualização: Jun 27, 2026

Um nó de lote Flink SQL permite usar instruções SQL padrão para definir e executar tarefas de processamento de dados. Utilize-o para analisar e transformar grandes conjuntos de dados em atividades como limpeza e agregação. O nó oferece configuração visual e representa uma solução eficiente e flexível para processamento em lote de grande escala. Este tópico descreve como utilizar um nó de lote Flink SQL para processar dados em lotes.

Pré-requisitos

  • Você criou um workspace e vinculou um recurso de computação do Realtime Compute for Apache Flink na seção Administration. Para mais informações, consulte Bind computing resources.

  • Você criou um nó de lote Flink SQL. Para mais informações, consulte Create a node for a scheduling workflow.

Etapa 1: Desenvolver o nó de lote Flink SQL

Na página de edição do nó de lote Flink SQL, desenvolva a tarefa do nó.

Desenvolver código SQL

Desenvolva o código da tarefa na área de edição SQL. No código, defina variáveis usando o formato ${variable_name}. Em seguida, no lado direito da página de edição do nó, atribua um valor à variável na seção Scheduling Parameters do painel Scheduling Settings. Isso permite passar parâmetros dinamicamente para o código em cenários de agendamento. Para mais informações sobre o uso de parâmetros de agendamento, consulte Scheduling parameter sources and their expressions. Veja um exemplo abaixo.

-- Create a source table named datagen_source.
CREATE TEMPORARY TABLE datagen_source_${var}(
  name VARCHAR
) WITH (
  'connector' = 'datagen',
  'number-of-rows' = '1000' 
);

-- Create a result table named blackhole_sink.
CREATE TEMPORARY TABLE blackhole_sink_${var}(
  name  VARCHAR
) WITH (
  'connector' = 'blackhole'
);

-- Insert data from the source table into the result table.
INSERT INTO blackhole_sink_${var}
SELECT
  name
FROM datagen_source_${var};
Nota

Neste exemplo, o parâmetro bizdate tem o valor $[yyyymmdd], o que possibilita a sincronização em lote de novos dados diários.

Etapa 2: Configurar o nó de lote Flink SQL

Configure os parâmetros da tarefa para o nó de lote Flink SQL conforme suas necessidades de negócio.

Configurar recursos Flink

Defina os seguintes parâmetros no lado direito da página de edição, na seção Flink resource information dentro de Scheduling Settings. Para mais detalhes, consulte Configure schedule settings.

Parâmetro

Descrição

Flink cluster

Nome do recurso de computação Flink totalmente gerenciado vinculado em Administration.

Flink engine version

Selecione uma versão do motor adequada às suas necessidades.

Resource Group for Scheduling

Selecione um serverless resource group com conectividade de rede ao Flink.

Job Manager CPU

Seguindo as melhores práticas do Flink, o JobManager precisa de pelo menos 0,5 núcleo de CPU e 2 GiB de memória para operar com estabilidade. Recomenda-se 1 núcleo de CPU e 4 GiB de memória, com limite máximo de 16 núcleos de CPU. Ajuste a configuração conforme a escala do cluster e a complexidade do job.

Job Manager Memory

A configuração de memória do JobManager influencia sua capacidade de lidar com tarefas de agendamento e gerenciamento. Para garantir operação estável e eficiente, utilize valores entre 2 GiB e 64 GiB. Adapte o valor segundo a escala do cluster e os requisitos do job.

Task Manager CPU

A configuração de CPU do TaskManager determina sua capacidade de processamento de tarefas. De acordo com as melhores práticas do Flink, recomenda-se no mínimo 0,5 núcleo de CPU e 2 GiB de memória, sendo ideal 1 núcleo de CPU e 4 GiB de memória, até o limite de 16 núcleos. Ajuste conforme necessário.

Task Manager Memory

A memória configurada no TaskManager define o volume de dados e o desempenho no processamento de tarefas. Para assegurar execução estável e eficiente, a memória deve ser de no mínimo 2 GiB, podendo chegar a 64 GiB.

Concurrency

Define o número de execuções paralelas de tarefas em um job Flink. Maior concorrência pode aumentar a velocidade de processamento e a utilização de recursos. Defina este valor considerando os recursos do cluster e as características do job.

Maximum number of slots

Um slot é uma unidade de recurso de tamanho fixo em um Task Manager, alocável para tarefas. Cada slot executa uma instância de tarefa ou operador. Ajuste o número máximo de slots conforme os recursos disponíveis.

Number of slots per TaskManager

A quantidade de slots por TaskManager indica quantas tarefas ele processa simultaneamente. Modifique essa configuração para otimizar o uso de recursos e a capacidade de processamento paralelo.

(Opcional) Configurar parâmetros de agendamento

No lado direito da página de edição, na seção Scheduling Parameters dentro de Scheduling Settings, clique em Add parameters e edite o Parameter name e o Parameter Value para usá-los dinamicamente no código.

(Opcional) Configurar parâmetros de runtime do Flink

Configure parâmetros de runtime no lado direito da página de edição, na seção Flink running parameters dentro de Scheduling Settings. Para mais informações, consulte Configure schedule settings.

Ao configurar parâmetros de runtime do Flink, a sintaxe é compatível com VVP (Ververica Platform). Escreva as configurações diretamente em formato YAML, sem adicionar ponto e vírgula ou outros caracteres especiais para quebras de linha.

Nota

Para executar a tarefa do nó em um cronograma periódico, configure as informações de agendamento (Scheduling Policy, Scheduling time, Scheduling Dependency e Node output parameters) conforme suas necessidades de negócio. Para mais informações, consulte Configure schedule settings.

Após concluir a configuração da tarefa, clique em Save.

Etapa 4: Implantar e gerenciar o nó de lote Flink SQL

  1. Após configurar a tarefa do nó, implante-o. Para mais informações, consulte Deploy a node.

  2. Depois de implantar a tarefa, clique em Go to operation and maintenance abaixo de Deploy to Production para visualizar o status de execução das tarefas agendadas no Operation Center. Para mais informações, consulte View scheduled tasks.

Referência