Para executar operações de gerenciamento de tabelas Paimon — como compactar arquivos pequenos e ordenar dados — no Development Console, implante o JAR paimon-flink-action como uma implantação JAR. Este tópico aborda como baixe os pacotes necessários, enviá-los como artefatos e crie a implantação.
Pré-requisitos
Antes de começar, verifique se você tem:
Ververica Runtime (VVR) 8.0.5 ou posterior (versões anteriores não oferecem suporte a tabelas Paimon)
Baixe os pacotes JAR
Os pacotes JAR necessários dependem da versão do mecanismo da sua implantação.
VVR 11.x (recomendado)
Use os pacotes JAR da comunidade Apache Paimon para obter os recursos mais recentes de gerenciamento de tabelas lake. Baixe tanto o paimon-flink-action quanto o paimon-flink-1.20. O VVR 11.x é compatível com o Flink 1.20 da comunidade.
As versões estáveis estão disponíveis no repositório Maven: paimon-flink-action e paimon-flink-1.20.
Se o recurso necessário ainda não estiver incluído em uma versão estável, use o snapshot noturno mais recente. Para mais informações, consulte Downloads do Apache Paimon.
VVR 8.x
Use os pacotes JAR fixos fornecidos pelo Realtime Compute for Apache Flink:
paimon-flink-action: paimon-flink-action-1-ali-16.0.jarpaimon-ali-vvr: paimon-ali-vvr-8.0-vvp-1-ali-16.0-1.jar
Crie uma implantação JAR
No Development Console, acesse Artifacts e clique em Upload Artifact. Envie ambos os pacotes JAR baixados.
Acesse O&M > Deployments e clique em Create Deployment > JAR Deployment.
-
Na caixa de diálogo Create JAR Deployment, preencha os seguintes campos:
Campo
Descrição
Exemplo
Deployment Mode
Selecione Stream Mode ou Batch Mode conforme a necessidade.
Batch Mode
Deployment Name
Nome desta implantação.
paimon-compaction
Engine Version
Selecione VVR 8.0.5 ou posterior.
vvr-8.0.5-flink-1.17
JAR URI
Selecione o JAR
paimon-flink-actionenviado.—
Entry Point Class
Deixe em branco.
—
Entry Point Main Arguments
Parâmetros de ação passados ao método principal. Especifique os parâmetros com base na operação Paimon desejada. Por exemplo, para ordenação de dados, consulte Data consumption. Algumas ações do Paimon usam um modo de execução leve por padrão e não iniciam um job Flink. Como o Realtime Compute for Apache Flink exige que o programa em uma implantação JAR inicie um job Flink, adicione
--force_start_flink_job trueaos argumentos. Para os parâmetroscatalog_confexigidos por uma ação, consulte Configure catalog_conf parameters.—
Additional Dependencies
Selecione o segundo pacote JAR enviado:
paimon-ali-vvrpara VVR 8.x oupaimon-flink-1.20para VVR 11.x. Certifique-se de tê-lo enviado para Artifacts na Etapa 1 antes de selecioná-lo aqui.—
Clique em Deploy.
Localize a implantação na lista e clique em Start. Para obter detalhes, consulte Start a job.
Configure parâmetros catalog_conf
Uma ação Paimon acessa o catálogo de destino usando os parâmetros catalog_conf. Os parâmetros definidos dependem do tipo de catálogo.
Catálogo DLF
Defina os parâmetros do catálogo DLF, incluindo o par de AccessKey. Para mais informações, consulte Access DLF with Flink DataStream.
|
Parâmetro |
Descrição |
Exemplo |
|
|
Tipo do catálogo. O valor é analisado automaticamente a partir do JAR personalizado. Não o altere. |
paimon |
|
|
Tipo de metastore. Defina o valor como rest. |
rest |
|
|
Endpoint VPC do DLF REST Catalog Server, no formato |
http://cn-hangzhou-vpc.dlf.aliyuncs.com |
|
|
Nome do catálogo DLF. |
dlf_test |
|
|
Provedor de token. Defina o valor como dlf. |
dlf |
|
|
AccessKey ID da sua conta Alibaba Cloud ou de um usuário RAM. |
None |
|
|
AccessKey secret da sua conta Alibaba Cloud ou de um usuário RAM. |
None |
Metastore de sistema de arquivos
Configure os parâmetros de warehouse e AccessKey do OSS. Para mais informações, consulte Gerencie Paimon catalogs.
|
Opção |
Descrição |
Obrigatório |
Observações |
|
|
Diretório do data warehouse no OSS. |
Sim |
O formato é |
|
|
Endpoint do OSS. |
Sim |
Use um endpoint VPC se o workspace Flink e o bucket OSS estiverem na mesma região. Caso contrário, use um endpoint público. Este parâmetro é necessário quando o bucket OSS especificado em warehouse reside em uma região diferente do workspace Flink ou pertence a outra conta. Para mais informações, consulte Regions and endpoints. |
|
|
AccessKey ID da conta Alibaba Cloud ou usuário RAM com permissões de leitura e gravação no OSS. |
Sim |
Para mais informações, consulte Create an AccessKey pair. |
|
|
AccessKey secret da conta Alibaba Cloud ou usuário RAM com permissões de leitura e gravação no OSS. |
Sim |
Configure fs.oss.endpoint, fs.oss.accessKeyId e fs.oss.accessKeySecret nos parâmetros de tempo de execução da implantação Flink. Definir esses valores em catalog_conf pode não surtir efeito.
Próximos passos
Para ajustar parâmetros do job após o início da implantação, consulte Configure a deployment.
Para atualize parâmetros sem reiniciar o job, consulte Dynamically update the parameter configuration for dynamic scaling.
Para otimizações de desempenho comuns em tabelas escaláveis de chave primária e anexação do Paimon, consulte Performance optimization.