Para executar jobs do Ray no DataWorks, vincule um cluster Ray de um workspace do EMR Serverless Spark como recurso de computação Serverless Ray. Após o vínculo, selecione esse recurso em um nó Serverless Ray no Data Studio para executar tarefas.
Pré-requisitos
Você já criou um workspace do EMR Serverless Spark no E-MapReduce e tem um cluster Ray disponível nesse workspace.
-
Você já criou um workspace do DataWorks, adicionou sua conta RAM ao workspace e atribuiu a ela a função de administrador do workspace.
ImportanteSomente workspaces que Use Data Studio (New Version) são suportados.
Você já utilizou um grupo de recursos serverless e o vinculou ao workspace do DataWorks de destino.
Limitações
Restrições de região: As regiões suportadas são as mesmas listadas para vinculação de um recurso de computação do EMR Serverless Spark. As regiões incluem China (Hangzhou), China (Shanghai), China (Beijing), China (Shenzhen), China (Chengdu), China (Hong Kong), Japão (Tóquio), Singapura, Indonésia (Jacarta), Alemanha (Frankfurt), EUA (Vale do Silício) e EUA (Virgínia). Consulte o console para verificar as regiões efetivamente disponíveis.
-
Requisitos de permissão:
Operador
Permissões
Conta Alibaba Cloud
Nenhuma permissão adicional necessária.
Conta RAM/Função RAM
-
Permissões administrativas do DataWorks: Apenas membros do workspace com as funções de O&M e administrador do workspace, ou com a permissão
AliyunDataWorksFullAccess, podem criar recursos de computação. Para mais detalhes, consulte Conceder a permissão de administrador do workspace a um usuário. -
Permissões do serviço EMR Serverless Spark: É necessário ter a política de permissão
AliyunEMRServerlessSparkFullAccesse a permissão deOwnerno workspace Spark de destino. Para mais detalhes, consulte Gerenciar usuários e funções.
-
Vincular um recurso de computação Serverless Ray
Na página Compute Resources, vincule um cluster Ray como recurso de computação Serverless Ray.
-
Selecione o tipo de recurso de computação a vincular.
Clique em Associate Computing Resources para acessar a página Associate Computing Resources.
Na página Associate Computing Resources, selecione Serverless Ray como tipo de recurso de computação para abrir o assistente Bind Serverless RAY Compute Resource.
-
Preencha as informações de vínculo no assistente.
Na segunda etapa da página Enter Information, configure os parâmetros descritos na tabela a seguir.
Parâmetro
Descrição
Spark Workspace
Selecione o workspace do EMR Serverless Spark que contém o cluster Ray. Também é possível criar um workspace Spark diretamente na lista suspensa.
Billing Method
Definido pelo workspace Spark selecionado, como Pay-as-you-go. Não pode ser modificado independentemente.
RAY Cluster
Escolha o cluster Ray a vincular. A lista exibe todos os clusters Ray disponíveis no workspace Spark selecionado.
Engine Version
Preenchido automaticamente com base no cluster Ray escolhido, incluindo a versão do mecanismo e as versões integradas do Ray e Python. As versões exibidas no console são as válidas.
Computing Resource Instance Name
Identifica este recurso de computação nas tarefas do DataWorks. Ao executar uma tarefa, selecione o nome da instância correspondente no nó para utilizar este vínculo.
Description
Opcional. Descreva a finalidade de negócio deste recurso de computação para facilitar a gestão.
ImportantePara garantir a recuperação correta das informações do cluster no DataWorks, não remova a função de administrador das funções vinculadas ao serviço do DataWorks
AliyunServiceRoleForDataWorksOnEmreAliyunServiceRoleForDataWorksEnginedo workspace E-MapReduce Serverless Spark. Clique em Confirm para concluir o vínculo do recurso de computação Serverless Ray.
Próxima etapa
Após o vínculo, crie um nó Serverless Ray no Data Studio e selecione este recurso de computação para executar jobs do Ray.