Use o Data Transmission Service (DTS) para migrar dados de uma instância do ApsaraDB RDS for MySQL para um cluster do Alibaba Cloud Elasticsearch.
Pré-requisitos
Crie uma instância de destino do Elasticsearch. Para mais informações, consulte Create an Alibaba Cloud Elasticsearch instance.
Para migração completa de dados, a instância de destino precisa ter mais espaço de armazenamento do que o banco de dados de origem utiliza.
Limitações
O DTS migra chaves estrangeiras durante a migração de esquema.
Durante a migração completa e incremental de dados, o DTS desativa temporariamente as verificações de restrições e cascatas de chave estrangeira no nível da sessão. Atualizações ou exclusões em cascata no banco de dados de origem enquanto a tarefa está em execução podem causar inconsistência de dados.
Tipo | Descrição |
Limitações do banco de dados de origem |
|
Outras limitações |
|
Casos especiais |
|
Se um objeto de sincronização do DTS for um alias de índice na instância Elasticsearch de destino, pode ocorrer inconsistência de dados quando o índice real apontado pelo alias mudar. Por exemplo, quando os dados são gravados, o alias do índice aponta para o Índice A. Se o alias passar a apontar para o Índice B durante uma operação de exclusão síncrona subsequente, os dados no Índice A não poderão ser excluídos. Como resultado, dados excluídos da origem ainda podem ser consultados no destino.
Faturamento
|
Tipo de migração |
Taxa de configuração da instância |
Taxa de tráfego de Internet |
|
Migração de esquema e migração completa de dados |
Gratuito. |
Quando o parâmetro Access Method do banco de dados de destino estiver definido como Public IP Address, você será cobrado pelo tráfego de Internet. Para mais informações, consulte Billing overview. |
|
Migração incremental de dados |
Pago. Para mais informações, consulte Billing overview. |
Tipos de migração
-
Migração de esquema
O DTS migra as definições de esquema dos objetos de migração do banco de dados de origem para o banco de dados de destino.
-
Migração completa
O DTS migra todos os dados históricos dos objetos de migração especificados do banco de dados de origem para o banco de dados de destino.
-
Migração incremental
Após a conclusão da migração completa, o DTS migra atualizações incrementais de dados do banco de dados de origem para o banco de dados de destino. A migração incremental permite migrar dados sem problemas, sem interromper suas aplicações autogerenciadas.
Operações SQL suportadas para migração incremental
Tipo | Instrução SQL |
DML | INSERT, UPDATE e DELETE Nota Usar uma instrução UPDATE para remover uma coluna não é uma operação suportada. |
Permissões da conta do banco de dados
Banco de dados | Migração de esquema | Migração completa de dados | Migração incremental de dados | Ações |
Instância ApsaraDB RDS for MySQL | Privilégio | Privilégio | Privilégios | |
Cluster Elasticsearch | A conta do banco de dados (geralmente | |||
Mapeamento de tipos de dados
-
Um banco de dados de origem e uma instância Elasticsearch suportam diferentes tipos de dados que nem sempre podem ser mapeados diretamente. Durante a inicialização da estrutura, o DTS mapeia os tipos de dados com base naqueles suportados pela instância Elasticsearch de destino. Para mais informações, consulte Data type mapping for structure initialization.
NotaDurante o processo de migração de esquema do DTS, o service não define o parâmetro
dynamicnomapping. O comportamento desse parâmetro depende das configurações da sua instância Elasticsearch. Se seus dados de origem forem do tipo json, você deve garantir que, para uma chave específica, seus valores correspondentes tenham o mesmo tipo de dados em todas as linhas de uma tabela. Caso contrário, o DTS pode encontrar problemas de sincronização. Para mais informações, consulte dynamic. -
O mapeamento entre o Elasticsearch e um banco de dados relacional varia conforme a versão do Elasticsearch.
ImportanteA partir do Elasticsearch 7.0, um índice não suporta mais múltiplos tipos, e os tipos foram completamente removidos no Elasticsearch 8.0. Por padrão, ao configurar uma tarefa de sincronização ou migração, o DTS mapeia uma tabela de um banco de dados relacional para um índice no Elasticsearch. É possível alterar esse mapeamento ao configurar os objetos a serem sincronizados ou migrados.
Elasticsearch 7.0 e posteriores
Elasticsearch
Banco de dados relacional
index
table
document
row
field
column
mapping
schema
Versões anteriores ao Elasticsearch 7.0
Elasticsearch
Banco de dados relacional
index
database
type
table
document
row
field
column
mapping
schema
Procedimento
-
Acesse a página da lista de tarefas de migração da região de destino usando um dos seguintes métodos.
Pelo console do DTS
Faça login no console do Data Transmission Service (DTS).
No painel de navegação à esquerda, clique em Data Migration.
No canto superior esquerdo da página, selecione a região onde a instância de migração está localizada.
Pelo console do DMS
NotaAs operações reais podem variar dependendo do modo e layout do console do DMS. Para mais informações, consulte Simple mode console e Customize the layout and style of the DMS console.
Faça login no console do Data Management (DMS).
Na barra de menu superior, escolha .
À direita de Data Migration Tasks, selecione a região onde a instância de migração está localizada.
Clique em Create Task para acessar a página de configuração da tarefa.
-
Configure os bancos de dados de origem e de destino.
Categoria
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome para a tarefa. Recomendamos especificar um nome descritivo para facilitar a identificação. O nome não precisa ser único.
Source Database
Select Existing Connection
Para usar uma instância de banco de dados que foi added to the system (criada ou salva), selecione a instância desejada na lista suspensa. As informações do banco de dados abaixo serão configuradas automaticamente.
NotaNo console do DMS, este parâmetro é denominado Select a DMS database instance..
Se você não registrou a instância de banco de dados no sistema ou não precisa usar uma instância registrada, configure manualmente as informações do banco de dados abaixo.
Database Type
Selecione MySQL.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região onde a instância ApsaraDB RDS for MySQL de origem está localizada.
Replicate Data Across Alibaba Cloud Accounts
Para migrar dados dentro da mesma conta Alibaba Cloud, selecione No.
RDS Instance ID
Selecione o ID da instância ApsaraDB RDS for MySQL de origem.
Database Account
Insira a conta do banco de dados para a instância ApsaraDB RDS for MySQL de origem. Para informações sobre as permissões necessárias, consulte Permissions required for database accounts.
Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
Selecione Non-encrypted ou SSL-encrypted conforme necessário. Se selecionar SSL-encrypted, você deve ativar a criptografia SSL para a instância RDS for MySQL antecipadamente. Para mais informações, consulte Use a cloud certificate to quickly enable SSL encryption.
Destination Database
Select Existing Connection
Para usar uma instância de banco de dados que foi added to the system (criada ou salva), selecione a instância desejada na lista suspensa. As informações do banco de dados abaixo serão configuradas automaticamente.
NotaNo console do DMS, este parâmetro é denominado Select a DMS database instance..
Se você não registrou a instância de banco de dados no sistema ou não precisa usar uma instância registrada, configure manualmente as informações do banco de dados abaixo.
Database Type
Selecione Elasticsearch.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região onde a instância Elasticsearch de destino está localizada.
Type
Selecione Cluster Edition ou Serverless de acordo com seus requisitos.
Instance ID
Selecione o ID da instância Elasticsearch de destino.
Database Account
Insira a conta usada para conectar à instância Elasticsearch. Este é o Username que você especificou ao criar a instância. A conta padrão é elastic.
Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
Selecione HTTP ou HTTPS conforme necessário.
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página.
NotaCertifique-se de que o segmento de endereço IP do service DTS foi adicionado automática ou manualmente às configurações de segurança dos bancos de dados de origem e destino para permitir o acesso dos servidores DTS. Para mais informações, consulte Add DTS server IP addresses to a whitelist.
Se o banco de dados de origem ou de destino for um banco de dados autogerenciado (o Access Method não é Alibaba Cloud Instance), você também deve clicar em Test Connectivity na caixa de diálogo CIDR Blocks of DTS Servers que aparece.
-
Configure os objetos da tarefa.
-
Na página Configure Objects, configure os objetos que deseja migrar.
Parâmetro
Descrição
Migration Types
Se precisar apenas realizar uma migração completa, selecione tanto Schema Migration quanto Full Data Migration.
Para realizar uma migração sem tempo de inatividade, selecione Schema Migration, Full Data Migration e Incremental Data Migration.
NotaSe não selecionar Schema Migration, você deve garantir que exista um banco de dados e tabelas para receber os dados no banco de dados de destino. Também é possível usar o recurso de mapeamento de nome de objeto na caixa Selected Objects conforme necessário.
Se não selecionar Incremental Data Migration, não grave novos dados na instância de origem durante a migração de dados para garantir a consistência dos dados.
Processing Mode for Existing Tables in Destination
Precheck and Report Errors: Verifica se existem tabelas com os mesmos nomes no banco de dados de destino. Se não existirem tabelas com os mesmos nomes, a pré-verificação é aprovada. Se existirem tabelas com os mesmos nomes, um erro é relatado durante a pré-verificação e a tarefa de migração de dados não é iniciada.
NotaSe uma tabela no banco de dados de destino tiver o mesmo nome, mas não puder ser facilmente excluída ou renomeada, você poderá alterar o nome da tabela no banco de dados de destino. Para mais informações, consulte Object name mapping.
Ignore Errors and Proceed: Ignora a verificação de tabelas com os mesmos nomes.
AvisoSelecionar Ignore Errors and Proceed pode causar inconsistência de dados e riscos ao negócio. Por exemplo:
Se os esquemas das tabelas forem consistentes e um registro no banco de dados de destino tiver o mesmo valor de chave primária que um registro no banco de dados de origem:
Durante a migração completa, o DTS mantém o registro no banco de dados de destino. O registro do banco de dados de origem não é migrado.
Durante a migração incremental, o DTS não mantém o registro no banco de dados de destino. O registro do banco de dados de origem sobrescreve o registro no banco de dados de destino.
Se os esquemas das tabelas forem inconsistentes, apenas algumas colunas de dados podem ser migradas ou a migração pode falhar. Prossiga com cautela.
Index Name
Se selecionar Table Name, o índice criado na instância Elasticsearch de destino terá o mesmo nome da tabela.
Se selecionar Database Name_Table Name, o nome do índice na instância Elasticsearch de destino será uma concatenação do nome do banco de dados, um sublinhado (_) e o nome da tabela.
NotaA configuração de mapeamento de nome de índice aplica-se a todas as tabelas.
Case Sensitivity Policy for Destination Object Names
É possível configurar a política de diferenciação de maiúsculas e minúsculas para os nomes dos objetos migrados, como bancos de dados, tabelas e colunas, na instância de destino. Por padrão, DTS default policy está selecionado. Você também pode optar por manter a diferenciação de maiúsculas e minúsculas consistente com a política padrão do banco de dados de origem ou de destino. Para mais informações, consulte Case sensitivity of object names in the destination database.
Source Objects
No painel Source Objects, clique no objeto que deseja migrar e, em seguida, clique no ícone
para mover o objeto para o painel Selected Objects.Selected Objects
Para modificar os nomes dos campos após a migração, clique com o botão direito no nome da tabela correspondente no painel Selected Objects, defina o nome do índice e o nome do tipo para a tabela na instância Elasticsearch de destino e, em seguida, clique em OK. Para mais informações, consulte Map a single table and its columns.
NotaO único caractere especial suportado para nomes de índices e nomes de tipos é o sublinhado (_).
É possível definir condições de filtro SQL. Apenas os dados que atendem a essas condições serão migrados para a instância de destino. Para mais informações, consulte Filter task data by using SQL conditions.
-
Clique em Next: Advanced Settings para configurar parâmetros avançados.
Parâmetro
Descrição
Dedicated Cluster for Task Scheduling
Por padrão, o DTS agenda tarefas em um cluster compartilhado. Não é necessário selecionar um. Se desejar tarefas mais estáveis, adquira um dedicated cluster para executar tarefas de migração do DTS.
Retry Time for Failed Connections
Após o início da tarefa de migração, se a conexão com o banco de dados de origem ou de destino falhar, o DTS relatará um erro e começará imediatamente a tentar reconectar. A duração padrão de nova tentativa é de 720 minutos. É possível personalizar o tempo de nova tentativa para um valor entre 10 e 1440 minutos. Recomendamos definir a duração para mais de 30 minutos. Se o DTS se reconectar aos bancos de dados de origem e destino dentro da duração especificada, a tarefa de migração será retomada automaticamente. Caso contrário, a tarefa falhará.
NotaPara múltiplas instâncias DTS que compartilham a mesma origem ou destino, o tempo de nova tentativa de rede é determinado pela configuração da última tarefa criada.
Como você é cobrado pela tarefa durante o período de nova tentativa de conexão, recomendamos personalizar o tempo de nova tentativa com base nas necessidades do seu negócio ou liberar a instância DTS o mais rápido possível após a liberação das instâncias de banco de dados de origem e destino.
Retry Time for Other Issues
Após o início da tarefa de migração, se ocorrer um problema não relacionado à conexão, como uma exceção de execução DDL ou DML, no banco de dados de origem ou de destino, o DTS relatará um erro e começará imediatamente a tentar repetir a operação. A duração padrão de nova tentativa é de 10 minutos. É possível personalizar o tempo de nova tentativa para um valor entre 1 e 1440 minutos. Recomendamos definir a duração para mais de 10 minutos. Se as operações relacionadas forem bem-sucedidas dentro da duração de nova tentativa especificada, a tarefa de migração será retomada automaticamente. Caso contrário, a tarefa falhará.
ImportanteO valor de Retry Time for Other Issues deve ser menor que o valor de Retry Time for Failed Connections.
Shard Configuration
Defina o número de shards primários e de réplica para o índice com base na configuração máxima de shards dos índices na instância Elasticsearch de destino.
String Index
Especifica como as strings são indexadas na instância Elasticsearch de destino.
analyzed: A string é primeiro analisada e depois indexada. Você também deve selecionar um analisador específico. Para informações sobre tipos de analisadores e suas funções, consulte Analyzers.
not_analyzed: A string não é analisada e é indexada usando seu valor original.
no: A string não é indexada.
Time Zone
Especifica o fuso horário aplicado quando o DTS migra tipos de dados baseados em tempo (como DATETIME e TIMESTAMP) para a instância Elasticsearch de destino.
NotaSe os dados baseados em tempo na instância de destino não exigirem um fuso horário, você deve definir previamente o tipo de documento (type) para esses tipos de dados na instância de destino.
DOCID
Por padrão, o DOCID é a chave primária da tabela. Se a tabela não tiver chave primária, o DOCID será uma coluna ID gerada automaticamente pelo Elasticsearch.
Environment Tag
Selecione uma tag de ambiente para identificar a instância. Este parâmetro é opcional para este exemplo.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carregamento (ETL). Para mais informações, consulte What is ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configure ETL in a data migration or data synchronization task.
-
No: Desativa o recurso ETL.
Whether to delete SQL operations on heartbeat tables of forward and reverse tasks
Escolha se deseja gravar informações SQL de heartbeat no banco de dados de origem enquanto a instância DTS está em execução.
-
Yes: As informações SQL de heartbeat não são gravadas no banco de dados de origem. Isso pode fazer com que a instância DTS relate um atraso.
-
No: Grava informações SQL de heartbeat no banco de dados de origem. Isso pode interferir em recursos como backup físico e clonagem do banco de dados de origem.
Monitoring and Alerting
Selecione se deseja definir alertas e receber notificações de alerta com base nas necessidades do seu negócio.
No: Não define um alerta.
Yes: Configure alertas definindo um alert threshold e um alert notifications. Se uma migração falhar ou a latência exceder o limiar, o sistema enviará uma notificação de alerta.
-
Após concluir as configurações anteriores, clique em Next: Configure Database and Table Fields na parte inferior da página para definir a
_routing policye o valor de_idpara as tabelas a serem migradas no Elasticsearch de destino.Tipo
Descrição
Set _routing
Configura o _routing para armazenar documentos em um shard específico na instância Elasticsearch de destino. Para mais informações, consulte _routing.
Selecione Yes para usar uma coluna personalizada para roteamento.
Selecione No para usar o valor _id para roteamento.
NotaSe a instância Elasticsearch de destino for versão 7.x, você deve selecionar No.
_routing Column
Selecione a coluna a ser usada para roteamento.
NotaEste parâmetro é necessário apenas se você selecionar Yes para Set _routing.
Value of _id
Selecione a coluna a ser usada como ID do documento.
-
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros de configuração desta instância ao chamar a operação API, passe o ponteiro sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão que aparece.
Se não precisar visualizar ou já tiver terminado de visualizar os parâmetros da API, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início da tarefa de migração, o DTS realiza uma pré-verificação. A tarefa só começa após ser aprovada na pré-verificação.
Se a pré-verificação falhar, clique em View Details ao lado do item de verificação com falha, corrija o problema com base no aviso e execute a pré-verificação novamente.
-
Se um aviso for relatado durante a pré-verificação:
Para itens de verificação que não podem ser ignorados, clique em View Details ao lado do item com falha, corrija o problema com base no aviso e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, clique em Confirm Alert Details, Ignore, OK e Precheck Again para pular o item de alerta e executar a pré-verificação novamente. Se optar por ignorar um aviso, isso pode causar problemas como inconsistência de dados e apresentar riscos ao seu negócio.
-
Adquira a instância.
Quando a Success Rate for 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione a especificação de link para a instância de migração de dados. Para mais informações, consulte a tabela a seguir.
Categoria
Parâmetro
Descrição
New Instance Class
Resource Group Settings
Selecione o grupo de recursos ao qual a instância pertence. O valor padrão é default resource group. Para mais informações, consulte What is resource management?
Instance Class
O DTS fornece especificações de migração com diferentes níveis de desempenho. A especificação do link afeta a velocidade da migração. Selecione uma especificação com base no seu cenário de negócio. Para mais informações, consulte Data migration link specifications.
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK que aparece, clique em OK.
Visualize o progresso da tarefa de migração na página de lista Data Migration Tasks.
NotaSe a tarefa de migração não incluir migração incremental, ela será parada automaticamente após a conclusão da migração completa. Após a parada da tarefa, seu Status muda para Completed.
Se a tarefa de migração incluir migração incremental, ela não será parada automaticamente. A tarefa de migração incremental continua em execução. Enquanto a tarefa de migração incremental estiver em execução, o Status da tarefa será Running.