Este tópico descreve como sincronizar dados de uma instância ApsaraDB RDS for MySQL para um cluster AnalyticDB for MySQL V3.0 usando o Data Transmission Service (DTS). Após a sincronização, use o AnalyticDB for MySQL para criar sistemas internos de business intelligence (BI), sistemas de consulta interativa e relatórios em tempo real.
Pré-requisitos
Instância ApsaraDB RDS for MySQL criada. Para mais informações, consulte Criar uma instância ApsaraDB RDS for MySQL.
Cluster de destino AnalyticDB for MySQL V3.0 criado. Para mais informações, consulte Criar um cluster.
Espaço de armazenamento disponível no cluster de destino AnalyticDB for MySQL V3.0 maior que o tamanho total dos dados na instância de origem ApsaraDB RDS for MySQL.
Observações de uso
Durante a sincronização de schema, o DTS não sincroniza chaves estrangeiras do banco de dados de origem para o de destino.
Nas fases de sincronização completa e incremental de dados, o DTS desativa temporariamente as verificações de restrições e operações em cascata de chaves estrangeiras no nível da sessão. Executar operações de atualização ou exclusão em cascata no banco de origem enquanto a tarefa está em execução pode causar inconsistência de dados.
O DTS não oferece suporte à sincronização de materialized views para a instância de destino AnalyticDB for MySQL durante a sincronização de schema. Caso precise utilizar materialized views, crie-as manualmente na instância de destino após a conclusão da sincronização.
Tipo | Descrição |
Limites do banco de dados de origem |
|
Outros limites |
|
Casos especiais |
|
Faturamento
|
Tipo de sincronização |
Preço |
|
Sincronização de schema e sincronização completa de dados |
Gratuito. |
|
Sincronização incremental de dados |
Pago. Para mais informações, consulte Visão geral do faturamento. |
Topologias de sincronização suportadas
Sincronização unidirecional um para um
Sincronização unidirecional um para muitos
Sincronização unidirecional muitos para um
Operações SQL que podem ser sincronizadas
Tipo de operação | Instrução SQL |
DML | INSERT, UPDATE e DELETE Nota Quando os dados são gravados no cluster AnalyticDB for MySQL, a instrução UPDATE é automaticamente convertida para a instrução REPLACE INTO. |
DDL | CREATE TABLE, DROP TABLE, RENAME TABLE, TRUNCATE TABLE, ADD COLUMN e DROP COLUMN |
Se o tipo de dados de um campo na tabela de origem for alterado durante a sincronização de dados, uma mensagem de erro será retornada e a tarefa de sincronização será interrompida. Siga as etapas abaixo para solucionar o problema:
Quando o DTS sincroniza dados para o cluster de destino AnalyticDB for MySQL, o tipo de dados de um campo na tabela de origem é alterado. Como resultado, a tarefa de sincronização de dados falha. Neste exemplo, a tabela de origem chama-se customer.
No cluster de destino AnalyticDB for MySQL V3.0, crie uma tabela chamada customer_new com o mesmo schema da tabela customer.
Execute a instrução INSERT INTO SELECT para copiar os dados da tabela customer e inseri-los na tabela customer_new. Isso garante que os dados das duas tabelas estejam consistentes.
Renomeie ou exclua a tabela customer. Em seguida, altere o nome da tabela customer_new para customer.
Reinicie a tarefa de sincronização de dados no console do DTS.
Procedimento
-
Acesse a página Data Synchronization Tasks.
Faça login no console do Data Management (DMS).
Na barra de navegação superior, clique em Data + AI.
No painel de navegação à esquerda, escolha .
NotaAs operações podem variar dependendo do modo e layout do console do DMS. Para mais informações, consulte Console no modo simples e Personalizar layout e estilo do console do DMS.
Você também pode acessar a página Data Synchronization Tasks do novo console do DTS.
-
No lado direito de Data Synchronization Tasks, selecione a região onde reside a instância de sincronização de dados.
NotaSe você usar o novo console do DTS, deverá selecionar a região onde reside a instância de sincronização de dados na barra de navegação superior.
-
Clique em Create Task para configurar os bancos de dados de origem e de destino.
AvisoApós selecionar as instâncias de origem e de destino, leia atentamente os limites exibidos na parte superior da página. O não cumprimento desses limites pode causar falha na tarefa ou inconsistência de dados.
Seção
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome para a tarefa. Recomendamos especificar um nome descritivo para facilitar a identificação. O nome não precisa ser único.
Source Database
Select DMS Database Instance
Selecione uma instância existente conforme necessário.
-
Se você usar uma instância existente, as informações do banco de dados serão preenchidas automaticamente. Não é necessário inseri-las novamente.
-
Se não usar uma instância existente, insira as seguintes informações do banco de dados.
Database Type
O tipo do banco de dados de origem. Selecione MySQL.
Connection Type
O método de acesso ao banco de dados de origem. Selecione Alibaba Cloud Instance.
Instance Region
A região onde reside a instância de origem ApsaraDB RDS for MySQL.
Cross-account
Especifica se os dados são sincronizados entre contas da Alibaba Cloud. Neste exemplo, No está selecionado.
RDS Instance ID
O ID da instância de origem ApsaraDB RDS for MySQL.
Database Account
A conta do banco de dados da instância de origem ApsaraDB RDS for MySQL. A conta deve ter permissões SELECT nos objetos a serem sincronizados e permissões REPLICATION CLIENT e REPLICATION SLAVE.
Database Password
Insira a senha correspondente à conta do banco de dados.
Connection Method
Selecione Non-encrypted ou SSL-encrypted conforme necessário. Se selecionar SSL-encrypted, você deve ativar a criptografia SSL para a instância RDS for MySQL antecipadamente. Para mais informações, consulte Usar um certificado de nuvem para ativar rapidamente a criptografia SSL.
Destination Database
Select DMS Database Instance
Selecione uma instância existente conforme necessário.
-
Se você usar uma instância existente, as informações do banco de dados serão preenchidas automaticamente. Não é necessário inseri-las novamente.
-
Se não usar uma instância existente, insira as seguintes informações do banco de dados.
Database Type
O tipo do banco de dados de destino. Selecione AnalyticDB for MySQL 3.0.
Connection Type
O método de acesso ao banco de dados de destino. Selecione Alibaba Cloud Instance.
Instance Region
A região onde reside o cluster de destino AnalyticDB for MySQL V3.0.
Instance ID
O ID do cluster de destino AnalyticDB for MySQL V3.0.
Database Account
A conta do banco de dados do cluster de destino AnalyticDB for MySQL V3.0. A conta deve ter permissões de leitura e gravação no banco de dados de destino.
Database Password
Insira a senha correspondente à conta do banco de dados.
-
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página.
Se o banco de dados de origem ou de destino for uma instância de banco de dados da Alibaba Cloud, como uma instância RDS for MySQL ou ApsaraDB for MongoDB, o DTS adiciona automaticamente os endereços IP dos servidores DTS na região correspondente à lista de permissões da instância de banco de dados da Alibaba Cloud. Se o banco de dados de origem ou de destino for um banco de dados autogerenciado hospedado em uma instância ECS, o DTS adiciona automaticamente os endereços IP dos servidores DTS na região correspondente às regras de segurança da instância ECS. Você também deve garantir que o banco de dados autogerenciado permita acesso da instância ECS. Se o banco de dados estiver implantado em um cluster em várias instâncias ECS, adicione manualmente os endereços IP dos servidores DTS na região correspondente às regras de segurança de cada instância ECS. Se o banco de dados de origem ou de destino for um banco de dados autogerenciado em um IDC ou um banco de dados de outro provedor de serviços em nuvem, adicione manualmente os endereços IP dos servidores DTS na região correspondente para permitir o acesso dos servidores DTS. Para mais informações sobre os endereços IP dos servidores DTS, consulte Blocos CIDR de endereços IP dos servidores DTS.
AvisoAdicionar os blocos CIDR de endereços IP públicos dos servidores DTS, seja automaticamente ou manualmente, pode apresentar riscos de segurança. Ao usar este produto, você reconhece e aceita esses riscos potenciais. Implemente proteções básicas de segurança. Essas proteções incluem, mas não se limitam a, fortalecer a segurança de senhas, restringir portas abertas para blocos CIDR, usar autenticação para comunicação interna de API e revisar e restringir regularmente blocos CIDR desnecessários. Alternativamente, conecte-se ao banco de dados por meio de uma rede interna, como uma linha dedicada, um VPN Gateway ou um Smart Access Gateway.
-
Configure os objetos da tarefa e as configurações avançadas.
-
Basic Settings
Parâmetro ou configuração
Descrição
Synchronization Types
Incremental Data Synchronization está selecionado. Por padrão, você também deve selecionar Schema Synchronization e Full Data Synchronization. Após a conclusão da pré-verificação, o DTS realiza uma sincronização completa dos dados dos objetos selecionados da instância de origem para o cluster de destino. Isso serve como base para a subsequente sincronização incremental de dados.
NotaSe Full Data Synchronization estiver selecionado, você poderá sincronizar o schema e os dados da tabela criada pela execução da instrução CREATE TABLE para o banco de dados de destino.
Processing Mode for Existing Tables in Destination
-
Precheck and Report Errors: Verifica se existe uma tabela com o mesmo nome no banco de dados de destino. Se não existir, a pré-verificação é aprovada. Se existir, a pré-verificação falha e a tarefa de sincronização de dados não é iniciada.
NotaSe não for possível excluir ou renomear a tabela com o mesmo nome no banco de dados de destino, mapeie-a para um nome de tabela diferente. Para mais informações, consulte Mapear nomes de tabelas e colunas.
-
Ignore Errors and Proceed: Ignora a verificação de nomes de tabelas duplicados no banco de dados de destino.
AvisoSelecionar Ignore Errors and Proceed pode causar inconsistência de dados e colocar seu negócio em risco. Por exemplo:
-
Se os schemas das tabelas forem iguais e um registro no banco de dados de destino tiver o mesmo valor de chave primária ou única que um registro no banco de dados de origem:
-
Durante a sincronização completa, o DTS mantém o registro no cluster de destino. O registro correspondente do banco de dados de origem não é sincronizado.
-
Durante a sincronização incremental, o registro do banco de dados de origem substitui o registro no banco de dados de destino.
-
-
Se os schemas das tabelas forem diferentes, a sincronização inicial de dados poderá falhar. Isso pode resultar na sincronização de apenas dados parciais de colunas ou em uma falha completa da sincronização. Proceda com cautela.
-
Select DDL and DML operations for instance-level synchronization
As operações DDL e DML que você deseja sincronizar. Para mais informações, consulte Operações SQL que podem ser sincronizadas.
NotaPara selecionar as operações SQL executadas em um banco de dados ou tabela específico, clique com o botão direito em um objeto na seção Selected Objects. Na caixa de diálogo exibida, selecione as operações SQL que deseja sincronizar.
Merge Multiple Tables
-
Selecione Yes: Em cenários OLTP, o sharding de banco de dados e tabelas é frequentemente usado para melhorar o tempo de resposta das tabelas de negócios. Em cenários OLAP, como o banco de dados de destino neste exemplo, uma única tabela de dados pode armazenar grandes volumes de dados, facilitando consultas de tabela única. Nesses cenários, use o recurso de mesclagem de múltiplas tabelas do DTS para sincronizar várias tabelas com o mesmo schema (tabelas fragmentadas) do banco de dados de origem em uma única tabela no banco de dados de destino. Para instruções específicas, consulte Ativar mesclagem de múltiplas tabelas.
Nota-
Após selecionar várias tabelas do banco de dados de origem, use o recurso de mapeamento de nomes de objetos para alterar seus nomes para o mesmo nome de tabela no banco de dados de destino. Para mais informações sobre o recurso de mapeamento de nomes de objetos, consulte Mapear nomes de tabelas e colunas.
-
O DTS adiciona a coluna
__dts_data_sourcedo tipo text à tabela de destino para armazenar a fonte de dados. O valor da coluna usa o formatoDTS instance ID:database name:schema name:table namepara identificar a origem da tabela, por exemplo,dts****:dtstestdata:testschema:customer1. -
O recurso de mesclagem de múltiplas tabelas atua no nível da tarefa, o que significa que não é possível realizar a mesclagem no nível da tabela. Se quiser mesclar algumas tabelas, mas não outras, crie duas tarefas de sincronização de dados.
AvisoNão execute operações DDL para alterar o schema do banco de dados ou da tabela no banco de dados de origem. Caso contrário, poderá ocorrer inconsistência de dados ou falha na tarefa de sincronização.
-
-
Selecione No. Esta é a opção padrão.
Case Sensitivity Policy for Destination Object Names
Configure a política de distinção entre maiúsculas e minúsculas para nomes de objetos de banco de dados, tabelas e colunas sincronizados com a instância de destino. Por padrão, a DTS default policy está selecionada. Você também pode optar por usar as políticas padrão dos bancos de dados de origem e de destino. Para mais informações, consulte Política de distinção entre maiúsculas e minúsculas para nomes de objetos de destino.
Source Objects
Na caixa Source Objects, clique em um objeto para sincronizar e, em seguida, clique em
para movê-lo para a caixa Selected Objects.NotaSelecione colunas, tabelas ou bancos de dados como objetos a serem sincronizados. Se selecionar tabelas ou colunas, o DTS não sincronizará outros objetos, como views, triggers ou stored procedures, para o banco de dados de destino.
Se selecionar um banco de dados como objeto a ser sincronizado, o DTS sincronizará os dados com base nas seguintes regras padrão:
Se a tabela a ser sincronizada no banco de dados de origem tiver uma chave primária, como uma chave primária de coluna única ou composta, as colunas de chave primária serão especificadas como chaves de distribuição.
Se a tabela a ser sincronizada no banco de dados de origem não tiver uma chave primária, uma coluna de chave primária com incremento automático será gerada automaticamente na tabela de destino. Isso pode causar inconsistência de dados entre os bancos de origem e destino.
Selected Objects
-
Para renomear um único objeto de sincronização na instância de destino, clique com o botão direito no objeto na caixa Selected Objects. Para mais informações sobre como renomear objetos, consulte Mapear um único banco de dados, tabela ou coluna.
-
Para alterar os nomes de vários objetos de sincronização na instância de destino em lote, clique em Batch Edit no canto superior direito da caixa Selected Objects. Para mais informações, consulte Mapear bancos de dados, tabelas e colunas em lote.
NotaPara selecionar as operações SQL executadas em um banco de dados ou tabela específico, clique com o botão direito em um objeto a ser sincronizado na seção Selected Objects. Na caixa de diálogo exibida, selecione as operações SQL que deseja sincronizar. Para mais informações sobre as operações SQL que podem ser sincronizadas, consulte Operações SQL que podem ser sincronizadas.
Para especificar condições WHERE para filtrar dados, clique com o botão direito em um objeto na seção Selected Objects. Na caixa de diálogo exibida, especifique as condições. Para mais informações sobre como especificar as condições, consulte Usar condições SQL para filtrar dados.
-
-
Advanced Settings
Parâmetro
Descrição
Monitoring and Alerting
Especifique se deseja configurar alertas. Se a sincronização falhar ou a latência exceder o limiar especificado, uma notificação será enviada a um contato de alerta.
-
No: Nenhum alerta é configurado.
-
Yes: Configure alertas definindo um limiar de alerta e especificando um alert notification. Para mais informações, consulte Configurar monitoramento e alertas durante a configuração da tarefa.
Replicate temporary tables created by online DDL tools for the source table to the destination database
Operações DDL não são suportadas para sincronização. Selecione No, Adapt to DMS Online DDL ou No, Adapt to gh-ost. Se a sincronização DDL for suportada neste cenário no futuro e você usar o Data Management (DMS) ou gh-ost para fazer alterações DDL online no banco de dados de origem, poderá escolher se deseja sincronizar dados das tabelas temporárias geradas durante as alterações DDL online.
ImportanteOs métodos de processamento para cada etapa são os seguintes: As etapas de Schema Synchronization e Full Data Synchronization não permitem operações DDL que alterem o schema do banco de dados ou da tabela. Portanto, essas etapas não são controladas pela política de Online DDL.
-
Schema Synchronization: Esta etapa não é controlada pela política de Online DDL. Tabelas temporárias relacionadas são criadas.
-
Full Data Synchronization: Esta etapa não é controlada pela política de Online DDL. Tabelas temporárias não são incluídas nos objetos de sincronização completa. Todas as tabelas cujos nomes correspondem à expressão regular (
^_(.+)_(?:gho|new)$ou^_(.+)_(?:ghc|del|old)$) são filtradas. -
Incremental Data Synchronization: Esta etapa é controlada pela política de Online DDL.
-
Yes: Sincroniza alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por operações DDL online. -
No, Adapt to DMS Online DDL e No, Adapt to gh-ost: Filtra alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por ferramentas como gh-ost com base em regras de expressão regular.
-
-
Yes: Sincroniza dados de tabelas temporárias gerados por alterações DDL online.
NotaSe os dados das tabelas temporárias gerados por alterações DDL online forem muito grandes, isso poderá causar latência na sincronização.
-
No, Adapt to DMS Online DDL: Não sincroniza dados de tabelas temporárias geradas por alterações DDL online. Em vez disso, sincroniza apenas as instruções DDL originais executadas no banco de dados de origem usando o Data Management (DMS).
NotaEsta opção causa bloqueio de tabelas no banco de dados de destino.
-
No, Adapt to gh-ost: Não sincroniza tabelas temporárias geradas por alterações DDL online. Suporta regras de filtragem personalizadas. O DTS filtra alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por ferramentas como gh-ost com base em regras de expressão regular. Modifique as expressões regulares padrão usadas para corresponder a shadow tables e useless tables conforme necessário:-
Shadow table:
^_(.+)_(?:gho|new)$ -
Useless table:
^_(.+)_(?:ghc|del|old)$
NotaEsta opção causa bloqueio de tabelas no banco de dados de destino.
-
Retry Time After Connection to Source or Destination Database Fails
Após o início de uma tarefa de sincronização, se a conexão com o banco de dados de origem ou de destino falhar, o DTS relatará um erro e iniciará imediatamente uma nova tentativa de conexão. A duração padrão de nova tentativa é de 720 minutos. Especifique uma duração personalizada de 10 a 1.440 minutos. Recomendamos definir a duração para 30 minutos ou mais. Se o DTS reconectar com sucesso ao banco de dados dentro da duração especificada, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
Nota-
Se você tiver várias instâncias do DTS (por exemplo, Instância A e Instância B) que compartilham a mesma origem ou destino, e definir o tempo de nova tentativa de rede para 30 minutos na Instância A e 60 minutos na Instância B, a duração mais curta de 30 minutos será usada para ambas.
-
Como o DTS cobra pelo tempo de execução da tarefa durante o período de nova tentativa de conexão, recomendamos personalizar a duração da nova tentativa com base nas necessidades do seu negócio ou liberar a instância do DTS o mais rápido possível após a liberação das instâncias de banco de dados de origem e de destino.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carregamento (ETL). Para mais informações, consulte O que é ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configurar ETL em uma tarefa de migração ou sincronização de dados.
-
No: Desativa o recurso ETL.
-
-
-
Opcional: Após concluir a configuração anterior, clique em Next: Configure Database and Table Fields para definir o Type, Primary Key Column, Distribution Key e informações de chave de partição (Partition Key, Partitioning Rules e Partition Lifecycle) para a tabela a ser sincronizada no banco de dados de destino.
NotaEsta etapa está disponível apenas se você selecionar Schema Synchronization para Synchronization Types ao configurar os objetos da tarefa. Em seguida, defina Definition Status como All para fazer modificações.
A Primary Key Column pode ser uma chave primária composta por várias colunas. Selecione uma ou mais colunas da Primary Key Column para servir como Distribution Key e Partition Key. Para mais informações, consulte CREATE TABLE.
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros da API para configurar esta instância, passe o mouse sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão.
Se terminar de visualizar os parâmetros da API, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início do trabalho de sincronização, o DTS executa uma pré-verificação. O trabalho só pode começar após a aprovação de todos os itens de pré-verificação.
Se a pré-verificação falhar, clique em View Details para o item com falha. Corrija o problema conforme indicado e execute a pré-verificação novamente.
-
Se a pré-verificação retornar um aviso:
Se um item de verificação falhar e não puder ser ignorado, clique em View Details ao lado do item. Siga as instruções para corrigir o problema e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, clique em Confirm Alert Details, Ignore, OK e Precheck Again em sequência para pular o aviso e executar a pré-verificação novamente. Se optar por ignorar o item de aviso, isso poderá causar problemas como inconsistência de dados e representar riscos para o seu negócio.
Quando a Success Rate for 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione o método de faturamento e a especificação de link para a instância de sincronização de dados. A tabela a seguir descreve esses parâmetros em detalhes.
Categoria
Parâmetro
Descrição
New Instance Class
Billing Method
-
Subscription: Você paga ao criar a instância. Adequado para necessidades de longo prazo e mais econômico que o pagamento conforme o uso. Quanto maior a duração da assinatura, maior o desconto.
-
Pagamento conforme o uso: Cobrado por hora. Adequado para necessidades de curto prazo. Libere a instância imediatamente após o uso para economizar custos.
Resource Group Configuration
O grupo de recursos ao qual a instância pertence. O padrão é default resource group. Para mais informações, consulte O que é Resource Management?.
Link Specification
O DTS fornece especificações de sincronização com diferentes níveis de desempenho. A especificação do link de sincronização afeta a taxa de sincronização. Escolha uma especificação com base no seu cenário de negócios. Para mais informações, consulte Especificações de link de sincronização de dados.
Subscription Duration
No modo Subscription, selecione a duração e a quantidade para a instância de assinatura. Escolha uma assinatura mensal de 1 a 9 meses ou uma assinatura anual de 1, 2, 3 ou 5 anos.
NotaEsta opção está disponível apenas quando o método de faturamento é Subscription.
-
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK, clique em OK.
Acompanhe o progresso da tarefa na página Data Synchronization.