Você pode sincronizar dados de uma instância ApsaraDB RDS for MySQL para um cluster AnalyticDB for MySQL V3.0 usando o Data Transmission Service (DTS). Esse recurso permite criar sistemas de business intelligence (BI), sistemas de consulta interativa e relatórios em tempo real.
Pré-requisitos
Uma instância ApsaraDB RDS for MySQL criada. Para mais informações, consulte Create an ApsaraDB RDS for MySQL instance.
O cluster de destino AnalyticDB for MySQL V3.0 criado. Para mais informações, consulte Create a cluster.
O espaço de armazenamento disponível no cluster de destino AnalyticDB for MySQL V3.0 deve ser maior que o tamanho total dos dados na instância de origem ApsaraDB RDS for MySQL.
Observações de uso
Durante a sincronização de schema, o DTS não sincroniza chaves estrangeiras do banco de dados de origem para o banco de dados de destino.
Nas fases de sincronização completa e incremental de dados, o DTS desativa temporariamente as verificações de restrições e operações em cascata de chaves estrangeiras no nível da sessão. Se você executar operações de atualização ou exclusão em cascata no banco de dados de origem enquanto a tarefa estiver em execução, poderá ocorrer inconsistência de dados.
O DTS não oferece suporte à sincronização de materialized views para a instância de destino AnalyticDB for MySQL durante a sincronização de schema. Se precisar usar materialized views, crie-as manualmente na instância de destino após a conclusão da sincronização.
|
Tipo |
Descrição |
|
Limites do banco de dados de origem |
|
|
Outros limites |
|
|
Casos especiais |
|
Faturamento
|
Tipo de sincronização |
Preços |
|
Sincronização de schema e sincronização completa de dados |
Gratuito. |
|
Sincronização incremental de dados |
Pago. Para mais informações, consulte Billing overview. |
Topologias de sincronização suportadas
Sincronização unidirecional um para um
Sincronização unidirecional um para muitos
Sincronização unidirecional muitos para um
Operações SQL sincronizáveis
|
Tipo de operação |
Instrução SQL |
|
DML |
INSERT, UPDATE e DELETE Nota
Quando dados são gravados no cluster AnalyticDB for MySQL, a instrução UPDATE é automaticamente convertida para a instrução REPLACE INTO. |
|
DDL |
CREATE TABLE, DROP TABLE, RENAME TABLE, TRUNCATE TABLE, ADD COLUMN e DROP COLUMN |
Se o tipo de dados de um campo na tabela de origem for alterado durante a sincronização, um erro será retornado e a tarefa será interrompida. Para solucionar esse problema:
Enquanto o DTS sincroniza dados para o cluster de destino AnalyticDB for MySQL, o tipo de dados de um campo na tabela de origem é alterado, causando falha na tarefa. Neste exemplo, a tabela de origem chama-se customer.
No cluster de destino AnalyticDB for MySQL V3.0, crie uma tabela chamada customer_new com o mesmo schema da tabela customer.
Execute a instrução INSERT INTO SELECT para copiar os dados da tabela customer para a tabela customer_new.
Renomeie ou exclua a tabela customer. Em seguida, altere o nome da tabela customer_new para customer.
Reinicie a tarefa de sincronização de dados no console do DTS.
Procedimento
-
Acesse a página Data Synchronization Tasks.
Faça login no console do Data Management (DMS).
Na barra de navegação superior, clique em Data + AI.
No painel de navegação à esquerda, escolha .
NotaAs operações podem variar conforme o modo e o layout do console do DMS. Para mais informações, consulte Simple mode console e Customize DMS console layout and style.
Também é possível acessar a página Data Synchronization Tasks do novo console do DTS.
-
No lado direito de Data Synchronization Tasks, selecione a região onde reside a instância de sincronização de dados.
NotaSe utilizar o novo console do DTS, selecione a região onde reside a instância de sincronização de dados na barra de navegação superior.
-
Clique em Create Task para configurar os bancos de dados de origem e de destino.
AvisoApós selecionar as instâncias de origem e de destino, leia atentamente os limites exibidos no topo da página. O descumprimento desses limites pode causar falha na tarefa ou inconsistência de dados.
Seção
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome para a tarefa. Recomendamos especificar um nome descritivo para facilitar a identificação. O nome não precisa ser único.
Source Database
Select DMS Database Instance
Selecione uma instância existente conforme necessário.
-
Ao usar uma instância existente, as informações do banco de dados são preenchidas automaticamente, sem necessidade de nova entrada.
-
Caso não utilize uma instância existente, insira as seguintes informações do banco de dados.
Database Type
Tipo do banco de dados de origem. Selecione MySQL.
Connection Type
Método de acesso ao banco de dados de origem. Selecione Alibaba Cloud Instance.
Instance Region
Região onde reside a instância de origem ApsaraDB RDS for MySQL.
Cross-account
Define se haverá sincronização de dados entre contas Alibaba Cloud. Neste exemplo, selecione No.
RDS Instance ID
ID da instância de origem ApsaraDB RDS for MySQL.
Database Account
Conta do banco de dados da instância de origem ApsaraDB RDS for MySQL. A conta deve ter permissões SELECT sobre os objetos a serem sincronizados, além das permissões REPLICATION CLIENT e REPLICATION SLAVE.
Database Password
Insira a senha correspondente à conta do banco de dados.
Connection Method
Selecione Non-encrypted ou SSL-encrypted conforme necessário. Se optar por SSL-encrypted, ative previamente a criptografia SSL na instância RDS for MySQL. Para mais informações, consulte Use a cloud certificate to quickly enable SSL encryption.
Destination Database
Select DMS Database Instance
Selecione uma instância existente conforme necessário.
-
Ao usar uma instância existente, as informações do banco de dados são preenchidas automaticamente, sem necessidade de nova entrada.
-
Caso não utilize uma instância existente, insira as seguintes informações do banco de dados.
Database Type
Tipo do banco de dados de destino. Selecione AnalyticDB for MySQL V3.0.
Connection Type
Método de acesso ao banco de dados de destino. Selecione Alibaba Cloud Instance.
Instance Region
Região onde reside o cluster de destino AnalyticDB for MySQL V3.0.
Instance ID
ID do cluster de destino AnalyticDB for MySQL V3.0.
Database Account
Conta do banco de dados do cluster de destino AnalyticDB for MySQL V3.0. A conta deve ter permissões de leitura e gravação no banco de dados de destino.
Database Password
Insira a senha correspondente à conta do banco de dados.
-
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página.
Se o banco de dados de origem ou de destino for uma instância de banco de dados Alibaba Cloud, como uma instância RDS for MySQL ou ApsaraDB for MongoDB, o DTS adiciona automaticamente os endereços IP dos servidores DTS da região correspondente à lista de permissões da instância. Se for um banco de dados autogerenciado hospedado em uma instância ECS, o DTS adiciona automaticamente os IPs dos servidores DTS às regras de segurança da instância ECS. Garanta também que o banco de dados autogerenciado permita acesso a partir da instância ECS. Se o banco de dados estiver implantado em um cluster em várias instâncias ECS, adicione manualmente os IPs dos servidores DTS às regras de segurança de cada instância ECS. Para bancos de dados autogerenciados em IDC ou de outros provedores de cloud, adicione manualmente os IPs dos servidores DTS na região correspondente para permitir o acesso. Para mais informações sobre os endereços IP dos servidores DTS, consulte IP address CIDR blocks of DTS servers.
AvisoAdicionar blocos CIDR de endereços IP públicos dos servidores DTS, seja automática ou manualmente, pode representar riscos de segurança. Ao usar este product, você reconhece e aceita esses riscos potenciais. Implemente proteções básicas de segurança, incluindo fortalecimento de senhas, restrição de portas abertas para blocos CIDR, uso de autenticação para comunicação interna de API e revisão regular de blocos CIDR desnecessários. Alternativamente, conecte-se ao banco de dados via rede interna, como linha dedicada, VPN Gateway ou Smart Access Gateway.
-
Configure os objetos da tarefa e as configurações avançadas.
-
Basic Settings
Parâmetro ou configuração
Descrição
Synchronization Types
Incremental Data Synchronization vem selecionado. Por padrão, também é necessário selecionar Schema Synchronization e Full Data Synchronization. Após a pré-verificação, o DTS realiza uma sincronização completa dos dados dos objetos selecionados da instância de origem para o cluster de destino, servindo como base para a subsequente sincronização incremental.
NotaCom Full Data Synchronization selecionado, é possível sincronizar o schema e os dados da tabela criada pela instrução CREATE TABLE para o banco de dados de destino.
Processing Mode for Existing Tables in Destination
-
Precheck and Report Errors: Verifica se existe uma tabela com o mesmo nome no banco de dados de destino. Se não existir, a pré-verificação é aprovada. Se existir, a pré-verificação falha e a tarefa de sincronização não inicia.
NotaCaso não seja possível excluir ou renomear a tabela homônima no destino, mapeie-a para um nome diferente. Para mais informações, consulte Map table and column names.
-
Ignore Errors and Proceed: Ignora a verificação de nomes de tabelas duplicados no banco de dados de destino.
AvisoSelecionar Ignore Errors and Proceed pode causar inconsistência de dados e colocar seu negócio em risco. Por exemplo:
-
Se os schemas das tabelas forem idênticos e um registro no banco de dados de destino tiver o mesmo valor de chave primária ou chave única que um registro no banco de dados de origem:
-
Durante a sincronização completa, o DTS mantém o registro no cluster de destino. O registro correspondente do banco de dados de origem não é sincronizado.
-
Durante a sincronização incremental, o registro do banco de dados de origem sobrescreve o registro no banco de dados de destino.
-
-
Se os schemas das tabelas forem diferentes, a sincronização inicial de dados pode falhar. Isso pode resultar na sincronização apenas parcial dos dados das colunas ou em uma falha completa da sincronização. Prossiga com cautela.
-
Select DDL and DML operations for instance-level synchronization
Operações DDL e DML que deseja sincronizar. Para mais informações, consulte SQL operations that can be synchronized.
NotaPara selecionar operações SQL executadas em um banco de dados ou tabela específica, clique com o botão direito em um objeto na seção Selected Objects. Na caixa de diálogo exibida, selecione as operações SQL desejadas.
Merge Multiple Tables
-
Selecione Yes: Em cenários OLTP, o sharding de bancos de dados e tabelas é comum para melhorar o tempo de resposta. Em cenários OLAP, como o banco de dados de destino deste exemplo, uma única tabela pode armazenar grandes volumes de dados, facilitando consultas. Nesses casos, use o recurso de mesclagem de múltiplas tabelas do DTS para sincronizar várias tabelas com o mesmo schema (tabelas fragmentadas) da origem em uma única tabela no destino. Para instruções específicas, consulte Enable multi-table merge.
Nota-
Após selecionar múltiplas tabelas na origem, use o recurso de mapeamento de nomes de objetos para defini-las com o mesmo nome no destino. Para mais informações sobre mapeamento de nomes de objetos, consulte Map table and column names.
-
O DTS adiciona a coluna
__dts_data_sourcedo tipo text à tabela de destino para armazenar a fonte dos dados. O valor segue o formatoDTS instance ID:database name:schema name:table namepara identificar a origem da tabela, por exemplo,dts****:dtstestdata:testschema:customer1. -
A mesclagem de múltiplas tabelas ocorre no nível da tarefa, não sendo possível aplicá-la apenas a tabelas específicas. Para mesclar apenas algumas tabelas, crie duas tarefas de sincronização de dados distintas.
AvisoNão execute operações DDL para alterar o schema do banco de dados ou da tabela na origem. Caso contrário, pode ocorrer inconsistência de dados ou falha na tarefa de sincronização.
-
-
Selecione No. Esta é a opção padrão.
Case Sensitivity Policy for Destination Object Names
Configure a política de diferenciação de maiúsculas e minúsculas para nomes de objetos de banco de dados, tabelas e colunas sincronizados na instância de destino. Por padrão, a DTS default policy está selecionada. Também é possível optar pelas políticas padrão dos bancos de dados de origem e destino. Para mais informações, consulte Case sensitivity policy for destination object names.
Source Objects
Na caixa Source Objects, clique em um objeto para sincronizar e, em seguida, clique em
para movê-lo para a caixa Selected Objects.Nota-
Selecione colunas, tabelas ou bancos de dados como objetos de sincronização. Ao selecionar tabelas ou colunas, o DTS não sincroniza outros objetos, como views, triggers ou stored procedures, para o banco de dados de destino.
-
Ao selecionar um banco de dados como objeto de sincronização, o DTS aplica as seguintes regras padrão:
-
Se a tabela de origem possuir chave primária (simples ou composta), as colunas da chave primária serão usadas como chaves de distribuição.
-
Se a tabela de origem não tiver chave primária, uma coluna de chave primária autoincrementável será gerada na tabela de destino. Isso pode causar inconsistência de dados entre a origem e o destino.
-
Selected Objects
-
Para renomear um único objeto de sincronização na instância de destino, clique com o botão direito no objeto na caixa Selected Objects. Para mais informações sobre renomeação de objetos, consulte Map a single database, table, or column.
-
Para alterar em lote os nomes de vários objetos de sincronização na instância de destino, clique em Batch Edit no canto superior direito da caixa Selected Objects. Para mais informações, consulte Map databases, tables, and columns in a batch.
Nota-
Para selecionar operações SQL executadas em um banco de dados ou tabela específica, clique com o botão direito em um objeto a ser sincronizado na seção Selected Objects. Na caixa de diálogo exibida, selecione as operações SQL desejadas. Para mais informações sobre operações SQL sincronizáveis, consulte SQL operations that can be synchronized.
-
Para especificar condições WHERE e filtrar dados, clique com o botão direito em um objeto na seção Selected Objects. Na caixa de diálogo exibida, especifique as condições. Para mais informações sobre como definir condições, consulte Use SQL conditions to filter data.
-
-
Advanced Settings
Parâmetro
Descrição
Monitoring and Alerting
Defina se deseja configurar alertas. Se a sincronização falhar ou a latência exceder o limiar especificado, uma notificação será enviada a um contato de alerta.
-
No: Nenhum alerta configurado.
-
Yes: Configure alertas definindo um limiar e especificando um alert notification. Para mais informações, consulte Configure monitoring and alerting during task configuration.
Replicate temporary tables created by online DDL tools for the source table to the destination database
Operações DDL não são suportadas para sincronização. Selecione No, Adapt to DMS Online DDL ou No, Adapt to gh-ost. Se futuramente a sincronização DDL for suportada neste cenário e você usar Data Management (DMS) ou gh-ost para alterações DDL online na origem, poderá escolher se deseja sincronizar dados das tabelas temporárias geradas durante essas alterações.
ImportanteOs métodos de processamento para cada etapa são os seguintes: As etapas de Schema Synchronization e Full Data Synchronization não permitem operações DDL que alterem o schema do banco de dados ou da tabela. Portanto, não são controladas pela política de Online DDL.
-
Schema Synchronization: Esta etapa não é controlada pela política de Online DDL. Tabelas temporárias relacionadas são criadas.
-
Full Data Synchronization: Esta etapa não é controlada pela política de Online DDL. Tabelas temporárias não são incluídas nos objetos de sincronização completa. Todas as tabelas cujos nomes correspondem à expressão regular (
^_(.+)_(?:gho|new)$ou^_(.+)_(?:ghc|del|old)$) são filtradas. -
Incremental Data Synchronization: Esta etapa é controlada pela política de Online DDL.
-
Yes: Sincroniza alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por operações DDL online. -
No, Adapt to DMS Online DDL e No, Adapt to gh-ost: Filtra alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por ferramentas como gh-ost com base em regras de expressão regular.
-
-
Yes: Sincroniza dados de tabelas temporárias geradas por alterações DDL online.
NotaSe os dados das tabelas temporárias geradas por alterações DDL online forem muito grandes, pode haver latência na sincronização.
-
No, Adapt to DMS Online DDL: Não sincroniza dados de tabelas temporárias geradas por alterações DDL online. Em vez disso, sincroniza apenas as instruções DDL originais executadas no banco de dados de origem usando Data Management (DMS).
NotaEsta opção causa bloqueio de tabelas no banco de dados de destino.
-
No, Adapt to gh-ost: Não sincroniza tabelas temporárias geradas por alterações DDL online. Suporta regras de filtragem personalizadas. O DTS filtra alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por ferramentas como gh-ost com base em regras de expressão regular. Modifique as expressões regulares padrão usadas para corresponder a shadow tables e useless tables conforme necessário:-
Shadow table:
^_(.+)_(?:gho|new)$ -
Useless table:
^_(.+)_(?:ghc|del|old)$
NotaEsta opção causa bloqueio de tabelas no banco de dados de destino.
-
Retry Time After Connection to Source or Destination Database Fails
Após o início da tarefa de sincronização, se a conexão com o banco de dados de origem ou destino falhar, o DTS reportará um erro e iniciará imediatamente novas tentativas de conexão. A duração padrão de tentativa é de 720 minutos. Especifique uma duração personalizada entre 10 e 1.440 minutos. Recomendamos definir a duração para 30 minutos ou mais. Se o DTS reconectar com sucesso ao banco de dados dentro do período especificado, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
Nota-
Se houver várias instâncias DTS (por exemplo, Instância A e Instância B) compartilhando a mesma origem ou destino, e o tempo de nova tentativa de rede for definido como 30 minutos para a Instância A e 60 minutos para a Instância B, a menor duração de 30 minutos será usada para ambas.
-
Como o DTS cobra pelo tempo de execução da tarefa durante o período de nova tentativa de conexão, recomendamos personalizar a duração da tentativa com base nas necessidades do seu negócio ou liberar a instância DTS assim que possível após a liberação das instâncias de banco de dados de origem e destino.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carga (ETL). Para mais informações, consulte What is ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configure ETL in a data migration or data synchronization task.
-
No: Desativa o recurso ETL.
-
-
-
Opcional: Após concluir a configuração anterior, clique em Next: Configure Database and Table Fields para definir Type, Primary Key Column, Distribution Key e informações de chave de partição (Partition Key, Partitioning Rules e Partition Lifecycle) para a tabela a ser sincronizada no banco de dados de destino.
NotaEsta etapa só estará disponível se você selecionar Schema Synchronization em Synchronization Types ao configurar os objetos da tarefa. Defina Definition Status como All para fazer modificações.
A Primary Key Column pode ser uma chave primária composta por várias colunas. Selecione uma ou mais colunas da Primary Key Column para servir como Distribution Key e Partition Key. Para mais informações, consulte CREATE TABLE.
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros da API para configurar esta instância, passe o mouse sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão exibido.
Após terminar de visualizar os parâmetros da API, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início do trabalho de sincronização, o DTS executa uma pré-verificação. O trabalho só pode começar após a aprovação de todos os itens de pré-verificação.
Se a pré-verificação falhar, clique em View Details para o item com falha. Corrija o problema conforme indicado e execute a pré-verificação novamente.
-
Se a pré-verificação retornar um aviso:
Se um item de verificação falhar e não puder ser ignorado, clique em View Details ao lado do item. Siga as instruções para corrigir o problema e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, clique em Confirm Alert Details, Ignore, OK e Precheck Again em sequência para pular o aviso e reexecutar a pré-verificação. Optar por ocultar o item de aviso pode causar problemas como inconsistência de dados e representar riscos ao seu negócio.
Quando a Success Rate for 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione o método de faturamento e a especificação de link para a instância de sincronização de dados. A tabela a seguir descreve esses parâmetros em detalhes.
Categoria
Parâmetro
Descrição
New Instance Class
Billing Method
-
Subscription: Pagamento realizado na criação da instância. Adequado para necessidades de longo prazo e mais econômico que o pagamento conforme o uso. Quanto maior a duração da assinatura, maior o desconto.
-
Pay-as-you-go: Cobrança horária. Adequado para necessidades de curto prazo. Libere a instância imediatamente após o uso para economizar custos.
Resource Group Configuration
Grupo de recursos ao qual a instância pertence. O padrão é default resource group. Para mais informações, consulte What is Resource Management?.
Link Specification
O DTS oferece especificações de sincronização com diferentes níveis de desempenho. A especificação do link de sincronização afeta a taxa de sincronização. Escolha uma especificação com base no seu cenário de negócio. Para mais informações, consulte Data synchronization link specifications.
Subscription Duration
No modo Subscription, selecione a duração e a quantidade para a instância de assinatura. Escolha uma assinatura mensal de 1 a 9 meses ou uma assinatura anual de 1, 2, 3 ou 5 anos.
NotaEsta opção só está disponível quando o método de faturamento é Subscription.
-
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK, clique em OK.
Acompanhe o progresso da tarefa na página Data Synchronization.
FAQ
O que fazer se o erro only 500 dimension table allowed, current dimensionTableCount: 500 ocorrer durante a sincronização/migração de schema?
Causa: No AnalyticDB for MySQL, a contagem total de tabelas inclui tanto tabelas ativas quanto tabelas na lixeira. Exceder esse limite aciona o erro. Para mais informações, consulte Limits.
-
Solução:
Na tarefa DTS, verifique se o número de tabelas para sincronização/migração de schema não excede o limite especificado na mensagem de erro.
-
Se a contagem de tabelas estiver dentro do limite, execute os seguintes comandos para verificar se há tabelas excluídas na lixeira. Para mais informações, consulte Table recycle bin.
-- Query the number of tables currently in use in the instance.SELECT COUNT(*) FROM INFORMATION_SCHEMA.tables;-- Query the number of tables in the recycle bin. SELECT COUNT(*) FROM INFORMATION_SCHEMA.KEPLER_META_RECYCLE_BIN; -
Se encontrar tabelas excluídas na lixeira, execute os seguintes comandos para limpá-las.
ImportanteTabelas removidas da lixeira não podem ser recuperadas. Certifique-se de que não precisa mais dessas tabelas.
Importante
-- Purge all tables from the table recycle bin.PURGE RECYCLE_BIN ALL;-- Purge a specified table from the table recycle bin.PURGE RECYCLE_BIN TABLE <table name in the ADB_RECYCLE_BIN database>;