Use o DTS para sincronizar dados de um cluster PolarDB for MySQL para um cluster AnalyticDB for MySQL 3.0 e crie rapidamente sistemas de business intelligence (BI) interno, consultas interativas e relatórios em tempo real.
Pré-requisitos
Crie um cluster PolarDB for MySQL. Para mais informações, consulte Comprar um cluster por assinatura e Comprar um cluster com pagamento conforme o uso.
Crie um cluster de destino AnalyticDB for MySQL 3.0. Para obter detalhes, consulte Criar um cluster.
A instância de destino AnalyticDB for MySQL precisa ter mais espaço de armazenamento do que a instância de origem PolarDB for MySQL utiliza.
Limitações
|
Tipo |
Descrição |
|
Limites do banco de dados de origem |
|
|
Outros limites |
|
|
Outras observações |
O DTS executa periodicamente o comando CREATE DATABASE IF NOT EXISTS |
Faturamento
|
Tipo de sincronização |
Preço |
|
Sincronização de esquema e sincronização completa de dados |
Gratuito. |
|
Sincronização incremental de dados |
Pago. Para mais informações, consulte Visão geral do faturamento. |
Topologias de sincronização suportadas
Sincronização unidirecional um para um
Sincronização unidirecional um para muitos
Sincronização unidirecional muitos para um
Operações SQL suportadas
Tipo de operação | Instrução SQL |
DML | INSERT, UPDATE e DELETE Nota Quando os dados são gravados no cluster AnalyticDB for MySQL, a instrução UPDATE é automaticamente convertida para a instrução REPLACE INTO. |
DDL | CREATE TABLE, DROP TABLE, RENAME TABLE, TRUNCATE TABLE, ADD COLUMN e DROP COLUMN |
Se o tipo de dados de um campo na tabela de origem for alterado durante a sincronização de dados, uma mensagem de erro será retornada e a tarefa de sincronização de dados será interrompida. Execute as etapas a seguir para solucionar o problema:
Quando o DTS sincroniza dados com o cluster de destino AnalyticDB for MySQL, o tipo de dados de um campo na tabela de origem é alterado. Como resultado, a tarefa de sincronização de dados falha. Neste exemplo, a tabela de origem chama-se customer.
No cluster de destino AnalyticDB for MySQL V3.0, crie uma tabela chamada customer_new que tenha o mesmo esquema da tabela customer.
Execute a instrução INSERT INTO SELECT para copiar os dados da tabela customer e inseri-los na tabela customer_new. Isso garante que os dados das duas tabelas estejam consistentes.
Renomeie ou exclua a tabela customer. Em seguida, altere o nome da tabela customer_new para customer.
Inicie a tarefa de sincronização de dados novamente no console do DTS.
Procedimento
-
Acesse a página da lista de tarefas de sincronização da região de destino. Use um dos dois métodos a seguir:
Pelo console do DTS
Faça login no console do Data Transmission Service (DTS).
No painel de navegação à esquerda, clique em Data Synchronization.
No canto superior esquerdo da página, selecione a região onde a instância de sincronização está localizada.
Pelo console do DMS
NotaAs operações reais podem variar dependendo do modo e do layout do console do DMS. Para mais informações, consulte Modo simples e Personalizar o layout e o estilo da interface do DMS.
Faça login no Data Management (DMS).
Na barra de menu superior, escolha .
À direita de Data Synchronization Tasks, selecione a região onde a instância de sincronização está localizada.
Clique em Create Task para abrir a página de configuração da tarefa.
-
Configure os bancos de dados de origem e de destino.
AvisoApós selecionar as instâncias de origem e de destino, leia atentamente as limitações exibidas na parte superior da página. Se você não seguir as limitações, a tarefa poderá falhar ou poderá ocorrer inconsistência de dados.
Categoria
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome para a tarefa. Recomendamos especificar um nome descritivo para facilitar a identificação. O nome não precisa ser único.
Source Database
Select Existing Connection
-
Para usar uma instância de banco de dados adicionada ao sistema (recém-criada ou salva), selecione a instância de banco de dados na lista suspensa. As informações do banco de dados são configuradas automaticamente.
NotaNo console do DMS, este item de configuração chama-se Select a DMS database instance..
-
Se você não adicionou a instância de banco de dados ao sistema ou não precisa usar uma instância já adicionada, configure manualmente as seguintes informações do banco de dados.
Database Type
Selecione PolarDB for MySQL.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região do cluster de origem PolarDB for MySQL.
PolarDB Cluster ID
Selecione o ID da instância do cluster de origem PolarDB for MySQL.
Database Account
Insira a conta do banco de dados do cluster de origem PolarDB for MySQL. Esta conta deve ter permissões de leitura nos objetos a serem sincronizados.
Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
Selecione uma opção com base nos requisitos do seu negócio. Para mais informações sobre criptografia SSL, consulte Configurar criptografia SSL.
Destination Database
Select Existing Connection
-
Para usar uma instância de banco de dados adicionada ao sistema (recém-criada ou salva), selecione a instância de banco de dados na lista suspensa. As informações do banco de dados são configuradas automaticamente.
NotaNo console do DMS, este item de configuração chama-se Select a DMS database instance..
-
Se você não adicionou a instância de banco de dados ao sistema ou não precisa usar uma instância já adicionada, configure manualmente as seguintes informações do banco de dados.
Database Type
Selecione AnalyticDB for MySQL 3.0.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região do cluster de destino AnalyticDB for MySQL 3.0.
Instance ID
Selecione o ID da instância do cluster de destino AnalyticDB for MySQL 3.0.
Database Account
Insira a conta do banco de dados do cluster de destino AnalyticDB for MySQL 3.0. Esta conta deve ter permissões de leitura e gravação.
Database Password
Insira a senha correspondente à conta do banco de dados.
-
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página.
NotaCertifique-se de que os blocos CIDR de endereços IP dos servidores do DTS foram adicionados às configurações de segurança dos bancos de dados de origem e de destino para permitir o acesso dos servidores do DTS. Adicione os blocos automática ou manualmente. Para mais informações, consulte Adicionar os blocos CIDR de endereços IP dos servidores do DTS a uma lista de permissões.
-
Configure os objetos da tarefa.
-
Na página Configure Objects, configure os objetos a serem sincronizados.
Parâmetro
Descrição
Synchronization Types
Incremental Data Synchronization está selecionado. Por padrão, você também deve selecionar Schema Synchronization e Full Data Synchronization. Após a conclusão da pré-verificação, o DTS realiza uma sincronização completa de dados dos objetos selecionados da instância de origem para o cluster de destino. Isso serve como dados de base para a subsequente sincronização incremental de dados.
NotaSe Full Data Synchronization estiver selecionado, você poderá sincronizar o esquema e os dados da tabela criada pela execução da instrução CREATE TABLE com o banco de dados de destino.
DDL and DML Operations to Be Synchronized
Selecione as operações DDL ou DML a serem sincronizadas no nível da instância. Para obter informações sobre as operações suportadas, consulte Operações SQL suportadas.
NotaPara selecionar operações SQL a serem sincronizadas no nível do banco de dados ou da tabela, clique com o botão direito em um objeto na lista Selected Objects e selecione as operações SQL desejadas no menu de atalho.
Merge Tables
-
Selecione Yes: Em cenários OLTP, o sharding de banco de dados e tabelas é frequentemente usado para melhorar o tempo de resposta das tabelas de negócios. Em cenários OLAP, como o banco de dados de destino neste exemplo, uma única tabela de dados pode armazenar grandes volumes de dados, tornando as consultas de tabela única mais convenientes. Nesses cenários, use o recurso de mesclagem de várias tabelas do DTS para sincronizar várias tabelas com o mesmo esquema (tabelas fragmentadas) do banco de dados de origem em uma única tabela no banco de dados de destino. Para instruções específicas, consulte Ativar mesclagem de várias tabelas.
Nota-
Após selecionar várias tabelas do banco de dados de origem, use o recurso de mapeamento de nomes de objetos para alterar seus nomes para o mesmo nome de tabela no banco de dados de destino. Para mais informações sobre o recurso de mapeamento de nomes de objetos, consulte Mapear nomes de tabelas e colunas.
-
O DTS adiciona a coluna
__dts_data_sourcedo tipo text à tabela de destino para armazenar a fonte de dados. O valor da coluna usa o formatoID da instância DTS:nome do banco de dados:nome do esquema:nome da tabelapara identificar a origem da tabela, por exemplo,dts****:dtstestdata:testschema:customer1. -
O recurso de mesclagem de várias tabelas atua no nível da tarefa, o que significa que você não pode realizar a mesclagem de várias tabelas no nível da tabela. Se quiser mesclar algumas tabelas, mas não outras, crie duas tarefas de sincronização de dados.
AvisoNão execute operações DDL para alterar o esquema do banco de dados ou da tabela no banco de dados de origem. Caso contrário, poderá ocorrer inconsistência de dados ou falha na tarefa de sincronização.
-
-
Selecione No. Esta é a opção padrão.
Processing Mode of Conflicting Tables
-
Precheck and Report Errors: Verifica se existe uma tabela com o mesmo nome no banco de dados de destino. Se não existir uma tabela com o mesmo nome, a pré-verificação é aprovada. Se existir uma tabela com o mesmo nome, a pré-verificação falha e a tarefa de sincronização de dados não inicia.
NotaSe você não puder excluir ou renomear a tabela com o mesmo nome no banco de dados de destino, poderá mapeá-la para um nome de tabela diferente. Para mais informações, consulte Mapear nomes de tabelas e colunas.
-
Ignore Errors and Proceed: Ignora a verificação de nomes de tabelas duplicados no banco de dados de destino.
AvisoSelecionar Ignore Errors and Proceed pode causar inconsistência de dados e colocar seus negócios em risco. Por exemplo:
-
Se os esquemas das tabelas forem iguais e um registro no banco de dados de destino tiver o mesmo valor de chave primária ou única que um registro no banco de dados de origem:
-
Durante a sincronização completa, o DTS mantém o registro no cluster de destino. O registro correspondente do banco de dados de origem não é sincronizado.
-
Durante a sincronização incremental, o registro do banco de dados de origem sobrescreve o registro no banco de dados de destino.
-
-
Se os esquemas das tabelas forem diferentes, a sincronização inicial de dados poderá falhar. Isso pode resultar na sincronização apenas parcial dos dados das colunas ou em uma falha completa da sincronização. Prossiga com cautela.
-
Capitalization of Object Names in Destination Instance
Configure a política de diferenciação de maiúsculas e minúsculas para nomes de objetos de banco de dados, tabelas e colunas sincronizados com a instância de destino. Por padrão, a DTS default policy está selecionada. Você também pode optar por usar as políticas padrão dos bancos de dados de origem e de destino. Para mais informações, consulte Política de diferenciação de maiúsculas e minúsculas para nomes de objetos de destino.
Source Objects
Na caixa Source Objects, clique em um objeto para sincronizar e, em seguida, clique em
para movê-lo para a caixa Selected Objects.NotaSelecione colunas, tabelas ou bancos de dados como objetos a serem sincronizados. Se você selecionar tabelas ou colunas como objetos a serem sincronizados, o DTS não sincronizará outros objetos, como views, triggers ou stored procedures, com o banco de dados de destino.
Se você selecionar um banco de dados como objeto a ser sincronizado, o DTS sincronizará os dados com base nas seguintes regras padrão:
Se a tabela a ser sincronizada no banco de dados de origem tiver uma chave primária, como uma chave primária de coluna única ou uma chave primária composta, as colunas da chave primária serão especificadas como chaves de distribuição.
Se a tabela a ser sincronizada no banco de dados de origem não tiver uma chave primária, uma coluna de chave primária de incremento automático será gerada automaticamente na tabela de destino. Isso pode causar inconsistência de dados entre os bancos de dados de origem e de destino.
Selected Objects
-
Para renomear um único objeto de sincronização na instância de destino, clique com o botão direito no objeto na caixa Selected Objects. Para mais informações sobre como renomear objetos, consulte Mapear um único banco de dados, tabela ou coluna.
-
Para alterar os nomes de vários objetos de sincronização na instância de destino em lote, clique em Batch Edit no canto superior direito da caixa Selected Objects. Para mais informações, consulte Mapear bancos de dados, tabelas e colunas em lote.
Nota-
Para selecionar operações SQL a serem sincronizadas no nível do banco de dados ou da tabela, clique com o botão direito no objeto na lista Selected Objects e selecione as operações SQL desejadas na caixa de diálogo exibida. Para obter uma lista de operações suportadas, consulte Operações SQL suportadas.
-
Para filtrar dados usando uma cláusula WHERE, clique com o botão direito na tabela na lista Selected Objects e especifique a condição de filtro na caixa de diálogo exibida. Para obter instruções, consulte Configurar filtragem de dados.
-
-
Clique em Next: Advanced Settings para configurar parâmetros avançados.
Parâmetro
Descrição
Dedicated Cluster for Task Scheduling
Por padrão, o DTS agenda tarefas em um cluster compartilhado, e você não precisa selecionar um cluster. Para um desempenho mais estável, adquira um cluster dedicado para executar tarefas de sincronização do DTS. Para mais informações, consulte O que é um cluster dedicado do DTS?.
Copy the temporary table of the Online DDL tool that is generated in the source table to the destination database.
Operações DDL não são suportadas para sincronização. Selecione No, Adapt to DMS Online DDL ou No, Adapt to gh-ost. Se a sincronização DDL for suportada neste cenário no futuro e você usar o Data Management (DMS) ou gh-ost para fazer alterações DDL online no banco de dados de origem, poderá escolher se deseja sincronizar dados das tabelas temporárias geradas durante as alterações DDL online.
ImportanteOs métodos de processamento para cada etapa são os seguintes: As etapas de Schema Synchronization e Full Data Synchronization não permitem operações DDL que alterem o esquema do banco de dados ou da tabela. Portanto, essas etapas não são controladas pela política de DDL Online.
-
Schema Synchronization: Esta etapa não é controlada pela política de DDL Online. Tabelas temporárias relacionadas são criadas.
-
Full Data Synchronization: Esta etapa não é controlada pela política de DDL Online. Tabelas temporárias não são incluídas nos objetos de sincronização completa. Todas as tabelas cujos nomes correspondem à expressão regular (
^_(.+)_(?:gho|new)$ou^_(.+)_(?:ghc|del|old)$) são filtradas. -
Incremental Data Synchronization: Esta etapa é controlada pela política de DDL Online.
-
Yes: Sincroniza alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por operações DDL online. -
No, Adapt to DMS Online DDL e No, Adapt to gh-ost: Filtra alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por ferramentas como gh-ost com base em regras de expressão regular.
-
-
Yes: Sincroniza dados de tabelas temporárias gerados por alterações DDL online.
NotaSe os dados das tabelas temporárias gerados por alterações DDL online forem muito grandes, isso poderá causar latência na sincronização.
-
No, Adapt to DMS Online DDL: Não sincroniza dados de tabelas temporárias gerados por alterações DDL online. Em vez disso, sincroniza apenas as instruções DDL originais executadas no banco de dados de origem usando o Data Management (DMS).
NotaEsta opção causa bloqueio de tabelas no banco de dados de destino.
-
No, Adapt to gh-ost: Não sincroniza tabelas temporárias geradas por alterações DDL online. Suporta regras de filtragem personalizadas. O DTS filtra alterações de dados em tabelas temporárias (por exemplo,
_table-name_gho) geradas por ferramentas como gh-ost com base em regras de expressão regular. Modifique as expressões regulares padrão usadas para corresponder a tabelas sombra e tabelas inúteis conforme necessário:-
Tabela sombra:
^_(.+)_(?:gho|new)$ -
Tabela inútil:
^_(.+)_(?:ghc|del|old)$
NotaEsta opção causa bloqueio de tabelas no banco de dados de destino.
-
Retry Time for Failed Connections
Após o início de uma tarefa de sincronização, se a conexão com o banco de dados de origem ou de destino falhar, o DTS reportará um erro e iniciará imediatamente uma nova tentativa de conexão. A duração padrão de nova tentativa é de 720 minutos. Especifique uma duração personalizada de nova tentativa de 10 a 1.440 minutos. Recomendamos definir a duração para 30 minutos ou mais. Se o DTS se reconectar com sucesso ao banco de dados dentro da duração especificada, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
Nota-
Se você tiver várias instâncias do DTS (por exemplo, Instância A e Instância B) que compartilham a mesma origem ou destino, e definir o tempo de nova tentativa de rede para 30 minutos para a Instância A e 60 minutos para a Instância B, a duração menor de 30 minutos será usada para ambas.
-
Como o DTS cobra pelo tempo de execução da tarefa durante o período de nova tentativa de conexão, recomendamos personalizar a duração da nova tentativa com base nas necessidades do seu negócio ou liberar a instância do DTS o mais rápido possível após a liberação das instâncias de banco de dados de origem e de destino.
Retry Time for Other Issues
Após o início da tarefa de sincronização, se ocorrerem outros problemas não relacionados à conectividade com o banco de dados de origem ou de destino (como exceções de execução DDL ou DML), o DTS reportará um erro e iniciará imediatamente operações contínuas de nova tentativa. A duração padrão de nova tentativa é de 10 minutos. Personalize a duração da nova tentativa dentro do intervalo de 1 a 1.440 minutos. Recomendamos definir para 10 minutos ou mais. Se as operações relevantes forem bem-sucedidas dentro da duração de nova tentativa definida, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
ImportanteO valor para Retry Time for Other Issues deve ser menor que o valor para Retry Time for Failed Connections.
Enable Throttling for Full Data Synchronization
Durante a etapa de sincronização completa, o DTS consome recursos de leitura e gravação dos bancos de dados de origem e de destino, o que pode aumentar a carga do banco de dados. Para reduzir a carga nos bancos de dados de origem e de destino, defina um limite de taxa para a tarefa de sincronização completa configurando os parâmetros Queries per second (QPS) to the source database, RPS of Full Data Migration e Data migration speed for full migration (MB/s).
Nota-
Este item de configuração está disponível apenas quando Synchronization Types está definido como Full Data Synchronization.
-
Você também pode ajustar a taxa de sincronização completa depois que a instância de sincronização estiver em execução.
Enable Throttling for Incremental Data Synchronization
Defina um limite de taxa para a tarefa de sincronização incremental. Para aliviar a pressão no banco de dados de destino, defina RPS of Incremental Data Synchronization e Data synchronization speed for incremental synchronization (MB/s).
Environment Tag
Selecione uma tag de ambiente para identificar a instância com base nos seus requisitos. Este parâmetro é opcional.
Whether to delete SQL operations on heartbeat tables of forward and reverse tasks
Escolha se deseja gravar informações SQL de heartbeat no banco de dados de origem enquanto a instância do DTS está em execução.
-
Yes: As informações SQL de heartbeat não são gravadas no banco de dados de origem. Isso pode fazer com que a instância do DTS reporte um atraso.
-
No: Grava informações SQL de heartbeat no banco de dados de origem. Isso pode interferir em recursos como backup físico e clonagem do banco de dados de origem.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carregamento (ETL). Para mais informações, consulte O que é ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configurar ETL em uma tarefa de migração ou sincronização de dados.
-
No: Desativa o recurso ETL.
Monitoring and Alerting
Especifique se deseja configurar alertas. Se a sincronização falhar ou a latência exceder o limiar especificado, uma notificação será enviada a um contato de alerta.
-
No: Nenhum alerta é configurado.
-
Yes: Configure alertas definindo um limiar de alerta e especificando um notificação de alerta. Para mais informações, consulte Configurar monitoramento e alertas durante a configuração da tarefa.
-
-
Clique em Next: Data Validation para configurar uma tarefa de validação de dados.
Se quiser usar o recurso de validação de dados, consulte Configurar validação de dados para obter instruções de configuração.
-
Opcional: Após concluir a configuração anterior, clique em Next: Configure Database and Table Fields para definir o Type, Primary Key Column, Distribution Key e as informações da chave de partição (Partition Key, Partitioning Rules e Partition Lifecycle) para a tabela a ser sincronizada no banco de dados de destino.
NotaEsta etapa só estará disponível se você selecionar Schema Synchronization para Synchronization Types ao configurar os objetos da tarefa. Defina Definition Status como All para fazer modificações.
A Primary Key Column pode ser uma chave primária composta por várias colunas. Selecione uma ou mais colunas da Primary Key Column para servir como Distribution Key e Partition Key. Para mais informações, consulte CREATE TABLE.
-
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros da API para configurar esta instância, passe o mouse sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão.
Se tiver terminado de visualizar os parâmetros da API, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início do trabalho de sincronização, o DTS executa uma pré-verificação. O trabalho só pode começar após a aprovação de todos os itens de pré-verificação.
Se a pré-verificação falhar, clique em View Details para o item com falha. Corrija o problema conforme indicado e execute a pré-verificação novamente.
-
Se a pré-verificação retornar um aviso:
Se um item de verificação falhar e não puder ser ignorado, clique em View Details ao lado do item. Siga as instruções para corrigir o problema e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, clique em Confirm Alert Details, Ignore, OK e Precheck Again em sequência para pular o aviso e executar a pré-verificação novamente. Se você optar por ignorar o item de aviso, isso poderá causar problemas como inconsistência de dados e representar riscos para o seu negócio.
-
Adquira a instância.
Quando a Success Rate for de 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione o método de faturamento e a especificação de link para a instância de sincronização de dados. A tabela a seguir descreve esses parâmetros em detalhes.
Categoria
Parâmetro
Descrição
New Instance Class
Método de faturamento
-
Assinatura: Você paga ao criar a instância. É adequado para necessidades de longo prazo e é mais econômico que o pagamento conforme o uso. Quanto maior a duração da assinatura, maior o desconto.
-
Pagamento conforme o uso: A cobrança é feita por hora. Adequado para necessidades de curto prazo. Libere a instância imediatamente após o uso para economizar custos.
Configuração do grupo de recursos
O grupo de recursos ao qual a instância pertence. O padrão é o grupo de recursos padrão. Para mais informações, consulte O que é Resource Management?.
Especificação do link
O DTS fornece especificações de sincronização com diferentes níveis de desempenho. A especificação do link de sincronização afeta a taxa de sincronização. Escolha uma especificação com base no seu cenário de negócios. Para mais informações, consulte Especificações de link de sincronização de dados.
Duração da assinatura
No modo de assinatura, selecione a duração e a quantidade para a instância de assinatura. Escolha uma assinatura mensal de 1 a 9 meses ou uma assinatura anual de 1, 2, 3 ou 5 anos.
NotaEsta opção só está disponível quando o método de faturamento é Subscription.
-
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK, clique em OK.
Visualize o progresso da tarefa na página Data Synchronization.