O ApsaraDB for SelectDB oferece respostas de consulta em menos de um segundo para grandes conjuntos de dados, dezenas de milhares de consultas pontuais simultâneas e análises complexas de alto throughput. O Data Transmission Service (DTS) sincroniza dados de fontes MySQL, como um banco de dados MySQL autogerenciado ou uma instância do ApsaraDB RDS for MySQL, para uma instância do ApsaraDB for SelectDB destinada a análises de dados em larga escala. Este tópico demonstra o procedimento usando uma instância do ApsaraDB RDS for MySQL como exemplo.
Pré-requisitos
Crie uma instância de destino do ApsaraDB for SelectDB com espaço de armazenamento superior ao utilizado pela instância de origem do ApsaraDB RDS for MySQL. Para mais informações, consulte Criar uma instância.
Considerações
|
Tipo |
Descrição |
|
Limitações do banco de dados de origem |
|
|
Outras limitações |
|
|
Casos especiais |
|
Faturamento
|
Tipo de sincronização |
Preço |
|
Sincronização de schema e sincronização completa de dados |
Gratuito. |
|
Sincronização incremental de dados |
Pago. Para mais informações, consulte Visão geral do faturamento. |
SQL para sincronização incremental
|
Tipo de operação |
Instrução SQL |
|
DML |
INSERT, UPDATE e DELETE |
|
DDL |
|
Permissões da conta do banco de dados
|
Banco de dados |
Permissões necessárias |
Ações |
|
Origem ApsaraDB RDS for MySQL |
Permissões de leitura e gravação nos objetos a serem sincronizados |
|
|
Instância de destino ApsaraDB for SelectDB |
Permissão de acesso ao cluster (Usage_priv) e permissões de leitura e gravação no banco de dados (Select_priv, Load_priv, Alter_priv, Create_priv e Drop_priv) |
Gerenciar permissões do cluster e Gerenciar permissões básicas |
Se você criou a conta do banco de dados de origem fora do console do ApsaraDB RDS for MySQL, garanta que ela tenha as permissões REPLICATION CLIENT, REPLICATION SLAVE, SHOW VIEW e SELECT.
Procedimento
-
Acesse a página da lista de tarefas de sincronização da região de destino. Use um dos dois métodos a seguir:
Pelo console do DTS
Faça login no console do Data Transmission Service (DTS).
No painel de navegação à esquerda, clique em Data Synchronization.
No canto superior esquerdo da página, selecione a região onde a instância de sincronização está localizada.
Pelo console do DMS
NotaAs operações reais podem variar dependendo do modo e do layout do console do DMS. Para mais informações, consulte Modo simples e Personalizar o layout e o estilo da interface do DMS.
Faça login no Data Management (DMS).
Na barra de menu superior, escolha .
À direita de Data Synchronization Tasks, selecione a região onde a instância de sincronização está localizada.
Clique em Create Task para acessar a página de configuração da tarefa.
-
Configure os bancos de dados de origem e de destino.
Seção
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome para a tarefa. Recomendamos especificar um nome descritivo para facilitar a identificação. O nome não precisa ser exclusivo.
Source Database
Select Existing Connection
-
Para usar uma instância de banco de dados que foi adicionada ao sistema (recém-criada ou salva), selecione a instância de banco de dados na lista suspensa. As informações do banco de dados são configuradas automaticamente.
NotaNo console do DMS, este item de configuração chama-se Select a DMS database instance..
-
Se você não adicionou a instância de banco de dados ao sistema ou não precisa usar uma instância já adicionada, configure manualmente as seguintes informações do banco de dados.
Database Type
Selecione MySQL.
Access Method
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região da instância de origem do ApsaraDB RDS for MySQL.
Replicate Data Across Alibaba Cloud Accounts
Neste exemplo, os dados são sincronizados dentro da mesma conta Alibaba Cloud. Selecione No.
RDS Instance ID
Selecione o ID da instância de origem do ApsaraDB RDS for MySQL.
Database Account
Insira a conta do banco de dados da instância de origem do ApsaraDB RDS for MySQL. Para informações sobre as permissões necessárias, consulte Permissões necessárias para contas de banco de dados.
Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
Selecione Non-encrypted ou SSL-encrypted conforme necessário. Se selecionar SSL-encrypted, você deve ativar a criptografia SSL para a instância RDS for MySQL antecipadamente. Para mais informações, consulte Usar um certificado cloud para ativar rapidamente a criptografia SSL.
Destination Database
Select Existing Connection
-
Para usar uma instância de banco de dados que foi adicionada ao sistema (recém-criada ou salva), selecione a instância de banco de dados na lista suspensa. As informações do banco de dados são configuradas automaticamente.
NotaNo console do DMS, este item de configuração chama-se Select a DMS database instance..
-
Se você não adicionou a instância de banco de dados ao sistema ou não precisa usar uma instância já adicionada, configure manualmente as seguintes informações do banco de dados.
Database Type
Selecione ApsaraDB for SelectDB.
Access Method
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região da instância de destino do ApsaraDB for SelectDB.
Replicate Data Across Alibaba Cloud Accounts
Neste exemplo, os dados são sincronizados dentro da mesma conta Alibaba Cloud. Selecione No.
Instance ID
Selecione o ID da instância de destino do ApsaraDB for SelectDB.
Database Account
Insira a conta do banco de dados da instância de destino do ApsaraDB for SelectDB. Para informações sobre as permissões necessárias, consulte Permissões necessárias para contas de banco de dados.
Database Password
Insira a senha correspondente à conta do banco de dados.
-
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página.
NotaGaranta que os blocos CIDR de endereços IP dos servidores DTS estejam adicionados às configurações de segurança dos bancos de dados de origem e destino para permitir o acesso dos servidores DTS. Adicione-os automática ou manualmente. Para mais informações, consulte Adicionar blocos CIDR de endereços IP dos servidores DTS a uma lista de permissões.
Se o banco de dados de origem ou de destino for autogerenciado (onde o Access Method não é Alibaba Cloud Instance), você também deve clicar em Test Connectivity na caixa de diálogo CIDR Blocks of DTS Servers.
-
Configure os objetos da tarefa.
-
Na página Configure Objects, configure os objetos a serem sincronizados.
Parâmetro
Descrição
Synchronization Types
Incremental Data Synchronization está selecionado. Por padrão, você também deve selecionar Schema Synchronization e Full Data Synchronization. Após a conclusão da pré-verificação, o DTS realiza uma sincronização completa dos dados dos objetos selecionados da instância de origem para o cluster de destino. Isso serve como base para a subsequente sincronização incremental de dados.
ImportanteOs tipos de dados são convertidos quando os dados são sincronizados do MySQL para o ApsaraDB for SelectDB. Se você não selecionar Schema Synchronization, deverá criar tabelas que usem o modelo Unique ou Duplicate com o schema apropriado na instância de destino do ApsaraDB for SelectDB antecipadamente. Para mais informações, consulte Mapeamento de tipos de dados, Colunas adicionais e Modelos de dados.
Processing Mode of Conflicting Tables
-
Precheck and Report Errors: O DTS verifica se existem tabelas com o mesmo nome no banco de dados de destino. Se houver conflito, o DTS relata um erro durante a pré-verificação e não inicia a tarefa.
NotaSe não for viável excluir ou renomear a tabela conflitante, você pode mapear a tabela para um nome diferente. Para mais informações, consulte Mapear nomes de objetos.
-
Ignore Errors and Proceed: Ignora a verificação de tabelas com o mesmo nome no banco de dados de destino.
AvisoSe você selecionar Ignore Errors and Proceed, pode ocorrer inconsistência de dados. Por exemplo:
-
Se os schemas das tabelas forem consistentes, os registros de destino com a mesma chave primária ou única que os registros de origem serão sobrescritos.
-
Se os schemas das tabelas forem inconsistentes, a tarefa pode falhar ou sincronizar apenas parcialmente os dados. Prossiga com cautela.
-
Capitalization of Object Names in Destination Instance
É possível configurar a política de distinção entre maiúsculas e minúsculas para nomes de objetos de banco de dados, tabelas e colunas sincronizados com a instância de destino. Por padrão, a DTS default policy está selecionada. Você também pode optar por usar as políticas padrão dos bancos de dados de origem e destino. Para mais informações, consulte Política de distinção entre maiúsculas e minúsculas para nomes de objetos de destino.
Source Objects
Na caixa Source Objects, clique em um objeto para sincronizar e, em seguida, clique em
para movê-lo para a caixa Selected Objects.NotaÉ possível selecionar objetos no nível de banco de dados ou de tabela.
Selected Objects
-
Para alterar o nome de um objeto de sincronização na instância de destino, clique com o botão direito do mouse no objeto na caixa Selected Objects. Para mais informações, consulte Mapear nomes de objetos.
-
Se você selecionar Schema Synchronization em Synchronization Types, selecionar tabelas como objetos de sincronização e precisar definir o número de buckets (parâmetro
bucket_count), clique com o botão direito do mouse na tabela na caixa Selected Objects. Na seção Parameter Settings, defina Enable Parameter Settings como Yes, especifique um Value conforme suas necessidades e clique em OK.
Nota-
Para selecionar as operações SQL incrementais a serem sincronizadas no nível de banco de dados ou tabela, clique com o botão direito do mouse no objeto na caixa Selected Objects e selecione as operações SQL desejadas na caixa de diálogo exibida.
-
Para filtrar dados usando uma cláusula WHERE, clique com o botão direito do mouse na tabela na caixa Selected Objects e defina as condições de filtro na caixa de diálogo exibida. Para mais informações, consulte Configurar condições de filtro.
-
Se você usar o recurso de mapeamento de nomes de objetos, outros objetos que dependem do objeto renomeado podem falhar na sincronização.
-
-
Clique em Next: Advanced Settings para configurar parâmetros avançados.
Parâmetro
Descrição
Dedicated Cluster for Task Scheduling
Por padrão, o DTS agenda tarefas em um cluster compartilhado, e não é necessário selecionar um cluster. Para um desempenho mais estável, você pode adquirir um cluster dedicado para executar tarefas de sincronização do DTS. Para mais informações, consulte O que é um cluster dedicado do DTS?.
Retry Time for Failed Connections
Após o início de uma tarefa de sincronização, se a conexão com o banco de dados de origem ou destino falhar, o DTS relatará um erro e iniciará imediatamente a tentativa de reconexão. A duração padrão de nova tentativa é de 720 minutos. Você também pode especificar uma duração personalizada de 10 a 1.440 minutos. Recomendamos definir a duração para 30 minutos ou mais. Se o DTS se reconectar com sucesso ao banco de dados dentro da duração especificada, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
Nota-
Se você tiver várias instâncias do DTS (por exemplo, Instância A e Instância B) que compartilham a mesma origem ou destino, e definir o tempo de nova tentativa de rede como 30 minutos para a Instância A e 60 minutos para a Instância B, a duração menor de 30 minutos será usada para ambas.
-
Como o DTS cobra pelo tempo de execução da tarefa durante o período de nova tentativa de conexão, recomendamos personalizar a duração da nova tentativa com base nas necessidades do seu negócio ou liberar a instância do DTS assim que possível após a liberação das instâncias de banco de dados de origem e destino.
Retry Time for Other Issues
Após o início da tarefa de sincronização, se ocorrerem outros problemas não relacionados à conexão com o banco de dados de origem ou destino (como exceções de execução DDL ou DML), o DTS relatará um erro e iniciará imediatamente operações contínuas de nova tentativa. A duração padrão de nova tentativa é de 10 minutos. Você também pode personalizar a duração da nova tentativa dentro do intervalo de 1 a 1.440 minutos. Recomendamos definir como 10 minutos ou mais. Se as operações relevantes forem bem-sucedidas dentro da duração de nova tentativa definida, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
ImportanteO valor para Retry Time for Other Issues deve ser menor que o valor para Retry Time for Failed Connections.
Enable Throttling for Full Data Synchronization
Durante a fase de sincronização completa, o DTS consome recursos de leitura e gravação dos bancos de dados de origem e destino, o que pode aumentar a carga do banco de dados. Para reduzir a carga nos bancos de dados de origem e destino, você pode definir um limite de taxa para a tarefa de sincronização completa configurando os parâmetros Queries per second (QPS) to the source database, RPS of Full Data Migration e Data migration speed for full migration (MB/s).
Nota-
Este item de configuração está disponível apenas quando Synchronization Types está definido como Full Data Synchronization.
-
Você também pode ajustar a taxa de sincronização completa depois que a instância de sincronização estiver em execução.
Enable Throttling for Incremental Data Synchronization
Você também pode definir um limite de taxa para a tarefa de sincronização incremental. Para aliviar a pressão no banco de dados de destino, defina RPS of Incremental Data Synchronization e Data synchronization speed for incremental synchronization (MB/s).
Environment Tag
Você pode selecionar uma tag de ambiente para identificar a instância conforme suas necessidades. Este exemplo não requer uma tag.
Whether to delete SQL operations on heartbeat tables of forward and reverse tasks
Escolha se deseja gravar informações SQL de heartbeat no banco de dados de origem enquanto a instância do DTS está em execução.
-
Yes: As informações SQL de heartbeat não são gravadas no banco de dados de origem. Isso pode fazer com que a instância do DTS relate um atraso.
-
No: Grava informações SQL de heartbeat no banco de dados de origem. Isso pode interferir em recursos como backup físico e clonagem do banco de dados de origem.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carregamento (ETL). Para mais informações, consulte O que é ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configurar ETL em uma tarefa de migração ou sincronização de dados.
-
No: Desativa o recurso ETL.
Monitoring and Alerting
Especifique se deseja configurar alertas. Se a sincronização falhar ou a latência exceder o limiar especificado, uma notificação será enviada a um contato de alerta.
-
No: Nenhum alerta é configurado.
-
Yes: Configure alertas definindo um limiar de alerta e especificando um notificação de alerta. Para mais informações, consulte Configurar monitoramento e alertas durante a configuração da tarefa.
-
-
Opcional: Após concluir as configurações anteriores, clique em Next: Configure Database and Table Fields para definir a Primary Key Column, a Distribution Key e o Engine para as tabelas de destino.
NotaEsta etapa está disponível apenas se você selecionar Schema Synchronization em Synchronization Types ao configurar os objetos de sincronização. Defina Definition Status como All para modificar as configurações.
É possível selecionar várias colunas para formar uma Primary Key Column composta. Você também deve selecionar uma ou mais colunas da Primary Key Column como Distribution Key.
Para uma tabela sem chave primária ou restrição única, você deve selecionar duplicate para o Engine. Caso contrário, a tarefa pode falhar ou ocorrer perda de dados.
-
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros da API para configurar esta instância, passe o mouse sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão.
Se tiver terminado de visualizar os parâmetros da API, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início do trabalho de sincronização, o DTS executa uma pré-verificação. O trabalho só pode começar após todos os itens de pré-verificação serem aprovados.
Se a pré-verificação falhar, clique em View Details para o item com falha. Corrija o problema conforme instruído e execute a pré-verificação novamente.
-
Se a pré-verificação retornar um aviso:
Se um item de verificação falhar e não puder ser ignorado, clique em View Details ao lado do item. Siga as instruções para corrigir o problema e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, clique em Confirm Alert Details, Ignore, OK e Precheck Again em sequência para pular o aviso e executar a pré-verificação novamente. Se você optar por ignorar o item de aviso, isso pode causar problemas como inconsistência de dados e representar riscos para o seu negócio.
-
Adquira a instância.
Quando a Success Rate for 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione o método de faturamento e a especificação de link para a instância de sincronização de dados. A tabela a seguir descreve esses parâmetros em detalhes.
Categoria
Parâmetro
Descrição
New Instance Class
Método de faturamento
-
Assinatura: Você paga ao criar a instância. Adequado para necessidades de longo prazo e mais econômico que o pagamento conforme o uso. Quanto maior a duração da assinatura, maior o desconto.
-
Pagamento conforme o uso: Cobrado por hora. Adequado para necessidades de curto prazo. Libere a instância imediatamente após o uso para economizar custos.
Configuração do grupo de recursos
O grupo de recursos ao qual a instância pertence. O padrão é default resource group. Para mais informações, consulte O que é Resource Management?.
Especificação de link
O DTS fornece especificações de sincronização com diferentes níveis de desempenho. A especificação do link de sincronização afeta a taxa de sincronização. Escolha uma especificação com base no seu cenário de negócios. Para mais informações, consulte Especificações de link de sincronização de dados.
Duração da assinatura
No modo de assinatura, selecione a duração e a quantidade para a instância de assinatura. Escolha uma assinatura mensal de 1 a 9 meses ou uma assinatura anual de 1, 2, 3 ou 5 anos.
NotaEsta opção está disponível apenas quando o método de faturamento é Subscription.
-
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK, clique em OK.
Visualize o progresso da tarefa na página Data Synchronization.
Mapeamento de tipos de dados
|
Categoria |
Tipo MySQL |
Tipo SelectDB |
|
NUMERIC |
TINYINT |
TINYINT |
|
TINYINT UNSIGNED |
SMALLINT |
|
|
SMALLINT |
SMALLINT |
|
|
SMALLINT UNSIGNED |
INT |
|
|
MEDIUMINT |
INT |
|
|
MEDIUMINT UNSIGNED |
BIGINT |
|
|
INT |
INT |
|
|
INT UNSIGNED |
BIGINT |
|
|
BIGINT |
BIGINT |
|
|
BIGINT UNSIGNED |
LARGEINT |
|
|
BIT(M) |
INT |
|
|
DECIMAL |
DECIMAL Nota
ZEROFILL não é suportado. |
|
|
NUMERIC |
Decimal |
|
|
FLOAT |
FLOAT |
|
|
DOUBLE |
DOUBLE |
|
|
BOOLEAN |
|
|
DATE AND TIME |
DATE |
DATEV2 |
|
DATETIME[(fsp)] |
DATETIMEV2 |
|
|
TIMESTAMP[(fsp)] |
DATETIMEV2 |
|
|
TIME[(fsp)] |
VARCHAR |
|
|
YEAR[(4)] |
INT |
|
|
STRING |
|
VARCHAR Importante
Para evitar perda de dados, dados CHAR e VARCHAR(n) são convertidos para VARCHAR(4*n) quando sincronizados com a instância de destino do ApsaraDB for SelectDB.
|
|
STRING |
|
|
STRING |
|
|
STRING |
|
|
ENUM |
STRING |
|
|
SET |
STRING |
|
|
JSON |
STRING |
Colunas adicionais
Esta tabela lista as colunas adicionais que o DTS adiciona automaticamente ou que você deve adicionar manualmente à tabela de modelo duplicate de destino.
|
Parâmetro |
Tipo |
Padrão |
Descrição |
|
_is_deleted |
Int |
0 |
Indica se a linha foi excluída.
|
|
_version |
Bigint |
0 |
|
|
_record_id |
Bigint |
0 |
|