O DTS pode sincronizar um conjunto de réplicas do MongoDB para outro conjunto de réplicas ou para um cluster fragmentado.
Bancos de dados de origem e destino suportados
Esta seção lista os bancos de dados de origem e destino compatíveis com a sincronização de dados de um conjunto de réplicas do MongoDB para um conjunto de réplicas ou cluster fragmentado do MongoDB. Este tópico demonstra o procedimento de configuração usando uma instância de conjunto de réplicas do ApsaraDB for MongoDB como origem e uma instância de conjunto de réplicas ou cluster fragmentado do ApsaraDB for MongoDB como destino. O procedimento para outras fontes de dados é semelhante.
|
Banco de dados de origem |
Banco de dados de destino |
|
Instância de conjunto de réplicas do ApsaraDB for MongoDB |
Instância de conjunto de réplicas ou cluster fragmentado do ApsaraDB for MongoDB |
|
Conjunto de réplicas do MongoDB autogerenciado em uma instância ECS |
Conjunto de réplicas ou cluster fragmentado do MongoDB autogerenciado em uma instância ECS |
|
Conjunto de réplicas do MongoDB autogerenciado conectado via Express Connect, VPN Gateway ou Smart Access Gateway |
Conjunto de réplicas ou cluster fragmentado do MongoDB autogerenciado conectado via Express Connect, VPN Gateway ou Smart Access Gateway |
Pré-requisitos
-
Crie uma instância de conjunto de réplicas do ApsaraDB for MongoDB de origem e uma instância do ApsaraDB for MongoDB de destino (conjunto de réplicas ou cluster fragmentado). Para obter instruções, consulte Create a replica set instance e Create a sharded cluster instance.
NotaPara versões compatíveis, consulte Synchronization solution overview.
A instância do ApsaraDB for MongoDB de destino deve ter pelo menos 10% a mais de espaço de armazenamento do que o utilizado pela instância do ApsaraDB for MongoDB de origem.
-
Se a instância do ApsaraDB for MongoDB de destino for um cluster fragmentado, crie os bancos de dados e coleções que deseja fragmentar, configure o sharding de dados, ative o balanceador e execute o pré-sharding na instância do ApsaraDB for MongoDB de destino conforme suas necessidades de negócio. Para mais informações, consulte Configure data sharding to make full use of shard performance e How to handle unbalanced data distribution in an ApsaraDB for MongoDB sharded cluster.
NotaConfigurar o sharding de dados distribui os dados sincronizados por todos os shards, maximizando o desempenho do cluster. Ativar o balanceador e realizar o pré-sharding ajuda a evitar distorção de dados.
Limitações
|
Tipo |
Descrição |
|
Limites do banco de dados de origem |
|
|
Outros limites |
|
|
Casos especiais |
Se o banco de dados de origem for um MongoDB autogerenciado:
Nota
Se você selecionar sincronização de banco de dados completo, crie uma tabela de heartbeat. Atualize ou grave nesta tabela a cada segundo. |
Faturamento
|
Tipo de sincronização |
Preço |
|
Sincronização de esquema e sincronização completa de dados |
Gratuito. |
|
Sincronização incremental de dados |
Pago. Para mais informações, consulte Billing overview. |
Topologias de sincronização suportadas
Sincronização unidirecional um para um
Sincronização unidirecional um para muitos
Sincronização unidirecional muitos para um
Sincronização unidirecional em cascata
Para detalhes sobre essas topologias de sincronização e suas considerações, consulte Synchronization topologies.
Tipos de sincronização
|
Tipo |
Descrição |
|
Sincronização de esquema |
Replica os esquemas dos objetos selecionados da instância ApsaraDB for MongoDB de origem para a instância ApsaraDB for MongoDB de destino. |
|
Sincronização completa de dados |
Replica todos os dados históricos dos objetos selecionados da instância ApsaraDB for MongoDB de origem para a instância ApsaraDB for MongoDB de destino. Nota
A sincronização completa de dados é suportada nos níveis de banco de dados e coleção. |
|
Sincronização incremental de dados |
Replica alterações contínuas da instância ApsaraDB for MongoDB de origem para a instância ApsaraDB for MongoDB de destino após a conclusão da sincronização completa de dados. OplogA sincronização incremental de dados não replica bancos de dados criados após o início da tarefa. As seguintes alterações são replicadas:
Change streamAs seguintes alterações são replicadas:
|
Procedimento
-
Acesse a página da lista de tarefas de sincronização da região de destino. Use um dos dois métodos a seguir:
Pelo console do DTS
Faça login no console do Data Transmission Service (DTS).
No painel de navegação à esquerda, clique em Data Synchronization.
No canto superior esquerdo da página, selecione a região onde a instância de sincronização está localizada.
Pelo console do DMS
NotaAs operações reais podem variar com base no modo e layout do console do DMS. Para mais informações, consulte Simple mode e Customize the layout and style of the DMS interface.
Faça login no Data Management (DMS).
Na barra de menu superior, escolha .
À direita de Data Synchronization Tasks, selecione a região onde a instância de sincronização está localizada.
Clique em Create Task para abrir a página de configuração da tarefa.
-
Configure os bancos de dados de origem e destino.
AvisoApós selecionar as instâncias de origem e destino, leia atentamente os limites exibidos no topo da página. Se você não seguir os limites, a tarefa pode falhar ou pode ocorrer inconsistência de dados.
Categoria
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome de tarefa. Recomendamos especificar um nome descritivo para fácil identificação. O nome não precisa ser único.
Source Database
Select Existing Connection
-
Para usar uma instância de banco de dados que seja added to the system (recém-criada ou salva), selecione a instância de banco de dados na lista suspensa. As informações do banco de dados são configuradas automaticamente.
NotaNo console do DMS, este item de configuração é denominado Select a DMS database instance..
-
Se você não adicionou a instância de banco de dados ao sistema, ou não precisa usar uma instância já adicionada, configure manualmente as seguintes informações do banco de dados.
Database Type
Selecione MongoDB.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região onde a instância ApsaraDB for MongoDB de origem está localizada.
Replicate Data Across Alibaba Cloud Accounts
Este exemplo usa uma instância de banco de dados que pertence à conta atual do Alibaba Cloud. Selecione No.
Architecture
Selecione Replica Set.
Migration Method
Selecione um método para sincronização incremental de dados com base nas suas necessidades.
-
Oplog (Recomendado):
Esta opção está disponível se o Oplog estiver ativado para o banco de dados de origem.
NotaO Oplog é ativado por padrão para bancos de dados MongoDB autogerenciados e instâncias ApsaraDB for MongoDB. Este método oferece menor latência para tarefas de sincronização incremental porque os logs são recuperados mais rapidamente. Recomendamos selecionar Oplog.
-
ChangeStream:
Esta opção está disponível se o Change Streams estiver ativado para o banco de dados de origem.
Nota-
Se o banco de dados de origem for uma instância Amazon DocumentDB (cluster não elástico), você só pode selecionar ChangeStream.
-
Se você definir a Architecture do banco de dados de origem como Sharded Cluster, não é necessário especificar Shard account e Shard password.
-
Instance ID
Selecione o ID da instância ApsaraDB for MongoDB de origem.
Authentication Database
Insira o nome do banco de dados associado à conta da instância ApsaraDB for MongoDB de origem. O padrão é
admin.Database Account
Insira a conta do banco de dados ApsaraDB for MongoDB de origem. A conta deve ter permissão de leitura nos bancos de dados a serem sincronizados, no banco de dados
config, no banco de dadosadmine no banco de dadoslocal.NotaSe você usar ChangeStream como método de sincronização incremental, a conta do banco de dados de origem requer permissões de leitura de Change Streams em toda a instância (como
readAnyDatabase). Se a origem for uma instância ApsaraDB for MongoDB com uma conta personalizada, você também deve conceder à conta permissão de leitura no banco de dadosadmin. Para detalhes, consulte Permissions of the root account specified during instance creation.Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
O DTS suporta três métodos de conexão: Non-encrypted, SSL-encrypted e Mongo Atlas SSL. As opções para Encryption variam com base no Access Method e na Architecture selecionados. As opções exibidas no console prevalecem.
Nota-
Um banco de dados MongoDB cuja Architecture seja Sharded Cluster e o Migration Method seja Oplog não suporta SSL-encrypted.
-
Se a origem for um banco de dados MongoDB autogerenciado (Access Method não é Alibaba Cloud Instance) com arquitetura Replica Set, e você selecionar SSL-encrypted, o DTS também permite carregar um certificado CA para verificar a conexão.
Destination Database
Select Existing Connection
-
Para usar uma instância de banco de dados que seja added to the system (recém-criada ou salva), selecione a instância de banco de dados na lista suspensa. As informações do banco de dados são configuradas automaticamente.
NotaNo console do DMS, este item de configuração é denominado Select a DMS database instance..
-
Se você não adicionou a instância de banco de dados ao sistema, ou não precisa usar uma instância já adicionada, configure manualmente as seguintes informações do banco de dados.
Database Type
Selecione MongoDB.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região onde a instância ApsaraDB for MongoDB de destino está localizada.
Replicate Data Across Alibaba Cloud Accounts
Este exemplo usa uma instância de banco de dados que pertence à conta atual do Alibaba Cloud. Selecione No.
Architecture
Selecione o tipo de arquitetura da instância ApsaraDB for MongoDB de destino.
Instance ID
Selecione o ID da instância ApsaraDB for MongoDB de destino.
Authentication Database
Insira o nome do banco de dados associado à conta da instância ApsaraDB for MongoDB de destino. O padrão é
admin.Database Account
Insira a conta do banco de dados ApsaraDB for MongoDB de destino. A conta deve ter a permissão dbAdminAnyDatabase, a permissão readWrite no banco de dados de destino e a permissão de leitura no banco de dados local.
Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
O DTS suporta três métodos de conexão: Non-encrypted, SSL-encrypted e Mongo Atlas SSL. As opções para Encryption variam com base no Access Method e na Architecture selecionados. As opções exibidas no console prevalecem.
Nota-
Bancos de dados MongoDB com Architecture de Sharded Cluster não suportam SSL-encrypted.
-
Se o destino for um banco de dados MongoDB autogerenciado (Access Method não é Alibaba Cloud Instance) com Replica Set, e você selecionar SSL-encrypted, o DTS também permite carregar um certificado CA para verificar a conexão.
-
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página.
NotaCertifique-se de que os blocos CIDR de endereços IP dos servidores DTS estejam adicionados às configurações de segurança dos bancos de dados de origem e destino para permitir o acesso dos servidores DTS. Isso pode ser feito automática ou manualmente. Para mais informações, consulte Add the IP address CIDR blocks of DTS servers to a whitelist.
Se o banco de dados de origem ou destino for um banco de dados autogerenciado (onde o Access Method não é Alibaba Cloud Instance), você também deve clicar em Test Connectivity na caixa de diálogo CIDR Blocks of DTS Servers.
-
Configure os objetos da tarefa.
-
Na página Configure Objects, configure os objetos a serem sincronizados.
Parâmetro
Descrição
Synchronization Types
Incremental Data Synchronization está selecionado. Por padrão, você também deve selecionar Schema Synchronization e Full Data Synchronization. Após a conclusão da pré-verificação, o DTS executa uma sincronização completa de dados dos objetos selecionados da instância de origem para o cluster de destino. Isso serve como dados de base para a subsequente sincronização incremental de dados.
NotaPara mais informações, consulte Task steps.
Processing Mode of Conflicting Tables
-
Precheck and Report Errors: Verifica se existe uma coleção com o mesmo nome no banco de dados de destino. Se uma coleção com o mesmo nome for encontrada, um erro é relatado e a tarefa de sincronização de dados não inicia. Caso contrário, a pré-verificação é bem-sucedida.
NotaSe você não puder excluir ou renomear a coleção com o mesmo nome no banco de dados de destino, poderá alterar o nome da coleção no banco de dados de destino. Para mais informações, consulte Set the name of a synchronization object in the destination instance.
-
Ignore Errors and Proceed: Ignora a verificação de coleções com o mesmo nome no banco de dados de destino.
AvisoSelecionar Ignore Errors and Proceed pode causar inconsistência de dados e colocar seu negócio em risco. Por exemplo:
-
Se um registro no banco de dados de destino tiver o mesmo valor de chave primária ou chave única que um registro no banco de dados de origem, o registro no banco de dados de destino será mantido. O registro do banco de dados de origem não será sincronizado para o banco de dados de destino.
-
Isso pode fazer com que a inicialização de dados falhe, apenas dados parciais sejam sincronizados ou toda a sincronização falhe.
-
Synchronization Topology
Selecione One-way Synchronization.
Capitalization of Object Names in Destination Instance
Você pode configurar a política de diferenciação de maiúsculas e minúsculas para os nomes em inglês dos objetos de banco de dados e coleção sincronizados na instância de destino. Você pode selecionar a DTS default policy, que é a opção padrão, ou usar as políticas padrão do banco de dados de origem ou destino. Para mais informações, consulte Case sensitivity policy for destination object names.
Source Objects
Na caixa Source Objects, clique em um objeto para sincronizar e, em seguida, clique em
para movê-lo para a caixa Selected Objects.NotaVocê pode selecionar objetos no nível DATABASE ou COLLECTION.
Selected Objects
-
Para definir o nome de um objeto de sincronização na instância de destino ou especificar qual objeto recebe os dados, clique com o botão direito no objeto de sincronização na caixa Selected Objects e modifique-o. Para mais informações, consulte Map table and column names.
-
Para remover um objeto de sincronização, clique nele na caixa Selected Objects e, em seguida, clique em
para movê-lo para a caixa Source Objects.
Nota-
Para selecionar operações incrementais no nível de banco de dados ou coleção, clique com o botão direito no objeto desejado na caixa Selected Objects e faça suas seleções na caixa de diálogo que aparece.
-
Para filtrar dados (suportado durante a sincronização completa, mas não na sincronização incremental), clique com o botão direito na coleção desejada na caixa Selected Objects e configure as definições na caixa de diálogo que aparece. Para instruções, consulte Configure filter conditions.
-
Se você usar o recurso de mapeamento de nomes de objetos para especificar um banco de dados ou coleção para receber dados, a sincronização pode falhar para outros objetos que dependem do objeto mapeado.
-
-
Clique em Next: Advanced Settings para configurar parâmetros avançados.
Parâmetro
Descrição
Dedicated Cluster for Task Scheduling
Por padrão, o DTS agenda tarefas em um cluster compartilhado, e você não precisa selecionar um cluster. Para um desempenho mais estável, você pode adquirir um cluster dedicado para executar tarefas de sincronização do DTS. Para mais informações, consulte What is a DTS dedicated cluster?.
Retry Time for Failed Connections
Após o início de uma tarefa de sincronização, se a conexão com o banco de dados de origem ou destino falhar, o DTS relata um erro e começa imediatamente a tentar reconectar. A duração padrão de nova tentativa é de 720 minutos. Você também pode especificar uma duração personalizada de nova tentativa de 10 a 1.440 minutos. Recomendamos definir a duração para 30 minutos ou mais. Se o DTS conseguir se reconectar ao banco de dados dentro da duração especificada, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
Nota-
Se você tiver várias instâncias DTS (por exemplo, Instância A e Instância B) que compartilham a mesma origem ou destino, e definir o tempo de nova tentativa de rede para 30 minutos para a Instância A e 60 minutos para a Instância B, a duração mais curta de 30 minutos será usada para ambas.
-
Como o DTS cobra pelo tempo de execução da tarefa durante o período de nova tentativa de conexão, recomendamos personalizar a duração da nova tentativa com base nas necessidades do seu negócio ou liberar a instância DTS o mais rápido possível após a liberação das instâncias de banco de dados de origem e destino.
Retry Time for Other Issues
Após o início da tarefa de sincronização, se ocorrerem outros problemas não relacionados à conectividade com o banco de dados de origem ou destino (como exceções de execução DDL ou DML), o DTS relata um erro e inicia imediatamente operações contínuas de nova tentativa. A duração padrão de nova tentativa é de 10 minutos. Você também pode personalizar a duração da nova tentativa dentro do intervalo de 1 a 1.440 minutos. Recomendamos definir para 10 minutos ou mais. Se as operações relevantes forem bem-sucedidas dentro da duração de nova tentativa definida, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
ImportanteO valor para Retry Time for Other Issues deve ser menor que o valor para Retry Time for Failed Connections.
Enable Throttling for Full Data Synchronization
Durante a fase de sincronização completa, o DTS consome recursos de leitura e gravação dos bancos de dados de origem e destino, o que pode aumentar a carga do banco de dados. Para reduzir a carga nos bancos de dados de origem e destino, você pode definir um limite de taxa para a tarefa de sincronização completa configurando os parâmetros Queries per second (QPS) to the source database, RPS of Full Data Migration e Data migration speed for full migration (MB/s).
Nota-
Este item de configuração está disponível apenas quando Synchronization Types está definido como Full Data Synchronization.
-
Você também pode adjust the full synchronization rate após a instância de sincronização estar em execução.
Only one data type for primary key _id in a table of the data to be synchronized
Especifique se os tipos de dados da chave primária
_idsão únicos dentro de cada coleção a ser sincronizada.Importante-
Selecione uma opção com base nos seus dados reais. Uma seleção incorreta pode levar à perda de dados.
-
Este parâmetro está disponível apenas se Synchronization Types incluir Full Data Synchronization.
-
Yes: Os tipos de dados são únicos. Durante a fase de sincronização completa, o DTS não verifica os tipos de dados das chaves primárias nos dados de origem. Para cada coleção, o DTS sincroniza apenas os dados correspondentes a um tipo de dados de chave primária.
-
No: Os tipos de dados não são únicos. Durante a fase de sincronização completa, o DTS verifica os tipos de dados das chaves primárias nos dados de origem e sincroniza todos os dados.
Enable Throttling for Incremental Data Synchronization
Você também pode definir um limite de taxa para a tarefa de sincronização incremental. Para aliviar a pressão no banco de dados de destino, defina RPS of Incremental Data Synchronization e Data synchronization speed for incremental synchronization (MB/s).
Environment Tag
Você pode selecionar uma tag de ambiente para identificar a instância com base nas suas necessidades. Neste exemplo, nenhuma seleção é necessária.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carregamento (ETL). Para mais informações, consulte What is ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configure ETL in a data migration or data synchronization task.
-
No: Desativa o recurso ETL.
Monitoring and Alerting
Especifique se deseja configurar alertas. Se a sincronização falhar ou a latência exceder o limiar especificado, uma notificação será enviada a um contato de alerta.
-
No: Nenhum alerta é configurado.
-
Yes: Configure alertas definindo um limiar de alerta e especificando um notificação de alerta. Para mais informações, consulte Configure monitoring and alerting during task configuration.
-
-
Clique em Next: Data Validation para configurar uma tarefa de validação de dados.
Se quiser usar o recurso de validação de dados, consulte Configure data validation para instruções de configuração.
-
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros da API para configurar esta instância, passe o mouse sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão.
Se terminar de visualizar os parâmetros da API, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início do trabalho de sincronização, o DTS executa uma pré-verificação. O trabalho só pode começar após todos os itens de pré-verificação serem aprovados.
Se a pré-verificação falhar, clique em View Details para o item com falha. Corrija o problema conforme solicitado e execute a pré-verificação novamente.
-
Se a pré-verificação retornar um aviso:
Se um item de verificação falhar e não puder ser ignorado, clique em View Details ao lado do item. Siga as instruções para corrigir o problema e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, você pode clicar em Confirm Alert Details, Ignore, OK e Precheck Again em sequência para pular o aviso e executar a pré-verificação novamente. Se você optar por ignorar o item de aviso, isso pode causar problemas como inconsistência de dados e representar riscos para o seu negócio.
-
Adquira a instância.
Quando a Success Rate for 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione o método de faturamento e a especificação de link para a instância de sincronização de dados. A tabela a seguir descreve esses parâmetros em detalhe.
Categoria
Parâmetro
Descrição
New Instance Class
Método de faturamento
-
Assinatura: Você paga ao criar a instância. Adequado para necessidades de longo prazo e mais econômico que o pagamento conforme o uso. Quanto maior a duração da assinatura, maior o desconto.
-
Pagamento conforme o uso: A cobrança é feita por hora. Adequado para necessidades de curto prazo. Você pode liberar a instância imediatamente após o uso para economizar custos.
Configuração do grupo de recursos
O grupo de recursos ao qual a instância pertence. O padrão é o grupo de recursos padrão. Para mais informações, consulte What is Resource Management?.
Especificação do link
O DTS fornece especificações de sincronização com diferentes níveis de desempenho. A especificação do link de sincronização afeta a taxa de sincronização. Você pode escolher uma especificação com base no seu cenário de negócio. Para mais informações, consulte Data synchronization link specifications.
Duração da assinatura
No modo de assinatura, selecione a duração e a quantidade para a instância de assinatura. Você pode escolher uma assinatura mensal de 1 a 9 meses, ou uma assinatura anual de 1, 2, 3 ou 5 anos.
NotaEsta opção está disponível apenas quando o método de faturamento é Subscription.
-
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK, clique em OK.
Você pode visualizar o progresso da tarefa na página Data Synchronization.
FAQ
Por que encontro latência de tarefa e inconsistência de dados mesmo quando não há gravações de aplicação?
-
Causa: Este problema ocorre devido a um conflito entre o mecanismo de exclusão automática de um índice TTL em uma coleção do MongoDB e o mecanismo de sincronização de dados do DTS. Esse conflito pode levar a latência de tarefa e inconsistência de dados na sua tarefa de sincronização/migração.
DELETEs redundantes reduzem a eficiência: Quando o índice TTL de origem exclui dados expirados, ele grava um registro DELETE no Oplog. O DTS reproduz este DELETE no destino. Se o índice TTL de destino já tiver excluído os mesmos dados, o MongoDB retorna uma contagem de linhas afetadas inesperada, acionando o tratamento de exceções e desacelerando a migração.
-
Inconsistência de dados devido à exclusão assíncrona do TTL: Índices TTL não excluem dados em tempo real. Dados expirados ainda podem existir na origem enquanto o destino já os excluiu, causando inconsistência.
Exemplo:
O Oplog ou ChangeStream do MongoDB registra apenas os campos atualizados para uma operação UPDATE, não o documento completo. Se um UPDATE não conseguir encontrar os dados de destino no destino, o DTS ignora a operação.
Momento
Instância de origem
Instância de destino
1
Serviço insere dados
2
DTS sincroniza a operação INSERT
3
Dados expiraram, mas ainda não foram excluídos pelo índice TTL
4
Serviço atualiza os dados (por exemplo, atualiza o campo do índice TTL para alterar o tempo de expiração)
5
Índice TTL exclui os dados
6
DTS sincroniza o UPDATE, mas os dados não são encontrados. A operação é ignorada.
Como resultado, este documento está ausente na instância MongoDB de destino.
Solução: Para resolver isso, modifique temporariamente o tempo de expiração do índice TTL no destino durante a tarefa de sincronização/migração. Isso garante tanto a eficiência da sincronização quanto a consistência dos dados. Para etapas detalhadas, consulte Best practices for synchronizing or migrating collections with TTL indexes from a MongoDB source.