O Data Transmission Service (DTS) permite sincronizar dados de um SQL Server autogerenciado para o AnalyticDB for PostgreSQL para análise de dados em tempo real.
Pré-requisitos
A versão do seu banco de dados SQL Server autogerenciado deve ser compatível. Para mais informações, consulte Synchronization solution overview.
Crie uma instância de destino do AnalyticDB for PostgreSQL. Para obter instruções, consulte Create an instance.
A instância de destino do AnalyticDB for PostgreSQL deve ter mais espaço de armazenamento que o banco de dados SQL Server autogerenciado de origem.
Limitações
Durante a sincronização de esquema, o DTS sincroniza chaves estrangeiras do banco de dados de origem para o banco de dados de destino.
Nas fases de sincronização total e incremental de dados, o DTS desativa temporariamente as verificações de restrições e operações em cascata de chaves estrangeiras no nível da sessão. Pode ocorrer inconsistência de dados se operações de atualização ou exclusão em cascata forem executadas no banco de dados de origem enquanto a tarefa estiver em execução.
|
Tipo |
Descrição |
|
Limitações do banco de dados de origem |
|
|
Outras limitações |
|
|
Casos especiais |
Quando a instância de origem é um ApsaraDB RDS for SQL Server, o DTS cria uma conta |
Faturamento
|
Tipo de sincronização |
Preço |
|
Sincronização de esquema e sincronização total de dados |
Gratuito. |
|
Sincronização incremental de dados |
Pago. Para mais informações, consulte Billing overview. |
Topologias de sincronização
Sincronização unidirecional um para um
Sincronização unidirecional um para muitos
Sincronização unidirecional muitos para um
Para uma introdução a essas topologias e considerações importantes, consulte Synchronization topologies.
Operações SQL suportadas
|
Tipo |
Instrução SQL |
|
DML |
INSERT, UPDATE e DELETE Nota
|
|
DDL |
Nota
|
Permissões da conta do banco de dados
|
Banco de dados |
Permissões necessárias |
Referências |
|
SQL Server autogerenciado |
sysadmin |
|
|
Instância AnalyticDB for PostgreSQL |
Nota
Você também pode usar a conta inicial da instância AnalyticDB for PostgreSQL. |
Create and manage a database account e Manage users and permissions |
Pré-requisitos
Antes de configurar uma tarefa de sincronização de dados, configure as definições de log e crie um índice clusterizado no seu banco de dados SQL Server autogerenciado.
Para sincronizar vários bancos de dados, repita as etapas 1 a 3 para cada banco de dados a fim de evitar inconsistências de dados.
-
Execute o seguinte comando no seu banco de dados SQL Server autogerenciado para alterar o modelo de recuperação do banco de dados para full. Você também pode usar o SQL Server Management Studio (SSMS) para alterar o modelo de recuperação. Para mais informações, consulte View or Change the Recovery Model of a Database (SQL Server).
use master; GO ALTER DATABASE <database_name> SET RECOVERY FULL WITH ROLLBACK IMMEDIATE; GOParâmetros:
<database_name>: O nome do banco de dados a ser sincronizado.Exemplo:
use master; GO ALTER DATABASE mytestdata SET RECOVERY FULL WITH ROLLBACK IMMEDIATE; GO -
Execute o seguinte comando para criar um backup lógico do banco de dados de origem. Se você já possui um backup lógico, pule esta etapa.
BACKUP DATABASE <database_name> TO DISK='<physical_backup_device_name>'; GOParâmetros:
<database_name>: O nome do banco de dados de origem.<physical_backup_device_name>: O caminho e o nome do arquivo de backup.
Exemplo:
BACKUP DATABASE mytestdata TO DISK='D:\backup\dbdata.bak'; GO -
Execute o seguinte comando para criar um backup de log do banco de dados de origem.
BACKUP LOG <database_name> to DISK='<physical_backup_device_name>' WITH init; GOParâmetros:
<database_name>: O nome do banco de dados de origem.<physical_backup_device_name>: O caminho e o nome do arquivo de backup.
Exemplo:
BACKUP LOG mytestdata TO DISK='D:\backup\dblog.bak' WITH init; GO
Procedimento
-
Acesse a página da lista de tarefas de sincronização da região de destino. Você pode usar um dos dois métodos a seguir:
Pelo console do DTS
Faça login no console do Data Transmission Service (DTS).
No painel de navegação à esquerda, clique em Data Synchronization.
No canto superior esquerdo da página, selecione a região onde a instância de sincronização está localizada.
Pelo console do DMS
NotaAs operações reais podem variar dependendo do modo e layout do console do DMS. Para mais informações, consulte Simple mode e Customize the layout and style of the DMS interface.
Faça login no Data Management (DMS).
Na barra de menu superior, escolha .
À direita de Data Synchronization Tasks, selecione a região onde a instância de sincronização está localizada.
Clique em Create Task para abrir a página de configuração da tarefa.
-
Configure os bancos de dados de origem e de destino.
Categoria
Parâmetro
Descrição
N/A
Task Name
O DTS gera automaticamente um nome para a tarefa. Recomendamos especificar um nome descritivo para facilitar a identificação. O nome não precisa ser único.
Source Database
Database Type
Selecione SQL Server.
Access Method
Selecione um tipo de conexão com base na implantação do seu banco de dados de origem. Neste exemplo, selecione Self-managed Database on ECS.
NotaSe você selecionar um tipo de conexão diferente para seu banco de dados autogerenciado, deverá concluir os preparativos correspondentes. Para mais informações, consulte Overview of preparations.
Instance Region
Selecione a região da instância ECS que hospeda seu banco de dados SQL Server autogerenciado.
ECS Instance ID
Selecione o ID da instância ECS que hospeda o banco de dados SQL Server autogerenciado.
Port Number
Insira a porta de service do banco de dados SQL Server autogerenciado. O valor padrão é 1433.
Database Account
Insira a conta do banco de dados SQL Server autogerenciado. Para informações sobre as permissões necessárias, consulte Permissions required for database accounts.
Database Password
Insira a senha correspondente à conta do banco de dados.
Encryption
Destination Database
Database Type
Selecione AnalyticDB for PostgreSQL.
Connection Type
Selecione Alibaba Cloud Instance.
Instance Region
Selecione a região da instância de destino AnalyticDB for PostgreSQL.
Instance ID
Selecione o ID da instância de destino AnalyticDB for PostgreSQL.
Database Name
Insira o nome do banco de dados de destino na instância AnalyticDB for PostgreSQL.
Database Account
Insira a conta da instância de destino AnalyticDB for PostgreSQL. Para informações sobre as permissões necessárias, consulte Permissions required for database accounts.
Database Password
Insira a senha correspondente à conta do banco de dados.
-
Após concluir a configuração, clique em Test Connectivity and Proceed na parte inferior da página. Na caixa de diálogo CIDR Blocks of DTS Servers, clique em Test Connectivity.
NotaCertifique-se de que os blocos CIDR de endereços IP dos servidores DTS foram adicionados às configurações de segurança dos bancos de dados de origem e destino para permitir o acesso dos servidores DTS. Isso pode ser feito automática ou manualmente. Para mais informações, consulte Add the IP address CIDR blocks of DTS servers to a whitelist.
-
Configure os objetos da tarefa.
-
Na página Configure Objects, configure os objetos a serem sincronizados.
Parâmetro
Descrição
Synchronization Types
Incremental Data Synchronization está selecionado. Por padrão, você também deve selecionar Schema Synchronization e Full Data Synchronization. Após a conclusão da pré-verificação, o DTS realiza uma sincronização total dos dados dos objetos selecionados da instância de origem para o cluster de destino. Isso serve como linha de base para a subsequente sincronização incremental de dados.
Processing Mode of Conflicting Tables
-
Precheck and Report Errors: Verifica se existe uma tabela com o mesmo nome no banco de dados de destino. Se não existir, a pré-verificação é aprovada. Se existir, a pré-verificação falha e a tarefa de sincronização de dados não inicia.
NotaSe não for possível excluir ou renomear a tabela com o mesmo nome no banco de dados de destino, você pode mapeá-la para um nome de tabela diferente. Para mais informações, consulte Map table and column names.
-
Ignore Errors and Proceed: Ignora a verificação de nomes de tabela duplicados no banco de dados de destino.
AvisoSelecionar Ignore Errors and Proceed pode causar inconsistência de dados e colocar seus negócios em risco. Por exemplo:
-
Se os esquemas das tabelas forem iguais e um registro no banco de dados de destino tiver o mesmo valor de chave primária ou única que um registro no banco de dados de origem:
-
Durante a sincronização total, o DTS mantém o registro no cluster de destino. O registro correspondente do banco de dados de origem não é sincronizado.
-
Durante a sincronização incremental, o registro do banco de dados de origem substitui o registro no banco de dados de destino.
-
-
Se os esquemas das tabelas forem diferentes, a sincronização inicial de dados pode falhar. Isso pode resultar na sincronização apenas parcial dos dados das colunas ou em uma falha completa da sincronização. Prossiga com cautela.
-
SQL Server Incremental Synchronization Mode
-
Log-based Parsing for Non-heap Tables and CDC-based Incremental Synchronization for Heap Tables (Hybrid Log-based Parsing):
-
Vantagens:
-
Suporta cenários com tabelas heap, tabelas sem chaves primárias, tabelas compactadas e tabelas com colunas computadas no banco de dados de origem.
-
Alta estabilidade do link. Este modo pode obter instruções DDL completas e oferece suporte abrangente para cenários DDL.
-
-
Desvantagens:
-
O DTS cria um gatilho dts_cdc_sync_ddl, uma tabela de heartbeat dts_sync_progress e uma tabela de armazenamento DDL dts_cdc_ddl_history no banco de dados de origem. Ele também ativa o CDC no nível do banco de dados e para algumas tabelas.
-
Não é possível executar instruções SELECT INTO, TRUNCATE, RENAME COLUMN ou de modificação de tipo de coluna em tabelas que tenham o CDC ativado no banco de dados de origem. O gatilho criado pelo DTS no banco de dados de origem não pode ser excluído manualmente.
NotaTabelas contendo tipos geometry, geography ou hierarchyid não suportam a ativação do CDC.
-
-
-
Incremental Synchronization Based on Logs of Source Database (Heap tables are not supported):
-
Vantagens:
Este modo não é intrusivo para o banco de dados de origem.
-
Desvantagens:
Não suporta cenários com tabelas heap, tabelas sem chaves primárias, tabelas compactadas ou tabelas com colunas computadas no banco de dados de origem.
-
-
Polling and querying CDC instances for incremental synchronization:
-
Vantagens:
-
Suporta sincronização total e incremental quando o banco de dados de origem é Amazon RDS for SQL Server, Azure SQL Database, Azure SQL Managed Instance, Azure SQL Server on Virtual Machine ou Google Cloud SQL for SQL Server.
-
Este modo utiliza o componente nativo Change Data Capture (CDC) do SQL Server para obter dados incrementais. Isso torna a sincronização incremental mais estável e consome menos largura de banda de rede.
-
-
Desvantagens:
-
A conta do banco de dados de origem usada pela instância DTS deve ter permissão para ativar o CDC. Existe um atraso de aproximadamente 10 segundos para a sincronização incremental de dados.
-
Em cenários que envolvem a sincronização de múltiplos bancos de dados e tabelas, podem existir riscos de problemas de estabilidade e desempenho.
-
-
The maximum number of tables for which CDC is enabled that DTS supports.
DDL and DML Operations to Be Synchronized
Selecione as operações DDL ou DML a serem sincronizadas no nível da instância. Para informações sobre operações suportadas, consulte Supported SQL operations.
NotaPara selecionar quais operações SQL sincronizar para um banco de dados ou tabela, clique com o botão direito no objeto de sincronização na caixa Selected Objects. Na caixa de diálogo exibida, selecione as operações SQL.
Storage Engine Type
Selecione o tipo de mecanismo de armazenamento para as tabelas de destino. O valor padrão é Beam.
NotaEste parâmetro está disponível apenas quando a versão do kernel da instância de destino AnalyticDB for PostgreSQL é v7.0.6.6 ou posterior, e Synchronization Types estiver selecionado para Schema Synchronization.
Source Objects
Na caixa Source Objects, clique em um objeto para sincronizar e, em seguida, clique em
para movê-lo para a caixa Selected Objects.NotaEste cenário envolve sincronização entre bancos de dados heterogêneos. Portanto, você pode selecionar apenas tabelas como objetos de sincronização. Outros objetos, como visualizações, gatilhos e procedimentos armazenados, não são sincronizados para o banco de dados de destino.
Selected Objects
-
Para renomear um único objeto de sincronização na instância de destino, clique com o botão direito no objeto na caixa Selected Objects. Para mais informações sobre como renomear objetos, consulte Map a single database, table, or column.
-
Para alterar em lote os nomes de vários objetos de sincronização na instância de destino, clique em Batch Edit no canto superior direito da caixa Selected Objects. Para mais informações, consulte Map databases, tables, and columns in a batch.
Nota-
Para selecionar operações SQL a serem sincronizadas no nível do banco de dados ou da tabela, clique com o botão direito em um objeto na lista Selected Objects e selecione as operações SQL desejadas na caixa de diálogo exibida.
-
Para especificar uma condição WHERE para filtrar dados, clique com o botão direito em uma tabela na lista Selected Objects e especifique a condição na caixa de diálogo exibida. Para obter instruções, consulte Configure filter conditions.
-
Se você usar mapeamento de objetos, objetos dependentes podem falhar na sincronização.
-
-
Clique em Next: Advanced Settings para configurar parâmetros avançados.
Parâmetro
Descrição
Dedicated Cluster for Task Scheduling
Por padrão, o DTS agenda tarefas em um cluster compartilhado, e você não precisa selecionar um cluster. Para um desempenho mais estável, você pode adquirir um cluster dedicado para executar tarefas de sincronização do DTS. Para mais informações, consulte What is a DTS dedicated cluster?.
Retry Time for Failed Connections
Após o início de uma tarefa de sincronização, se a conexão com o banco de dados de origem ou de destino falhar, o DTS reportará um erro e iniciará imediatamente uma nova tentativa de conexão. A duração padrão de nova tentativa é de 720 minutos. Você também pode especificar uma duração personalizada de 10 a 1.440 minutos. Recomendamos definir a duração para 30 minutos ou mais. Se o DTS reconectar com sucesso ao banco de dados dentro da duração especificada, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
Nota-
Se você tiver várias instâncias DTS (por exemplo, Instância A e Instância B) que compartilham a mesma origem ou destino, e definir o tempo de nova tentativa de rede como 30 minutos para a Instância A e 60 minutos para a Instância B, a duração menor de 30 minutos será usada para ambas.
-
Como o DTS cobra pelo tempo de execução da tarefa durante o período de nova tentativa de conexão, recomendamos personalizar a duração da nova tentativa com base nas necessidades do seu negócio ou liberar a instância DTS o mais rápido possível após a liberação das instâncias de banco de dados de origem e destino.
Retry Time for Other Issues
Após o início da tarefa de sincronização, se ocorrerem outros problemas não relacionados à conectividade com o banco de dados de origem ou destino (como exceções na execução de DDL ou DML), o DTS reportará um erro e iniciará imediatamente operações contínuas de nova tentativa. A duração padrão de nova tentativa é de 10 minutos. Você também pode personalizar a duração da nova tentativa dentro do intervalo de 1 a 1.440 minutos. Recomendamos definir como 10 minutos ou mais. Se as operações relevantes forem bem-sucedidas dentro da duração de nova tentativa definida, a tarefa de sincronização será retomada automaticamente. Caso contrário, a tarefa falhará.
ImportanteO valor para Retry Time for Other Issues deve ser menor que o valor para Retry Time for Failed Connections.
Enable Throttling for Full Data Synchronization
Durante a fase de sincronização total, o DTS consome recursos de leitura e gravação dos bancos de dados de origem e destino, o que pode aumentar a carga do banco de dados. Para reduzir a carga nos bancos de dados de origem e destino, você pode definir um limite de taxa para a tarefa de sincronização total configurando os parâmetros Queries per second (QPS) to the source database, RPS of Full Data Migration e Data migration speed for full migration (MB/s).
Nota-
Este item de configuração está disponível apenas quando Synchronization Types estiver definido como Full Data Synchronization.
-
Você também pode adjust the full synchronization rate depois que a instância de sincronização estiver em execução.
Enable Throttling for Incremental Data Synchronization
Você também pode definir um limite de taxa para a tarefa de sincronização incremental. Para aliviar a pressão no banco de dados de destino, defina RPS of Incremental Data Synchronization e Data synchronization speed for incremental synchronization (MB/s).
Enclose Object Names in Quotation Marks
Escolha se deseja adicionar aspas aos nomes dos objetos de destino. Se você selecionar Yes e qualquer uma das seguintes condições for atendida, o DTS adicionará aspas simples ou duplas aos nomes dos objetos de destino durante as fases de sincronização inicial de esquema e sincronização incremental de dados:
-
O ambiente de negócios do banco de dados de origem diferencia maiúsculas de minúsculas e usa casos mistos.
-
O nome da tabela de origem não começa com uma letra e contém caracteres diferentes de letras, números ou caracteres especiais.
NotaApenas sublinhados (_), sinais de libra (#) e cifrões ($) são suportados como caracteres especiais.
-
O nome do esquema, tabela ou coluna a ser sincronizado é uma palavra-chave, palavra reservada ou caractere inválido no banco de dados de destino.
NotaSe você optar por adicionar aspas, deverá usar o nome do objeto de destino entre aspas para consultas após a conclusão da tarefa de sincronização de dados.
Environment Tag
Você pode selecionar uma tag de ambiente para identificar a instância com base nas necessidades do seu negócio. Esta etapa não é necessária neste exemplo.
Configure ETL
Escolha se deseja ativar o recurso de extração, transformação e carga (ETL). Para mais informações, consulte What is ETL? Valores válidos:
-
Yes: Ativa o recurso ETL. Insira instruções de processamento de dados no editor de código. Para mais informações, consulte Configure ETL in a data migration or data synchronization task.
-
No: Desativa o recurso ETL.
Monitoring and Alerting
Especifique se deseja configurar alertas. Se a sincronização falhar ou a latência exceder o limiar especificado, uma notificação será enviada a um contato de alerta.
-
No: Nenhum alerta é configurado.
-
Yes: Configure alertas definindo um limiar de alerta e especificando um alert notification. Para mais informações, consulte Configure monitoring and alerting during task configuration.
-
-
Clique em Next: Data Validation para configurar uma tarefa de validação de dados.
Se desejar usar o recurso de validação de dados, consulte Configure data validation para obter instruções de configuração.
-
Opcional: Após concluir as configurações anteriores, clique em Next: Configure Database and Table Fields para especificar o Type, Primary Key Column e Distribution Key para as tabelas de destino na instância AnalyticDB for PostgreSQL.
NotaEsta etapa está disponível apenas se você selecionou Schema Synchronization para Synchronization Types ao configurar os objetos de sincronização. Você pode alterar as configurações definindo Definition Status como All.
A Primary Key Column pode ser uma chave composta por várias colunas. Você deve selecionar uma ou mais colunas da Primary Key Column para servir como Distribution Key. Para mais informações, consulte Manage tables e Define table distribution.
-
-
Salve a tarefa e execute uma pré-verificação.
Para visualizar os parâmetros da api para configurar esta instância, passe o mouse sobre o botão Next: Save Task Settings and Precheck e clique em Preview OpenAPI parameters no balão.
Se você terminou de visualizar os parâmetros da api, clique em Next: Save Task Settings and Precheck na parte inferior da página.
NotaAntes do início do job de sincronização, o DTS executa uma pré-verificação. O job só pode começar após todos os itens de pré-verificação serem aprovados.
Se a pré-verificação falhar, clique em View Details para o item com falha. Corrija o problema conforme indicado e execute a pré-verificação novamente.
-
Se a pré-verificação retornar um aviso:
Se um item de verificação falhar e não puder ser ignorado, clique em View Details ao lado do item. Siga as instruções para corrigir o problema e execute a pré-verificação novamente.
Para itens de verificação que podem ser ignorados, você pode clicar em Confirm Alert Details, Ignore, OK e Precheck Again em sequência para pular o aviso e executar a pré-verificação novamente. Se você optar por ignorar o item de aviso, isso pode causar problemas como inconsistência de dados e representar riscos para o seu negócio.
-
Adquira a instância.
Quando a Success Rate for 100%, clique em Next: Purchase Instance.
-
Na página Purchase, selecione o método de faturamento e a especificação de link para a instância de sincronização de dados. A tabela a seguir descreve esses parâmetros em detalhes.
Categoria
Parâmetro
Descrição
New Instance Class
Método de faturamento
-
Assinatura: Você paga ao criar a instância. É adequado para necessidades de longo prazo e é mais econômico que o pagamento conforme o uso. Quanto maior a duração da assinatura, maior o desconto.
-
Pagamento conforme o uso: Você é cobrado por hora. Adequado para necessidades de curto prazo. Você pode liberar a instância imediatamente após o uso para economizar custos.
Configuração do grupo de recursos
O grupo de recursos ao qual a instância pertence. O padrão é o grupo de recursos padrão. Para mais informações, consulte What is Resource Management?.
Especificação do link
O DTS fornece especificações de sincronização com diferentes níveis de desempenho. A especificação do link de sincronização afeta a taxa de sincronização. Você pode escolher uma especificação com base no seu cenário de negócios. Para mais informações, consulte Data synchronization link specifications.
Duração da assinatura
No modo de assinatura, selecione a duração e a quantidade para a instância de assinatura. Você pode escolher uma assinatura mensal de 1 a 9 meses, ou uma assinatura anual de 1, 2, 3 ou 5 anos.
NotaEsta opção está disponível apenas quando o método de faturamento é Subscription.
-
Após concluir a configuração, leia e selecione Data Transmission Service (Pay-as-you-go) Service Terms.
-
Clique em Buy and Start. Na caixa de diálogo OK, clique em OK.
Você pode visualizar o progresso da tarefa na página Data Synchronization.