Os clusters do PolarDB realizam failover automático do nó primário para um nó somente leitura quando o primário falha. Para manutenções planejadas ou testes de alta disponibilidade, você também pode acionar o failover manualmente ao definir um nó somente leitura específico como o novo primário.
Antes de começar
O failover interrompe o serviço de banco de dados. A duração da interrupção depende da ativação do standby quente no nó somente leitura que assume a função:
|
Standby quente |
Duração da interrupção |
|
Desativado |
Aproximadamente 20–30 segundos |
|
Ativado |
Entre 5–10 segundos |
Em casos extremos, o tempo de interrupção pode exceder a faixa típica, mas nunca ultrapassa 3 minutos.
Para reduzir o tempo de interrupção, ative o standby quente nos nós somente leitura. Consulte Configurar nós de réplica quente.
Verifique se sua aplicação consegue se reconectar automaticamente ao cluster após um failover.
Como funciona o failover automático
A Cluster Edition do PolarDB utiliza uma arquitetura de alta disponibilidade ativo-ativo. Quando o nó primário falha, o sistema elege um novo primário entre os nós somente leitura disponíveis.
Cada nó em um cluster possui uma prioridade de failover. Durante uma eleição, o sistema segue estas etapas:
Identifica todos os nós somente leitura disponíveis e elegíveis para promoção.
Selecione o nó com a maior prioridade de failover. Nós com a mesma prioridade têm probabilidade igual de serem eleitos.
Tenta realizar o failover para o nó selecionado. Se a tentativa falhar devido a problemas de rede, status de replicação anormal ou outros motivos, o sistema tenta o próximo nó elegível até concluir o failover com êxito.
Para visualize e configure a prioridade de failover de cada nó, acesse a página Database Nodes do cluster e verifique a seção Basic Information.

Executar um failover manual
O failover manual é útil para testar a alta disponibilidade do cluster ou promover um nó somente leitura específico a primário.
Faça login no console do PolarDB.
No canto superior esquerdo, selecione a região onde o cluster está implantado.
Localize o cluster e clique em seu ID.
Na página Basic Information, vá até a seção Database Nodes e clique em no ícone
no canto superior direito para alternar as visualizações.-
Clique em Fail Over.

Na caixa de diálogo, defina o parâmetro New Primary Node e clique em OK.
A duração da interrupção segue as mesmas regras do failover automático. Consulte Antes de começar para obter detalhes.
Preparar sua aplicação para o failover
Após um failover, as conexões persistentes entre sua aplicação e o cluster podem não detectar automaticamente a alteração no estado da conexão. Sem um timeout configurado, a aplicação aguarda indefinidamente por uma resposta do banco de dados. Isso geralmente causa desconexão após centenas de segundos, período em que as instruções SQL falham.
Configure os seguintes parâmetros para minimizar o tempo de recuperação:
|
Parâmetro |
Valor recomendado |
|
|
1–2 segundos (cenários de transação online) |
|
|
10–15 segundos (rede interna); 60–90 segundos (rede pública) |
Esses valores são diretrizes de referência. Ajuste-os conforme sua carga de trabalho e padrões de uso.
Referência de API
|
Operação |
Descrição |
|
Realiza um failover manual ao designar um nó somente leitura como o novo nó primário. |