O ApsaraDB for MongoDB opera em uma arquitetura de alta disponibilidade (HA). Quando o sistema HA detecta a indisponibilidade de um nó, ele aciona automaticamente um failover primário/secundário e notifica você por SMS ou mensagem interna.
Exemplo de notificação
[Alibaba Cloud] Prezado(a) \\\\: Sua instância do ApsaraDB for MongoDB dds-bp\\\\ (nome: \\\\) apresentou um erro. Um failover foi acionado para garantir a estabilidade da sua instância. Recomendamos verificar se sua aplicação ainda está conectada à instância e configure a reconexão automática.
Como funciona
Uma instância de conjunto de réplicas tem três nós por padrão. Cada shard em uma instância de cluster fragmentado também possui três nós. Os nós primários e secundários gerenciam as conexões da aplicação, enquanto os nós ocultos funcionam como alvos de reserva para o failover. Para mais informações, consulte Instâncias de conjunto de réplicas ou Instâncias de cluster fragmentado.
Motivos do acionamento do failover
Duas condições podem acionar um failover primário/secundário:
Nó indisponível: O sistema de monitoramento de integridade identifica que um nó não responde e promove um nó oculto para primário.
Host offline: Uma exceção ocorre no host que executa o nó primário. O sistema HA transfere a operação para um host íntegro para evitar tempo de inatividade prolongado.
Impacto do failover
O failover causa uma interrupção transitória de conexão inferior a 30 segundos.
Se sua aplicação se conectar diretamente ao endpoint do nó primário, as operações de leitura e gravação serão afetadas durante a janela do failover.
O que fazer
Para problemas imediatos de reconexão: Configure sua aplicação para reconectar automaticamente após uma desconexão. A maioria dos drivers do MongoDB oferece suporte à reconexão automática por padrão.
Para ambientes de produção: Use uma URI de string de conexão para acessar a instância. Assim, sua aplicação executa o failover automaticamente para um nó íntegro e mantém as operações de leitura e gravação disponíveis mesmo quando o primário é alternado. Para mais informações, consulte Conectar-se a uma instância de conjunto de réplicas ou Conectar-se a uma instância de cluster fragmentado.