Todos os produtos
Search
Central de documentação

Elastic Compute Service:Confiabilidade de dados do disco em nuvem ESSD

Última atualização: Jul 02, 2026

Os discos em nuvem ESSD atingem 99,9999999% (nove noves) de confiabilidade de dados com redundância local e 99,9999999999% (doze noves) com redundância de zona por meio de armazenamento triplo e validação de dados ponta a ponta.

Vantagens técnicas

  • Durabilidade dos dados: O sistema replica cada dado em três cópias armazenadas em nós físicos e racks distintos. Se uma ou duas réplicas ficarem indisponíveis, as demais continuam a atender operações de leitura e escrita.

  • Integridade dos dados: O sistema gera e verifica um checksum em cada etapa do processo de gravação e armazenamento. Qualquer divergência aciona imediatamente a correção de erros para evitar corrupção de dados durante a transferência e o armazenamento. Essa validação usa aceleração de hardware e tem impacto insignificante no desempenho de leitura e escrita.

  • Recuperação automática de falhas: Ao detectar falha em um nó de armazenamento ou número insuficiente de réplicas, o sistema restaura os dados a partir de uma réplica íntegra para restabelecer o estado completo de três réplicas. Esse processo é transparente para suas aplicações.

Cenários de proteção

  • Indisponibilidade de dados por falha de hardware

    • Desafio: Danos em discos, indisponibilidade de servidores ou quedas de energia em racks podem tornar inacessíveis os dados nos dispositivos físicos afetados.

    • Proteção técnica: O mecanismo de armazenamento triplo distribui os dados entre diferentes nós físicos. Em caso de falha, o sistema executa failover para réplicas íntegras e reconstrói uma nova réplica em segundo plano, sem impacto aos seus negócios.

  • Corrupção silenciosa de dados

    • Desafio: Inversões de bits na memória, erros de transmissão de rede ou degradação de firmware de disco podem causar corrupção de dados não detectada e difícil de identificar com métodos tradicionais.

    • Proteção técnica: A validação de dados ponta a ponta gera checksums em cada etapa do processo de gravação. Durante a leitura, o sistema verifique esses checksums e aciona a correção imediata de erros em caso de divergência. Isso garante que os dados lidos correspondam exatamente aos dados gravados.

Importante

Essas tecnologias protegem contra falhas de hardware e corrupção de dados na camada de infraestrutura. Riscos no nível da aplicação, como exclusão acidental ou ataques de vírus, exigem o uso de snapshots.

Mecanismo de armazenamento triplo

O armazenamento triplo resolve a indisponibilidade de dados causada por falhas de hardware. O sistema replica cada dado gravado em um disco em nuvem em três cópias e as armazena em nós físicos distintos.

Processo de gravação de dados

Triplicate storage

O sistema utiliza um mecanismo de gravação síncrona com múltiplas réplicas. Uma operação de gravação só é bem-sucedida quando os dados são escritos em todas as réplicas; caso contrário, ela falha. Isso garante consistência forte: qualquer leitura subsequente retorna sempre os dados gravados mais recentemente.

Estratégia de posicionamento das réplicas

Para evitar falhas correlacionadas, como a perda de múltiplas réplicas devido a uma queda de energia em um rack, o mecanismo de armazenamento triplo segue esta estratégia de posicionamento:

  • Isolamento por rack: As três réplicas são distribuídas entre nós de armazenamento em racks diferentes. A falha de uma única máquina ou de um único rack não afeta a disponibilidade dos dados.

  • Isolamento por domínio de falha: Para discos em nuvem ESSD com redundância local, as réplicas são distribuídas em racks distintos dentro da mesma zona. Já para discos ESSD com redundância de zona, as réplicas abrangem zonas diferentes, elevando a recuperação de desastres do nível de rack para o nível de zona.

  • Balanceamento de carga: Além de atender aos requisitos de isolamento, o sistema considera capacidade de armazenamento, carga de I/O e topologia de rede para equilibrar a utilização de recursos e o desempenho.

Processo de recuperação de falhas

Data protection mechanism

Ao detectar número insuficiente de réplicas, o sistema seleciona um nó de armazenamento íntegro que atenda à política de isolamento e copia os dados de uma réplica existente para restaurar o estado de três réplicas. Esse processo é transparente para suas aplicações e não requer intervenção manual.

Validação de dados ponta a ponta

A validação de dados ponta a ponta previne a corrupção silenciosa de dados durante a transferência e o armazenamento.

Processo de validação

Em cada etapa do processo de gravação e armazenamento, o sistema utiliza Cyclic Redundancy Check (CRC) para verificar a integridade dos dados.

  1. Após o início de uma solicitação de I/O: Os dados entram no caminho de armazenamento em bloco e o sistema gera um checksum inicial.

  2. Após a cópia na memória: Depois que os dados são copiados para a memória do nó de computação, o sistema compara o checksum para detectar erros.

  3. Após a transmissão pela rede: Quando os dados chegam à camada de rede do nó de armazenamento, o sistema compara o checksum para identificar erros de bits ocorridos durante a transferência.

  4. No recebimento pelo nó de armazenamento: Após a gravação dos dados na memória do nó de armazenamento, o sistema compara o checksum.

  5. Na persistência dos dados em disco: Depois que os dados são gravados no disco, o sistema compara o checksum.

Se houver divergência de checksum em qualquer etapa, o sistema aciona imediatamente o tratamento de erros. Essa validação usa aceleração de hardware e tem impacto insignificante no desempenho de leitura e escrita.

Tratamento de erros

O tratamento varia conforme o local onde o erro ocorre:

  • Camada de transporte de rede: O sistema retransmite os dados até que a validação seja bem-sucedida.

  • Mídia de armazenamento: O sistema marca o bloco defeituoso e lê os dados corretos de outra réplica para recuperar as informações.

  • Memória: O mecanismo Error-Correcting Code (ECC) corrige os erros e o sistema tenta novamente a operação de I/O.

Perguntas frequentes

  • O mecanismo de armazenamento triplo significa que preciso pagar por três vezes a capacidade de armazenamento?

    Não. O armazenamento triplo é um recurso integrado de confiabilidade de dados. A Alibaba Cloud arca com o custo da redundância de armazenamento 3x. Você paga apenas pela capacidade do disco em nuvem que adquirir. Por exemplo, um disco em nuvem de 40 GiB oferece 40 GiB de capacidade utilizável e faturável.

  • Como posso proteger ainda mais meus dados?

  • O mecanismo de armazenamento triplo previne todos os tipos de perda de dados?

    O armazenamento triplo protege contra falhas de hardware na camada de infraestrutura. Riscos no nível da aplicação, como exclusão acidental ou ataques de vírus, exigem o uso de snapshots.

  • Como o mecanismo de armazenamento triplo garante a consistência dos dados?

    O sistema utiliza um mecanismo de gravação síncrona com múltiplas réplicas. Uma operação de gravação só é bem-sucedida quando os dados são escritos em todas as réplicas; caso contrário, ela falha. Isso garante consistência forte: qualquer leitura subsequente retorna sempre os dados gravados mais recentemente.