O ApsaraDB for HBase é um banco de dados NoSQL altamente otimizado (edição empresarial está disponível comoLindorm) que é compatível com a edição comunitária do HBase. Graças a essa compatibilidade e integração com Spark, Phoenix e Solr, o ApsaraDB for HBase é fácil de usar e oferece estabilidade e desempenho de custo superiores. O ApsaraDB for HBase pode facilmente suportar cenários de alta taxa de transferência e alta simultaneidade, fornecendo suporte para armazenamento volumétrico de dados em tempo real, indexação de texto completo, consultas SQL leves, bem como espaço tempo e consultas série.
Comparado com sua contraparte de código aberto, o ApsaraDB for HBase é melhor otimizado, até o kernel, com desempenho superior de leitura/gravação, recursos de recuperação de desastres, eficiência de armazenamento, latência de resposta. Em termos de números, o desempenho de leitura/gravação é marcado por uma melhoria de 3 a 7 vezes, o RPO é reduzido para menos de 1 minuto, a latência do percentil de 99% foi reduzida em 90%, O MTTR é reduzido em 90% e a taxa de compressão aumentou 13 vezes. O ApsaraDB for HBase garante um uptime de serviço de 99,9%. O ApsaraDB for HBase é adequado para aplicações industriais de alta demanda como controle de risco, recomendação, publicidade, IoT, VoT, feed streaming e cenários de visualização de dados. Internamente no Alibaba, o ApsaraDB for HBase já forneceu suporte para vários dos principais negócios do Alibaba Group, incluindo Taobao, Alipay e Cainiao.
Benefícios
-
Confiabilidade alta do armazenamento
Construído com uma arquitetura de cluster distribuído com seis backups de dados e pelo menos três réplicas para garantir uma confiabilidade de dados de 99,99999999%.
-
Alta disponibilidade
O monitoramento de disponibilidade em tempo real e o failover de ponto único são suportados para garantir a continuidade de suas cargas de trabalho. O monitoramento do processo de serviço e a recuperação automática podem ajudá-lo a recuperar processos em poucos segundos.
-
Operações e manutenção de alta eficiência
O ApsaraDB for HBase é equipado com uma plataforma unificada para gerenciamento, monitoramento e alertas de banco de dados visualizados. Seu kernel foi atualizado automaticamente para operações e manutenção de alta eficiência, e o console da Web, API e SDKs multilíngue correspondentes foram projetados para facilitar o gerenciamento de clusters.
-
Desempenho significativamente melhorado
Desenvolvido como uma versão melhorada da edição comunitária do HBase. O Alibaba Cloud otimizou significativamente o kernel, permitindo que o desempenho de leitura e gravação fosse aumentado de 3 a 7 vezes, com 99% de latência percentual reduzida em 90% e MTTR reduzido em 90%.
Recursos
Kernel e arquitetura otimizados
Arquitetura de alta disponibilidade com cluster scaling ilimitado e kernel otimizado.
Arquitetura de alta disponibilidade
O ApsaraDB for HBase adapta uma arquitetura de alta disponibilidade onde os mestres são executados como backups uns dos outros. Alta confiabilidade é garantida pela detecção de disponibilidade em tempo real. As regiões podem ser comutadas dentro de alguns segundos quando um nó principal falha.
Custos reduzidos do armazenamento
Proporções de alta compressão, armazenamento a frio e separação de dados a quente e a frio são suportados para reduzir os custos de armazenamento em mais de 50%.
Escalabilidade do cluster
Cada nó principal pode responder a até 100 mil consultas por segundo e fornecer até 8 TB de espaço de armazenamento. Os tamanhos do disco e do cluster podem ser expandidos conforme necessário. Um cluster pode ser dimensionado até 1.000 nós para lidar com 10 milhões de consultas por segundo e armazenar petabytes de dados.
Baixa latência de leitura/gravação
SSDs são usados para suportar leituras e gravações de alta velocidade. Uma entrada de dados individual menor que 0,2 KB pode ser lida ou gravada com uma latência do percentil 99,9 de 3 milissegundos e uma latência média de 1 milissegundo.
Backup de dados
Backup e restauração de dados cluster e backup de dados incrementais em tempo real são suportados. O Recovery Time Objective (RTO) é reduzido para menos de 1 minuto.
Recuperação de desastres de cluster duplo
Clusters primários e secundários são usados para failover automático. Dados entre dois clusters são sincronizados em tempo real.
Suporte para vários cenários
SQL, séries temporais, espaço temporal e recuperação de dados são suportados.
Suporte para SQL
O componente SQL phoenix suporta índices secundários e sintaxe SQL padrão.
Suporte para Solr
O componente Solr integrado suporta índices de texto completo para pesquisas complexas. Este componente é fornecido para sincronizar dados do ApsaraDB for HBase para Solr.
Índices secundários nativos
Os índices secundários nativos podem ser lidos e escritos seis vezes mais rápido que os índices Phoenix. Nenhum componente externo precisa de ser instalado.
Suporte para séries temporais
O componente OpenTSDB oferece suporte a dados de séries temporais.
Suporte para Time Space
O componente GeoMesa oferece suporte a dados espaço-temporais.
Armazenamento de objetos de tamanho médio em tempo real (MOB)
O armazenamento em tempo real e o acesso de objetos menores que 10 MB são suportados.
Motor de análise HBase totalmente gerenciado
O Analytics Engine foi projetado para atender às necessidades do usuário em streaming e análise de dados.
Suporte para streaming de dados
O suporte para a ingestão de dados do Kafka, Log Service e Message Queue permite alertar e processar Extrair, Transformar, Carregar (ETL).
Suporte para várias fontes
O suporte para várias fontes de dados, incluindo HBase, Object Storage Service (OSS), RDS e MongoDB permite análises de dados complexas.
Alto desempenho
Suporte para pushdown do operador e poda coluna.
Operações e manutenção eficientes
É fornecida uma plataforma de O&M visualizada e fácil de usar que atualiza automaticamente o sistema para a versão mais recente.
Monitoramento do cluster na nuvem
As informações do cluster são monitoradas em tempo real, para que você possa obter informações atualizadas do cluster. As métricas monitoradas incluem utilização da CPU, IOPS, conexões e espaço em disco. Alertas são enviados quando anomalias são detectadas.
Plataforma de gerenciamento visualizada
Uma plataforma de gerenciamento visualizada é fornecida para que você possa facilmente dimensionar clusters, modificar configurações e reiniciar clusters.
Gerenciamento de versão do kernel do banco de dados
Atualizações automáticas são suportadas para corrigir vulnerabilidades o mais cedo possível, eliminando a necessidade de gerenciar versões do kernel manualmente. As configurações do HBase são otimizadas para maximizar a utilização dos recursos do sistema.
Cenários
-
Controle de risco financeiro
-
Armazenamento e análise de dados volumétricos
-
Sistema de recomendação
-
Séries Temporais e Espaço em IoT
-
Feeds sociais
-
Armazenamento MOB rápido
-
Dados volumétricos de correspondência difusa
-
Processamento de dados de registro de jogo
-
Armazenamento de dados de vídeo
-
Visualização de dados em tempo real

Controle de risco financeiro
Ambos os dados estruturados e não estruturados são suportados
O ApsaraDB for HBase pode ajudá-lo a agregar e analisar dados de transações, dados corporativos e dados rastreados da Internet. Você pode então desenvolver software como serviços de controle de risco baseados em big data, como sistemas antifraude e de perfil de usuário.
Benefícios
-
Baixos custos do armazenamento
O ApsaraDB for HBase usa esquemas de armazenamento esparsos para suportar petabytes de dados estruturados e não estruturados. Você pode pesquisar registros tração para informações detalhadas.
-
Transação híbrida/processamento analítico (HTAP) para dados volumétricos
Com o ApsaraDB for HBase, você pode usar Phoenix e índices secundários para Online Transaction Processing (OLTP) em tempo real, e usar Spark for Online Analytical Processing (OLAP).
-
Alta concorrência para gravações rápidas
Diferentemente das árvores B + tradicionais, o ApsaraDB for HBase suporta armazenamento baseado em Log-Structured Merge (LSM). Ele é projetado para gravações rápidas com base em alta concorrência.

Armazenamento e análise de dados volumétricos
Suporte para dados volumétricos
O ApsaraDB for HBase suporta a ingestão rápida de dados volumétricos e sincronização em tempo real de dados incrementais. Ele permite que você use o Spark para analisar dados volumétricos offline.
Benefícios
-
Baixos custos do armazenamento
A separação quente e fria automática dos dados é apoiada. Os dados frios são compactados usando o Zstandard e armazenados no Object Storage Service (OSS), reduzindo os custos de armazenamento em mais de 60%.
-
Transmissão de dados
O Spark Streaming para cargas de trabalho em tempo real é suportado.
-
Carregamentos rápidos
Você pode usar o Bulk Load para carregar rapidamente centenas de terabytes de dados para o ApsaraDB for HBase.

Sistema de recomendação
O armazenamento otimizado do perfil do usuário reduz a latência da recomendação em tempo real para milissegundos
Dados do comportamento do usuário são armazenados em tempo real. Com perfis de usuário criados com base nos dados do usuário, seu sistema de recomendação em tempo real pode responder a consultas em apenas alguns milissegundos.
Benefícios
-
Baixos custos do armazenamento
Usa esquemas de armazenamento escassos, adequados para armazenar dados de perfil do usuário altamente compactados.
-
Alta escalabilidade
Cada nó pode responder a mais de 100 mil consultas por segundo. Os nós podem ser dimensionados conforme necessário. Nenhum banco de dados ou tabela sharding necessário.
-
Baixa latência
Kernel profundamente otimizado: se suas cargas de trabalho são sensíveis à latência de resposta, você pode optar por SSDs para reduzir a latência média de leitura/gravação para menos de 2 milissegundos. A latência do percentil 99,9 pode ser reduzida para menos de 80 milissegundos.

Séries Temporais e Espaço em IoT
TSDB distribuído de alto desempenho
Um componente OpenTSDB integrado é fornecido para processar dados de séries temporais com alta eficiência a baixos custos para você, tornando o ApsaraDB for HBase adequado para cenários de IoT, monitoramento e gráficos de linha K.
Benefícios
-
OpenTSDB nativo para processar dados de pontos flutuantes a baixos custos
O OpenTSDB nativo é baseado na arquitetura distribuída do HBase e é compatível com mecanismos de banco de dados de código aberto, permitindo dimensionar facilmente bancos de dados de séries temporais.
-
Suporte para petabytes de dados espaço-temporais e alta concorrência para gravações rápidas
O armazenamento e a computação são dissociados e a alta simultaneidade é suportada para gravações rápidas. Cada nó pode responder a centenas de milhares de consultas por segundo.
-
Índices e algoritmos tempo-espaço
O mecanismo de análise é baseado em curvas de preenchimento de espaço Z-Order e Hilbert e suporta índices de espaço-tempo 2D e 3D.

Feeds sociais
Armazena feeds sociais volumétricos
Você pode usar o ApsaraDB for HBase para armazenar feeds sociais volumétricos, como postagens, artigos, registros de bate-papo e comentários.
Benefícios
-
Alta concorrência para gravações rápidas
Diferentemente das árvores B + tradicionais, o ApsaraDB for HBase suporta armazenamento baseado em Log-Structured Merge (LSM). Ele é projetado para gravações rápidas com base em alta concorrência.
-
Custo-eficácia
A separação quente e fria dos dados é apoiada. Dados frios são armazenados automaticamente no OSS, reduzindo os custos de armazenamento em 60%.
-
Baixa latência de leitura/gravação
Kernel profundamente otimizado. Se as cargas de trabalho forem sensíveis à latência de resposta, use SSDs para reduzir a latência média de leitura/gravação para menos de 2 milissegundos. A latência do P999 pode ser reduzida para menos de 80 milissegundos.

Armazenamento MOB rápido
Armazenamento e pesquisa extremamente rápidos de MOBs
O ApsaraDB for HBase usa a tecnologia MOB (objeto de tamanho médio). Suporta objetos com tamanhos entre 1 KB e 10 MB, como gráficos, arquivos de vídeo curtos e documentos. Para qualquer solicitação relacionada a várias consultas, a latência do sistema pode ser tão baixa quanto alguns milissegundos.
Benefícios
-
Alto desempenho
A tecnologia MOB pode ajudá-lo a reduzir a latência do sistema de 10 segundos para 20 milissegundos, aumentando o desempenho em 500%.
-
Capacidade de pesquisa poderosa
Poderosos recursos de pesquisa são incorporados e vêm com filtros e índices Phoenix.
-
Alta compressão e baixos custos
Vários algoritmos de compressão permitem taxas de compressão de 3:1 a 10:1.

Dados volumétricos de correspondência difusa
Correspondência difusa e correspondência exata para pesquisar grandes quantidades de registros
O componente Solr integrado suporta sincronização automática de texto completo e índice. Tanto a correspondência exata quanto a correspondência difusa são suportadas.
Benefícios
-
Lógica de sincronização incorporada
A lógica de sincronização incorporada ajuda a evitar possíveis perdas de dados.
-
Correspondência exata e correspondência difusa
Suporte para ambos correspondência exata e correspondência difusa.
-
Baixos custos do armazenamento
As relações altas da compressão e o apoio do armazenamento frio fazem para o desempenho e a eficiência custos superiores.

Processamento de dados de registro de jogo
Coleta, armazenamento e análise de dados de log
Você pode usar o ApsaraDB for HBase para coletar, armazenar e pesquisar dados de log de comportamento do usuário em servidores de jogos e verificar dados brutos, verificar registros de reinício da conta do jogador, e analisar dados em tempo real. Em seguida, por meio do processamento e análise de dados de log offline, você também pode calcular a taxa de retenção de clientes, a relação empréstimo/valor (LTV), a receita média por usuário (ARPU), e quantidade total de repor.
Benefícios
-
Processamento de dados online e offline
O ApsaraDB for HBase suporta gravações e leituras de dados online de alto rendimento e baixa latência. Você também pode usar o Spark para processar e analisar dados do ApsaraDB for HBase offline.
-
Esquemas de dados estruturados e não estruturados
Os esquemas de dados estruturados e não estruturados são suportados, para que você possa adicionar colunas dinamicamente para atender aos requisitos de operações e manutenção do jogo.
-
Custo-eficácia
O ApsaraDB for HBase suporta separação de dados quentes e frios, o que permite armazenar dados frios a baixo custo.

Armazenamento de dados de vídeo
Armazenamento e análise em tempo real de vídeos de cursos, palestras e vigilância
O ApsaraDB for HBase suporta leituras e gravações de dados de vídeo de alto rendimento com baixa latência e custos. Ele também suporta armazenamento convergente de índices de vídeo, características e dados de origem do vídeo.
Benefícios
-
Alto rendimento e baixa latência
O ApsaraDB for HBase suporta leituras e gravações de alto rendimento e baixa latência. Você pode expandir a capacidade de armazenamento para armazenar petabytes de dados.
-
Armazenamento convergente
Pesquisa complexa e armazenamento convergente de índices, características e dados de vídeo são suportados.

Visualização de dados em tempo real
Visualização de dados em tempo real
O AparaDB para HBase fornece uma solução completa para análise dinâmica de dados que é econômica e oferece latência de milissegundos. Essa solução também inclui computação em tempo real Spark. Essa solução foi empregada em várias plataformas de comércio eletrônico da Alibaba para o festival de compras Double 11, o maior evento de compras on-line do mundo, para a agregação em tempo real de visualizações de páginas, visitantes únicos, contagens de transações e informações de classificação em telas grandes.
Benefícios
-
Baixa latência
Suporte para leitura e gravação de dados de ponta a ponta com baixa latência.
-
Rendimento extremamente alto
As capacidades computacionais podem ser dimensionadas rápida e flexivelmente.
-
Custo-eficácia
Uma plataforma tudo-em-um construída para reduzir custos desnecessários e agilizar operações e manutenção.
Suporte atualizado para você
Consulta individual de pré-venda, suporte técnico 24/7, resposta mais rápida, e mais chamados.
Consulta individual de pré-venda
Suporte técnico 24/7
Seis chamados grátis por trimestre
