Usuários iniciantes no ApsaraDB for HBase podem não estar familiarizados com o serviço. Esses usuários frequentemente deixam de especificar o número de regiões ao criar tabelas ou utilizam um design de rowkey inadequado, o que causa hotspots.
O comando a seguir é o mais utilizado para criar uma tabela:
create 't3',{NAME => 'f1',COMPRESSION => 'snappy' }, { NUMREGIONS => 50, SPLITALGO => 'HexStringSplit' }
O parâmetro NUMREGIONS define a quantidade de regiões. Em geral, cada região deve ter entre 6 e 8 GB. Em clusters grandes, aumente o número de regiões mantendo esse tamanho ideal como referência.
-
O parâmetro SPLITALGO indica o algoritmo usado para dividir as rowkeys. O ApsaraDB for HBase oferece suporte a três algoritmos de pré-divisão: HexStringSplit, DecimalStringSplit e UniformSplit.
Cenários de uso recomendados para cada algoritmo de divisão:
HexStringSplit: indicado quando a rowkey tem como prefixo uma string hexadecimal.
DecimalStringSplit: apropriado para rowkeys com prefixo em formato decimal.
UniformSplit: ideal quando o prefixo da rowkey não segue um padrão específico.
Para obter mais informações sobre rowkeys, consulte Como projetar uma Rowkey.
Para mais detalhes sobre os algoritmos de compactação, consulte Compactação e codificação de dados.