Os índices de busca permitem consultas multidimensionais e análises estatísticas em cenários de big data com base em índices invertidos e armazenamento colunar. Este tópico descreve como usar o recurso de índice de busca com o Tablestore SDK for Java.
Gerencie índices
A tabela a seguir descreve as operações de gerenciamento compatíveis com índices de busca.
|
Operação |
Descrição |
|
Crie um índice de busca para uma tabela de dados. |
|
|
Consulte os índices de busca criados para uma tabela. |
|
|
Atualize o tempo de vida (TTL) de um índice de busca. |
|
|
Obtenha a descrição de um índice de busca, incluindo informações sobre os campos e as configurações do índice. |
|
|
Exclua um índice de busca que não seja mais necessário. |
|
|
Exclua dados históricos ou estenda o período de retenção dos dados em um índice de busca conforme as necessidades do negócio. |
Tipos de dados
Além dos tipos básicos, como Long, Double, Boolean, Keyword, Text, Date, Geopoint e Vector, os índices de busca suportam dois tipos especiais: Array e Nested. Para mais informações, consulte Tipos de dados.
Use o recurso de coluna virtual dos índices de busca para consultar novos campos e dados de novos tipos sem modificar o esquema de armazenamento ou os dados nas tabelas do Tablestore. Para mais detalhes, consulte Colunas virtuais.
Consulta de dados
A tabela a seguir descreve os tipos de consulta compatíveis com índices de busca. Selecione o tipo adequado às suas necessidades de negócio.
|
Recurso |
Tipo de consulta |
Descrição |
|
Consulta básica |
Corresponde a todas as linhas da tabela para obter a contagem total de linhas ou retornar várias linhas aleatórias. |
|
|
Recupera dados de uma tabela usando correspondências exatas, de forma similar a uma consulta baseada em correspondência de strings. |
||
|
Permite especificar múltiplas palavras-chave para buscar linhas que correspondam a pelo menos uma delas. Uma linha é retornada se o valor da coluna coincidir com qualquer uma das palavras-chave fornecidas. Funciona de maneira análoga ao operador IN em instruções SQL. |
||
|
Recupera dados de uma tabela que contenham o prefixo especificado. |
||
|
Recupera dados de uma tabela que contenham o sufixo especificado. |
||
|
Recupera dados que estejam dentro do intervalo especificado. |
||
|
Recupera dados que correspondem a uma string contendo caracteres curinga. |
||
|
Também conhecida como consulta NULL ou de valor NULL, verifica a existência de uma coluna em uma linha específica. É útil para dados esparsos. |
||
|
Agrupa o conjunto de resultados com base em uma coluna específica para exibir dados do tipo indicado apenas uma vez nos resultados retornados, garantindo a diversidade dos tipos de resultado. |
||
|
As consultas geográficas dividem-se nos seguintes tipos: geo-distance query, geo-bounding box query e geo-polygon query.
|
||
|
Recupera dados nas linhas filhas de campos aninhados. |
||
|
Processamento de dados |
Defina um método de ordenação ao criar o índice ou especifique-o durante a consulta. Assim, as linhas que atendem aos critérios são retornadas na ordem predefinida ou especificada. Se a resposta contiver um grande volume de linhas, localize os dados configurando os parâmetros limit e offset ou utilizando tokens. |
|
|
Execute operações de agregação para obter valores mínimos, máximos, somas, médias, contagens, contagens distintas, estatísticas de percentil e linhas por grupo. Também é possível agrupar resultados por valor de campo, intervalo, localização geográfica, filtro, histograma ou histograma de datas, além de realizar consultas aninhadas. Combine múltiplas agregações para atender a consultas complexas. |
||
|
Consulta baseada em combinação de condições de subconsulta |
Recupera dados de uma tabela com base em uma combinação de subconsultas. O Tablestore retorna as linhas que correspondem às subconsultas definidas. |
|
|
Busca full-text |
Utiliza correspondências aproximadas para recuperar dados de uma tabela. |
|
|
Semelhante à match query, mas avalia a posição dos tokens. Uma linha só atende à condição se a ordem e a posição dos tokens corresponderem exatamente ao especificado. |
||
|
Configure parâmetros de destaque para realçar as strings de consulta nos segmentos das linhas que atendem às condições. |
||
|
Busca vetorial |
Use o recurso de consulta vetorial k-nearest neighbor (KNN) para realizar buscas aproximadas de vizinhos mais próximos baseadas em vetores. Esse recurso permite encontrar itens de dados com maior similaridade ao vetor consultado em conjuntos de dados de grande escala. |
Exportação de dados
Se a ordem dos resultados não for relevante, use o recurso de varredura paralela para obter os dados de forma eficiente. Para mais informações, consulte Varredura paralela.