MatchQuery采用近似匹配的方式查询表中的数据。对Text类型的列值和查询关键词会先按照设置好的分词器做切分,然后按照切分好后的词去查询。对于进行模糊分词的列,建议使用MatchPhraseQuery实现高性能的模糊查询。
场景
匹配查询一般应用于全文检索场景,可应用于Text类型。例如某一行数据的title列的值是“杭州西湖风景区”,使用单字分词,如果MatchQuery中的查询词是“湖风”,则可以匹配到该行数据。
接口
匹配查询的接口为Search或者ParallelScan,具体的Query类型为MatchQuery。
使用
您可以使用如下语言的SDK实现匹配查询。
参数
参数 | 说明 |
---|---|
fieldName | 要匹配的列。
匹配查询可应用于Text类型。 |
text | 查询关键词,即要匹配的值。
当要匹配的列为Text类型时,查询关键词会被分词成多个词,分词类型为创建多元索引时设置的分词器类型。如果创建多元索引时未设置分词器类型,则默认分词类型为单字分词。 例如当要匹配的列为Text类型时,分词类型为单字分词,则查询词为"this is",可以匹配到“...,this is tablestore”、“is this tablestore”、“tablestore is cool”、“this"、“is”等。 |
query | 设置查询类型为matchQuery。 |
offset | 本次查询的开始位置。 |
limit | 本次查询需要返回的最大数量。
如果只为了获取行数,无需具体数据,可以设置limit=0,即不返回任意一行数据。 |
minimumShouldMatch | 最小匹配个数。
只有当某一行数据的fieldName列的值中至少包括最小匹配个数的词时,才会返回该行数据。 说明 minimumShouldMatch需要与逻辑运算符OR配合使用。
|
operator | 逻辑运算符。默认为OR,表示当分词后的多个词只要有部分匹配时,则行数据满足查询条件。
如果设置operator为AND,则只有分词后的所有词都在列值中时,才表示行数据满足查询条件。 |
getTotalCount | 是否返回匹配的总行数,默认为false,表示不返回。
返回匹配的总行数会影响查询性能。 |
tableName | 数据表名称。 |
indexName | 多元索引名称。 |
columnsToGet | 是否返回所有列,包含returnAll和columns设置。
returnAll默认为false,表示不返回所有列,此时可以通过columns指定返回的列;如果未通过columns指定返回的列,则只返回主键列。 当设置returnAll为true时,表示返回所有列。 |
示例
/**
* 查询表中Col_Keyword列的值能够匹配"hangzhou"的数据,返回匹配到的总行数和一些匹配成功的行。
* @param client
*/
private static void matchQuery(SyncClient client) {
SearchQuery searchQuery = new SearchQuery();
MatchQuery matchQuery = new MatchQuery(); //设置查询类型为MatchQuery。
matchQuery.setFieldName("Col_Keyword"); //设置要匹配的列。
matchQuery.setText("hangzhou"); //设置要匹配的值。
searchQuery.setQuery(matchQuery);
searchQuery.setOffset(0); //设置offset为0。
searchQuery.setLimit(20); //设置limit为20,表示最多返回20行数据。
//searchQuery.setGetTotalCount(true); //设置返回匹配的总行数。
SearchRequest searchRequest = new SearchRequest("sampleTable", "sampleSearchIndex", searchQuery);
//通过设置columnsToGet参数可以指定返回的列或返回所有列,如果不设置此参数,则默认只返回主键列。
//SearchRequest.ColumnsToGet columnsToGet = new SearchRequest.ColumnsToGet();
//columnsToGet.setReturnAll(true); //设置为返回所有列。
//columnsToGet.setColumns(Arrays.asList("ColName1","ColName2")); //设置为返回指定列。
//searchRequest.setColumnsToGet(columnsToGet);
SearchResponse resp = client.search(searchRequest);
//System.out.println("TotalCount: " + resp.getTotalCount()); //打印匹配到的总行数,非返回行数。
System.out.println("Row: " + resp.getRows());
}