使用 Tablestore Java SDK 的萬用字元查詢可通過 * 和 ? 構造匹配模式,查詢 Keyword、Text 或 FuzzyKeyword 欄位中與模式比對的資料。
前提條件
安裝Tablestore Java SDK並初始化用戶端。
功能說明
萬用字元查詢通過包含萬用字元的模式比對索引欄位,匹配語義與 SQL LIKE 類似,但使用 * 和 ? 作為萬用字元。對於 Keyword 和 FuzzyKeyword 類型欄位,查詢模式與完整欄位值進行匹配;對於 Text 類型欄位,查詢模式與欄位分詞後的單個詞條進行匹配,查詢模式本身不會被分詞。萬用字元查詢支援的欄位類型請參見字串類型。匹配區分大小寫。
查詢模式可以萬用字元開頭,並支援以下萬用字元:
*:匹配 0 個或多個字元。?:匹配任意單個字元。
例如,table*e 可以匹配 tablestore;hang*u 可以匹配 hangu 和 hangzhou;hang?u 可以匹配 hangxu,但不能匹配 hangu。
如果需要查詢包含指定字串的資料,例如使用 *word* 形式的查詢模式(等同於 SQL WHERE field_a LIKE '%word%'),可使用基於分詞的萬用字元查詢。該方式可避免查詢效能隨資料量增加而下降。
如需排除與模式比對的資料,將 WildcardQuery 添加到 BoolQuery.mustNotQueries,可實現與 SQL NOT LIKE 相同的排除效果。有關 BoolQuery 的配置方法,請參見多條件組合查詢。
調用 search 方法時,將查詢類型設定為 WildcardQuery,並通過 SearchQuery 配置返回數量、總行數統計和其他通用查詢行為。
SearchResponse search(SearchRequest request)
以下樣本查詢 Keyword 類型的 product_name 欄位值與 table*e 模式比對的資料,返回最多 10 行資料及匹配總行數。
String tableName = "example_table";
String indexName = "example_index";
WildcardQuery wildcardQuery = new WildcardQuery();
wildcardQuery.setFieldName("product_name");
wildcardQuery.setValue("table*e");
SearchQuery searchQuery = new SearchQuery();
searchQuery.setQuery(wildcardQuery);
searchQuery.setLimit(10);
searchQuery.setTrackTotalCount(SearchQuery.TRACK_TOTAL_COUNT);
SearchRequest request = new SearchRequest(tableName, indexName, searchQuery);
SearchRequest.ColumnsToGet columnsToGet = new SearchRequest.ColumnsToGet();
columnsToGet.setReturnAll(true);
request.setColumnsToGet(columnsToGet);
SearchResponse response = client.search(request);
System.out.println(response.getTotalCount());
System.out.println(response.getRows());
參數說明
查詢請求
request 的類型為 SearchRequest,包含以下參數。
|
名稱 |
類型 |
說明 |
|
tableName(必選) |
String |
資料表名稱。 |
|
indexName(必選) |
String |
多元索引名稱。 |
|
searchQuery(必選) |
SearchQuery |
查詢條件和通用查詢配置。 |
|
columnsToGet(可選) |
SearchRequest.ColumnsToGet |
返回列配置。未設定時只返回主鍵列。 |
|
timeoutInMillisecond(可選) |
int |
請求級查詢逾時時間,單位為毫秒。預設值為 |
|
routingValues(可選) |
|
自訂路由欄位對應的主索引值列表。未配置自訂路由時無需設定。 |
查詢配置
request.searchQuery 的類型為 SearchQuery,包含以下參數。
|
名稱 |
類型 |
說明 |
|
query(必選) |
Query |
查詢條件。萬用字元查詢設定為 |
|
offset(可選) |
Integer |
本次查詢的起始位置。 |
|
limit(可選) |
Integer |
本次查詢返回的最大行數。設定為 |
|
highlight(可選) |
Highlight |
|
|
collapse(可選) |
Collapse |
結果摺疊配置,用於按指定列對返回結果去重。有關配置方法,請參見摺疊(去重)。 |
|
sort(可選) |
Sort |
返回結果的排序方式。有關配置方法,請參見排序和翻頁。 |
|
trackTotalCount(可選) |
int |
期望統計的最大匹配行數。預設值為 |
|
filter(可選) |
SearchFilter |
對 |
|
aggregationList(可選) |
|
統計彙總配置。有關配置方法,請參見統計彙總。 |
|
groupByList(可選) |
|
分組配置。有關配置方法,請參見統計彙總。 |
|
token(可選) |
byte[] |
翻頁憑證。將上一次響應的 |
查詢條件
request.searchQuery.query 的類型為 WildcardQuery,包含以下參數。
|
名稱 |
類型 |
說明 |
|
fieldName(必選) |
String |
要查詢的 |
|
value(必選) |
String |
包含萬用字元的查詢模式,最長為 32 個字元,匹配區分大小寫。對於 |
|
weight(可選) |
float |
查詢條件的相關性權重,必須為正浮點數。值越大,該查詢條件對 BM25 相關性評分的貢獻越高。該參數不影響匹配結果和返回行數,僅在使用 |
返回列
request.columnsToGet 的類型為 SearchRequest.ColumnsToGet,包含以下參數。
|
名稱 |
類型 |
說明 |
|
columns(可選) |
|
要返回的屬性列名稱。僅 |
|
returnAll(可選) |
boolean |
是否返回資料表中的全部屬性列。預設值為 |
|
returnAllFromIndex(可選) |
boolean |
是否返回已建立索引的全部屬性列。預設值為 |
傳回值
search 方法返回 SearchResponse。核心欄位如下。
|
名稱 |
類型 |
說明 |
|
totalCount |
long |
匹配行數,通過 |
|
rows |
|
本次查詢返回的行資料,通過 |
|
searchHits |
|
查詢命中結果,通過 |
|
nextToken |
byte[] |
下一頁憑證,通過 |
|
isAllSuccess |
boolean |
是否已成功查詢全部索引分割區,通過 |