使用 Tablestore Python SDK 的多條件組合查詢可按與、或、非邏輯組合多個查詢條件。
前提條件
安裝Tablestore Python SDK並初始化用戶端。
功能說明
多條件組合查詢使用 BoolQuery 將多個子查詢組合成複雜條件。子查詢可以是任意查詢類型,也可以是另一個 BoolQuery。must_queries 和 filter_queries 表示 AND,should_queries 表示 OR,must_not_queries 表示 NOT;其中 filter_queries 和 must_not_queries 不參與相關性評分。
未設定 minimum_should_match 時,如果同級包含 must_queries 或 filter_queries,則 should_queries 預設不作為必須滿足的條件;其他包含 should_queries 的情況預設至少滿足一個 should_queries 子查詢。
BoolQuery(
must_queries=None,
must_not_queries=None,
filter_queries=None,
should_queries=None,
minimum_should_match=None,
weight=None,
)
以下樣本查詢 city 等於 hangzhou 且 category 等於 book 的資料。
query = BoolQuery(
must_queries=[
TermQuery("city", "hangzhou"),
TermQuery("category", "book"),
]
)
response = client.search(
"example_table",
"example_index",
SearchQuery(query, limit=10, get_total_count=True),
ColumnsToGet(return_type=ColumnReturnType.ALL),
)
print(response.rows)
參數說明
查詢請求
search 方法包含以下參數。
|
名稱 |
類型 |
說明 |
|
table_name(必選) |
|
資料表名稱。 |
|
index_name(必選) |
|
多元索引名稱。 |
|
search_query(必選) |
|
查詢條件和通用查詢配置。 |
|
columns_to_get(可選) |
|
返回列配置。未設定時只返回主鍵列。 |
|
routing_keys(可選) |
|
自訂路由欄位對應的主索引值列表。未配置自訂路由時無需設定。 |
|
timeout_s(可選) |
|
請求級逾時時間,單位為秒。未設定時使用用戶端預設逾時時間。 |
查詢配置
search_query 的類型為 SearchQuery,包含以下參數。
|
名稱 |
類型 |
說明 |
|
query(必選) |
|
查詢條件。設定為 |
|
sort(可選) |
|
返回結果的排序方式。有關配置方法,請參見排序和翻頁。 |
|
get_total_count(可選) |
|
是否返回匹配總行數。預設值為 |
|
next_token(可選) |
|
翻頁憑證。將上一次響應的 |
|
offset(可選) |
|
本次查詢的起始位置,適用於淺翻頁。 |
|
limit(可選) |
|
本次查詢返回的最大行數。設定為 |
|
aggs(可選) |
|
指標彙總配置。有關配置方法,請參見統計彙總。 |
|
group_bys(可選) |
|
分組配置。有關配置方法,請參見統計彙總。 |
|
collapse_field(可選) |
|
結果摺疊配置。有關配置方法,請參見摺疊(去重)。 |
|
highlight(可選) |
|
|
組合查詢條件
search_query.query 的類型為 BoolQuery,包含以下參數。
|
名稱 |
類型 |
說明 |
|
must_queries(可選) |
|
必須全部滿足的子查詢。匹配的子查詢參與相關性評分。 |
|
filter_queries(可選) |
|
必須全部滿足的子查詢,但不參與相關性評分。 |
|
should_queries(可選) |
|
至少滿足指定數量的子查詢。滿足的條件越多,相關性得分越高。 |
|
must_not_queries(可選) |
|
不能滿足其中任何一個條件的子查詢,不參與相關性評分。 |
|
minimum_should_match(可選) |
|
必須滿足的 |
|
weight(可選) |
|
查詢權重,必須為正浮點數。預設值為 |
返回列
columns_to_get 的類型為 ColumnsToGet,包含以下參數。
|
名稱 |
類型 |
說明 |
|
column_names(可選) |
|
要返回的屬性列名稱。僅 |
|
return_type(可選) |
|
返回列模式。 |
傳回值
search 方法返回 SearchResponse。核心欄位如下。
|
欄位 |
類型 |
說明 |
|
rows |
|
本次查詢返回的行資料,數量不超過 |
|
next_token |
|
下一頁憑證。值為空白時表示沒有更多資料。 |
|
total_count |
|
匹配行數,取決於 |
|
is_all_succeed |
|
是否已成功查詢全部索引分割區。值為 |
|
agg_results |
|
指標彙總結果。未配置 |
|
group_by_results |
|
分組結果。未配置 |
|
search_hits |
|
查詢命中結果,包含行資料、相關性得分和高亮結果等擴充資訊。 |
相容 Tuple 返回格式
Tablestore Python SDK 5.2.0 開始將查詢介面的傳回值由 Tuple 調整為響應對象,5.1.0 及以下版本直接返回 Tuple。5.2.1 及以上版本可調用 SearchResponse.v1_response() 擷取與舊版本相容的 Tuple。新代碼建議直接存取 SearchResponse 的屬性,避免返回欄位擴充後解包數量不匹配。
(
rows,
next_token,
total_count,
is_all_succeed,
agg_results,
group_by_results,
search_hits,
) = response.v1_response()
情境樣本
組合 OR、NOT 和過濾條件
以下樣本要求資料屬於 book- 分類,並至少滿足 Python 或 Java 分類中的一個,同時排除 deprecated 狀態。
query = BoolQuery(
filter_queries=[PrefixQuery("category", "book-")],
should_queries=[
TermQuery("category", "book-python"),
TermQuery("category", "book-java"),
],
must_not_queries=[TermQuery("status", "deprecated")],
minimum_should_match=1,
)
response = client.search(
"example_table",
"example_index",
SearchQuery(query, limit=10),
)
print(response.rows)