使用 Tablestore Python SDK 的嵌套类型查询可在 Nested 字段中按子行边界匹配数据,并可返回匹配子行。
前提条件
安装Tablestore Python SDK并初始化客户端。
功能说明
嵌套类型查询用于查询 Nested 字段中的子行。Nested 字段的每个子行独立保留字段间的对应关系,不能直接按其子字段查询,需要使用 NestedQuery 包裹子查询。path 指定嵌套字段路径,子查询中的字段名称需要使用完整路径。子查询可以是任意 Query 类型。同一个子行必须满足多个条件时,将包含多个子条件的 BoolQuery 设置为一个 NestedQuery 的子查询;不同子行可以分别满足多个条件时,为每个条件分别构造 NestedQuery,再使用外层 BoolQuery 组合。
NestedQuery(path, query, score_mode=ScoreMode.NONE, inner_hits=None, weight=None)
以下示例查询 items 嵌套字段中,同一个子行的 items.name 等于 alice 且 items.age 小于 40 的数据。
child_query = BoolQuery(
must_queries=[
TermQuery("items.name", "alice"),
RangeQuery("items.age", range_to=40),
]
)
query = NestedQuery("items", child_query)
search_query = SearchQuery(
query,
limit=10,
get_total_count=True,
)
response = client.search(
"example_table",
"example_index",
search_query,
ColumnsToGet(return_type=ColumnReturnType.ALL),
)
print(response.total_count)
for row in response.rows:
print(row)
参数说明
查询请求
search 方法包含以下参数。
|
名称 |
类型 |
说明 |
|
table_name(必选) |
|
数据表名称。 |
|
index_name(必选) |
|
多元索引名称。 |
|
search_query(必选) |
|
查询条件和通用查询配置。 |
|
columns_to_get(可选) |
|
返回列配置。未设置时只返回主键列。 |
|
routing_keys(可选) |
|
自定义路由字段对应的主键值列表。未配置自定义路由时无需设置。 |
|
timeout_s(可选) |
|
请求级超时时间,单位为秒。未设置时使用客户端默认超时时间。 |
查询配置
search_query 的类型为 SearchQuery,包含以下参数。
|
名称 |
类型 |
说明 |
|
query(必选) |
|
查询条件。设置为 |
|
sort(可选) |
|
返回结果的排序方式。有关配置方法,请参见排序和翻页。 |
|
get_total_count(可选) |
|
是否返回匹配总行数。默认值为 |
|
next_token(可选) |
|
翻页凭证。将上一次响应的 |
|
offset(可选) |
|
本次查询的起始位置。适用于浅翻页。 |
|
limit(可选) |
|
本次查询返回的最大行数。设置为 |
|
aggs(可选) |
|
统计聚合配置。有关配置方法,请参见统计聚合。 |
|
group_bys(可选) |
|
分组配置。有关配置方法,请参见统计聚合。 |
|
collapse_field(可选) |
|
结果折叠配置,用于按指定字段对返回结果去重。有关配置方法,请参见折叠(去重)。 |
查询条件
search_query.query 的类型为 NestedQuery,包含以下参数。
|
名称 |
类型 |
说明 |
|
path(必选) |
|
要查询的嵌套字段路径。查询多层嵌套字段时,设置为目标字段的完整路径,例如 |
|
query(必选) |
|
在 |
|
score_mode(可选) |
|
多个子行匹配时的父行评分方式。 |
|
inner_hits(可选) |
|
匹配子行的返回、排序、分页和高亮配置。未设置时不返回匹配子行明细。 |
|
weight(可选) |
|
查询条件的相关性权重,必须为正浮点数。默认值为 |
匹配子行
search_query.query.inner_hits 的类型为 InnerHits,包含以下参数。
|
名称 |
类型 |
说明 |
|
sort(必选) |
|
匹配子行的排序规则。不排序时设置为 |
|
offset(必选) |
|
匹配子行的起始位置。不指定具体值时传入 |
|
limit(必选) |
|
返回的匹配子行数量。传入 |
|
highlight(必选) |
|
子字段的摘要与高亮配置。不需要高亮时设置为 |
返回列
columns_to_get 的类型为 ColumnsToGet,包含以下参数。
|
名称 |
类型 |
说明 |
|
column_names(可选) |
|
要返回的属性列名称。仅 |
|
return_type(可选) |
|
返回列模式。 |
返回值
search 方法返回 SearchResponse。核心字段如下。
|
字段 |
类型 |
说明 |
|
rows |
|
本次查询返回的行数据,数量不超过 |
|
next_token |
|
下一页凭证。值非空时,将其设置到下一次请求中继续读取。 |
|
total_count |
|
匹配行数。返回值取决于 |
|
is_all_succeed |
|
是否已成功查询全部索引分区。值为 |
|
agg_results |
|
统计聚合结果。未配置 |
|
group_by_results |
|
分组结果。未配置 |
|
search_hits |
|
查询命中结果,包含相关性评分、高亮结果和匹配子行等扩展信息。 |
兼容 Tuple 返回格式
Tablestore Python SDK 5.2.0 开始将查询接口的返回值由 Tuple 调整为响应对象,5.1.0 及以下版本直接返回 Tuple。5.2.1 及以上版本可调用 SearchResponse.v1_response() 获取与旧版本兼容的 Tuple。新代码建议直接访问 SearchResponse 的属性,避免返回字段扩展后解包数量不匹配。
(
rows,
next_token,
total_count,
is_all_succeed,
agg_results,
group_by_results,
search_hits,
) = response.v1_response()
场景示例
返回匹配子行及高亮结果
以下示例查询 items.name 等于 alice 的嵌套子行,并返回匹配子行及高亮分片。高亮结果位于 search_hits[].search_inner_hits[].search_hits[].highlight_result。
highlight = Highlight([HighlightParameter("items.name")])
inner_hits = InnerHits(
sort=None,
offset=0,
limit=10,
highlight=highlight,
)
query = NestedQuery(
"items",
TermQuery("items.name", "alice"),
inner_hits=inner_hits,
)
response = client.search(
"example_table",
"example_index",
SearchQuery(query, limit=10),
)
for search_hit in response.search_hits:
for inner_hit in search_hit.search_inner_hits:
for child_hit in inner_hit.search_hits:
print(child_hit.row)
print(child_hit.highlight_result.highlight_fields)