使用 Tablestore Java SDK 的匹配查询可检索 Text 或 Keyword 类型字段,并返回满足匹配条件的数据及相关性得分。
前提条件
安装Tablestore Java SDK并初始化客户端。
功能说明
匹配查询用于检索 Text 或 Keyword 类型字段(字段说明请参见字符串类型),两种字段的匹配方式不同:
Text:使用创建多元索引时配置的分词器对字段值和查询文本分词,然后根据词条匹配。未配置分词器时,默认使用单字分词。默认使用OR逻辑,字段值包含任意查询词条即可命中;也可改为AND逻辑,或指定最少需要匹配的词条数。Keyword:字段值和查询文本均不分词,字段完整值与查询文本相同时命中。
匹配查询只判断词条是否匹配,不要求词条按查询文本中的顺序相邻出现。如需按词条顺序匹配,请使用短语匹配查询。如果 Text 字段使用模糊分词器且需要执行高性能模糊查询,也建议使用短语匹配查询。
以下示例查询 description 字段中包含 tablestore 或 durable 词条的数据,返回最多 10 行数据、匹配总行数和相关性得分。
String tableName = "example_table";
String indexName = "example_index";
MatchQuery matchQuery = new MatchQuery();
matchQuery.setFieldName("description");
matchQuery.setText("tablestore durable");
SearchQuery searchQuery = new SearchQuery();
searchQuery.setQuery(matchQuery);
searchQuery.setSort(new Sort(Collections.singletonList(new ScoreSort())));
searchQuery.setLimit(10);
searchQuery.setTrackTotalCount(SearchQuery.TRACK_TOTAL_COUNT);
SearchRequest request = new SearchRequest(tableName, indexName, searchQuery);
SearchRequest.ColumnsToGet columnsToGet = new SearchRequest.ColumnsToGet();
columnsToGet.setReturnAll(true);
request.setColumnsToGet(columnsToGet);
SearchResponse response = client.search(request);
for (SearchHit hit : response.getSearchHits()) {
System.out.println(hit.getRow());
System.out.println(hit.getScore());
}
参数说明
查询请求
request 的类型为 SearchRequest,包含以下参数。
|
名称 |
类型 |
说明 |
|
tableName(必选) |
String |
数据表名称。 |
|
indexName(必选) |
String |
多元索引名称。 |
|
searchQuery(必选) |
SearchQuery |
查询条件和通用查询配置。 |
|
columnsToGet(可选) |
SearchRequest.ColumnsToGet |
返回列配置。未设置时只返回主键列。 |
|
timeoutInMillisecond(可选) |
int |
请求级查询超时时间,单位为毫秒。默认值为 |
|
routingValues(可选) |
|
自定义路由字段对应的主键值列表。未配置自定义路由时无需设置。 |
查询配置
request.searchQuery 的类型为 SearchQuery,包含以下参数。
|
名称 |
类型 |
说明 |
|
query(必选) |
Query |
查询条件。匹配查询设置为 |
|
offset(可选) |
Integer |
本次查询的起始位置。 |
|
limit(可选) |
Integer |
本次查询返回的最大行数。设置为 |
|
highlight(可选) |
Highlight |
|
|
collapse(可选) |
Collapse |
结果折叠配置,用于按指定列对返回结果去重。有关配置方法,请参见折叠(去重)。 |
|
sort(可选) |
Sort |
返回结果的排序方式。有关配置方法,请参见排序和翻页。 |
|
trackTotalCount(可选) |
int |
期望统计的最大匹配行数。默认值为 |
|
filter(可选) |
SearchFilter |
对 |
|
aggregationList(可选) |
|
统计聚合配置。有关配置方法,请参见统计聚合。 |
|
groupByList(可选) |
|
分组配置。有关配置方法,请参见统计聚合。 |
|
token(可选) |
byte[] |
翻页凭证。将上一次响应的 |
匹配条件
request.searchQuery.query 的类型为 MatchQuery,包含以下参数。
|
名称 |
类型 |
说明 |
|
fieldName(必选) |
String |
要查询的 |
|
text(必选) |
String |
查询文本。查询 |
|
operator(可选) |
QueryOperator |
查询词条的组合方式。 |
|
minShouldMatch(可选) |
String 或 int |
当 |
|
weight(可选) |
float |
查询权重。默认值为 |
setMinimumShouldMatch(Integer) 已弃用。请使用 setMinShouldMatch(int) 或 setMinShouldMatch(String)。
返回列
request.columnsToGet 的类型为 SearchRequest.ColumnsToGet,包含以下参数。
|
名称 |
类型 |
说明 |
|
columns(可选) |
|
要返回的属性列名称。仅 |
|
returnAll(可选) |
boolean |
是否返回数据表中的全部属性列。默认值为 |
|
returnAllFromIndex(可选) |
boolean |
是否返回已建立索引的全部属性列。默认值为 |
返回值
查询响应
search 方法返回 SearchResponse。核心字段如下。
|
名称 |
类型 |
说明 |
|
totalCount |
long |
匹配行数,通过 |
|
rows |
|
本次查询返回的行数据,通过 |
|
searchHits |
|
查询命中结果,通过 |
|
nextToken |
byte[] |
下一页凭证,通过 |
|
isAllSuccess |
boolean |
是否已成功查询全部索引分区,通过 |
查询命中
response.searchHits[] 的类型为 SearchHit,包含以下核心字段。
|
名称 |
类型 |
说明 |
|
row |
Row |
命中的行数据,通过 |
|
score |
Double |
相关性得分,通过 |
|
highlightResultItem |
HighlightResultItem |
摘要与高亮结果,通过 |
场景示例
匹配全部查询词条
将 operator 设置为 AND,只有字段值包含全部查询词条时才命中。
MatchQuery matchQuery = new MatchQuery();
matchQuery.setFieldName("description");
matchQuery.setText("tablestore durable");
matchQuery.setOperator(QueryOperator.AND);
SearchQuery searchQuery = new SearchQuery();
searchQuery.setQuery(matchQuery);
设置最小匹配词条数
使用 OR 逻辑时,可通过 minShouldMatch 指定至少需要匹配的查询词条数。以下示例要求至少匹配两个词条。
MatchQuery matchQuery = new MatchQuery();
matchQuery.setFieldName("description");
matchQuery.setText("tablestore durable cloud");
matchQuery.setOperator(QueryOperator.OR);
matchQuery.setMinShouldMatch(2);
SearchQuery searchQuery = new SearchQuery();
searchQuery.setQuery(matchQuery);