使用通配符查询(WildcardQuery)可以实现模糊查询,类似于数据库中的Like语法,例如查询文本中包含某个词或短句的数据。
如果要实现NOT LIKE功能,则WildcardQuery需要和BoolQuery中的mustNotQueries结合使用。更多信息,请参见多条件组合查询。
功能概述
通配符查询通过特定的符号实现模糊匹配,能有效提升数据查找的精确度与效率。
使用WildcardQuery功能查询数据时,您可以使用带有通配符的字符串进行数据匹配。目前支持星号(*)和问号(?)两种通配符。其中星号(*)代表任意字符序列,问号(?)代表任意单个字符。查询字符串支持以星号(*)或问号(?)开头。例如查询table*e
,可以匹配到tablestore
。
目前支持用于WildcardQuery的数据类型包括Keyword和FuzzyKeyword。
Keyword类型:字符串基础数据类型,在中大规模数据上进行WildcardQuery等模糊查询的性能较差,且性能会随着数据规模增长而下降。
FuzzyKeyword类型:专门为WildcardQuery等模糊查询功能优化过的数据类型,在小、中、大规模数据上的查询性能均会更好更稳定,且性能基本不会随着数据规模增长而下降。
为了满足用户不同场景的模糊匹配需求,多元索引提供了3种不同类型的通配符查询,具体说明请参见下表。
本文主要介绍基于Keyword类型和FuzzyKeyword类型的WildcardQuery,如果想了解基于Text类型实现模糊查询的方案,请参见基于分词的通配符查询文档。
数据类型 | 查询方式 | 优势 | 劣势 |
Keyword | WildcardQuery | 兼容Elasticsearch的方式 | 随着索引数据增多后查询性能会变差 |
FuzzyKeyword | WildcardQuery | 性能好且稳定,性能基本不会随着数据规模增长而下降 | 数据会有部分膨胀 |
Text | MatchPhraseQuery | 支持大小写不敏感 | 数据会有部分膨胀 |
注意事项
不论是Keyword类型还是FuzzyKeyword类型,WildcardQuery中的查询词长度均不能超过32个字符。
接口
通配符查询的接口为Search或者ParallelScan,具体的Query类型为WildcardQuery。
参数
参数 | 描述 |
fieldName | 列名称。 |
value | 带有通配符的字符串,字符串长度不能超过32个字符。 |
query | 设置查询类型为WildcardQuery。 |
getTotalCount | 是否返回匹配的总行数,默认为false,表示不返回。 返回匹配的总行数会影响查询性能。 |
weight | 查询权重,用于全文检索场景中的score排序。查询时指定列的算分权重,值越大,结果中分数的值会越大。取值范围为正浮点数。 使用此参数不会影响返回的结果数,只会影响返回的结果中的分数。 |
tableName | 数据表名称。 |
indexName | 多元索引名称。 |
columnsToGet | 是否返回所有列,包含returnAll和columns设置。 returnAll默认为false,表示不返回所有列,此时可以通过columns指定返回的列;如果未通过columns指定返回的列,则只返回主键列。 当设置returnAll为true时,表示返回所有列。 |
使用方式
您可以使用控制台、命令行工具或者SDK进行通配符查询。进行通配符查询之前,您需要完成如下准备工作。
目前基于FuzzyKeyword类型的WildcardQuery只支持使用表格存储SDK实现。
使用阿里云账号或者使用具有表格存储操作权限的RAM用户进行操作。如果需要为RAM用户授权表格存储操作权限,请参见通过RAM Policy为RAM用户授权进行配置。
使用SDK方式和命令行工具方式进行操作时,如果当前无可用AccessKey,则需要为阿里云账号或者RAM用户创建AccessKey。具体操作,请参见创建AccessKey。
已创建数据表。具体操作,请参见数据表操作。
已为数据表创建多元索引。具体操作,请参见创建多元索引。
使用SDK方式进行操作时,还需要完成初始化Client。具体操作,请参见初始化OTSClient。
使用命令行工具方式进行操作前,还需要完成下载并启动命令行工具,然后配置接入实例信息并选择要操作的表。具体操作,请参见下载命令行工具、启动并配置接入信息和数据表操作。
计费说明
使用VCU模式(原预留模式)时,使用多元索引查询数据会消耗VCU的计算资源。使用CU模式(原按量模式)时,使用多元索引查询数据会消耗读吞吐量。更多信息,请参见多元索引计量计费。
常见问题
相关文档
多元索引查询类型包括精确查询、多词精确查询、全匹配查询、匹配查询、短语匹配查询、前缀查询、范围查询、通配符查询、基于分词的通配符查询、多条件组合查询、地理位置查询、嵌套类型查询、向量检索介绍与使用和列存在性查询,您可以选择合适的查询类型进行多维度数据查询。
如果要对结果集进行排序或者翻页,您可以使用排序和翻页功能来实现。具体操作,请参见排序和翻页。
如果要按照某一列对结果集做折叠,使对应类型的数据在结果展示中只出现一次,您可以使用折叠(去重)功能来实现。具体操作,请参见折叠(去重)。
如果要进行数据分析,例如求最值、求和、统计行数等,您可以使用Search接口的统计聚合功能或者SQL查询来实现。具体操作,请参见统计聚合和SQL查询。
如果要快速导出数据,而不关心整个结果集的顺序时,您可以使用ParallelScan接口和ComputeSplits接口实现多并发导出数据。具体操作,请参见并发导出数据。