匹配查询
MatchQuery采用近似匹配的方式查询表中的数据。表格存储会先对Text类型的列值和查询关键词按照设置好的分词器做切分,然后按照切分好后的词去查询。对于使用模糊分词的Text类型的列,建议使用MatchPhraseQuery实现高性能的模糊查询。
前提条件
已初始化OTSClient。具体操作,请参见初始化OTSClient。
已在数据表上创建多元索引。具体操作,请参见创建多元索引。
参数
参数 | 说明 |
FieldName | 要匹配的列。 匹配查询可应用于Text类型。 |
Text | 查询关键词,即要匹配的值。 当要匹配的列为Text类型时,查询关键词会被分词成多个词,分词类型为创建多元索引时设置的分词器类型。如果创建多元索引时未设置分词器类型,则默认分词类型为单字分词。 例如当要匹配的列为Text类型时,分词类型为单字分词,则查询词为"this is",可以匹配到“...,this is tablestore”、“is this tablestore”、“tablestore is cool”、“this"、“is”等。 |
Query | 设置查询类型为MatchQuery。 |
Operator | 逻辑运算符。默认为OR,表示当分词后的多个词只要有部分匹配时,则行数据满足查询条件。 如果设置Operator为AND,则只有分词后的所有词都在列值中时,才表示行数据满足查询条件。 |
MinimumShouldMatch | 最小匹配个数。 只有当某一行数据的FieldName列的值中至少包括最小匹配个数的词时,才会返回该行数据。 说明 MinimumShouldMatch需要与逻辑运算符OR配合使用。 |
TableName | 数据表名称。 |
IndexName | 多元索引名称。 |
GetTotalCount | 是否返回匹配的总行数,默认为false,表示不返回。 返回匹配的总行数会影响查询性能。 |
ColumnsToGet | 是否返回所有列。包含ReturnAll和Columns以及ReturnAllFromIndex设置。 ReturnAll默认为false,表示不返回所有列。此时可以通过如下任一设置返回所需列。如果未设置Columns和ReturnAllFromIndex,则只返回主键列。
当设置ReturnAll为true时,表示返回所有列。 |
示例
以下示例用于查询表中Text_type_col列的值能够匹配"SearchIndex"的数据。
/// <summary>
/// 查询表中Text_type_col列的值能够匹配"SearchIndex"的数据,返回匹配到的总行数。
/// </summary>
/// <param name="otsClient"></param>
public static void MatchQuery(OTSClient otsClient)
{
var searchQuery = new SearchQuery();
//设置查询类型为MatchQuery,要匹配的列为Text_type_col,要匹配的值为"SearchIndex"。
searchQuery.Query = new MatchQuery("Text_type_col", "SearchIndex");
//设置返回匹配的总行数。
searchQuery.GetTotalCount = true;
var request = new SearchRequest(TableName, IndexName, searchQuery);
//通过ColumnsToGet参数可以设置返回多元索引中所有列、返回指定列或返回所有列,如果不设置此参数,则默认只返回主键列。
request.ColumnsToGet = new ColumnsToGet()
{
//设置为返回多元索引中所有列。
ReturnAllFromIndex = true
//设置为返回指定列。
//Columns = new List<string>() { Long_type_col, Text_type_col, Keyword_type_col }
//设置为返回所有列。
//ReturnAll = true
};
var response = otsClient.Search(request);
Console.WriteLine("Total Count:" + response.TotalCount); //打印匹配到的总行数,非返回行数。
}
常见问题
相关文档
多元索引查询类型包括精确查询、多词精确查询、全匹配查询、匹配查询、短语匹配查询、前缀查询、范围查询、通配符查询、多条件组合查询、地理位置查询、嵌套类型查询和列存在性查询,您可以选择合适的查询类型进行多维度数据查询。
如果要对结果集进行排序或者翻页,您可以使用排序和翻页功能来实现。具体操作,请参见排序和翻页。
如果要按照某一列对结果集做折叠,使对应类型的数据在结果展示中只出现一次,您可以使用折叠(去重)功能来实现。具体操作,请参见折叠(去重)。
如果要进行数据分析,例如求最值、求和、统计行数等,您可以使用Search接口的统计聚合功能或者SQL查询来实现。具体操作,请参见统计聚合和SQL查询。
如果要快速导出数据,而不关心整个结果集的顺序时,您可以使用ParallelScan接口和ComputeSplits接口实现多并发导出数据。具体操作,请参见并发导出数据。