您可以通过JindoTable表或分区的访问热度收集功能来区分冷热数据,从而节约整体的存储成本,提高缓存利用效率。
数据收集
JindoTable支持收集访问Hive表的记录,目前支持的引擎有Spark和Hive。收集的数据保存在集群SmartData服务的Namespace中。
数据收集是默认打开的。如果需要关闭,请参见关闭数据收集。
数据查询
JindoTable提供了命令方式查询热度信息。
- 语法
jindo table -accessStat <-d [days]> <-n [topNums]>
days
和topNums
为正整数。当天数为1时,表示查询从本地时间当天0:00开始到现在的所有访问记录。 - 功能
查询在指定时间范围内,访问最多表或分区的指定条数。
- 示例,查询近七天访问最多的表或分区的20条访问记录。
jindo table -accessStat -d 7 -n 20
JindoTable使用详情,请参见JindoTable使用说明。