GBASE南大通用分享
MergeTree表引擎参数:
partition by:分区键
order by:排序键
primary key:主键
sample by:抽样表达式(如果使用此配置,主键配置也需要声明同样的表达式)
settings index_granularity:索引力度,默认值是8192,表示每隔8192行数据才生成一条索引
settings:index_granularity_bytes:根据每一批次写入数据的体量大小,动态划分间隔大小,默认为10M,设置为0表示不启动自适应功能
settings:enable_mixed_granularity_parts:设置是否开启自适应索引间隔的功能
settings:merge_with_ttl_timeout:数据ETL功能
settings:storage_policy:多路径的存储策略
一级索引:
稀疏索引
索引粒度:8192,通过index_granularity这个参数来实现
二级索引:
allow_experimental_data_skipping_indices
granularity:数据的粒度
index_granularity:聚合信息汇总的粒度
跳数索引类型:
minmax:记录了一段数据内的最小和最大极致
set:记录了声明字段或表达式的取值(唯一值,无重复),其中max_rows是一个阈值,表示在一个index_granularity内索引最多记录的数据行数,如果为0,表示无限制
ngrambf_v1:记录的是数据短语的布隆表过滤器,只支持string和fixedstring数据类型,完整形式(n,size_of_bloom_filter_in_bytes,number_of_hash_functions,random_seed)
n:token长度,依据n的长度将数据切割为token短语
size_of_bloom_filter_in_bytes:布隆过滤器的大小
number_of_hash_functions:布隆过滤器中使用hash函数的个数
random_seed:hash函数的随机种子
tokenbf_v1:是ngrambf_v1的变种,除了短语token的处理方法外,其他的一样。
查询压缩数据的统计信息:
clickhouse-compressor –stat < .bin(数据文件)
数据块的大小由min_compress_block_size(默认65536)与max_compress_block_size(默认1048576)参数指定
原文地址:https://blog.csdn.net/weixin_47390342/article/details/135867885
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如若转载,请注明出处:http://www.7code.cn/show_62715.html
如若内容造成侵权/违法违规/事实不符,请联系代码007邮箱:suwngjj01@126.com进行投诉反馈,一经查实,立即删除!