ClickHouse表引擎

引擎的名称大小写敏感

表引擎（即表的类型）决定了：
1）数据的存储方式和位置，写到哪里以及从哪里读取数据
2）支持哪些查询以及如何支持。
3）并发数据访问。
4）索引的使用（如果存在）。
5）是否可以执行多线程请求。
6）数据复制参数。
ClickHouse的表引擎有很多，下面介绍其中几种，对其他引擎有兴趣的可以去查阅官方文档：官方文档

分区:

是为了分区间能够并行计算

数据其实是先写到临时分区, 后续才被合并到现有分区

分区目录: 由文件+索引文件+表定义文件组成

主键:

它只提供了数据的一级索引，但不是唯一约束

是稀疏索引(类似于跳表)

二级索引

TTL:

数据的存活时间, 数据过期失效后不会立即清除, 而是在合并时才进行清除, 被清除前这个数据依旧是可见的

它的清除不是为了业务去及时清除过期数据, 而只是为了节省内存才清除失效数据

order by:

设定了分区内数据按照哪些字段进行有序地保存

主键必须是order by字段的前缀字段, 比如 order by的字段是(id,sku_id)时, 那么主键必须是id 或者(id,sku_id)

可作ReplacingMergeTree里的去重字段, 和SummingMergeTree里的维度字段

TinyLog
最简单的表引擎，用于将数据存储在磁盘上。每列都存储在单独的压缩文件中，写入时，数据将附加到文件末尾。
该引擎没有并发控制
●如果同时从表中读取和写入数据，则读取操作将抛出异常；
●如果同时写入多个查询中的表，则数据将被破坏。
这种表引擎的典型用法是 write-once：首先只写入一次数据，然后根据需要多次读取。此引擎适用于相对较小的表（建议最多1,000,000行）。如果有许多小表，则使用此表引擎是适合的，因为它比需要打开的文件更少。当拥有大量小表时，可能会导致性能低下。不支持索引。
案例：创建一个TinyLog引擎的表并插入一条数据
此时我们到保存数据的目录/var/lib/clickhouse/data/default/t中可以看到如下目录结构：
a.bin 和 b.bin 是压缩过的对应的列的数据， sizes.json 中记录了每个 *.bin 文件的大小：

:)create table t (a UInt16, b String) ENGINE = TinyLog;
:)insert into t (a, b) values (1, 'abc');

Memory

内存引擎，数据以未压缩的原始形式直接保存在内存当中，服务器重启数据就会消失。读写操作不会相互阻塞

相关阅读:
图像处理之边缘检测[微分算子、Canny算子和LOG算子]
React Native Sectionlist item移除动画
E - Blackout 2（离线 + 思维倒推 + 并查集）
C语言从入门到精通第二章（数据的表现形式）
职场工作与生活
从小白到架构师(4): Feed 流系统实战
掌握webpack
智慧城市运营中心建设方案（SCOC）智慧城市的心脏
Centos7安装MongoDB
kubeadmin安装k8s集群

原文地址：https://blog.csdn.net/robinhunan/article/details/127425363