• ClickHouse表引擎


    引擎的名称大小写敏感

    表引擎(即表的类型)决定了:
    1)数据的存储方式和位置,写到哪里以及从哪里读取数据
    2)支持哪些查询以及如何支持。
    3)并发数据访问。
    4)索引的使用(如果存在)。
    5)是否可以执行多线程请求。
    6)数据复制参数。
    ClickHouse的表引擎有很多,下面介绍其中几种,对其他引擎有兴趣的可以去查阅官方文档:官方文档

    分区:

    是为了分区间能够并行计算

    数据其实是先写到临时分区, 后续才被合并到现有分区

    分区目录: 由文件+索引文件+表定义文件组成

    主键:

    它只提供了数据的一级索引,但不是唯一约束

    是稀疏索引(类似于跳表)

    二级索引

    TTL:

    数据的存活时间, 数据过期失效后不会立即清除, 而是在合并时才进行清除, 被清除前这个数据依旧是可见的

    它的清除不是为了业务去及时清除过期数据, 而只是为了节省内存才清除失效数据

    order by:

    设定了分区内数据按照哪些字段 进行有序地保存

    主键必须是order by字段的前缀字段, 比如 order by的字段是(id,sku_id)时, 那么主键必须是id 或者(id,sku_id)

    可作ReplacingMergeTree里的去重字段, 和SummingMergeTree里的维度字段

    TinyLog
    最简单的表引擎,用于将数据存储在磁盘上。每列都存储在单独的压缩文件中,写入时,数据将附加到文件末尾。
    该引擎没有并发控制
    ●如果同时从表中读取和写入数据,则读取操作将抛出异常;
    ●如果同时写入多个查询中的表,则数据将被破坏。
    这种表引擎的典型用法是 write-once:首先只写入一次数据,然后根据需要多次读取。此引擎适用于相对较小的表(建议最多1,000,000行)。如果有许多小表,则使用此表引擎是适合的,因为它比需要打开的文件更少。当拥有大量小表时,可能会导致性能低下。 不支持索引。
    案例:创建一个TinyLog引擎的表并插入一条数据
    此时我们到保存数据的目录/var/lib/clickhouse/data/default/t中可以看到如下目录结构:
    a.bin 和 b.bin 是压缩过的对应的列的数据, sizes.json 中记录了每个 *.bin 文件的大小:

    :)create table t (a UInt16, b String) ENGINE = TinyLog;
    :)insert into t (a, b) values (1, 'abc');

    Memory

    内存引擎,数据以未压缩的原始形式直接保存在内存当中,服务器重启数据就会消失。读写操作不会相互阻塞

  • 相关阅读:
    图像处理之边缘检测[微分算子、Canny算子和LOG算子]
    React Native Sectionlist item移除动画
    E - Blackout 2(离线 + 思维倒推 + 并查集)
    C语言从入门到精通 第二章(数据的表现形式)
    职场工作与生活
    从小白到架构师(4): Feed 流系统实战
    掌握webpack
    智慧城市运营中心建设方案(SCOC)智慧城市的心脏
    Centos7安装MongoDB
    kubeadmin安装k8s集群
  • 原文地址:https://blog.csdn.net/robinhunan/article/details/127425363