搜索

回答

ClickHouse 主要用于在线分析处理查询（OLAP），能够使用 SQL 查询实时生成分析数据报告。

和我们常见的关系型数据库非常不同。比如，MySQL，Postgresql，SQL Server 等数据库采用的都是行式存储，而 ClickHouse 采用的却是列式存储。下面我们通过一个简单的例子，来比较它们的不同。

如上述表格所示，传统的 MySQL 数据库的每一行数据都是物理的存储在一起的。如果我要去 id 等于 10000 这一条数据的 name 列，那我就必须要把这一行数据读取出来，然后取 name 列。

再比如，下面的 SQL：

SELECT name FROM artcle where id > 10000;

在众多的数据中，我只取一列，但我需要把每条数据都读取出来。

基于上面传统数据库的一些特点，ClickHouse 另辟蹊径，推出了列式存储。

看上图的列式存储示例，完全和 MySQL 等数据库不同。当我执行下面的 SQL 时，查询效率非常的高！

SELECT name FROM article where id > 10000;

由于 name 列的数据都存储在一起，因此效率大大地超过了传统的数据库。

除了逻辑上的不同，磁盘上的组织结构也大不一样。

除了列式存储上的不同，ClickHouse 还有高效的数据压缩，默认使用LZ4算法，总体压缩比可达 8:1。ClickHouse 还采用了分布式多主架构提高并发性能，ClickHouse使读请求可以随机打到任意节点，均衡读压力，写请求也无需转发到master节点，不会产生单点压力。

ClickHouse 还有向量引擎，利用 SIMD 指令实现并行计算。对多个数据块来说，一次 SIMD 指令会同时操作多个块，大大减少了命令执行次数，缩短了计算时间。向量引擎在结合多核后会将 ClickHouse 的性能淋漓尽致地发挥出来。

ClickHouse 在索引上也有不同，采用了稀数索引及跳数索引。同时还有很多 MergeTree，提供海量业务场景支持。

总结

ClickHouse的列式存储有其优势，但是也有不足，例如不支持事务、异步修改。

在数据不是频繁修改的情况下，采用ClickHouse来存储和处理数据查询。如果需要频繁修改数据场景，最好的方案还是用MySQL，并对数据进行分表处理。

网友回复

我知道答案，我要回答

我有问题

回答

win10上powershell运行wsl报错Wsl/0x80072f7d如何解决？

人工智能技术属于科学范畴吗？

pi与claw及codex有啥不同？

有没有在电脑上运行iphone虚拟机的软件？

如何将电脑扬声器声音同步输出到另外一台手机或电脑上/

为啥图片和视频大模型的提示词支持json和python代码？

Chromium的 Kiosk 模式是干啥的？

豆包如何生成15秒以上的视频？

ai文本大模型最后会升级成做任何动画片吗？

python有没有一键扒谱和音乐背景旋律与人声分离的库？