目录
- 写在前面
- 环境部署
- Zookeeper集群部署
- Clickhouse集群部署
- 1.临时镜像拷贝出配置
- 2.修改config.xml配置
- 3.拷贝到其他文件夹
- 4.分发到其他服务器
- 配置集群
- 1.修改配置
- 2.新增集群配置文件metrika.xml
- 集群运行及测试
写在前面抽空来更新一下大数据的玩意儿了,起初架构选型的时候有考虑Hadoop那一套做数仓,但是Hadoop要求的服务器数量有点高,集群至少6台或以上,所以选择了Clickhouse(后面简称CH) 。CH做集群的话,3台服务器起步就可以的,当然,不是硬性,取决于你的zookeeper做不做集群,其次CH性能更强大,对于量不是非常巨大的场景来说,单机已经足够应对OLAP多种场景了 。
进入正题,相关环境:
IP服务器名操作系统服务备注 172.192.13.10server01Ubuntu20.04两个Clickhouse实例、ZookeeperCH实例1端口:tcp 9000, http 8123, 同步端口9009,MySQL 9004, 类型: 主分片1
CH实例2端口:tcp 9000, http 8124, 同步端口9010,MySQL 9005, 类型: server02的副本
172.192.13.11server02Ubuntu20.04两个Clickhouse实例、ZookeeperCH实例3端口:tcp 9000, http 8123, 同步端口9009,MySQL 9004, 类型: 主分片2
CH实例4端口:tcp 9000, http 8124, 同步端口9010,MySQL 9005, 类型: server03的副本
172.192.13.12server03Ubuntu20.04两个Clickhouse实例、ZookeeperCH实例5端口:tcp 9000, http 8123, 同步端口9009,MySQL 9004, 类型: 主分片3
CH实例6端口:tcp 9000, http 8124, 同步端口9010,MySQL 9005, 类型: server01的副本
在每一台服务上都安装docker,docker里面分别安装有3个服务:ch-main,ch-sub,zookeeper_node,如图所示:

文章插图
细心的已经看到,PORTS没有映射关系,这里是使用Docker host网络模式,模式简单并且性能高,避免了很多容器间或跨服务器的通信问题,这个踩了很久 。
环境部署1. 服务器环境配置
在每一台服务器上执行:vim /etc/hosts,打开hosts之后新增配置:
【以示例讲解Clickhouse Docker集群部署以及配置】172.192.13.10 server01172.192.13.11 server02172.192.13.12 server032.安装docker
太简单,略...
3.拉取clickhouse、zookeeper镜像
太简单,略...
Zookeeper集群部署在每个服务器上你想存放的位置,新建一个文件夹来存放zk的配置信息,这里是/usr/soft/zookeeper/,在每个服务器上依次运行以下启动命令:
server01执行:
docker run -d -p 2181:2181 -p 2888:2888 -p 3888:3888 --name zookeeper_node --restart always \-v /usr/soft/zookeeper/data:/data \-v /usr/soft/zookeeper/datalog:/datalog \-v /usr/soft/zookeeper/logs:/logs \-v /usr/soft/zookeeper/conf:/conf \--network host\-e ZOO_MY_ID=1zookeeperserver02执行:
docker run -d -p 2181:2181 -p 2888:2888 -p 3888:3888 --name zookeeper_node --restart always \-v /usr/soft/zookeeper/data:/data \-v /usr/soft/zookeeper/datalog:/datalog \-v /usr/soft/zookeeper/logs:/logs \-v /usr/soft/zookeeper/conf:/conf \--network host\-e ZOO_MY_ID=2zookeeperserver03执行:
docker run -d -p 2181:2181 -p 2888:2888 -p 3888:3888 --name zookeeper_node --restart always \-v /usr/soft/zookeeper/data:/data \-v /usr/soft/zookeeper/datalog:/datalog \-v /usr/soft/zookeeper/logs:/logs \-v /usr/soft/zookeeper/conf:/conf \--network host\-e ZOO_MY_ID=3zookeeper唯一的差别是:-e ZOO_MY_ID=*而已 。
其次,每台服务上打开/usr/soft/zookeeper/conf路径,找到zoo.cfg配置文件,修改为:
dataDir=/datadataLogDir=/datalogtickTime=2000initLimit=5syncLimit=2clientPort=2181autopurge.snapRetainCount=3autopurge.purgeInterval=0maxClientCnxns=60server.1=172.192.13.10:2888:3888server.2=172.192.13.11:2888:3888server.3=172.192.13.12:2888:3888然后进入其中一台服务器,进入zk查看是否配置启动成功:
docker exec -it zookeeper_node /bin/bash./bin/zkServer.sh status

文章插图
Clickhouse集群部署
1.临时镜像拷贝出配置运行一个临时容器,目的是为了将配置、数据、日志等信息存储到宿主机上:
docker run --rm -d --name=temp-ch yandex/clickhouse-server拷贝容器内的文件:
docker cp temp-ch:/etc/clickhouse-server/ /etc///https://www.cnblogs.com/EminemJK/p/15138536.html
2.修改config.xml配置//同时兼容IPV6,一劳永逸
3.拷贝到其他文件夹cp -rf /etc/clickhouse-server/ /usr/soft/clickhouse-server/maincp -rf /etc/clickhouse-server/ /usr/soft/clickhouse-server/submain为主分片,sub为副本 。
4.分发到其他服务器#拷贝配置到server02上scp /usr/soft/clickhouse-server/main/ server02:/usr/soft/clickhouse-server/main/scp /usr/soft/clickhouse-server/sub/ server02:/usr/soft/clickhouse-server/sub/ #拷贝配置到server03上scp /usr/soft/clickhouse-server/main/ server03:/usr/soft/clickhouse-server/main/scp /usr/soft/clickhouse-server/sub/ server03:/usr/soft/clickhouse-server/sub/SCP真香 。
然后就可以删除掉临时容器:docker rm -f temp-ch
配置集群

文章插图
这里三台服务器,每台服务器起2个CH实例,环状相互备份,达到高可用的目的,资源充裕的情况下,可以将副本Sub实例完全独立出来,修改配置即可,这个又是Clickhouse的好处之一,横向扩展非常方便 。
1.修改配置进入server1服务器,/usr/soft/clickhouse-server/sub/conf修改config.xml文件,主要修改内容:
原:81239000
2.新增集群配置文件metrika.xmlserver01,main主分片配置:
进入/usr/soft/clickhouse-server/main/conf文件夹内,新增metrika.xml文件(文件编码:utf-8) 。
server01,sub副本配置:
集群运行及测试在每一台服务器上依次运行实例,zookeeper前面已经提前运行,没有则需先运行zk集群 。
运行main实例:
docker run -d --name=ch-main -p 8123:8123 -p 9000:9000 -p 9009:9009 --ulimit nofile=262144:262144 \-v /usr/soft/clickhouse-server/main/data:/var/lib/clickhouse:rw \-v /usr/soft/clickhouse-server/main/conf:/etc/clickhouse-server:rw \-v /usr/soft/clickhouse-server/main/log:/var/log/clickhouse-server:rw \--add-host server01:172.192.13.10 \--add-host server02:172.192.13.11 \--add-host server03:172.192.13.12 \--hostname server01 \--network host \--restart=always \ yandex/clickhouse-server运行sub实例:
docker run -d --name=ch-sub -p 8124:8124 -p 9001:9001 -p 9010:9010 --ulimit nofile=262144:262144 \-v /usr/soft/clickhouse-server/sub/data:/var/lib/clickhouse:rw \-v /usr/soft/clickhouse-server/sub/conf:/etc/clickhouse-server:rw \-v /usr/soft/clickhouse-server/sub/log:/var/log/clickhouse-server:rw \--add-host server01:172.192.13.10 \--add-host server02:172.192.13.11 \--add-host server03:172.192.13.12 \--hostname server01 \--network host \--restart=always \ yandex/clickhouse-server在每台服务器执行命令,唯一不同的参数是hostname,因为我们前面已经设置了hostname来指定服务器,否则在执行select * from system.clusters查询集群的时候,将is_local列全为0,则表示找不到本地服务,这是需要注意的地方 。在每台服务器的实例都启动之后,这里使用正版DataGrip来打开:

文章插图
在任一实例上新建一个查询:
create table T_UserTest on cluster cluster_3s_1r(tsDateTime,uid String,biz String)engine = ReplicatedMergeTree('/clickhouse/tables/{layer}-{shard}/T_UserTest', '{replica}') PARTITION BY toYYYYMMDD(ts) ORDER BY ts SETTINGS index_granularity = 8192;cluster_3s_1r是前面配置的集群名称,需一一对应上,/clickhouse/tables/是固定的前缀,相关语法可以查看官方文档了 。

文章插图
刷新每个实例,即可看到全部实例中都有这张T_UserTest表,因为已经搭建zookeeper,很容易实现分布式DDL 。
继续新建Distributed分布式表:
CREATE TABLE T_UserTest_All ON CLUSTER cluster_3s_1r AS T_UserTest ENGINE = Distributed(cluster_3s_1r, default,T_UserTest, rand())每个主分片分别插入相关信息:
--server01insert intoT_UserTest values ('2021-08-16 17:00:00',1,1)--server02insert intoT_UserTest values ('2021-08-16 17:00:00',2,1)--server03insert intoT_UserTest values ('2021-08-16 17:00:00',3,1)然后查询分布式表select * from T_UserTest_All,

文章插图
查询对应的副本表或者关闭其中一台服务器的docker实例,查询也是不受影响,时间关系不在测试 。
到此这篇关于Clickhouse Docker集群配置及部署的文章就介绍到这了,更多相关Clickhouse Docker集群内容请搜索考高分网以前的文章或继续浏览下面的相关文章希望大家以后多多支持考高分网!
- 春季老年人吃什么养肝?土豆、米饭换着吃
- 三八妇女节节日祝福分享 三八妇女节节日语录
- 老人谨慎!选好你的“第三只脚”
- 校方进行了深刻的反思 青岛一大学生坠亡校方整改校规
- 脸皮厚的人长寿!有这特征的老人最长寿
- 长寿秘诀:记住这10大妙招 100%增寿
- 春季老年人心血管病高发 3条保命要诀
- 眼睛花不花要看四十八 老年人怎样延缓老花眼
- 香槟然能防治老年痴呆症? 一天三杯它人到90不痴呆
- 老人手抖的原因 为什么老人手会抖
