ClickHouse安装使用(单机、集群、高可用)

Clickhouse版本：20.3.6.40-2

安装包地址：https://repo.yandex.ru/clickhouse/rpm/stable/x86_64/

一、单机版

1、安装依赖

yum install libicu.x86_64

2、下载安装包

http://repo.yandex.ru/clickhouse/rpm/

3、安装

rpm -ivh *.rpm --force --nodeps

4、修改数据、日志目录

vi /etc/clickhouse-server/config.xml

5、创建相关目录

只需创建log文件目录即可

mkdir /bigdata/clickhouse

mkdir /bigdata/clickhouse/log

chown clickhouse:clickhouse /bigdata/clickhouse

chown clickhouse:clickhouse /bigdata/clickhouse/log

6、启动

/etc/init.d/clickhouse-server start

/etc/init.d/clickhouse-server stop

7、登录

由于9000与其它服务端口冲突，故tcp端口更改为9011

clickhouse-client --host localhost --port 9011

二、集群版

1、修改配置文件（三分片、单副本）

分别在三个节点都创建文件，红色字体每个节点配置不一样

vim /etc/metrika.xml

<yandex>

    <clickhouse_remote_servers>

        <cluster-01>

            <shard>

                <internal_replication>true</internal_replication>

                <replica>

                    <host>spbsjzy19</host>

                    <port>9011</port>

                    <user>rt</user>

                    <password>SPBsjzy@)@)</password>

                </replica>

            </shard>

            <shard>

                <internal_replication>true</internal_replication>

                <replica>

                    <host>spbsjzy20</host>

                    <port>9011</port>

                    <user>rt</user>

                    <password>SPBsjzy@)@)</password>

                </replica>

            </shard>

            <shard>

                <internal_replication>true</internal_replication>

                <replica>

                    <host>spbsjzy21</host>

                    <port>9011</port>

                    <user>rt</user>

                    <password>SPBsjzy@)@)</password>

                </replica>

            </shard>

        </cluster-01>

    </clickhouse_remote_servers>

    <zookeeper-servers>

        <node index="1">

            <host>spbsjzy33</host>

            <port>2181</port>

        </node>

        <node index="2">

            <host>spbsjzy34</host>

            <port>2181</port>

        </node>

        <node index="3">

            <host>spbsjzy35</host>

            <port>2181</port>

        </node>

    </zookeeper-servers>

     <macros>

      <cluster>cluster-01</cluster>

      <shard>01</shard>

      <replica>spbsjzy19</replica>

     <!-- <shard>02</shard>

      <replica>spbsjzy20</replica>

      <shard>03</shard>

      <replica>spbsjzy21</replica>

-->

    </macros>

    <clickhouse_compression>

        <case>

            <min_part_size>10000000000</min_part_size>

            <min_part_size_ratio>0.01</min_part_size_ratio>

            <method>lz4</method>

        </case>

    </clickhouse_compression>

</yandex>

注意：

1) <macros> </macros>中的shard名

三个节点配置相同则在任意一个节点插入数据，其他节点都会查询到；不相同的话复制表之间数据不会同步(插入分布表，数据会随机分配到某个节点的复制表；插入任意一个节点的复制表，分布表可以查询到，其他节点复制表无法查到)

2) <macros> </macros>中 <cluster>表示集群名称，<shard>表示分片编号，<replica>表示副本标识，这里使用了cluster{cluster}-{shard}-{replica}的表示方式

3) <internal_replication>

如果设置为true，则往本地表写入数据时，总是写入到完整健康的副本里，然后由表自身完成复制，这就要求本地表是能自我复制的（推荐）。如果设置为false，则写入数据时，是写入到所有副本中。这时，是无法保证一致性的

4) <user></user><password></password>

添加完后使用默认default用户也可以查询分布表。

相关报错信息：

ru.yandex.clickhouse.except.ClickHouseException: ClickHouse exception, code: 516, host: spbsjzy20, port: 8123; Code: 516, e.displayText() = DB::Exception: Received from spbsjzy19:9011. DB::Exception: default: Authentication failed: password is incorrect or there is no user with such name. (version 20.3.6.40 (official build))

2、修改配置

vim /etc/clickhouse-server/config.xml

把注释打开，否则节点之间无法访问，分布表也无法查询其它节点数据

3、建议

生产中建议一般采用复制表和分布表；先创建复制表而后创建分布表，复制表用来存储数据，分布表用来查询和写入

ReplacingMergeTree:

4、创建表

分别在三个节点创建复制表：

CREATE TABLE default.test (`eventdate` Date, `company` String, `deliveryno` String, `usercardtype` String, `id` String, `name` String, `mob` String, `orgcode` String, `creditcode` String, `taxregno` String, `type` String, `cardid` String, `staffna` String, `staffmob` String, `staffaddress` String, `checkdate` String, `method` String, `address` String, `utcdate` DateTime DEFAULT now()) ENGINE = ReplicatedMergeTree('/clickhouse/tables/{shard}/test', '{replica}', eventdate, (eventdate, company, deliveryno, id, mob, name), 8192)

在一个节点创建分布表：

CREATE TABLE default.test_all (`eventdate` Date, `company` String, `deliveryno` String, `usercardtype` String, `id` String, `name` String, `mob` String, `orgcode` String, `creditcode` String, `taxregno` String, `type` String, `cardid` String, `staffna` String, `staffmob` String, `staffaddress` String, `checkdate` String, `method` String, `address` String, `utcdate` DateTime DEFAULT now()) ENGINE = Distributed('{cluster}', 'default', 'test', rand())

5、插入表

insert into test(eventdate,company,deliveryno,id) VALUES('2020-12-05','ff','vv','xx');

insert into test_all(eventdate,company,deliveryno,id) VALUES('2020-12-06','xx','vv','xx');

6、数据分布测试

（1）三张复制表分别执行

insert into test(eventdate,company,deliveryno,id) VALUES('2020-12-07','ff','vv','xx');

insert into test(eventdate,company,deliveryno,id) VALUES('2020-12-08','ff','vv','xx');

insert into test(eventdate,company,deliveryno,id) VALUES('2020-12-09','ff','vv','xx');

查询复制表：

查询分布表

（2）插入分布表（随机分布）

insert into test_all(eventdate,company,deliveryno,id) VALUES('2020-12-07','xx','vv','xx');

insert into test_all(eventdate,company,deliveryno,id) VALUES('2020-12-08','xx','vv','xx');

查询复制表

查询分布表

7、节点宕机测试

ClickHouse安装使用(单机、集群、高可用)的更多相关文章

openstack pike 集群高可用安装部署目录汇总
# openstack pike 集群高可用安装部署#安装环境 centos 7 史上最详细的openstack pike版部署文档欢迎经验分享,欢迎笔记分享欢迎留言,或加QQ群663105353 ...
Rabbitmq集群高可用测试
Rabbitmq集群高可用 RabbitMQ是用erlang开发的,集群非常方便,因为erlang天生就是一门分布式语言,但其本身并不支持负载均衡. Rabbit模式大概分为以下三种:单一模式.普通模 ...
浅谈MySQL集群高可用架构
前言高可用架构对于互联网服务基本是标配,无论是应用服务还是数据库服务都需要做到高可用.对于一个系统而言,可能包含很多模块,比如前端应用,缓存,数据库,搜索,消息队列等,每个模块都需要做到高可用,才能 ...
bitmq集群高可用测试
Rabbitmq集群高可用 RabbitMQ是用erlang开发的,集群非常方便,因为erlang天生就是一门分布式语言,但其本身并不支持负载均衡. Rabbit模式大概分为以下三种:单一模式.普通模 ...
mysql集群高可用架构
前言高可用架构对于互联网服务基本是标配,无论是应用服务还是数据库服务都需要做到高可用.对于一个系统而言,可能包含很多模块,比如前端应用,缓存,数据库,搜索,消息队列等,每个模块都需要做到高可用,才能 ...
hadoop+zookeeper集群高可用搭建
hadoop+zookeeper集群高可用搭建 Senerity 发布于 2 ...
RabbitMQ从零到集群高可用(.NetCore5.0) -高可用集群构建落地
系列文章: RabbitMQ从零到集群高可用(.NetCore5.0) - RabbitMQ简介和六种工作模式详解 RabbitMQ从零到集群高可用(.NetCore5.0) - 死信队列,延时队列 ...
Eureka 集群高可用配置.
SERVER:1 server: port: 1111 eureka: instance: hostname: ${spring.cloud.client.ip-address} instance-i ...
集群高可用之lvs+keepalive
集群高可用之lvs+keepalive keepalive简介: 负载均衡架构依赖于知名的IPVS内核模块,keepalive由一组检查器根据服务器的健康情况动态维护和管理服务器池.keepalive ...
RabbitMQ从零到集群高可用(.NetCore5.0) - 死信队列，延时队列
系列文章: RabbitMQ从零到集群高可用(.NetCore5.0) - RabbitMQ简介和六种工作模式详解 RabbitMQ从零到集群高可用(.NetCore5.0) - 死信队列,延时队列 ...

随机推荐

BIOS、UEFI、Boot Loader都是些什么
BIOS.UEFI.Boot Loader都是些什么目录 BIOS.UEFI.Boot Loader都是些什么什么是BIOS 基本的输入输出是什么自检程序"检"了什么系统自 ...
EasyX 简易绘图工具接口整理
EasyX Library for C++ (Ver:20190415(beta)) http://www.easyx.cn EasyX.h 1 #pragma once 2 3 #ifndef ...
基数排序（Radix Sort）
基数排序(Radix Sort) 第一趟:个位收集: 第二趟:十位第三趟:百位 3元组基数排序--不是基于"比较"的排序算法递增就是把收集的过程返过来算法效率分析需要r ...
QQ电话能定位
QQ电话是网络电话,可以定位吗??? 下面介绍利用wireshark获取QQ好友IP实施精准定位超详!! Wireshark Wireshark是一个使用WinPcap作为接口,直接与网卡进行数据报 ...
babel 与 ast
什么是 babel Babel 是一个工具链,主要用于将 ECMAScript 2015+ 版本的代码转换为向后兼容的 JavaScript 语法,以便能够运行在当前和旧版本的浏览器或其他环境中. 什 ...
matplotlib的学习14-图中图
# 导入pyplot模块 import matplotlib.pyplot as plt # 初始化figure fig = plt.figure() # 创建数据 x = [1, 2, 3, 4, ...
sqli-labs 18-19 --Header_injection
sqli-labs 18 知识点头部注入报错注入使用的函数: updatexml (XML_document, XPath_string, new_value); 第一个参数:XML_docum ...
Tensorflow环境配置&安装
Tensorflow环境配置&安装明知故犯,是不想有遗憾. 背景:Tensorflow 环境配置和安装. 一.安装 Anaconda 二.建立.激活.安装.验证.使用 Tensorflow ...
frp杀毒软件报毒？
原文地址:https://wuter.cn/1909.html/ 部分用户下载frp之后,windows defender可能会报毒,并且自动删除内网穿透主程序,导致无法穿透. 首先看一下报毒的原理是 ...
NAT、端口映射、内网穿透、公网IP都是啥
原文地址:https://wuter.cn/1756.html/ 一.IPv4地址 IP协议是为计算机网络相互连接进行通信而设计的协议,它是能使连接到网上的所有计算机网络实现相互通信的一套规则. 这里 ...

ClickHouse安装使用(单机、集群、高可用)

ClickHouse安装使用(单机、集群、高可用)的更多相关文章

随机推荐

热门专题