介绍

Alauda Data Services Analytical Database E1 是一项基于开源 ClickHouse® 构建的企业级实时分析数据库服务。它在 Kubernetes 上提供云原生部署、运维和完整的集群生命周期管理。

它是什么

一种面向列的 OLAP 引擎,用于对大型数据集执行实时查询和分析,并以 Kubernetes operator 的形式提供。您可以在自定义资源中声明所需的集群拓扑;operator 会生成并协调实现该拓扑的 StatefulSets、Services、ConfigMaps 和 PersistentVolumeClaims。

三个自定义资源均位于组 clickhouse.altinity.com/v1 中,并且均为命名空间级资源:

KindShort namePurpose
ClickHouseInstallationchi一个数据库集群:其拓扑、设置和用户
ClickHouseInstallationTemplatechit合并到 CHI 中的可复用片段
ClickHouseOperatorConfigurationchopconfoperator 全局行为

operator 以 OLM bundle 的形式交付。OLM package 名称为 clickhouse-operator,并安装到 operators 命名空间中。 amd64arm64 均声明为受支持。

分片和复制

集群由分片和从节点组成的网格构成,声明为 spec.configuration.clusters[].layout.shardsCount.replicasCount。分片保存数据中彼此独立的一部分;从节点是某个分片的完整副本。每个分片/从节点对(即一个 host)都对应一个独立的 StatefulSet,并且恰好承载一个 Pod。

复制本身由引擎执行,而不是由 operator 执行。*ReplicatedMergeTree 表引擎和 distributed_ddl 通过兼容 ZooKeeper 的 ensemble 进行协调,集群通过 spec.configuration.zookeeper.nodes 访问该 ensemble。operator 会将该地址写入每个 Pod 生成的 <zookeeper> 配置中,并将数据库模式传播到新添加的 host。

它不是什么

  • 不是 OLTP 数据库。它专为面向大型数据集的读密集型分析扫描和聚合而构建,而不是用于事务性工作负载。
  • 没有备份或恢复 API。三个自定义资源均不提供备份或恢复功能。数据保护必须在 operator 之外安排。
  • 不会代为管理协调服务。CRD 明确说明,operator “不管理 Zookeeper”。您必须提供一个正在运行的兼容 ZooKeeper 的 ensemble,并将 CR 指向该 ensemble。此发行版中没有 ClickHouseKeeperInstallation CRD——随附的 bundle 恰好包含上文列出的三个 CRD。

由其他 Alauda 产品使用

Alauda Container Platform Log Storage for ClickHouse 是 Alauda Container Platform 日志服务的 ClickHouse 存储选项,依赖此 operator。有关将 ClickHouse 安装和运行作为日志存储的信息,请参阅日志文档

版本

组件
Operand 镜像middleware/clickhouse-server:v25.8.33.6-30274dd7
ClickHouse® 引擎25.8.33.6
OLM packageclickhouse-operator

ClickHouse 是 ClickHouse, Inc. 的注册商标。https://clickhouse.com

Alauda 是独立供应商。本产品与 ClickHouse, Inc. 没有关联,也未获得其认可或赞助。所有商标均为其各自所有者的财产,此处仅用于标识目的。