介绍
Alauda Data Services Analytical Database E1 是一项基于开源 ClickHouse® 构建的企业级实时分析数据库服务。它在 Kubernetes 上提供云原生部署、运维和完整的集群生命周期管理。
它是什么
一种面向列的 OLAP 引擎,用于对大型数据集执行实时查询和分析,并以 Kubernetes operator 的形式提供。您可以在自定义资源中声明所需的集群拓扑;operator 会生成并协调实现该拓扑的 StatefulSets、Services、ConfigMaps 和 PersistentVolumeClaims。
三个自定义资源均位于组 clickhouse.altinity.com/v1 中,并且均为命名空间级资源:
operator 以 OLM bundle 的形式交付。OLM package 名称为
clickhouse-operator,并安装到
operators 命名空间中。
amd64 和 arm64 均声明为受支持。
分片和复制
集群由分片和从节点组成的网格构成,声明为
spec.configuration.clusters[].layout.shardsCount 和 .replicasCount。分片保存数据中彼此独立的一部分;从节点是某个分片的完整副本。每个分片/从节点对(即一个 host)都对应一个独立的 StatefulSet,并且恰好承载一个 Pod。
复制本身由引擎执行,而不是由 operator 执行。*ReplicatedMergeTree
表引擎和 distributed_ddl 通过兼容 ZooKeeper 的
ensemble 进行协调,集群通过 spec.configuration.zookeeper.nodes 访问该 ensemble。operator 会将该地址写入每个 Pod 生成的 <zookeeper> 配置中,并将数据库模式传播到新添加的 host。
它不是什么
- 不是 OLTP 数据库。它专为面向大型数据集的读密集型分析扫描和聚合而构建,而不是用于事务性工作负载。
- 没有备份或恢复 API。三个自定义资源均不提供备份或恢复功能。数据保护必须在 operator 之外安排。
- 不会代为管理协调服务。CRD 明确说明,operator “不管理 Zookeeper”。您必须提供一个正在运行的兼容 ZooKeeper 的 ensemble,并将 CR 指向该 ensemble。此发行版中没有
ClickHouseKeeperInstallationCRD——随附的 bundle 恰好包含上文列出的三个 CRD。
由其他 Alauda 产品使用
Alauda Container Platform Log Storage for ClickHouse 是 Alauda Container Platform 日志服务的 ClickHouse 存储选项,依赖此 operator。有关将 ClickHouse 安装和运行作为日志存储的信息,请参阅日志文档。
版本
ClickHouse 是 ClickHouse, Inc. 的注册商标。https://clickhouse.com
Alauda 是独立供应商。本产品与 ClickHouse, Inc. 没有关联,也未获得其认可或赞助。所有商标均为其各自所有者的财产,此处仅用于标识目的。