创建服务网格

本文档说明如何创建单集群服务网格。在继续之前,请确保您已熟悉以下主题:

  • Mesh 部署模型:选择适合您需求的 mesh 部署模型。
  • Mesh 组件说明:了解 mesh 各组件的职责,并为服务网格预留必要的 CPU 和内存资源。

如需了解如何创建多集群服务网格,请参阅 Multi-Cluster Service Mesh 文档。

约束和限制

  • 每个集群只能部署一个服务网格。
  • 当集群为 global 集群,且平台处于灾备环境中(即 global 具有主集群和灾备集群)时,global 集群不能部署服务网格。
  • 当集群为 IPv4/IPv6 双栈网络时,无法部署服务网格。

前提条件

  • 已安装 Alauda Service Mesh Essentials Cluster Plugin

  • 下载与您的平台架构对应的以下安装包,并使用 Upload Packages 机制将包上传到 global 集群和目标集群(请不要手动安装)。

    • Alauda Service Mesh Operator
    • Flagger Operator
    • Alauda Build of Jaeger Operator
    • Alauda Build of OpenTelemetry Operator
    WARNING

    使用 violet push 上传 operators 时,不要添加 --target-catalog-source 参数——请使用 operator 中定义的默认 catalog source。

  • 确保集群已部署 Prometheus 插件或 VictoriaMetrics 插件。

    注意:当 VictoriaMetrics 采用多集群部署架构时,vmstorage 可以与服务网格位于不同的集群中。

  • 确保存在可用的 Elasticsearch。服务网格可以对接集群的 Elasticsearch 日志插件或您自己的 Elasticsearch。

  • 当集群为 OpenShift 集群时,还必须满足以下前提条件:

    • 已创建命名空间 istio-system
    • istio-system 命名空间添加到 anyuid SCC(Security Context Constraints)组中。为此,请登录 OpenShift 集群的 bastion host 并执行以下命令:
      oc adm policy add-scc-to-group anyuid system:serviceaccounts:istio-system

步骤

  1. 在左侧导航栏中,点击 Service Mesh > Mesh
  2. 点击 Create Service Mesh
  3. 选择要部署服务网格的集群和 Istio 版本。在高级配置中,确保 mesh 架构为单集群,并填写 Elasticsearch 和监控系统的接口参数。您可以选择平台现有系统或外部系统。
    • 如果对高可用性有严格要求,请将 Pod anti-affinity 设置为 mandatory。
    • 组件资源可以使用默认值,但随着 mesh 中服务规模的增长,组件也需要扩容。请及时为 mesh 组件配置告警策略,以便在需要扩容时收到通知。

更多信息,请参见 Mesh 参数说明

注意:当集群为 OpenShift 集群时,mesh 会默认自动检测并部署 istio-cni 组件。

后续步骤

  • 启用 Istio CNI,以消除每个 Pod 中对特权 init container 的需求。
  • 启用全局限流。
  • 使用 Istioctl 工具。
  • 监控 Mesh 组件。

Mesh 参数说明

全局配置

mesh 的全局配置将应用于部署该 mesh 的所有集群。

参数说明
与 Elasticsearch 对接平台:与平台任意集群上的 Elasticsearch 日志插件对接。请选择 Elasticsearch 日志插件所在的集群。
外部:与外部 Elasticsearch 日志插件对接。用户需要配置以下参数:
访问地址:Elasticsearch 的访问地址,以 http://https:// 开头。
认证方式:访问 Elasticsearch 的认证方式。
- Basic Auth:输入用于身份验证的用户名和密码。
- 无认证:访问时不需要认证。
与监控系统对接平台:与集群中的 Prometheus 插件或 VictoriaMetrics 插件对接。
外部:与外部插件提供的 Prometheus 或 VictoriaMetrics 对接。用户需要配置以下参数:
数据查询地址:监控组件的数据查询地址,以 http://https:// 开头。
认证方式:访问监控系统的认证方式。
- Basic Auth:输入用于身份验证的用户名和密码。
- 无认证:访问时不需要认证。
注意:由于 Prometheus 插件无法聚合来自多个集群的监控数据,因此该集群下的服务网格无法再添加更多集群以组成多集群服务网格。

集群维度配置

集群维度配置仅适用于所选集群。

参数说明
Sidecar 配置资源配额:集群级别的 sidecar 资源配额默认值。在为特定服务注入 sidecar 时,可根据实际情况修改,但不能超过 sidecar 所在命名空间容器配额(LimitRange)的最大限制。
Trace 配置采样率:集群级别的 sidecar trace 默认采样率。
Redis 配置仅在数据平面中使用 全局限流 功能时才需要配置。具体配置方法请参见启用全局限流。
HTTP 重试策略重试次数:集群级别的 HTTP 默认最大重试次数。
注意:服务路由 超时和重试 策略中的 重试次数 会覆盖该默认值。

组件配置

注意:mesh 组件以 Deployments 的形式部署在集群的特定命名空间中。成功创建 mesh 后,您可以在 Components 选项卡中查看组件的运行状态,或者点击 组件名称 跳转到该组件在 Container Platform 上部署的命名空间,并查看该运行中 Deployment 的详细信息。

参数说明
Pod Anti-AffinityKubernetes 会将组件 Pod 调度到满足 Pod Anti-Affinity 设置的节点上。
Mandatory:同一组件的 Pod 在同一节点上只允许运行一个。
Preferred:同一组件的多个 Pod 可以运行在同一节点上。Kubernetes 会根据调度算法尽量将该组件的 Pod 均匀调度到可用节点上,但不能保证每个节点上都有组件 Pod。
Instance Count组件 Pod 预计运行数量,请根据实际业务请求量设置。
Resource Quota组件在创建时每个容器实例的资源(CPU、内存)请求值(requests),同时也是该容器可用资源的限制值(limits)。请根据实际业务量和实例数量合理设置。
Deployment Node组件部署的节点。创建 mesh 时,该组件的 Pod 只能调度到所选节点上。
ELB华为云 Elastic Load Balancer(ELB),用于为 CCE 集群上的 Istio Gateway 提供负载均衡能力。当所选集群为 CCE 集群时,需要填写 ELB IDELB Type,以关联为该集群预先准备好的 ELB。
Total Resources在当前配置下创建该组件所有容器实例所需的总资源(CPU、内存)配额。当组件启用自动扩缩容时,将按最大实例数进行统计。