跳至主要内容 跳至导航 跳至页脚

克隆或迁移正在运行的 Kubernetes 集群

集群整体搬走:节点、配置、数据全部带走。可以搬到另一台机器或另一个数据中心。整个切换过程只需几秒,而不是等上一整个周末。

问题所在

集群被锁定在最初部署的地方

Kubernetes 让应用随处运行,但集群本身做不到。数据始终存储在一个数据中心。想要迁移,就意味着一个重建项目:新节点、新存储、从备份恢复、重新测试。所以大多数团队从不迁移,而供应商对此心知肚明。

27% 的云支出每年都被浪费掉 1 Flexera 2024 年云计算状态报告
17% 组织平均云预算超支比例 2 Flexera 2025 年云计算状态报告
$0.09/GB 设计上让离开变得昂贵的出站流量费 3 AWS/Azure/GCP 定价 2024
46s
2 节点集群完整克隆
16s
迁移切换耗时(可精确测量)
1-5s
命名空间克隆
工作原理

整个集群就是一组文件

1

集群镜像加存储卷

每个节点都从一个镜像文件启动。每个存储卷都是一个 Ceph RBD 镜像。合在一起,就是整个集群:应用、配置和数据。

2

原地克隆

一条命令,写时复制克隆所有镜像。在我们实验室里,一个 2 节点集群 46 秒内完成克隆,父级集群全程保持运行。

3

短暂切换完成迁移

Rediacc 会在集群运行时预先复制数据,然后停止服务、发送最终增量,再在新机器上重新启动。实测切换时间:16 秒。

生产环境(数据中心 A) Running
Nodes 2 (k3s + Ceph)
Namespaces 8 apps
Volumes Ceph RBD
State Keeps running
克隆
46s
prod-staging(数据中心 B) Running
Nodes 2 (k3s + Ceph)
Namespaces 8 apps
Volumes Ceph RBD clones
State Own identity, new IPs
底层技术

为什么集群能像文件一样说搬就搬

每个节点都从 btrfs 上的一个镜像文件启动。每个存储卷都是一个 Ceph RBD 镜像。复制集群,就是对这些镜像做写时复制克隆。没有导出,没有格式转换,没有恢复步骤。这就是为什么克隆只需几秒,而不是几个月。

重要意义

保持 Kubernetes,获得集群流动性

保持 Kubernetes

Rediacc 可以运行 k3s,也可以接入现有的集群。存储卷基于 ceph-csi RBD。你的 Manifests 配置保持不变。

真正的数据中心迁移能力

支持在本地 KVM 主机部署,也支持 Linode 等提供私有 VLAN 的云服务。节点池自动隔离高磁盘需求的 Ceph 节点和高 CPU 需求的 Kubernetes 节点。

一套思路,管理一切

每个 Kubernetes 应用就是一个命名空间。像克隆任何仓库一样克隆它:1~5 秒完成,数据无损。操作命令和其他 Docker 仓库完全一样。

时间有限?

跳过深度解读,直接获取五分钟速览版,供团队站会阅读。

下载简版简报(PDF)
差距对比

没有别的工具能带着数据迁移运行中的集群

备份工具只能先停机再恢复。Cluster API 只克隆骨架,不带数据。RBD 镜像只复制存储卷,不复制整个集群。Rediacc 把这一切全部搬走。

为集群提供出口

克隆后测试迁移,验证无误后再正式切换。立即开始 14 天免费试用。

免费开始使用社区版
$ rdc cluster fork prod --tag staging