跳到主要内容

创建第一个容灾实例

DisasterInstance 是用户最常接触的核心资源。它表达“保护哪个应用、从哪里同步到哪里、按什么策略恢复”。

前置条件

  • 源集群和目标集群都已注册并 Ready。
  • 对象存储已配置并可用。
  • 业务命名空间存在于源集群。
  • Velero 在业务集群中可正常备份恢复。

创建流程

  1. 创建或选择容灾同步策略,用于后续 DataSync 和 ResourceSync 调度。
  2. 创建容灾基础配置,选择主集群、备集群、S3 仓库、数据同步类型,并引用前一步创建的同步策略。
  3. 创建容灾实例配置,选择需要保护的命名空间或标签筛选器。
  4. 配置工作负载类型和高级选项,例如资源选择、资源定制化修改、批量修改和业务镜像前缀重写。
  5. 创建 DisasterInstance,等待实例进入保护状态。

先在 灾备策略管理 中创建 容灾同步策略。第一个容灾实例流程只需要选择容灾同步策略,用于定义 DataSync 和 ResourceSync 的同步触发时间。自动备份策略用于应用备份场景,不参与容灾基础配置。

灾备策略管理

创建策略时选择 容灾同步策略

创建灾备策略

容灾基础配置 页面,建立主备集群、存储仓库和同步策略之间的基础关系。

容灾基础配置

创建基础配置时,需要选择主集群、备集群、S3 仓库、数据同步类型,以及前面创建好的资源同步策略和数据同步策略。

创建容灾基础配置

最后进入 容灾实例配置,基于基础配置选择应用范围。

容灾实例配置

创建实例时,先选择容灾配置,再选择命名空间或标签筛选器。未选择容灾配置前,命名空间列表不会加载。

创建容灾实例配置

创建后发生什么

Operator 会调谐实例:

  1. Pending:实例刚创建。
  2. Initializing:创建或对齐 DataSyncResourceSync
  3. Protected:数据同步和资源同步都进入 Ready。

如果配置错误,实例可能进入 ConfigErrorFailed,应查看 status.reasonstatus.message、conditions 和事件。

验证

通过 API 查询:

curl /apis/disasterinstances.testudo.softcdata.com/v1/instances

或订阅 Watch:

curl /apis/disasterinstances.testudo.softcdata.com/v1/watch/instances

重点确认:

  • 实例 fsmStateProtected
  • DataSync.status.stateReady
  • ResourceSync.status.stateReady
  • 最近一次同步历史中 backup/restore 成功。