跳到主要内容

DisasterDrill

DisasterDrill 流程图

可编辑图源:drill-flow.excalidraw

DisasterDrill 用于验证备份和恢复链路。它可以针对单个 DisasterInstance,也可以针对 DisasterGroup

状态机

演练状态包括:

  • Pending:创建后自检。
  • Ready:校验通过,等待确认。
  • Executing:执行恢复和扩容。
  • Completed:演练完成。
  • CleaningUp:清理中。
  • CleanedUp:已清理。
  • Failed:失败。

恢复模式

当前版本的演练执行链路固定使用 FullRestore:创建恢复对象,将资源和数据恢复到目标集群。DisasterDrill.status.restoreMode 中仍保留 Reuse 枚举,用于历史兼容和后续扩展;创建演练时没有 restoreMode 配置项。

关键配置

  • instanceNamegroupName 二选一。
  • targetCluster 可选,不填时通常使用实例 secondary cluster。
  • namespaceMapping 用于把源命名空间恢复到演练命名空间。
  • restorePolicy 可在演练级覆盖实例策略。
  • confirmed 控制从 Ready 进入 Executing。
  • cleanup 触发清理。

清理行为

如果配置了命名空间映射,清理通常删除演练命名空间或相关资源。未配置命名空间映射时,演练恢复可能覆盖目标集群同名命名空间中的资源,执行前需要确认目标集群和命名空间是否允许被演练链路写入。