DisasterDrill

可编辑图源:drill-flow.excalidraw
DisasterDrill 用于验证备份和恢复链路。它可以针对单个 DisasterInstance,也可以针对 DisasterGroup。
状态机
演练状态包括:
Pending:创建后自检。Ready:校验通过,等待确认。Executing:执行恢复和扩容。Completed:演练完成。CleaningUp:清理中。CleanedUp:已清理。Failed:失败。
恢复模式
当前版本的演练执行链路固定使用 FullRestore:创建恢复对象,将资源和数据恢复到目标集群。DisasterDrill.status.restoreMode 中仍保留 Reuse 枚举,用于历史兼容和后续扩展;创建演练时没有 restoreMode 配置项。
关键配置
instanceName或groupName二选一。targetCluster可选,不填时通常使用实例 secondary cluster。namespaceMapping用于把源命名空间恢复到演练命名空间。restorePolicy可在演练级覆盖实例策略。confirmed控制从 Ready 进入 Executing。cleanup触发清理。
清理行为
如果配置了命名空间映射,清理通常删除演练命名空间或相关资源。未配置命名空间映射时,演练恢复可能覆盖目标集群同名命名空间中的资源,执行前需要确认目标集群和命名空间是否允许被演练链路写入。