登录控制台并确认 operator、server、web 状态
控制台是教程中的主要操作入口。进入控制台前,先确认三类组件的职责和健康状态,后续排障会更快。
组件职责
| 组件 | 主要职责 | 常见排查入口 |
|---|---|---|
disaster-operator | 监听 CRD,执行备份、恢复、同步、切换、演练状态机 | Pod 日志、CRD status、Kubernetes Events |
disaster-server | 提供 REST API、Watch API、认证、统计和 DTO 聚合 | server 日志、浏览器 Network、Swagger/OpenAPI |
disaster-web | 平台控制台,调用 server API 展示任务和操作入口 | 浏览器控制台、Network、Service 暴露方式 |
登录控制台
通过 NodePort 或端口转发访问 web:
http://<NodeIP>:30087
本地调试时常用:
http://127.0.0.1:8087
登录后先查看首页总览,确认平台能加载集群、备份、恢复和任务统计。

Kubernetes 侧检查
kubectl get deploy,pods,svc -n disaster-system
kubectl get crd | grep testudo.softcdata.com
kubectl get events -n disaster-system --sort-by=.lastTimestamp
如果首页接口报错,优先查看 server 日志:
kubectl -n disaster-system logs deploy/disaster-server --tail=200
如果对象状态长时间不变化,查看 operator 日志:
kubectl -n disaster-system logs deploy/disaster-operator --tail=200
API 连通性检查
可以从本地或 Pod 内访问 server 健康接口和业务 API。具体路径以当前部署暴露为准,教程中常用业务 API 前缀包括:
/apis/cluster.testudo.softcdata.com/v1/clusters/apis/storage.testudo.softcdata.com/v1/storages/apis/policies.testudo.softcdata.com/v1/policies/apis/appbackups.testudo.softcdata.com/v1/appbackups/apis/disasterinstances.testudo.softcdata.com/v1/instances
状态异常时先看哪里
- 页面能打开但列表为空:检查 server 是否有访问 CRD 的 RBAC。
- 页面接口 502:检查 web 的
backendUrl和 server Service。 - 对象创建成功但不执行:检查 operator 是否 watch 到对应 CRD。
- 任务失败但页面没有细节:进入 任务事件 页面或直接查看 Kubernetes Events。
后续教程都会在控制台中操作,同时给出必要的 API 或 CRD 等价路径。