跳到主要内容

登录控制台并确认 operator、server、web 状态

控制台是教程中的主要操作入口。进入控制台前,先确认三类组件的职责和健康状态,后续排障会更快。

组件职责

组件主要职责常见排查入口
disaster-operator监听 CRD,执行备份、恢复、同步、切换、演练状态机Pod 日志、CRD status、Kubernetes Events
disaster-server提供 REST API、Watch API、认证、统计和 DTO 聚合server 日志、浏览器 Network、Swagger/OpenAPI
disaster-web平台控制台,调用 server API 展示任务和操作入口浏览器控制台、Network、Service 暴露方式

登录控制台

通过 NodePort 或端口转发访问 web:

http://<NodeIP>:30087

本地调试时常用:

http://127.0.0.1:8087

登录后先查看首页总览,确认平台能加载集群、备份、恢复和任务统计。

平台首页总览

Kubernetes 侧检查

kubectl get deploy,pods,svc -n disaster-system
kubectl get crd | grep testudo.softcdata.com
kubectl get events -n disaster-system --sort-by=.lastTimestamp

如果首页接口报错,优先查看 server 日志:

kubectl -n disaster-system logs deploy/disaster-server --tail=200

如果对象状态长时间不变化,查看 operator 日志:

kubectl -n disaster-system logs deploy/disaster-operator --tail=200

API 连通性检查

可以从本地或 Pod 内访问 server 健康接口和业务 API。具体路径以当前部署暴露为准,教程中常用业务 API 前缀包括:

  • /apis/cluster.testudo.softcdata.com/v1/clusters
  • /apis/storage.testudo.softcdata.com/v1/storages
  • /apis/policies.testudo.softcdata.com/v1/policies
  • /apis/appbackups.testudo.softcdata.com/v1/appbackups
  • /apis/disasterinstances.testudo.softcdata.com/v1/instances

状态异常时先看哪里

  • 页面能打开但列表为空:检查 server 是否有访问 CRD 的 RBAC。
  • 页面接口 502:检查 web 的 backendUrl 和 server Service。
  • 对象创建成功但不执行:检查 operator 是否 watch 到对应 CRD。
  • 任务失败但页面没有细节:进入 任务事件 页面或直接查看 Kubernetes Events。

后续教程都会在控制台中操作,同时给出必要的 API 或 CRD 等价路径。