Customer story · Electronics manufacturing

LCFC: Container Platform Upgrade and Optimization

联宝科技的核心任务是在不影响现有生产业务的前提下,完成容器平台升级、集群标准化和保障能力补齐,并向全球化、集群联邦与云边端演进。
Platform upgradeMigrationRuntime optimization
01

管理单元

多集群联邦
02

场景范围

云边端
03

保障能力

备份恢复
04

交付视角

全球部署

Background

The existing container platform needed to support newer technology versions and operational requirements.

Core challenge

The upgrade had to balance business continuity, compatibility, and long-term operability.

Customer context and needs

Clarify the problems before defining the program

Pain points

管理平台版本过低

多套 Rancher 版本偏旧,对高版本 Kubernetes 纳管和长期安全维护造成约束。

集群标准不一致

集群版本、资源模式、建设标准和架构实践存在差异,稳定性与维护复杂度难以统一控制。

备份恢复机制不完整

管理平台和业务集群缺少完整的备份、恢复与容灾设计,故障后难以快速准确恢复。

跨区域交付与运维分散

国内多数据中心、越南工厂、公有云和未来海外节点之间缺少统一发布、调度和观测机制。

Requirements

安全升级管理平台和业务集群

依次完成兼容性评估、验证环境、平台升级、集群改造和应用迁移,同时保留回退路径。

补齐基础保障能力

完善管理平台和业务集群备份、镜像分发、监控告警、日志、安全与统一认证。

建立多集群统一应用模型

实现应用一次建模、多区域分发、统一策略下发、跨集群弹性与多版本灰度。

支撑全球工厂与云边端

总部统一开发和交付,区域中心自治管理,工厂边缘就近处理生产数据,并按合规要求路由数据。

Goals

Translate business needs into verifiable goals

  1. 01Complete a safe platform upgrade

    依次完成兼容性评估、验证环境、平台升级、集群改造和应用迁移,同时保留回退路径。

  2. 02Optimize the platform architecture

    完善管理平台和业务集群备份、镜像分发、监控告警、日志、安全与统一认证。

  3. 03Establish continuous operations

    实现应用一次建模、多区域分发、统一策略下发、跨集群弹性与多版本灰度。

Solution

Platform, workload, and dependency assessment followed by a phased upgrade and modernization program.

01

基础能力优化

容器管理平台、业务集群、GPU 集群、网络、存储、安全、IAM 与 DevOps 集成。

02

备份、容灾和镜像治理

对管理平台和业务集群分别建立 S3 备份,优化 Harbor 分发,明确业务连续性的 RPO/RTO。

03

集群联邦和全球化

以 Rancher 分区管理集群,Karmada 统一发布和调度,支持总部开发、全球部署和多区域观测。

04

云边端与工厂边缘

总部、区域中心和工厂边缘分层部署,应用统一编排,实时数据边缘处理,观测在中心汇聚。

Key architecture

多集群联邦与全球化架构

以总部交付中心为起点,连接多数据中心、海外区域和工厂边缘。
01

业务应用与数据

全球生产和管理场景

MES供应链设备接入质量与工艺数据服务全球工厂应用
02

统一应用交付

总部开发,多区域发布

DevOps一次构建多集群分发灰度发布快速回滚镜像同步
03

多集群统一控制

分区管理与联邦调度

KarmadaRancher跨集群弹性策略下发配置管理故障域隔离
04

多中心与云边端

按区域和生产环境分层承载

HF 数据中心A2 同城中心VN 数据中心公有云区域中心工厂边缘
05

统一保障与治理

观测、安全和连续性

全局观测日志汇聚IAM容器安全S3 备份RPO / RTO

Implementation journey

A phased path from assessment to sustainable operations

  1. 01
    Assess state and dependencies

    Map platform versions, plugins, workloads, data, and operational dependencies.

  2. 02
    Upgrade and migrate in waves

    Verify compatibility, then migrate workloads through controlled batches.

  3. 03
    Observe cutover and optimize

    Complete the transition with reversible cutover, observation, and issue closure.

Implementation principle

Validation, migration, cutover, and operational observation were used to control upgrade risk.

Results

Outcomes across efficiency, quality, resilience, and operations

01

升级风险可控

通过现状盘点、依赖识别、兼容测试、分批迁移和可回退切换,在保障业务的同时完成平台演进。

02

跨集群能力提升

统一应用模型与联邦调度提升跨集群发布、弹性、容灾和服务可用性。

03

全球运行一致性

国内中心、海外区域、公有云和工厂节点建立共同的交付、观测和治理框架。

04

业务保障能力提升

备份恢复、多中心、故障域隔离和分层容灾设计缩小故障影响范围。

Future evolution

Capabilities continue to evolve after platform launch

Continuous version and capacity governance

Turn upgrade experience into repeatable version, health, capacity, and operations baselines.

Capability tags

Platform upgradeMigrationRuntime optimization