![]() |
全新云原生平台将加速卡算力平均利用率由 35% 提升至超过 60%,每处理 100 万个 token 的推理成本下降逾 60%
核心亮点
- 中国领先商业银行之一 China Merchants Bank 在 KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026 的 CNCF 最终用户案例研究大赛中胜出。
- 获奖方案基于 Kueue、KEDA、Prometheus、HAMi 和 Fluid 构建 Kubernetes 统一控制平面,支持 AI 训练、微调和在线推理共享近 1 万张异构加速卡。
- 通过将 99% 的加速卡算力资源纳入统一框架,该行将平均利用率由 35% 提升至超过 60%,并将每处理 100 万个 token(输入和输出合计)的成本降低逾 60%。
- 该行自主研发的 Twinkle 训练框架默认支持 5 个 LoRA 租户共享 1 个基座模型实例,使该配置下的加速卡资源用量减少 80%,训练密度提高至原来的 5 倍。
上海2026年9月8日 美通社 -- Cloud Native Computing Foundation®(CNCF®)今日宣布,中国领先商业银行之一 China Merchants Bank 在 KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026 的 CNCF 最终用户案例研究大赛中胜出。
CNCF 首席技术官 Chris Aniszczyk 表示:“随着 AI 工作负载不断拓展至金融等关键基础设施领域,支撑这些负载的核心技术必须发挥更大效能,同时避免成本成倍增长。China Merchants Bank 统一 AI 训练与推理的实践清晰地表明,基于 CNCF 项目构建的可组合、厂商中立基础设施,能够在大规模应用中实现可量化的效率提升。”
China Merchants Bank 的 AI 基础设施团队将 Kubernetes 与 Kueue、KEDA、Prometheus、HAMi 和 Fluid 相结合,构建统一控制平面,让模型训练、微调和在线推理共享近 1 万张异构加速卡。通过与数据中心及其他团队密切协作,该团队将全行 99% 的加速卡算力资源纳入统一框架,使近 1 万张加速卡的平均利用率由 35% 提升至超过 60%。同时,在模型和服务条件可比的情况下,每处理 100 万个 token(输入和输出合计)的成本下降逾 60%。
China Merchants Bank AI 基础设施架构师 PeiXiang Tan 表示:“在 China Merchants Bank,我们通过软件创新释放硬件潜能。平台构建于统一的云原生基础架构之上,集异构算力池化、训练作业调度、推理弹性扩缩容、数据与模型访问加速,以及端到端可观测能力于一体。这使训练和推理能够根据各自工作负载的特点运行,同时保持紧密协同,让每一份算力持续创造更大价值。”
随着 AI 在金融领域的应用场景不断拓展,China Merchants Bank 发现,训练、推理和多租户微调对同一套硬件有着显著不同的需求。分布式训练需要稳定、可预测的算力供给,但在等待其余工作节点或加速卡就绪时,算力可能出现闲置;在线推理则需要根据难以预测的流量变化快速扩缩容。为协调这些相互竞争的资源需求,该行构建了一套可组合架构,在共享基础设施的同时,将训练与推理的运行时解耦:Kueue 负责训练作业的准入、队列和配额管理,避免作业在具备运行条件前预占算力;KEDA 和 Prometheus 根据实时需求信号,对在线推理服务进行扩缩容;HAMi 以细粒度方式为训练和推理两条执行路径分配共享加速卡资源;Fluid 则加速对数据集、模型权重和检查点的访问,减少加速卡等待数据的时间。
China Merchants Bank 自主研发的 Twinkle 训练框架进一步提升了多租户微调的效率,默认支持 5 个 LoRA 租户共享 1 个基座模型实例。通过将基座模型副本数从 5 个减少至 1 个,该配置下的加速卡资源用量降低了 80%,训练密度则提高至原来的 5 倍。
China Merchants Bank 此前曾发布多篇有关 AI 基础设施实践的 CNCF 案例研究。其中一篇详细介绍了基于 Kubernetes 和 HAMi 的调度平台:该平台通过拓扑感知调度,实现了 100% 的硬件资源池利用率,并使分布式训练工作负载的跨机器调度减少 30%。
China Merchants Bank 计划在现有成果的基础上持续推进,重点聚焦四个方向:一是动态调整多租户训练并发度;二是整合利用率、队列状态和时延信号,实施以单位成本为依据的容量管理;三是扩展 KEDA 以支持无服务器推理,使推理服务能够在需求高峰间隙缩容至零;四是扩大基于 HAMi 的异构加速器支持范围,同时接入更多训练和推理后端。
China Merchants Bank 的获奖消息已在 KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 的一场主题演讲中现场公布。
如需了解完整的架构实现及后续成效,请阅读 China Merchants Bank 的完整案例研究。
更多资源
-
新型电网建设加快推进 绿能科创强化绿色能源系统创新支撑9月1日,国家能源局召开新型电网建设工作部署会,国家电投发起实施的绿能科创专项工程正发挥连接技术攻关、工程验证和成果转化的作用,为新能源系统能力提升和新型电网2026-09-08
-
德国唯宝集团连续第二年荣获EcoVadis铂金奖牌,可持续发展评级再创新高全球知名的陶瓷与卫浴五金制造商,德国唯宝集团连续第二年荣获全球权威可持续发展评估机构EcoVadis授予的最高等级——铂金奖牌。本次评估中,唯宝集团成绩再获大幅提2026-09-08
-
China Merchants Bank 凭借基于 Kubernetes 的 AI 训练与推理一体化实践,在 CNCF 最终用户案例研究大赛中胜出全新云原生平台将加速卡算力平均利用率由 35% 提升至超过 60%,每处理 100 万个 token 的推理成本下降逾 60% 核心亮点 * 中国领先商业银行之一 China Merchants Ba2026-09-08
-
Tozorakimab在OBERON和TITANIA两项Ⅲ期临床试验中,在降低慢阻肺病急性加重方面均显示出统计学和临床意义上的显著改善Tozorakimab在不同血嗜酸性粒细胞水平患者中均显示临床获益 完整结果已发表于《新英格兰医学杂志》,并在2026年欧洲呼吸学会(ERS)年会上进行报告 Tozorakimab用于2026-09-08
-
TCL在IFA 2026上斩获30余项国际大奖,显示技术、AI与智慧生活前沿创新获行业认可柏林2026年9月8日 美通社 -- 全球消费电子领军企业、Mini LED及超大屏【1】电视全球第一品牌TCL宣布,公司在IFA 2026上斩获超30项荣誉,其中包含7项“IFA Innovation2026-09-08
-
AMD股价暴跌17%创近9年之最,苏姿丰紧急回应:AI增速远超想象
-
Ledger 中国销售渠道说明:广州馨潇贸易有限公司官方直营渠道公示
-
江苏省脑机接口产业联盟在宁成立,麦澜德分享前沿成果
-
艾芬达入选国家知识产权强国建设示范创建对象:二十载长期主义,兑现每一份用户价值
-
Esentia宣布成功完成2033年到期的6.125%优先票据和2038年到期的6.500%优先票据的定价
-
中荷人寿北京分公司成功举办中荷创享家品牌发布暨协同发展启航仪式
-
华为系具身智能公司具脑磐石完成新一轮融资:对标JEPA,押注类脑智能的认知世界模型
-
北京暑假补习班有哪些?家长首推一对一权威机构金博升学
-
上海高新技术企业代理机构深度访谈与推荐
-
2026 雷瓦亮相京东 MALL ,匠心筑造专业造型新标杆

