郑州联通智算项目 "算力即服务"模式 构建安全可控智算底座
采用算力服务型采购模式,以国产训练服务器与智算平台软件构建100P训推一体云算力服务能力,为期三年持续提供安全可靠的算力支撑,推动大模型训练与AI应用高质量发展。
背景与挑战
随着人工智能及大模型技术的快速发展,郑州瀚博创芯科技有限公司在智能计算和模型训练方面面临日益增长的算力需求。然而,传统硬件采购模式投入大、折旧快、运维重,难以灵活匹配业务节奏。 同时,算力供应链安全成为关键关切——依赖进口芯片存在不确定性,国产化替代势在必行。如何在控制成本的前提下,快速获取高规格、可持续、安全可控的训推一体算力能力,成为亟待解决的核心命题。
-
算力需求缺口大
大模型训练与推理对算力规格要求高,企业自有算力难以满足峰值需求
-
重资产投入压力
传统硬件采购模式固定资产投资大、折旧风险高,运维团队建设成本沉重
-
供应链安全风险
进口芯片供应存在不确定性,算力基础设施国产化替代需求迫切
-
服务质量难保障
缺乏明确的服务等级协议与赔偿机制,算力服务的稳定性与可用性难以约束
解决方案
采用"算力即服务"模式,以国产训练服务器与国产算力智算平台软件为核心,构建100P训推一体云算力服务能力。设备产权归服务方所有,用户按需使用算力服务,三年服务周期内持续获得安全可靠的高性能算力支撑,实现轻资产运营与供应链安全双重目标。
HARDWARE — 国产算力硬件层
32台国产训练服务器;3台业务管理服务器;400G RoCE计算网络;热存储与通用存储系统
PLATFORM — 智算平台软件层
国产算力智算平台;模型适配与调优服务;云集成与部署服务;多层级网络交换管理
SERVICE — 算力服务交付层
100P训推一体算力;三年持续服务保障;按季度服务交付;SLA等级协议约束
核心特点
国产化导向,全栈自主可控
采用国产训练服务器与国产算力智算平台软件,从硬件到平台层全面实现国产化替代,有效保障算力供应链安全可控,为后续更大规模算力建设奠定技术基础与实践经验。
服务化交付,轻资产运营
以算力服务形式交付,用户按需使用算力能力,无需承担硬件采购成本与运维管理压力。设备产权归服务方所有,有效降低固定资产投资风险与运营负担。
高规格配置,满足大模型训练
采用400G RoCE高速计算网络与高性能GPU训练服务器,构建100P训推一体算力能力。多层级网络交换设备与热存储系统协同,全面满足大语言模型训练与推理的高性能计算需求。
完善SLA,服务质量有保障
建立明确的服务等级协议与赔偿机制,配套全套安全防护设备与软件,从算力可用性、服务响应到安全保障形成完整闭环,确保三年服务周期内算力服务的稳定可靠运行。
应用场景展示
收益与价值
以服务化模式构建安全可控的国产智算底座,推动AI与大模型领域高质量发展。