CORE CAPABILITIES
核心能力
万卡集群建设与调优能力,IB/RoCE 双网络架构与全液冷绿色散热,省级算力调度平台统一纳管多地异构算力。
GPU CLUSTERS
高端 GPU 集群
已交付 H200 千 P 级集群、500 台 5090 集群,B300 集群持续扩建,并开展国产 GPU 信创试点。

| GPU 型号 | 类型 | 算力等级 | 应用场景 |
|---|---|---|---|
| NVIDIA H100 / H200 | 进口高端 | 千 P 级集群 | 大模型训练 |
| NVIDIA B300 | 进口旗舰 | 2500P+ 持续扩建 | 训练 + 推理 |
| NVIDIA 5090 | 进口中端 | 千 P 级集群 | 边缘推理 |
| 沐曦 C500 | 国产 | 试点 50P 集群 | 信创替代 |
| 摩尔线程 S5000 | 国产 | 试点 100P 集群 | 信创替代 |
SCHEDULING PLATFORM
闽江流域算力调度平台
省级智能算力操作系统,自研异构混训与跨域调度服务平台。

以省级智能算力操作系统统一纳管跨区域异构算力,打通训练、微调到推理的全栈流程,为大模型与行业应用提供稳定、弹性、可调度的算力底座。
4500P+
已接入可调度算力
<50ms
跨区调度延迟
99.95%
平台可用性
六种芯片
统一纳管调度
异构算力统一调度
支持 NVIDIA、摩尔线程、华为昇腾、沐曦等六种主流芯片统一对接;基于 Kubernetes 与自研 Device Operator 实现卡级拓扑感知,支持十万级 Pod 并发。
智能调度算法
训练任务完成时间缩短 35%,推理延迟降低 28%,GPU 虚拟化下调度延迟小于 20ms。
跨区域拉远训练
70km+ RDMA 光纤链路、小于 1ms 网络抖动、400Gbps 参数面带宽,跨区训练效率达 95%。
训推一体全栈服务
覆盖数据准备、模型训练、微调到推理全链路,内置 PyTorch / MindSpore / DeepSpeed 等主流套件。
NETWORK & OPERATIONS
组网与运维体系
从网络架构、绿色散热到智能运维与故障自愈的全栈保障体系。

IB / RoCE 双网络架构
支持 InfiniBand 高速互联与 RoCEv2 以太网融合网络,低时延、高带宽集群内通信。
全液冷绿色散热
全液冷散热方案 PUE<1.2,绿色节能,运营成本降低 30% 以上,已应用于西宁图灵小镇等项目。
7×24 智能运维
自建专业集群运维团队,SLA 99.5%。芯片级 / 节点级 / 任务级 / 服务级四级监控,AI 异常检测提前 10 分钟预警。
故障自愈体系
秒级隔离、自动迁移、状态回退,全年平台可用性目标不低于 99.95%,单卡能耗下降 12%。
SUPPLY CHAIN
供应链保障
GPU 与液冷设备双链路保障,高端进口设备零违约记录,确保项目按期交付。


GPU 设备渠道
英伟达、AMD、摩尔线程渠道供货稳定,高端进口设备零违约记录。
整机深度绑定
5090 系列与同泰怡深度绑定,已交付 500 台集群稳定运行。
液冷设备保障
与超聚变建立液冷设备战略合作,双链路备份确保项目按期交付。
国产产线闭环
“闽都号”摩尔线程 GPU 生产线,构建芯片、组装、集群、运营完整产业链。
