国产大模型公司千卡 NVIDIA 推理集群生产交付
大模型公司 NVIDIA 千卡推理生产集群
基于 Coding 推理服务,对比传统 ROFT 网络架构,验证 ZCube 通过扁平化组网和更均衡网络通信释放推理有效算力。
15%
GPU 平均推理吞吐提升
40.6%
首 Token 时延(TTFT)P99 降低
33%
网络硬件成本减少
覆盖 NVIDIA 与国产 GPU、大模型训练、推理及真实用户服务场景。每个案例独立呈现测试背景、业务环境、验证结果。

部署案例
进入案例详情,可查看对应环境、验证或交付方式、完整结果。
基于 Coding 推理服务,对比传统 ROFT 网络架构,验证 ZCube 通过扁平化组网和更均衡网络通信释放推理有效算力。
15%
GPU 平均推理吞吐提升
40.6%
首 Token 时延(TTFT)P99 降低
33%
网络硬件成本减少
在国产智算生态中,对比 ZCube 与传统 Clos 架构在集合通信、训练和推理维度的表现。
14.5%
All-to-All 吞吐提升
22%–30%
TTFT P99 降低
7%–10%
推理吞吐提升
对比 ZCube 与 Clos 架构,在集合通信、模型训练和多租户端到端推理场景中验证性能收益。
119%
集合通信性能提升
20.1%
模型训练吞吐提升
11.5%
推理时延降低
国产算力千卡级集群已上线稳定运行数月,持续承载真实业务流量,并面向真实用户提供服务。
千卡规模
国产算力集群部署
数月
生产环境稳定运行
真实用户
持续提供服务
围绕新建集群、存量改造、性能调优或智能运维,与我们一起评估网络如何释放更多有效算力。