跳到主要内容
新一代 AI 网络基础设施

以网强算,打造大模型时代AIDC 基础架构

驭驯网络以原创 ZCube 组网架构及配套技术重构 AI 集群网络,用更少网络硬件、更均衡网络通信和更高效的调优运维来提升集群有效算力。

智算中心服务器机柜与网络布线

网络架构创新,直接转化为生产收益

千卡推理生产集群,GPU、软件栈与应用保持不变,仅将网络架构从传统 ROFT 升级为 ZCube

15%

GPU 平均推理吞吐提升

仅升级网络架构释放更多有效算力。

40.6%

首 Token 时延(TTFT)P99 降低

高并发推理尾时延显著改善。

33%

网络硬件成本减少

交换机与光模块所需数量锐减。

聚焦客户需求

从集群建设到持续运维,解决智算网络关键问题

面向新建集群、存量改造、性能调优和智能运维需求,结合业务流量、硬件环境与运行目标,提供覆盖智算网络全生命周期的产品与服务。

新建智算集群

大模型公司、智算中心与算力运营商

从业务流量出发,完成网络架构、设备、布线和部署工具的一体化设计。

客户价值

以更少网络硬件建设高吞吐、低时延的智算底座,加快集群交付上线,提升集群有效算力。

存量网络改造

已运行 Clos / ROFT 集群的客户

识别网络热点、PFC 反压和链路负载不均衡问题,在不改变业务应用的前提下升级网络架构。

客户价值

降低尾时延和 GPU 空转时间,提升存量集群的有效算力。

智算性能调优

训练、推理与 AI infra 优化团队

深入刻画训推框架、通信库、网络、主机与存储全链路性能,定位影响吞吐和时延的系统瓶颈。

客户价值

通过跨层协同调优,提高大模型训练和推理的有效产能。

智能运维体系

智算集群运维与交付团队

统一计算、网络、任务指标和日志信息,解决监控数据分散、故障定位慢和人工排查依赖高的问题。

客户价值

加快异常发现和根因定位,缩短 MTTR,形成可复用的智能运维闭环。

产品服务

组网、调优、运维一体化

驭驯网络不是单点设备供应商,而是以 ZCube 为核心、覆盖智算网络全生命周期的解决方案提供商。

ZCube 产品展示

智算组网

ZCube新一代智算集群组网架构

摒弃传统多层树状结构,采用完全扁平的互联架构,取消 Spine 层交换机,配合“单轨+多轨”混合接入与专属路由,为集群内 GPU 通信规划更短、负载更均衡的路径。

了解产品
YCOS 产品展示

智算调优

YCOS智算调优系统

面向大规模智算业务,对训推框架、通信库、网络配置和主机配置等关键环节进行系统化调优。

了解产品
XOPS 产品展示

智算运维

XOPS智算运维系统

面向智算集群的大规模训练和推理场景,打造计算、网络、存储全链路一体化运维平台,实现问题快速定位和故障高效排查。

了解产品
全生命周期服务 产品展示

专业服务

全生命周期服务从规划到上线的完整交付能力

通过网络设备、算网调优和运维服务的一站式交付,保障智算集群网络稳定、通信高效、SLA 达标,助力集群快速上线。

了解产品

核心技术

ZCube:新一代智算集群组网架构

ZCube 去除只负责中转的 Spine 层,将 Leaf 交换机分为两组并建立完全二部图互联,减少通信跳数的同时提升网络负载均衡效果。

阅读技术博客

组网成本更低

相同集群规模下,所需交换机与光模块数量为 Clos 架构的 2/3。

故障源更少

去除专用 Spine 层设备,精简网络转发节点。

通信路径更短

全网 GPU 之间通信转发跳数仅为 2 跳,少于 Clos 架构的 3 至 5 跳。

负载均衡更强

具备结构性全局负载均衡能力,避免选路哈希冲突和局部热点。

故障域更小

无 Spine 交换机故障传导风险,单设备故障仅影响局部节点。

多用户隔离性更好

支持链路级精细化流量隔离,减少多任务并行时的流量串扰。

部署案例

集群落地部署案例,展现 ZCube 架构实践效果

进入案例详情,可查看对应环境、验证或交付方式、完整结果。

国产大模型公司千卡 NVIDIA 推理集群生产交付

大模型公司 NVIDIA 千卡推理生产集群

基于 Coding 推理服务,对比传统 ROFT 网络架构,验证 ZCube 通过扁平化组网和更均衡网络通信释放推理有效算力。

15%

GPU 平均推理吞吐提升

40.6%

首 Token 时延(TTFT)P99 降低

33%

网络硬件成本减少

查看案例
国产算力芯片公司国产 GPU 千卡集群生产交付

国产算力芯片公司千卡生产集群

国产算力千卡级集群已上线稳定运行数月,持续承载真实业务流量,并面向真实用户提供服务。

千卡规模

国产算力集群部署

数月

生产环境稳定运行

真实用户

持续提供服务

查看案例

联接产业

从网络顶会论文,到大规模产业实践

ZCube 相关论文发表于 ACM SIGCOMM 2025,并入选 2026 WAIC SAIL 奖 TOP30 与 ODCC 杰出项目。

  • 网络领域顶级会议 ACM SIGCOMM 2025
  • 2026 WAIC SAIL 奖 TOP30
  • 参与智算系统架构联盟,与产业链伙伴共建生态
  • 推进 ZCube 算力组网架构标准工作
了解驭驯网络

原创架构

以扁平换效率,以确定换性能

权威认可

SIGCOMM 2025 与 SAIL TOP30

产业落地

多类型 GPU、多个千卡规模集群

工程能力

控制器、工具链与全生命周期交付

从网络开始

让下一座智算中心,从网络开始更高效

围绕新建集群、存量改造、性能调优或智能运维,与我们一起评估网络如何释放更多有效算力。

联系我们