郑州,2026 年 3 月 12 日 —— 今日,中科曙光在郑州举办 “智联芯基 网擎未来” 主题发布会,正式推出首款全栈自研 400G 无损高速网络产品scaleFabric。该产品实现国产高端原生 RDMA(远程直接内存访问)技术里程碑式突破,标志着中国在超大规模智算集群高速互联领域彻底打破国外垄断,迈入 100% 自主可控的全新发展阶段。
全栈自研,筑牢自主可控算力底座
scaleFabric 是国内首款基于原生 RDMA 架构的无损高速网络,历时三年核心技术攻关,实现从底层 112G SerDes IP、自研交换芯片、网卡,到整机设备、驱动程序与管理软件的全链条自主研发,彻底填补国内数据中心高端高速网络领域的技术空白。
中国工程院院士邬贺铨在视频致辞中高度评价,高速网络的自主可控直接关乎国家算力基建安全,scaleFabric 的发布 “打破国外技术垄断,补齐国产高端智算最后一块拼图”,为我国 AI 大模型训练、超算应用等核心场景提供安全可靠的网络支撑。
性能对标国际顶尖,关键指标实现赶超
作为面向万卡级智算集群打造的 “算力大动脉”,scaleFabric 400 系列产品技术规格全面对标国际主流高端 RDMA 产品,多项核心性能指标实现超越:
- 超高带宽:网卡端口带宽达 400Gbps,交换机单端口支持 800Gbps,整机交换容量双向 64Tbps;
- 超低时延:端到端通信时延低至 0.9 微秒,交换机转发时延仅 260 纳秒;
- 高密度扩展:交换机支持 400G×80 端口配置,端口密度较国际同类产品提升 25%;
- 超大规模组网:单子网可支撑最大 11.4 万卡集群部署,组网成本降低 30%。同时,产品采用基于信用的无损流控机制,链路故障恢复时间小于 1 毫秒,从根源规避拥塞丢包风险,已在国家超算互联网郑州节点完成部署,支撑三套 scaleX 万卡级智算集群稳定运行,36 小时完成网络部署,验证了产品的规模化落地能力与高可靠性。
适配超算智算场景,激活算力价值释放
当前,AI 大模型训练进入十万卡集群时代,算力竞争已从单一芯片性能比拼,转向 “算、网、存” 全生态协同博弈。scaleFabric 深度适配超大规模智算集群、高性能计算、分布式存储等核心场景,通过原生 RDMA 硬件卸载技术,减少 CPU 参与与数据拷贝,显著提升集合通信效率。
结合中科曙光 “超级隧道” 技术,scaleFabric 可构建专属数据高速通道,实现 “存算传一体化” 紧耦合协同,有效解决万卡集群训练中网络拥堵、算力空转等痛点,让 GPU 算力利用率提升 30% 以上,为大模型训练、科学计算、工业仿真等场景提供高效网络支撑。
生态开放共建,引领产业协同发展
scaleFabric 兼容主流 IB 生态,提供原生 RDMA verbs 接口,支持即插即用,大幅降低用户迁移与优化成本。未来,中科曙光将持续加大 scaleFabric 技术迭代与生态投入,联合产业链上下游伙伴,构建自主可控、开放兼容的国产 RDMA 网络生态,推动技术向云计算、边缘计算等领域延伸。
此次 scaleFabric 的首发,是中科曙光深耕算力基础设施核心技术的重要成果,更是我国高端网络技术从 “跟跑” 到 “领跑” 的关键跨越。随着国产原生 RDMA 技术的规模化应用,将进一步夯实我国 AI 与超算产业根基,为数字经济高质量发展注入强劲动力。