平头哥自研真武 M890 训推一体 AI 芯片打造的灵骏磐久 AI128 国产超节点,已完成对 2.4 万亿参数 Qwen3.8 混合专家(MoE)大模型全链路适配调试,成为国内首个稳定承载 2 万亿级参数超大模型运行的全国产超节点系统。该整套软硬一体化算力方案已正式上线阿里云百炼 MaaS 平台对外提供商用推理服务,标志我国国产超节点、万亿级大模型协同技术彻底走出实验室验证阶段,全面进入规模化产业落地周期。
在 2026 世界人工智能大会(WAIC)期间,超节点被行业公认为下一代 AI 算力基础设施标准架构。区别于传统分布式服务器堆叠模式,国产超节点依靠自研高速互联芯片、统一内存编址架构,将多块 AI 加速卡融合为逻辑上的 “单台超级计算机”,破解长期制约万亿参数大模型落地的显存墙、通信墙两大核心技术瓶颈。
本次落地的灵骏真武 M890 超节点搭载自研 ICN Switch 1.0 互联交换芯片,实现 64 颗国产 AI 芯片 800GB/s 超高带宽片间互联,单节点聚合显存池高达 9TB,无需多集群跨机房调度,单实例即可独立完成 2.4 万亿 MoE 模型专家并行运算。硬件层面,真武 M890 原生覆盖 FP32 至 FP4 全精度算力,兼顾超大模型预训练、智能体高并发推理双重需求;软件端配套全栈自研分布式调度框架、MoE 算子深度优化套件,实测复杂 Agent 多轮交互场景下,推理吞吐性能较传统国产集群提升 1.5 倍,单位 Token 生成成本显著下降,具备大规模商业化交付基础。
业内专家表示,万亿参数混合专家大模型是通用人工智能、复杂行业智能体的核心底座,但海外高端算力供给受限、传统集群协同效率低下,长期阻碍国内前沿大模型规模化商用。此次国产超节点跑通 2 万亿参数大模型,实现 “国产芯片 + 国产算力架构 + 国产超大模型 + 云服务平台” 全链路自主闭环,验证了 “成熟制程芯片 + 先进超节点互联” 中国算力特色发展路线的可行性,打破海外算力生态垄断壁垒。
从产业格局来看,2026 年被业内定义为 “国产超节点元年”。WAIC 展会集中亮相华为昇腾、百度昆仑、燧原、沐曦等多家厂商自研超节点产品,昇腾 384 超节点已累计商用落地 750 余套,国内头部云厂商、智算中心均启动万卡级国产超节点集群建设规划。随着本次 2 万亿参数大模型商用落地落地,金融、智能制造、政务大模型、科研仿真、多模态智能体等行业将批量接入国产万亿级算力服务,大幅降低企业部署超大模型的门槛与成本。
阿里云相关负责人介绍,百炼平台已面向政企、科研机构、AI 创业公司开放该超节点专属算力实例,支持 Qwen 系列全尺寸大模型、第三方开源万亿级 MoE 模型一键部署。平台数据显示,依托国产超节点算力支撑,平台 MaaS 服务日均 Token 调用量同比增长 15 倍,相关算力业务已实现正向盈利,证明国产超大规模算力具备可持续商业化盈利能力。下一步团队将持续迭代光互联超节点架构,推进万卡级全域统一内存智算集群落地,持续完善国产 AI 软硬件生态,支撑国内通用人工智能产业高质量自主发展。
鹏城实验室发布的《超节点定义与实践白皮书》指出,超节点是支撑 Agentic 智能时代的核心算力载体,本次 2 万亿参数大模型商用落地案例,为全国各区域算力枢纽、国家智算中心建设提供标准化国产落地范本,加速我国 AI 基础设施自主可控进程,助力 “十五五” 数字经济与人工智能产业规划落地实施。