2026 年 6 月 17 日,北京 —— 国产算力龙头海光信息技术股份有限公司正式官宣,旗下深算系列 DCU 加速芯片完成智谱 AI 全新开源旗舰大模型 GLM-5.2发布当日 Day0 全链路适配,成为国内首批完整支撑百万级无损长上下文、全场景代码推理的国产通用算力底座,标志着国产芯片 + 国产大模型自主闭环生态建设实现跨越式进展。
软硬深度协同,攻克千亿 MoE 模型国产部署行业痛点
GLM-5.2 是智谱面向长程智能体、软件工程场景打造的新一代旗舰基座,采用 744B 参数 MoE 稀疏架构,原生支持 100 万 token 无损超长上下文窗口,在全球 Code Arena 代码盲测中位列开源模型第一,长任务综合能力比肩国际顶尖闭源模型 Claude Opus 4.8,支持项目级全流程开发、复杂知识库解析、AI 智能体多步骤执行等高负载业务,是当前商用价值最高的开源国产大模型之一。
本次适配并非基础 Demo 级兼容,海光信息基于自研 DTK 异构计算软件栈,针对 GLM-5.2 稀疏注意力、MoE 专家路由、百万长文本调度完成底层算子定制优化,系统性解决长期困扰国产算力生态的三大难题:长文本推理精度衰减、高并发场景吞吐不足、大显存模型频繁溢出。
技术实测数据显示:经过软硬件协同调优后,海光 DCU 硬件算力利用率由通用部署的 38% 提升至 72% 以上;软件开发场景推理吞吐提升 57%,前后端混合开发、系统架构设计等高负载任务响应延迟降低 32%;原生兼容 INT4/FP16/KV8 全精度量化链路,单卡稳定承载完整 1M 上下文推理任务,无需拆分模型、降低精度妥协性能。
依托海光独有 IndexShare 高带宽内存架构与 HSL 高速互联总线,搭载海光 CPU+DCU 双芯组合的国产信创服务器,可零重构、零改造直接部署 GLM-5.2,开发者无需更换开发框架、重写适配代码,vLLM、SGLang、Transformers 等主流推理工具链全线原生兼容,大幅降低政企、金融、能源等关键行业国产化 AI 落地迁移成本。
Day0 极速适配彰显成熟生态实力,筑牢自主可控算力底座
业内普遍认为,大模型发布当日同步完成全栈硬件适配,是衡量国产算力生态成熟度的核心标尺。过往多数国产芯片需滞后数月才能完成主流大模型基础兼容,而海光信息凭借覆盖 6000 余家伙伴的 “光合组织” 算力共同体,长期深度布局大模型适配体系,已实现国内绝大多数开源、闭源大模型首发同步适配,形成行业领先的软硬件协同响应能力。
作为国内唯一同时实现高端通用 CPU 与通用 AI 加速 DCU 量产落地的芯片企业,海光构建 “CPU+DCU 双芯底座 + 国产操作系统 + 国产大模型” 完整信创闭环。本次 GLM-5.2 Day0 适配落地,进一步夯实海光在政务私有 AI、金融研发平台、企业本地知识库、工业代码辅助、运营商智能运维等场景的国产化替代优势,为有数据安全、自主可控硬性要求的行业提供完全脱离海外算力方案的全栈国产化 AI 部署路径。
深化产业协同,加速千行百业国产 AI 规模化落地
海光信息表示,完成基础 Day0 适配仅是双方产业合作起点。下一步,海光将联合智谱 AI 开展两大方向深度联合优化:一是针对政企知识库、大型软件研发、AI 智能体自动化运维等真实业务场景开展大规模集群验证,打磨高并发、高稳定生产级联合解决方案;二是持续深挖 DCU 硬件底层潜力,针对 GLM-5.2 长程任务、多轮复杂推理特性迭代专属算子库,进一步提升超大参数 MoE 模型集群推理效率与部署性价比。
当前全球 AI 算力供给外部约束加剧,海外算力服务存在不可控、断供风险,构建自主可控 “芯片 – 软件 – 大模型 – 行业应用” 全链条产业链已成为产业共识。海光 DCU 与 GLM-5.2 的极速适配,证明国产算力硬件已具备承载全球第一梯队开源大模型完整性能的能力,打破 “高端大模型必须依赖海外加速卡” 的固有认知,为国内 AI 产业摆脱外部技术依赖提供核心支撑。
未来,海光信息将持续依托光合组织生态,联动智谱及更多国产大模型厂商,持续推进新一代大模型首发同步适配,不断完善训练、推理、微调全流程优化方案,推动国产 AI 算力底座深度走进千行百业数字化场景,助力我国人工智能产业高质量自主发展。