国内 AI 独角兽月之暗面(Moonshot AI)正式发布全新旗舰开源基础模型Kimi K3。该模型总参数规模达 2.8 万亿,是当前全球参数体量最大的开源大模型,依托自研双核心注意力架构与百万级超长上下文窗口,在长程编程、复杂工程自主执行、多模态协同开发领域实现跨越式突破,大幅降低大型软件工程、科研计算、数字内容生产的 AI 落地门槛,完整模型权重将于 7 月 27 日面向全球开发者社区开放。
一、超大参数 + 底层架构革新,破解长序列工程算力痛点
Kimi K3 采用 MoE 混合专家架构,搭载 896 个专家单元,单次推理高效激活 16 组专家模块,搭配两大自研底层技术形成差异化壁垒:
- KDA 混合线性注意力(Kimi Delta Attention):针对 100 万 Token 超长上下文优化,长文本解码速度最高提升 6.3 倍,解决超大代码库读取、超长工程文档推理卡顿难题;
- 注意力残差(Attention Residuals):模型训练效率提升 25%,额外算力成本控制在 2% 以内,兼顾超大模型训练成本与迭代速度。
对比前代 K2 系列,Kimi K3 整体算力扩展效率提升 2.5 倍,原生内置百万 Token 上下文窗口,可一次性载入完整大型代码仓库、全套科研文献、多轮工程日志,无需分段切割任务,为连续数十小时自主编程提供底层支撑。模型同步上线 API 服务,兼容主流开发框架,企业与开发者可即刻调用能力开展测试落地。
二、核心王牌:长程编程能力,实现低干预全流程软件工程
本次 Kimi K3 核心定位聚焦长周期自主代码开发,区别于传统代码模型仅支持单文件片段生成,可在极少人工监督下连续运行数十小时,独立完成全链路软件工程任务:
- 大型代码库全域理解与迭代:自主读取百万行级开源仓库,调用终端工具、调试运行日志、定位代码缺陷,失败后自动复盘修复,适配后端系统、前端工程、GPU 底层算子开发;官方实测中,模型连续 15 小时迭代优化训练算子,将运算耗时压缩超 60%;
- 底层编译器自主搭建:从零构建类 Triton GPU 编译器,自主设计中间层 IR、优化算法管线,生成可直接运行的 PTX 底层代码,在硬件性能基准测试中对标国际顶级闭源模型;
- 科研代码全自动复现验证:仅 2 小时完成资深研究员 1-2 周工作量,交叉研读 20 余篇专业论文,评估 300 余种物理状态方程,生成 3000 余行 Python 数值代码,自主产出可视化分析仪表盘,还可识别文献公式逻辑漏洞;
- 多模态协同编程开发:原生支持图像、截图、视频输入,可结合前端渲染截图、CAD 图纸、游戏画面双向迭代代码,覆盖游戏开发、工业建模、交互页面设计全场景。
三、多模态能力延伸,覆盖工程、科研、创意全场景
除长程编程核心优势外,Kimi K3 打通代码、图文、音视频跨模态统一推理,拓展多元落地场景:
- 数字内容生产:自主剪辑长素材短视频,完成选片、逐帧卡点、音频混音、多轮修改,替代专业剪辑 1-2 天工作量;
- 芯片与硬件研发:48 小时自主完成芯片架构设计、性能调优、仿真验证全流程;
- 企业知识工程:整合海量业务文档、接口代码、运维日志,搭建自动化运维智能体,持续迭代系统运维脚本。
四、开源战略释放产业红利,重塑全球 AI 开发者生态
月之暗面宣布,Kimi K3 完整权重将于 7 月 27 日开源开放,所有企业、科研机构、独立开发者均可免费获取、二次微调、商用部署。当前全球万亿级参数基座多为闭源产品,Kimi K3 作为首个 2.8 万亿参数开源大模型,填补超大参数开放基座空白:
- 中小企业无需承担超高训练成本,即可拥有顶级长程编程 AI 能力;
- 高校、科研院所可基于模型开展通用人工智能、代码智能体前沿研究;
- 行业厂商可微调定制垂直编程模型,赋能工业软件、芯片设计、生物医药计算等赛道国产化升级。
业内分析指出,Kimi K3 发布标志国内开源大模型正式迈入 2 万亿参数时代,大幅缩小中美前沿大模型综合能力差距,依托强长程代码能力,有望推动国内软件工程、算力基础设施领域 AI 产业化提速。月之暗面同步配套发布 Kimi Code 开发插件,无缝适配 VSCode、JetBrains 全系列编辑器,为开发者提供一站式 AI 编程工具链。
月之暗面相关负责人表示,Kimi K3 并非单纯堆砌参数,而是围绕 “长周期自主智能体” 重构底层模型架构,以长程编程为核心抓手,打通从代码生成、系统搭建到工程落地的完整链路。未来公司将持续迭代 MoE 架构与多模态推理技术,持续开放前沿模型能力,推动通用人工智能技术普惠全行业。多模态协同开发、开源基座、算力扩展效率、SWE 软件工程基准、数值仿真复现