深度求索(DeepSeek)正式推出DeepSeek-V4-Flash 正式版(0731),模型权重同步对外开放开源。本次更新创造行业标志性突破:在不改动模型架构、不调整参数规模的前提下,依托系统性后训练优化,新版智能体(Agent)、代码生成、工具调用等核心能力全方位超越此前发布的 DeepSeek-V4-Pro 预览版,重塑 MoE 大模型性能与成本的平衡边界。
DeepSeek-V4-Flash 延续成熟混合专家 MoE 架构,总参数 2840 亿,推理激活参数仅 130 亿,原生支持100 万 Token 超长上下文窗口,搭载思考 / 非思考双模式,兼容 FP4、FP8 混合精度部署,可流畅适配昇腾、海光、英伟达等多系列异构算力硬件,降低本地化部署门槛。
与常规版本迭代逻辑不同,本次升级未改动基础模型骨架,聚焦面向智能体场景的 SFT、DPO 强化后训练,针对性优化多步骤任务链式推理、工具连续调用、长程代码工程能力。官方 9 项权威基准评测数据显示,V4-Flash 正式版实现跨越式提升:Terminal Bench 2.1 达到 82.7 分、Cybergym 网络安全攻防 76.7 分、Toolathlon Verified 工具调用 70.3 分;全栈开发基准 DSBench-FullStack 68.7 分、高难度编码 DSBench-Hard 59.6 分,全部指标领先 V4-Pro 预览版。
长久以来行业普遍存在 “旗舰 Pro 版本性能强于轻量化 Flash 版本” 的固有认知,本次 V4-Flash 正式版实现 “轻量化模型反超旗舰预览版”,验证了高质量后训练对大模型实用能力巨大的提升潜力。在推理成本层面,V4-Flash 具备显著优势,单次推理算力开销远低于 V4-Pro,API 调用价格大幅下探,非常适合智能体应用、自动化运维、批量代码生成、长文档处理等高并发业务场景。
同时该模型采用宽松开源协议开放权重,个人开发者、企业团队可自由开展本地部署、二次微调、商业化应用开发。模型原生兼容 Codex、Responses API,降低智能体项目迁移与开发成本,推动开源 AI 智能体生态快速发展。
DeepSeek 表示,后续将持续迭代 V4 系列模型,进一步打通从基础模型、智能体框架到行业落地的全链路方案,持续降低高性能通用大模型的使用门槛,助力国内 AI 开发者打造低成本、高可用的原生 Agent 应用。