由新华网联合中国信息通信研究院牵头,多家人工智能企业、网络安全机构、行业主管单位共同编制的《智能助手类智能体安全分级规范与建设指南》(下称《指南》)正式对外发布,为国内智能助手类 AI 智能体搭建标准化安全评估、建设、落地体系,补齐智能体自主交互时代安全治理短板,引导产业发展重心从功能可用性转向安全可信性新华网。
当前人工智能产业已完成从单轮对话交互向多工具、跨系统自主执行任务的跨越,各类办公、政务、金融、医疗智能助手深度融入生产生活。伴随智能体自主决策、插件调用、多主体协同能力快速升级,提示注入攻击、用户隐私数据泄露、权限越权劫持、多智能体协同失控、行为无法溯源等新型安全风险集中显现。原有面向传统大模型的内容安全管控标准,无法覆盖智能体全链路运行风险,行业长期缺少统一、可量化、分场景的安全建设依据,企业安全投入无统一参照、监管评估缺少标准化标尺,成为制约智能助手规模化落地的核心瓶颈新华网。
本次发布的《指南》核心创新是构建L1-L5 五级递进式安全分级体系,针对不同风险场景匹配差异化安全能力要求,杜绝标准 “一刀切” 管理模式:
- L1 基础级:满足行业基础合规要求,搭建账号基础防护、基础内容过滤能力,面向低风险通用咨询类智能助手;
- L2 进阶级:增加完整操作审计、输入风险拦截机制,统一身份认证为刚性门槛,可抵御常规网络攻击,适用于普通办公、生活服务智能助手;
- L3 自主级:覆盖智能体全生命周期安全防护,完善最小权限管控、数据隔离机制,可应对中高级安全威胁,适配企业内部业务自动化助手;
- L4 协同级:具备跨系统、跨组织、多智能体协同安全保障框架,建立跨域数据流转防护规则,面向政企多部门联动智能服务;
- L5 自治级:行业最高安全等级,搭载纵深防御、全链路不可篡改审计体系,可抵御高级持续性渗透攻击,专供政务、金融、医疗等高敏感核心场景智能助手使用。
区别于单一聚焦模型输出管控的现有规范,《指南》打通输入 – 感知 – 决策 – 记忆 – 工具调用 – 执行 – 多智能体协作七大环节,搭建完整安全闭环防护框架,对每个运行节点明确安全管控细则。其中统一身份认证、最小权限分配、操作全程可追溯、高危操作人工复核四大要求贯穿全部安全等级,从底层规避智能体越权操作、隐私窃取风险新华网。
针对政务、金融、医疗三大高风险行业,《指南》设置专项增强安全条款:政务场景严格落实数据不出域、意识形态多层审核;金融场景资金、交易类操作强制人工二次确认,全流程交易日志永久留存;医疗场景明确智能体诊疗建议仅作辅助参考,严禁替代执业医师诊断,患者健康数据独立隔离存储,严防敏感医疗信息外流。
参与编制专家表示,这套五级分级体系相当于智能体行业通用 “安全资质标尺”。企业可依据自身业务风险等级匹配对应安全建设方案,监管机构能够依托统一指标开展标准化安全评测,政企采购、行业准入可将安全分级作为硬性参考依据,从供给端倒逼厂商提升智能体内生安全能力。
在产业落地层面,《指南》同步配套完整建设实施路径,覆盖产品研发、上线评测、运营管控、应急处置全流程,为技术服务商、平台运营方、行业用户提供可落地、可核验、可督导的操作方案。同时兼顾创新发展与安全治理平衡,明确不设置过高准入门槛,鼓励中小厂商循序渐进完成安全能力升级,避免过度管控抑制智能体技术创新活力。
业内人士评价,《指南》的发布填补了国内智能助手类智能体分级安全标准空白,标志我国 AI 智能体治理从零散合规要求走向系统化、量化分级管理新阶段。未来依托统一安全标尺,将逐步淘汰高风险、无防护的低质智能助手产品,构建 “可控、可信、可追溯” 的 AI 服务生态,推动行业整体实现从 “能用、好用” 向 “安全可信、放心使用” 跨越式升级,为人工智能产业高质量、规范化发展筑牢安全根基。
下一步,编制工作组将面向行业开展多场标准宣贯、落地培训,同步推出配套安全分级评测工具与第三方认证机制,加速推动《指南》在政企、金融、医疗、消费终端等场景规模化落地应用。