人工智能体(AI Agent)依托自主规划、工具调用、多任务协同能力加速落地,深度渗透政务、金融、工业、民生服务等核心领域,成为数字经济智能化转型核心载体。伴随技术快速迭代,提示注入、权限越权、数据泄露、多智能体协同失控、深度伪造滥用等新型安全风险同步凸显。各地各部门坚持统筹发展和安全,以技术攻坚、制度规范、行业自律、协同治理多维发力,全方位筑牢人工智能体安全屏障,推动产业实现安全可控、合规有序、创新可持续发展新华网。
近日,全国人工智能安全专题研讨暨智能体标准化推进会召开,网信、工信、公安、市场监管等多部门、科研院所、头部 AI 企业、网络安全机构齐聚,围绕人工智能体全生命周期风险防控、分级分类监管、核心安全技术攻关、行业标准落地等议题达成共识,明确以高水平安全保障人工智能体高质量创新发展总体路径。
技术筑基:攻坚内生安全,构建主动免疫防护体系
与会专家指出,传统被动防御模式已无法适配智能体自主执行、跨系统交互的技术特征,安全治理范式需全面转向事前预警、事中阻断、事后溯源的主动免疫架构新华网。
一是聚焦底层核心安全技术攻关。集中力量突破算法可解释性、模型防投毒、运行沙箱隔离、行为围栏、API 安全网关、全链路日志审计关键技术,搭建 “最小权限 + 环境隔离 + 动态监测” 三层防护底座。严格落实最小代理权限原则,对文件修改、数据外发、系统配置等高风险操作增设人工复核机制,从源头遏制权限劫持、越权访问风险。
二是搭建智能体安全检测验证平台。部署专用安全沙箱,实现智能体插件、第三方工具安装前风险扫描、运行时行为实时监控,对可疑指令、越狱攻击、提示注入行为自动拦截阻断,建立漏洞挖掘、风险预警、应急处置闭环机制,提升系统鲁棒性与抗攻击能力中国信息通…。
三是夯实数据全链路安全保障。规范训练语料合规校验、用户隐私脱敏、敏感密钥加密存储流程,建立智能体长期记忆、跨平台数据传输监测阻断机制,严防个人信息泄露、商业数据窃取、涉密数据外流等安全隐患中央网络安…。
制度立规:完善标准监管体系,实施分级分类精准治理
我国持续加快人工智能体治理制度供给,形成法规、标准、评估三位一体合规框架,为产业划定清晰安全边界。
在顶层制度层面,《智能体规范应用与创新发展实施意见》《人工智能拟人化互动服务管理暂行办法》等文件落地实施,明确算法备案、安全评估、科技伦理审查强制要求,厘清研发企业、运营平台、行业用户三方安全主体责任,规范智能体自主决策与用户授权边界,严禁无授权自动化高风险操作中央网络安…。
在行业标准层面,《智能助手类智能体安全分级规范与建设指南》《云上智能体服务网络和数据安全自律公约(2026 版)》正式发布,搭建 L1-L5 五级安全分级体系,针对政务、医疗、金融等高风险场景实施严格准入管控,面向文娱、通用办公等低风险领域推行包容审慎监管,平衡安全约束与创新活力新华网。
在合规监管层面,全面推行智能体全生命周期安全评估机制,将安全审查嵌入立项、研发、部署、运营、迭代全流程,建立第三方安全认证服务网络,实现合规认证互通互认;完善算法备案、风险公示、违规处置配套流程,构建动态、敏捷、可追溯的现代化监管模式新华网。
行业共治:压实主体责任,打造多方协同治理格局
会议明确,构建政府引导、企业主责、科研支撑、社会监督、全球协同的多元共治体系,凝聚智能体安全防护合力。
企业层面,落实人工智能安全主体责任,头部平台牵头签署《人工智能安全行业自律倡议》,建立内部安全合规部门与伦理审查委员会,定期开展智能体风险自查、安全能力升级;开放安全实践经验,共享风险案例、防护方案,共建安全技能可信资源池,杜绝未经安全校验的第三方插件无序流通。
产学研协同层面,搭建联合安全攻关平台,高校、科研院所、安全企业联合培养智能体安全专业人才,围绕新型攻击手段、未知风险开展前沿研究,输出标准化防护方案与行业白皮书,补齐安全人才、技术储备短板新华网。
跨部门协同层面,建立网信、工信、公安、金融、医疗等行业风险信息共享、联合应急响应机制,针对智能体涉诈、虚假信息传播、数据滥用等违法应用开展专项整治;畅通公众投诉举报渠道,强化社会监督作用。
国际治理层面,积极参与全球人工智能安全规则磋商,分享中国分级分类治理、行为围栏、主动免疫防护实践经验,搭建跨境智能体安全对话平台,携手应对跨国深度伪造、跨境数据流动等共性安全挑战。
发展展望:以安全底线托举产业创新高线
与会各方一致认为,安全是人工智能体产业健康发展不可逾越的底线,创新是驱动产业升级的核心动力,二者辩证统一、不可偏废。
下一步,各地区、各行业将持续落实本次会议部署:持续加大安全核心技术研发投入,完善分级分类监管细则,加速安全标准规模化落地;常态化开展智能体安全专项检查与合规培训,引导企业树立 “安全前置” 研发思维;推动安全服务产业化,培育智能体安全检测、评估、托管专业服务商;持续优化包容审慎治理环境,鼓励合规前提下的技术创新与场景落地。
未来,我国将持续完善全方位、多层次、立体化人工智能体安全防线,守住科技安全、数据安全、意识形态安全底线,让可信、可控、可靠的人工智能体赋能实体经济、服务民生发展,助力数字中国建设行稳致远。