AI安全治理框架3.0发布:智能体风险首次纳入
9月14日,2026年国家网络安全宣传周在山东济南开幕。开幕式上,全国网络安全标准化技术委员会正式发布《人工智能安全治理框架3.0》,首次把智能体自主行动风险系统纳入治理体系。在AI智能体加速走进千行百业的当下,这份框架为智能体时代的安全治理划出了第一张相对完整的”施工图”。
事件详情
- 发布场合:2026年国家网络安全宣传周9月14日至20日在济南举行,由中央网信办、工业和信息化部、公安部等10个部门联合主办,主题为”网络安全为人民,网络安全靠人民——守护智能时代的网络安全”。
- 框架结构:3.0版延续”原则—风险—措施—指引”的体例,设人工智能安全治理原则、安全风险分类、技术应对措施、综合治理措施、安全指引五章,并附风险分级原则、智能体风险管理框架、可信人工智能基本准则三个附件。
- 最大增量:附件二《智能体风险管理框架》首次系统规范智能体自主行动带来的风险,将其归纳为计划错误、越权行为、记忆操纵、身份伪造、工具误用五类风险。
具体来看,被纳入框架的五类智能体风险各有针对性:计划错误指智能体对任务的拆解与规划出现偏差;越权行为指智能体超出授权范围调用工具或访问数据;记忆操纵指外部输入污染智能体的长期记忆;身份伪造指智能体冒充用户或系统身份行动;工具误用指对外部工具、API的错误调用。这些风险在传统软件时代并不存在,正是智能体”自主行动”这一新范式带来的新课题。
- 同期发布:《2026年AI技术赋能网络安全应用测试结果》,以及一批完成网络安全标识注册的消费级联网摄像头产品名单。
背景分析
从1.0、2.0到3.0,治理框架的聚焦点完成了从”模型算法风险”到”智能体自主行动风险”的迁移,这与AI智能体的爆发节奏高度同步:过去一年,从编程智能体到办公智能体,能够自主规划、调用工具、执行长任务的Agent产品快速普及,风险形态也从”生成有害内容”扩展为”替你做了不该做的事”。与欧盟AI法案偏重高风险场景分类、美国偏向轻监管的路径不同,中国选择了”标准先行、分类分级”的治理路线。
影响展望
对厂商而言,框架3.0意味着智能体产品的合规成本将上升,”先上线再补安全”的野蛮生长阶段正在过去,权限控制、行为审计、记忆隔离等能力需要内建进产品。对行业而言,附件中的智能体风险管理框架有望成为事实上的行业基准,并影响中国AI产品的出海合规。更值得观察的是框架提出的”柔性、动态、可控的沙箱监管”思路——如何在管住风险的同时不掐灭创新,将是3.0版本真正的考验。