Skip to content

通用型智能体L1-L5分级安全框架白皮书(1.0版)

2026年7月

2026年7月19日,安远AI在世界人工智能大会(WAIC)上,联合上海人工智能实验室、清华大学智能产业研究院、华为共同发布了《通用型AI智能体L1-L5分级安全框架白皮书》(下称“报告”)。报告以“自主性”作为能力分级主轴,对通用型AI智能体进行系统性分级并提出相应的风险识别、安全防护和综合治理措施建议。

智能体技术正从实验演示走向大规模部署,但技术演进与安全治理之间存在显著的时间差。近期国内外频发的智能体安全事件,以及政策界和学术界相继发布的安全风险提示均表明,智能体已无法沿用传统 AI 系统的治理逻辑。全球主要市场虽尚未形成统一治理模式,但围绕智能体的能力水平和风险影响实施“分级治理”,正逐渐成为共识。然而学术界和工业界已有的分级框架多聚焦于能力分级,对各能力等级对应的风险和安全措施缺乏完整分析。

报告试图系统回答三个核心问题:如何以自主性对通用型智能体分级;随自主性等级提升,风险如何演进、高自主性等级可能产生哪些新兴风险;应设置哪些与各等级风险相匹配的安全防护措施和综合治理措施。

报告将智能体按“自主性水平”分为L1至L5五级,并将自主性分解为决策自主度和降险自主度两个维度,系统描述各等级能力特征及人机角色分工。其中L4 和 L5 虽暂无现实实例,但被纳入进行前瞻性分析,以避免未来自主性突破后出现的防护措施真空。基于国内外已有风险分类框架,报告提出各等级智能体的通用故障风险,剖析随自主性提升各主要故障风险的演进路径,并重点提示L3-L5在滥用和主动失控领域可能出现的新兴风险。

随后,报告结合风险演进逐一给出针对性安全防护措施建议,并在此基础上,进一步提出智能体产品设计应遵循的红线与推荐性治理原则,并针对智能体生态链中五大责任主体的对内治理和对外透明措施提出建议。

报告试图为智能体开发者、使用者和第三方研究与评测者提供可参考的分级安全治理框架,并希望与产业界、学术界和政策界共同探讨框架的落地和迭代。

作者: 本报告的主要贡献者 安远AI:程远(主要撰写人)、谢旻希、方亮、王伟冰、段雅文、王金戈 上海人工智能实验室:邵婧、徐甲、张杰 清华大学智能产业研究院:李元春、袁宜桢 华为:肖亚军、罗俊、刘海军、李思行
Back To Top