TrustX 发布智能体风险分级框架,助力企业治理自主AI系统
随着自主AI系统在企业和公共部门的快速普及,通用AI风险框架已难以满足分类与治理需求。TrustX团队在arXiv上发布《Agent Risk Classification Framework》,提出一套结构化、可重复的风险分级工具。该框架基于现有AI治理框架构建,核心采用12维度评分体系,能对七类自主AI系统进行风险量化评估。
ARC框架整合了GPA + IAT分类模型与五级自主性框架,最终输出三级治理建议及对应控制措施。特别针对编码助手类系统,框架还提供了专门扩展模块以应对其特殊性。研究团队通过示例演示了框架的实际应用流程。
该工具主要面向AI治理从业者、风险官员、开发者和监管机构,未来将持续迭代完善。目前社区可通过https://arc.responsible.ai/访问交互式框架。该研究为日益复杂的自主AI系统治理提供了可操作的方法论支撑。