IBM发布Granite.Trust政策工具:为生成式AI应用打造可共享、可执行的安全策略框架

IBM·8 天前

在生成式AI安全政策领域,通用方案难以满足多样化需求。不同组织及应用场景面临的风险各异,需结合应用环境、监管要求、组织价值观和用户画像进行定制。然而,现有政策规范方法多针对传统访问控制设计,难以捕捉生成式AI应用中基于内容约束的细微差别。

IBM研究团队近日在arXiv发布论文,提出两项创新贡献:一是“可执行政策模式”,采用YAML格式规范模型响应中允许与禁止的内容,支持基于例外的政策治理机制;二是合成数据生成管道,为模型对齐和测试提供符合政策要求的训练数据,并配套工具集辅助模式定义与政策执行。

这套开源工具使组织能够一次性定义政策,并在生成式AI应用全生命周期中持续执行——从模型对齐阶段到运行时监控环节。目前,可执行政策模式、示例政策及相关工具已在GitHub开源发布,研究团队欢迎社区贡献新想法与反馈。该框架有望帮助企业在快速发展的人工智能领域建立更精细、可操作的安全治理体系。

AI安全生成式AI政策治理IBM开源工具

原文来源:https://arxiv.org/abs/2608.23870

相关阅读

IBM推出Spyre加速卡:企业AI推理新架构,数据安全与性能兼得

← 返回