AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
政策合规
1 篇相关内容
相关话题
大语言模型
安全对齐
自蒸馏
AI安全
PolicyAlign:无需标注数据,直接让大模型理解并遵守安全政策
研究者提出PolicyAlign框架,允许大语言模型直接根据自然语言描述的安全政策进行对齐,无需依赖传统的标注数据,在提升安全性的同时保持模型通用能力。
a
arXiv
·
26 天前
大语言模型
安全对齐
政策合规
自蒸馏
a