AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
审计机制
1 篇相关内容
相关话题
AI治理
博弈论
RLHF
AI安全
双精灵博弈:审计型AI治理中的采纳与福利权衡
研究通过进化博弈论分析,在竞争市场中,以最小化危害为目标的AI代理何时能取代寻求认可的RLHF代理,并探讨审计型治理能否真正防止社区伤害。
a
arXiv
·
21 天前
AI治理
博弈论
RLHF
审计机制
a