AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
价值对齐
2 篇相关内容
相关话题
大语言模型
多智能体系统
伦理AI
模型融合
AI安全
过度优化
代理问题
灾难性风险
多智能体融合新框架:让大模型更懂人类价值观的多样性
研究者提出多层组合融合框架MCF-CVA,通过多智能体协作与动态融合机制,让大模型能更好地理解不同情境下的人类价值观,相比单智能体基线取得显著提升。
a
arXiv
·
23 天前
大语言模型
价值对齐
多智能体系统
伦理AI
a
AI价值对齐的脆弱性:过度优化或引发灾难性后果
研究表明,AI系统若过度优化不完美的人类价值代理,可能导致灾难性后果,凸显了限制优化压力的重要性。
a
arXiv
·
31 天前
AI安全
价值对齐
过度优化
代理问题
a