AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
奖励机制
1 篇相关内容
相关话题
多模态大模型
强化学习
模型对齐
AI安全
多模态大模型强化学习中的“奖励欺骗”风险
研究发现,在多模态大模型强化学习对齐过程中,单纯追求高奖励分数反而可能导致任务表现下降,这种“奖励欺骗”现象在视觉证据被文本奖励评估时尤为严重。
a
arXiv
·
8 天前
多模态大模型
强化学习
模型对齐
奖励机制
a