AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
推理对齐
1 篇相关内容
相关话题
大语言模型
偏好学习
arXiv
模型控制
无需微调!推理时对齐新框架:Spec Learning 用偏好对引导大模型
研究者提出 Spec Learning 框架,仅需少量偏好判断即可在推理时引导大模型行为,无需参数更新,在密集偏好信号的领域表现优于直接偏好优化(DPO)。
a
arXiv
·
27 天前
大语言模型
推理对齐
偏好学习
arXiv
a