AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
模型控制
2 篇相关内容
相关话题
大模型
潜在空间
可信AI
语言模型
大语言模型
推理对齐
偏好学习
arXiv
大模型潜在空间新探索:用控制向量与校准器提升可信度
研究团队提出利用大模型潜在空间实现行为控制与输出校准的新方法,通过控制向量干预模型行为,并开发潜在空间校准器评估输出可信度。
a
arXiv
·
19 天前
大模型
潜在空间
模型控制
可信AI
a
无需微调!推理时对齐新框架:Spec Learning 用偏好对引导大模型
研究者提出 Spec Learning 框架,仅需少量偏好判断即可在推理时引导大模型行为,无需参数更新,在密集偏好信号的领域表现优于直接偏好优化(DPO)。
a
arXiv
·
27 天前
大语言模型
推理对齐
偏好学习
arXiv
a