AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
模型泛化
2 篇相关内容
相关话题
arXiv研究
强化学习
AI对齐
有益AI
大语言模型
硬件设计
RTL编码
强化学习能否训练出广泛且持久有益的人工智能模型?
研究表明,在现实领域中对有益行为进行强化学习,能显著提升AI模型在训练分布之外的泛化对齐能力,并增强其抵抗恶意引导的持久性。
a
arXiv
·
27 天前
强化学习
AI对齐
模型泛化
有益AI
a
大语言模型在硬件设计中的局限:RTL编码的失败与泛化瓶颈
研究发现,大语言模型在硬件设计领域面临严峻挑战,尤其在将顺序编程思维转化为并行硬件逻辑时,存在不可逾越的泛化天花板,模型表现受限于预训练知识而非对齐技术。
a
arXiv
·
31 天前
大语言模型
硬件设计
RTL编码
模型泛化
a