AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
微调
2 篇相关内容
相关话题
AI安全
语言模型
模型对齐
涌现现象
大语言模型
模型安全
多语言
大模型“涌现式错位”是真实现象还是数据假象?
最新研究对语言模型训练中报告的“涌现式错位”现象提出质疑,发现该现象对数据集表面特征高度敏感,其稳健性可能被高估。
a
arXiv
·
8 天前
语言模型
模型对齐
涌现现象
微调
a
多语言微调暗藏安全风险:良性数据也会削弱大模型安全性
最新研究发现,使用良性多语言数据微调大语言模型,可能意外导致模型对恶意提示的防御能力下降,且安全影响在不同语言间差异显著。
a
arXiv
·
21 天前
大语言模型
模型安全
多语言
微调
a