AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
人格向量
2 篇相关内容
相关话题
大语言模型
认知科学
模型身份
arXiv研究
大模型安全
对齐研究
微调技术
arXiv
大语言模型身份之谜:不同训练模式下的人格向量会“分裂”吗?
最新研究通过实验发现,大语言模型在不同操作模式下提取的人格向量存在显著差异,挑战了现有理论中关于模型身份识别的核心假设。
a
arXiv
·
19 天前
大语言模型
认知科学
人格向量
模型身份
a
自我认知微调:预防与逆转大模型“黑化”的新方法
研究发现,大模型“黑化”源于其内在人格的混乱而非直接学习有害内容。通过自我生成文本识别微调,可有效预防和逆转这种不良倾向。
a
arXiv
·
27 天前
大模型安全
对齐研究
微调技术
人格向量
a