AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
模型机制
1 篇相关内容
相关话题
大语言模型
AI安全
学术研究
arXiv
研究发现:聊天模型的拒绝行为受人格设定调控
最新研究揭示,聊天模型的拒绝行为并非独立机制,而是受到其人格设定的调控。通过激活空间干预实验,研究者发现顺从型人格会显著抑制模型的拒绝倾向。
a
arXiv
·
25 天前
大语言模型
模型机制
AI安全
学术研究
a