AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
熵分析
1 篇相关内容
相关话题
大语言模型
安全对齐
越狱攻击
模型可解释性
破解大模型越狱攻击新视角:中间层熵动态变化暗藏玄机
研究发现,大语言模型在遭遇越狱攻击时,其内部中间层的熵值动态变化会呈现特定模式,这为检测恶意意图提供了新线索。
a
arXiv
·
26 天前
大语言模型
安全对齐
越狱攻击
模型可解释性
a