AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
概念链
1 篇相关内容
相关话题
大语言模型
推理脆弱性
对抗攻击
模型安全
概念链:用自然文本隐式操控大模型推理路径
研究发现大语言模型的推理存在脆弱性,可通过生成看似普通的“概念链”段落进行隐式操控,在不直接提及答案的情况下系统性地改变模型预测偏好。
a
arXiv
·
4 天前
大语言模型
推理脆弱性
对抗攻击
模型安全
a