AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
权限控制
1 篇相关内容
相关话题
AI安全
大语言模型
智能体
对齐研究
智能体安全新视角:行动对齐,而非单纯拒绝
研究表明,将聊天机器人时代‘拒绝不安全输入’的安全策略直接套用于AI智能体场景存在根本性错误,智能体安全的核心应是‘行动对齐’与‘最小权限’的外部执行。
a
arXiv
·
21 天前
AI安全
大语言模型
智能体
对齐研究
a