AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
安全框架
2 篇相关内容
相关话题
AI安全
LLM智能体
工具调用
上下文感知
AI代理
行为治理
可验证性
arXiv研究
Safety Sentry:为AI智能体引入上下文感知的三路安全路由机制
研究团队提出Safety Sentry框架,将传统二元安全判断扩展为“执行-询问-拒绝”三路决策,通过单次解码调用实现轻量级安全防护,显著提升LLM智能体工具调用的安全性。
a
arXiv
·
5 天前
AI安全
LLM智能体
工具调用
安全框架
a
AgentBound:为自主AI代理提供可验证的行为治理框架
研究人员提出AgentBound框架,通过三重权威评估机制和加密可验证的治理凭证,为自主AI代理提供运行时行为监督,将治理从依赖信任转变为可独立验证的过程。
a
arXiv
·
20 天前
AI代理
行为治理
可验证性
安全框架
a