AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
AI 安全
2 篇相关内容
相关话题
大语言模型
AI 对齐
行为评估
Google DeepMind
网络安全
漏洞利用
Anthropic
DeepMind 新研究:评估大语言模型的行为倾向对齐性
Google DeepMind 发布研究,探讨如何评估生成式 AI 模型的行为倾向与人类价值观的对齐程度,为 AI 安全提供新视角。
G
Google DeepMind
·
26 天前
大语言模型
AI 对齐
AI 安全
行为评估
G
Anthropic 研究:大语言模型如何加速 N-day 漏洞利用开发
Anthropic 官网发布最新研究,评估大语言模型在自动化开发已公开漏洞(N-day)利用程序方面的能力与潜在影响。
A
Anthropic
·
27 天前
大语言模型
网络安全
漏洞利用
AI 安全
A