Anthropic 推出新基准:评估大语言模型生成漏洞利用的能力
近日,Anthropic 在官网宣布推出了两项具有挑战性的新学术基准测试。这两项测试旨在衡量大型语言模型在生成漏洞利用代码方面的能力。同时,该公司还更新了用于评估智能合约漏洞利用的基准测试版本。这些基准测试的推出,反映了业界对 AI 模型安全性和潜在滥用风险的持续关注。通过量化模型在发现和利用安全漏洞方面的“能力”,有助于研究人员和开发者更好地理解模型的风险边界,并推动开发更安全、更可靠的 AI 系统。此举也是 Anthropic 致力于负责任 AI 发展的一部分,旨在为 AI 安全评估提供更严谨、更标准化的工具。