AI360
资讯
首页
专栏
快讯
应用中心
API 平台
#
机器学习研究
1 篇相关内容
相关话题
AI对齐
Anthropic
Claude
大模型安全
Anthropic发布新研究:如何减少AI代理行为中的“目标错位”问题
Anthropic发布最新研究成果,探讨了在训练AI助手Claude过程中,如何有效减少“代理行为错位”这一核心挑战,旨在提升AI与人类意图的一致性。
A
Anthropic
·
27 天前
AI对齐
Anthropic
Claude
大模型安全
A