Claude Opus 4.7 机器人任务测试:效率超人类团队20倍
Anthropic近日公布了代号'Project Fetch'第二阶段的最新测试结果,重点评估其大模型Claude在协助员工完成复杂机器人任务方面的能力。测试数据显示,最新版本Claude Opus 4.7在完全无人干预的情况下,执行各类机器人操作任务的速度表现惊人——相比不到一年前参与测试的最快人类团队,其任务完成效率提升了约20倍。
这项测试延续了Anthropic对AI在物理世界任务中应用潜力的探索。虽然具体任务细节未完全公开,但可以确定的是,这些任务属于'复杂机器人操作'范畴,需要一定的认知理解和物理协调能力。值得注意的是,此次测试中Claude完全自主运行,未接收任何人类实时指导,这标志着AI在机器人控制领域的自主性迈出了重要一步。
Anthropic表示,这一突破性进展不仅展示了大型语言模型在机器人领域的应用潜力,也为未来AI与物理世界的深度融合提供了重要参考。公司将继续推进相关研究,探索AI在更广泛现实场景中的应用可能性。
原文来源:https://www.anthropic.com/research/project-fetch-phase-two