AI智能体能力最新评测:阿里通义千问Qwen3.8登顶全球榜首

近日,国际知名AI评测机构Artificial Analysis发布最新智能体能力评估榜单。在该榜单中,阿里巴巴集团研发的通义千问大模型Qwen3.8版本表现突出,综合得分位列全球第一。

此次评测聚焦于大模型的智能体能力,即模型作为自主智能体执行复杂任务、规划推理和与环境交互的综合表现。Qwen3.8凭借其在多轮对话、任务分解、工具调用和决策规划等方面的优异表现,超越了包括GPT-4、Claude等在内的国际主流大模型,成为该榜单的领跑者。

这一成绩标志着中国自主研发的大模型在AI智能体这一前沿领域取得了重要突破。智能体能力被认为是实现通用人工智能的关键路径之一,其发展将深刻影响未来AI应用的广度和深度。阿里通义千问团队表示,将继续推进大模型的技术创新和生态建设。

行业观察人士指出,随着全球AI竞赛进入深水区,智能体能力的比拼将成为新的焦点。中国大模型在此领域的快速进步,为全球AI发展格局注入了新的活力。

大模型阿里云AI智能体行业评测通义千问

原文来源:https://www.qbitai.com/2026/08/467444.html

← 返回