通义千问开源Qwen2.5-Coder系列:32B版本媲美GPT-4o,覆盖多尺寸与编程语言

阿里云通义千问团队正式开源Qwen2.5-Coder系列代码大模型,该系列以“强大、多样、实用”为核心理念,致力于推动开源代码大模型生态发展。其中,Qwen2.5-Coder-32B-Instruct表现尤为突出,在多项基准测试中达到当前开源代码模型的最高水平(SOTA),其综合编程能力可与GPT-4o相媲美。该模型不仅具备强大的代码生成、理解和调试能力,还保持了优秀的通用任务处理与数学推理性能。

系列同时强调多样性布局:在已开源的1.5B和7B版本基础上,新增14B和32B两种尺寸,形成覆盖从轻量到高能力的完整矩阵。模型支持Python、Java、C++、JavaScript等主流编程语言,并针对SQL、Bash等专用语言进行专项优化。团队特别优化了模型的长上下文处理能力,支持128K上下文长度,满足复杂代码库的分析需求。

所有模型已在Hugging Face、ModelScope等平台开源,并提供在线演示。此次发布标志着国产代码大模型在专业化与实用化道路上迈出重要一步,为开发者社区提供了更丰富的工具选择。

代码大模型通义千问开源模型编程AI阿里云

原文来源:https://qwenlm.github.io/blog/qwen2.5-coder-family/

相关阅读

通义千问Qwen2.5正式发布,开源阵容再创新高
通义千问Qwen2.5-Turbo发布:上下文长度突破100万tokens
通义千问发布QwQ模型:以哲学思辨探索认知边界
通义千问发布视觉增强大模型QVQ,探索语言与视觉融合新路径
通义千问团队探索数学推理过程监督新方法,提升大模型可靠性

← 返回