通义千问发布Qwen3系列模型:性能全面升级,推理效率提升
通义千问团队近日正式发布了Qwen3系列大语言模型,这是该模型家族的最新迭代版本。此次发布的旗舰模型Qwen3-235B-A22B在代码生成、数学推理及通用能力等多个基准评估中取得了具有竞争力的成绩,其综合表现可与DeepSeek-R1、o1、o3-mini、Grok-3及Gemini-2.5-Pro等业界领先模型相媲美。
值得注意的是,团队还同步推出了采用混合专家架构的小型模型Qwen3-30B-A3B,该模型在激活参数量仅为十分之一的情况下,性能表现超越了QwQ-32B模型。此外,即便是参数量仅4B的微型模型Qwen3-4B,其性能也已达到与上一代Qwen2模型相当的水平,展现了模型架构优化带来的显著效率提升。
目前,Qwen3系列模型已在GitHub、Hugging Face、ModelScope等多个主流开源平台发布,并提供了在线演示体验。这一系列模型的推出,标志着通义千问在模型性能与推理效率的平衡上取得了新的进展。