通义千问发布Qwen2.5-VL-32B:更智能、更轻量的视觉语言模型
今年1月底,通义千问团队发布了Qwen2.5-VL系列模型,获得了社区的广泛关注和积极反馈。基于该系列的成功基础,团队持续通过强化学习技术对模型进行优化,并于近日在Apache 2.0开源协议下,推出了备受期待的32B参数规模新版本——Qwen2.5-VL-32B-Instruct。
相较于此前发布的Qwen2.5-VL模型,新版本在保持高性能的同时,通过算法优化实现了模型轻量化改进。该模型延续了通义千问在视觉语言理解方面的技术优势,能够更好地处理图像与文本的多模态交互任务。开源协议的采用将进一步降低开发者使用门槛,促进多模态AI技术的生态发展。
目前,该模型已在GitHub、Hugging Face、ModelScope等主流平台同步发布,开发者可通过官方Discord社区获取最新技术支持和更新信息。这一发布标志着通义千问在多模态大模型领域的技术迭代进入新阶段。