通义千问发布Qwen2.5-VL-32B:更智能、更轻量的视觉语言模型

今年1月底,通义千问团队发布了Qwen2.5-VL系列模型,获得了社区的广泛关注和积极反馈。基于该系列的成功基础,团队持续通过强化学习技术对模型进行优化,并于近日在Apache 2.0开源协议下,推出了备受期待的32B参数规模新版本——Qwen2.5-VL-32B-Instruct。

相较于此前发布的Qwen2.5-VL模型,新版本在保持高性能的同时,通过算法优化实现了模型轻量化改进。该模型延续了通义千问在视觉语言理解方面的技术优势,能够更好地处理图像与文本的多模态交互任务。开源协议的采用将进一步降低开发者使用门槛,促进多模态AI技术的生态发展。

目前,该模型已在GitHub、Hugging Face、ModelScope等主流平台同步发布,开发者可通过官方Discord社区获取最新技术支持和更新信息。这一发布标志着通义千问在多模态大模型领域的技术迭代进入新阶段。

通义千问多模态模型视觉语言模型开源AI阿里云

原文来源:https://qwenlm.github.io/blog/qwen2.5-vl-32b/

相关阅读

通义千问Qwen2.5正式发布,开源阵容再创新高
通义千问开源Qwen2.5-Coder系列:32B版本媲美GPT-4o,覆盖多尺寸与编程语言
通义千问Qwen2.5-Turbo发布:上下文长度突破100万tokens
通义千问发布QwQ模型:以哲学思辨探索认知边界
通义千问发布视觉增强大模型QVQ,探索语言与视觉融合新路径

← 返回