通义千问发布Qwen-Image图像模型,原生文本渲染能力显著提升

近日,通义千问团队正式推出Qwen-Image图像基础模型。该模型采用20B参数的MMDiT架构,在复杂文本渲染任务中表现突出,能够精准处理多行布局、段落级语义及细粒度细节的文本生成。同时,模型在精确图像编辑方面也取得显著进展,支持字母语言等多种文本类型的原生渲染。用户现可通过Qwen Chat平台体验最新模型,选择“图像生成”功能即可使用。团队已在GitHub、Hugging Face、ModelScope等平台开放模型资源,并提供在线演示与社区交流渠道。

通义千问图像生成多模态模型文本渲染AI绘画

原文来源:https://qwenlm.github.io/blog/qwen-image/

相关阅读

通义千问Qwen2.5正式发布,开源阵容再创新高
通义千问开源Qwen2.5-Coder系列:32B版本媲美GPT-4o,覆盖多尺寸与编程语言
通义千问Qwen2.5-Turbo发布:上下文长度突破100万tokens
通义千问发布QwQ模型:以哲学思辨探索认知边界
通义千问发布视觉增强大模型QVQ,探索语言与视觉融合新路径

← 返回