通义千问发布Qwen-Image图像模型,原生文本渲染能力显著提升
近日,通义千问团队正式推出Qwen-Image图像基础模型。该模型采用20B参数的MMDiT架构,在复杂文本渲染任务中表现突出,能够精准处理多行布局、段落级语义及细粒度细节的文本生成。同时,模型在精确图像编辑方面也取得显著进展,支持字母语言等多种文本类型的原生渲染。用户现可通过Qwen Chat平台体验最新模型,选择“图像生成”功能即可使用。团队已在GitHub、Hugging Face、ModelScope等平台开放模型资源,并提供在线演示与社区交流渠道。