7月21日,阿里巴巴集团发布了最新的图像生成基础模型Qwen-Image-3.0,该模型在图像生成领域取得了显著的技术进步。Qwen-Image-3.0支持最大4.5ktoken的超长输入,能够一次性生成包含公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解和复杂UI界面。此外,该模型还支持12国语言和20多款字体的原生渲染,实现了字字清晰,大幅降低了多语言产品海报、影视/漫画分镜等商业素材的生产成本。
Qwen-Image-3.0的核心优势体现在内容丰实、细节真实和知识厚实三个维度。在内容丰实方面,模型能够轻松生成报纸、分镜、试卷等复杂版面,支持10px小字精准渲染,以及逼真的微观级刻画。在知识厚实方面,Qwen-Image-3.0拥有覆盖12国语言、多种字体、100+艺术风格和多种UI界面的渲染能力,展现了模型对世界知识的深度理解。
目前,阿里云百炼、千问AI平台已开通API邀测,QwenStudio和千问APP也即将上线供用户免费体验。Qwen-Image-3.0的推出,预示着图像生成技术在设计、内容创作、教育、电商等领域的应用潜力,有望成为提升生产力的重要工具。


