阿里发布最新图像模型Qwen-Image-3.0

赖奇春 2026-07-22 21:30:00

7月21日,阿里发布最新图像生成基础模型Qwen-Image-3.0。新模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面,同时支持12国语言和20多款字体原生渲染,大幅降低多语言产品海报、影视/漫画分镜等“可读可用”商业素材的生产成本。

据介绍,Qwen-Image-3.0着重提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了4.5倍的跃升。在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话,而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,从而让模型更精准地生成图文内容,减少反复生成和人工调试成本。凭借Qwen-Image-3.0对于语义并置和空间控制能力的极致把握,新模型可一次性生成涵盖9种不同领域的9宫格知识图解。

得益于Qwen-Image-3.0的"生图编辑一体化"模型架构,新模型在文生图中积累的文字渲染能力、细节质感和世界知识也自然迁移到了编辑场景中,诸如古画修复、全景图生成、手绘草图转PPT、多镜头机位生成等复杂编辑任务,均可一键完成。新模型能够在保持原图结构与语义一致性的基础上,精准执行局部改写、内容扩展和风格迁移,让图像创作从单次生成走向可持续迭代的完整工作流。

据了解,阿里云百炼、千问AI平台已开通API邀测,Qwen Studio和千问APP也即将上线供免费体验。