最高 4.5K token
长篇结构化指令
接近 10px 的文字
可读的小字号文字
原生支持 12 种语言
多语言视觉文字
什么是 Qwen Image 3.0?
Qwen Image 3.0 是 Qwen 的图像生成与编辑模型,于 2026 年 7 月 21 日正式发布。你可以把结构化创意简报转化为完整视觉,再通过图像编辑继续优化结果。
- 发布日期
- 2026 年 7 月 21 日
- 官方亮点速览
- 基于 Qwen 官方发布公告
最高 4.5K token
长篇结构化指令
接近 10px 的文字
可读的小字号文字
原生支持 12 种语言
多语言视觉文字
Qwen Image 3.0 核心能力
以下四个方面来自该模型的官方发布定位。
丰富内容
遵循最高 4.5K token 的简报,在报纸、故事板、试卷、界面等复杂布局中组织高密度信息。
真实细节
呈现人物、材质、光照和物理场景中的写实微观细节。
深度知识
利用广泛的世界知识支持教育、科学、文化和信息密集型视觉。
生成与编辑
创建新图像并优化现有视觉,同时保留所需结构、内容和意图。
视觉项目的概念方向
使用这些参考图规划信息密度、字体排版、布局和编辑方向,并在制作前明确视觉方向。 这些图片是本站现有视觉素材库中的场景示意图,不是经验证的 Qwen Image 3.0 基准输出。




Qwen Image 3.0 与 2.0 对比
本表仅使用 Qwen Image 3.0 发布公告中披露的信息。
指令长度
- Qwen Image 2.0
- 未披露
- Qwen Image 3.0
- 最高 4.5K token
小字号文字
- Qwen Image 2.0
- 未披露
- Qwen Image 3.0
- 接近 10px 时仍可读
原生语言
- Qwen Image 2.0
- 未披露
- Qwen Image 3.0
- 12 种语言
内容结构
- Qwen Image 2.0
- 未披露
- Qwen Image 3.0
- 复杂布局和高密度内容
图像工作流
- Qwen Image 2.0
- 未披露
- Qwen Image 3.0
- 生成与编辑
| 能力 | Qwen Image 2.0 | Qwen Image 3.0 |
|---|---|---|
| 指令长度 | 未披露 | 最高 4.5K token |
| 小字号文字 | 未披露 | 接近 10px 时仍可读 |
| 原生语言 | 未披露 | 12 种语言 |
| 内容结构 | 未披露 | 复杂布局和高密度内容 |
| 图像工作流 | 未披露 | 生成与编辑 |
Qwen Image 3.0 适用场景
将已公开的能力匹配到结构化视觉任务。
营销海报
创建海报方向、编辑页面、活动布局和多语言出版概念。
产品与电商视觉
准备产品叙事、目录版式、社交素材和可重复的内容变体。
编辑与社交内容
在制作前规划编辑版式、文章视觉和多面板社交内容。
创意概念开发
从结构化简报探索插画方向、视觉叙事和编辑概念。
三步工作流
将长篇创意需求整理成模型可理解、可优化的简报。
描述视觉目标
定义受众、目标、格式、必要事实、视觉风格和输出限制。
明确布局与文字
描述各区块、层级、准确文案、语言、字体方向和每个视觉元素的位置。
检查并优化
核对文字、事实、结构和细节,再修改指令或定向编辑需要调整的区域。
Qwen Image 3.0 常见问题
Qwen 于 2026 年 7 月 21 日正式发布 Qwen Image 3.0。
3.0 公告重点介绍了更丰富的内容、更真实的细节、更深的知识、长指令支持、小字号文字、12 种原生语言以及生成与编辑。2.0 未披露的数值在本页标为未披露。
这意味着创意简报可包含约 4,500 个 token 的结构化要求,为区块、事实、文案、布局和风格限制提供更多空间。
Qwen 表示该模型能渲染接近 10px 的可读文字。实际可读性仍取决于图像尺寸、语言、字体、对比度和布局。
官方公告称该模型原生支持 12 种语言。完整语言列表请以 Qwen 官方发布信息为准。
可以。Qwen 在官方公告中将图像生成和图像编辑都列为支持的工作流。








