新在哪
- 从"好看"转向"好用":官方说这一代的核心是"真",1.0 主打"精准"、2.0 主打"精准、多样、完整、美观、真实",3.0 把目标收到一个词——让生成图能直接当生产力工具用。
- 提示词上限拉到约 4500 token:一次能塞进大段说明,直接生成排版复杂的版面,比如报纸、分镜脚本、试卷。
- 10px 小字也能清楚渲染:连毛孔、发丝这种微观细节都在官方展示的还原范围内。
- 支持 12 种语言原生渲染:日语、韩语、西班牙语等直接生成,还能模拟网页、游戏界面、直播画面这类真实界面。
适合做什么
- 信息密度极高的版面:报纸排版、分镜脚本、试卷、说明书。
- 需要小字也清楚的场景:UI 截图模拟、图表标注。
- 多语言物料:不只中英文,还有日、韩、西等 12 种语言原生生成。
提示词要点
- 把排版结构直接写进提示词:要几栏、标题放哪、图文比例,说得越细越接近专业排版设计。
- 长提示词放心用:约 4500 token 的空间足够描述完整的版面逻辑,不用担心写太长。
- 小字内容直接写文本:想要清楚的小字标注,把具体文字内容写进提示词,而不是留给模型自由发挥。
- 用负向提示词排除干扰元素:接口支持 negative_prompt 字段,把不想要的元素写进去。
- 按需求选提示词扩写模式:想要模型自己发挥创意用 agent 模式(仅文生图支持),要稳定还原原意就用 direct 模式或直接关闭。
生成一张科技类报纸头版排版:顶部主标题"人工智能改变城市交通",
左侧大图配图说明文字,右侧三栏正文排版,底部一条数据图表带坐标轴标签,
整体黑白报纸印刷质感,标题字号明显大于正文。
已知限制
- 改图一次最多给 3 张参考图,比上一代 2.0 系列的 4 张更少。
- 官方这篇发布文章没有提供参数量、跑分或技术报告等模型细节,透明度不如阿里通义自己那条持续开源的 Qwen-Image 系列(见 qwen-image 词条)。
- 提示词扩写的 agent 模式只在文生图里能用,改图任务不支持。
在 Nomi 里怎么用
在生成画布里新建一张图片卡,模型框里选「Qwen-Image 3.0」,再选生成方式(文生图、改图),放好参考素材、写提示词,点生成。分镜表里也能给每个镜头单独选它。第一次用,先在「设置 → 模型」里接上面列出的任意一家。





