阿里巴巴通义千问 · 图片模型

Qwen-Image 3.0

阿里通义新一代图片模型,主打"能用"而不只是"好看":约 4500 token 的长提示词、10px 小字都能清楚渲染。

发布 2026-07-22 · 最后核对 2026-09-28

新在哪

  • 从"好看"转向"好用":官方说这一代的核心是"真",1.0 主打"精准"、2.0 主打"精准、多样、完整、美观、真实",3.0 把目标收到一个词——让生成图能直接当生产力工具用。
  • 提示词上限拉到约 4500 token:一次能塞进大段说明,直接生成排版复杂的版面,比如报纸、分镜脚本、试卷。
  • 10px 小字也能清楚渲染:连毛孔、发丝这种微观细节都在官方展示的还原范围内。
  • 支持 12 种语言原生渲染:日语、韩语、西班牙语等直接生成,还能模拟网页、游戏界面、直播画面这类真实界面。

适合做什么

  • 信息密度极高的版面:报纸排版、分镜脚本、试卷、说明书。
  • 需要小字也清楚的场景:UI 截图模拟、图表标注。
  • 多语言物料:不只中英文,还有日、韩、西等 12 种语言原生生成。

提示词要点

  • 把排版结构直接写进提示词:要几栏、标题放哪、图文比例,说得越细越接近专业排版设计。
  • 长提示词放心用:约 4500 token 的空间足够描述完整的版面逻辑,不用担心写太长。
  • 小字内容直接写文本:想要清楚的小字标注,把具体文字内容写进提示词,而不是留给模型自由发挥。
  • 用负向提示词排除干扰元素:接口支持 negative_prompt 字段,把不想要的元素写进去。
  • 按需求选提示词扩写模式:想要模型自己发挥创意用 agent 模式(仅文生图支持),要稳定还原原意就用 direct 模式或直接关闭。
生成一张科技类报纸头版排版:顶部主标题"人工智能改变城市交通",
左侧大图配图说明文字,右侧三栏正文排版,底部一条数据图表带坐标轴标签,
整体黑白报纸印刷质感,标题字号明显大于正文。

已知限制

  • 改图一次最多给 3 张参考图,比上一代 2.0 系列的 4 张更少。
  • 官方这篇发布文章没有提供参数量、跑分或技术报告等模型细节,透明度不如阿里通义自己那条持续开源的 Qwen-Image 系列(见 qwen-image 词条)。
  • 提示词扩写的 agent 模式只在文生图里能用,改图任务不支持。

在 Nomi 里怎么用

在生成画布里新建一张图片卡,模型框里选「Qwen-Image 3.0」,再选生成方式(文生图、改图),放好参考素材、写提示词,点生成。分镜表里也能给每个镜头单独选它。第一次用,先在「设置 → 模型」里接上面列出的任意一家。

出处

商业级体验,模型按原价。

macOS · Windows · AGPL-3.0 · 不用注册

下载 Nomi
选择适合这台电脑的版本

能识别系统时会直接下载;无法可靠判断 Mac 芯片时,请选择对应安装包。

macOS 第一次打开

当前 macOS 安装包未使用 Apple Developer ID 签名,也未经过 Apple 公证。请只使用本页或 Nomi GitHub 官方仓库的下载链接。

  1. 下载对应的 DMG,把 Nomi 拖到“应用程序”。
  2. 在 Finder 的“应用程序”中右键 Nomi,选择“打开”,再确认“打开”。
  3. 如果仍被拦截,打开“系统设置” → “隐私与安全”,找到 Nomi 后点击“仍要打开”。

仅当 macOS 提示 Nomi“已损坏”时:先确认安装包来自上述官方链接,再打开“终端”运行:

xattr -dr com.apple.quarantine "/Applications/Nomi.app"

不需要、也不要全局关闭 Gatekeeper。