新在哪
- 是 Z-Image-Turbo 背后的基础模型:同样 6B 参数、Single-Stream DiT 架构,但保留完整 50 步生成流程,换来更高的多样性和可控性。
- 支持有效的负向提示词:这一点 Turbo 版本因为 CFG-free 蒸馏做不到,基础版可以正常用负向提示词精细排除元素。
- 面向二次开发设计:官方定位就是给社区做微调、LoRA、ControlNet 这类下游开发用的底座模型。
- 同样支持中英文双语文字渲染:画质定位为"High"(Turbo 是"Very High"但多样性更低),用更多步数换取更精细、更多样的结果。
适合做什么
- 想拿开源模型做微调、LoRA、ControlNet 训练的开发者。
- 需要负向提示词精细控制画面元素的创作场景。
- 想要更高多样性(同一句提示词能出不同构图)的批量创作。
提示词要点
- 正向负向都要写:和 Turbo 不同,这里负向提示词是有效的控制手段,善用它排除瑕疵和不想要的元素。
- guidance scale 别拉到极限:数值太高画面容易失真,官方给的参考范围是中等偏低(3.0–5.0)。
- 想要的风格直接点名:写实、二次元、艺术风格都可以,模型对风格词的响应范围很广。
- 复杂创意可以先把描述写丰富再喂给模型:官方展示了"推理增强"的用法,能借助模型的世界知识做联想式生成,而不只是字面翻译提示词。
一位老渔夫坐在木船上修补渔网,黄昏时分逆光剪影,海面波光粼粼,
背景是归航的渔船和远处的灯塔,写实摄影风格,暖橙色调,颗粒感胶片质感。
负向提示词:卡通感,过度锐化,畸形的手,模糊。
已知限制
- 50 步生成,速度比 Turbo 慢很多,不适合要求实时或低延迟的交互场景。
- 改图(编辑)能力是单独的 Z-Image-Edit 变体,这份基础模型本身主要面向文生图。
- 官方模型库表格把基础版的画质标注为"High",比 Turbo 的"Very High"低一档,如果只追求单张画质、不需要微调或多样性,Turbo 可能更合适。
在 Nomi 里怎么用
在生成画布里新建一张图片卡,模型框里选「Z-Image」,再选生成方式(文生图),放好参考素材、写提示词,点生成。分镜表里也能给每个镜头单独选它。第一次用,先在「设置 → 模型」里接上面列出的任意一家。





