新在哪
- 音画同步生成:视频自带同步音效,不用再单独配音,官方把这个列为 3.0 系列的核心能力之一。
- 多镜头故事板:一次最多排 5 个镜头,每个镜头能单独写提示词,适合把一个小故事从头讲到尾。
- 元素参考:用
@元素名的写法,把最多 3 组人物、产品或声音素材交给模型,让它在整条视频里保持一致。 - 原生 4K 画质:官方在 2026 年 4 月称可灵是首个支持原生 4K 输出的 AI 视频模型,3.0 系列可以直接选 4K 档位出片。
适合做什么
- 要有开头、发展、结尾的多镜头短片:广告、产品展示、短剧片段。
- 角色或产品需要从头到尾长一个样的片子:用元素参考把关键素材钉住。
- 想要成片自带声音、不想后期再单独配音的项目。
提示词要点
- 先选画质档位:std(标清)、pro(高清)、4K,档位越高细节越多,生成也越慢。
- 时长按秒写清楚:3–15 秒之间任选;多镜头模式下再把总时长拆给每个镜头。
- 要声音就打开声效开关,并且具体写"什么声音",别只写"要有声音"。
- 用
@元素名引用参考素材:一条任务最多引用 3 组元素,每组最多放 2–4 张图、1 段 3–8 秒的视频,或 1 段 5–30 秒的音频。 - 给了参考图就不用自己定比例:画幅会跟着参考图自动适配。
- 多镜头要写清楚切换点:一个镜头一句话交代画面在讲什么,别把好几个场景压进一句话里。
16:9,pro 画质,15 秒,三个连续镜头,打开声效。
参考 @女孩:全程同一张脸、同一件红色外套。
镜头一(0-5秒):清晨,女孩走出咖啡店,手里端着咖啡。
镜头二(5-10秒):中景,她在长椅坐下,风吹起她的头发。
镜头三(10-15秒):远景,她望向街道尽头,笑了一下。
声音:街道环境音、风声、远处车流。不要出现多余的人物。
已知限制
- 多镜头模式只能用首帧图,不能和首尾帧一起用。
- 一条任务最多引用 3 组
@元素,每组素材数量也有上限(图 2–4 张、视频限 1 段、音频限 1 段)。 - 画质档位越高生成越慢,尤其是 4K,官方文档没给出具体慢多少。
在 Nomi 里怎么用
在生成画布里新建一张视频卡,模型框里选「可灵 3.0」,再选生成方式(文生视频、首帧生视频、首尾帧),放好参考素材、写提示词,点生成。分镜表里也能给每个镜头单独选它。第一次用,先在「设置 → 模型」里接上面列出的任意一家。





