Skip to content

官方提示词公式

即梦背后的模型是字节的 Seedance 系列。字节把提示词写法写进了火山引擎的开发者文档里——这是唯一的官方一手资料,比任何自媒体教程都可靠。

本册所有引用块里的内容都是官方原文,出处见附录的官方链接

精准主体 + 动作细节 + 场景环境 + 光影色调 + 镜头运镜 + 视觉风格 + 画质 + 约束条件

官方对这个顺序的解释:

先锁定“谁”在“干什么”,再交代“在哪”“什么氛围”,然后告诉模型“怎么拍”,最后用风格、画质和约束条件把结果收紧。

官方还给了一段很关键的模型原理说明:

Seedance 2.0 本质上是一个多模态 AI 导演:同时读取你的文字提示词、图片、视频、音频,并在内部拆成“空间层”(画面里有什么)和“时间层”(事情如何随时间变化)两个维度来理解和生成画面。

因此,好的提示词不是单纯的“文案型形容”,而是“工程型指令”:谁、在什么场景、做什么动作、镜头如何运动、按怎样的时间顺序发生,分别投递给空间层和时间层。

“工程型指令,不是文案型形容”——这一句是整份文档的题眼。你写的不是散文,是施工单。

主体 + 运动 + 环境(非必须)+ 运镜/切镜(非必须)+ 美学描述(非必须)+ 声音(非必须)

这个更简短,适合单镜头。注意后面四项官方都标了“非必须”——主体和运动才是必填项

配套的三条基础原则(官方原文):

描述必要的信息:给出主体、运动的限定描述;给出画面应体现的直观信息;善用程度副词。

描述清晰的信息:prompt 与画面、音频形成正确对应;用特征指定主体,指定方式全程一致。

做精准的切镜描述:明确区分每个镜头,告诉模型确切的切镜信息;精准撰写切镜的时机;切镜之间有明确的景别/内容区分。

1.0 没给一条总公式,是按板块教的:动作指令 → 镜头语言 → 多风格直出 → 控制美感 → 多镜头 → 创意特效 → 画幅遵循。基础句式就是「主体 + 动作」。

版本 特点 适合
Seedance 2.0 系列 原生音视频联合生成,多模态参考最强,支持时间轴分镜 漫剧主力,尤其需要对白配音时
Seedance 1.5 Pro 专攻音画同步,口型毫秒级对齐,支持多语言方言 对白密集的戏、需要方言的场景
Seedance 1.0 pro 多镜头叙事能力强,1080P 纯画面、不需要音频时
Seedance 1.0 pro fast 速度快约 3 倍,价格降 72% 试错阶段用这个省钱

按 2.0 进阶公式逐项填空:

公式项 填什么
精准主体 25 岁亚洲男性,短碎黑发,浅灰色衬衫袖口挽起
动作细节 猛然抬头,瞳孔收缩,手指攥紧背包带
场景环境 晚高峰地铁车厢内,周围乘客面无表情
光影色调 车厢顶灯冷白,冷蓝光从侧面打在脸上
镜头运镜 镜头缓慢推近至面部特写
视觉风格 2D 日漫风格国漫质感,赛璐璐上色
画质 高清,细节丰富,电影质感
约束条件 人物面部稳定不变形,保持无字幕,不要生成水印

拼起来:

2D日漫风格国漫质感,赛璐璐上色。晚高峰地铁车厢内,25岁亚洲男性,
短碎黑发,浅灰色衬衫袖口挽起,猛然抬头,瞳孔收缩,手指攥紧背包带,
周围乘客面无表情。车厢顶灯冷白,冷蓝光从侧面打在脸上。
镜头缓慢推近至面部特写。高清,细节丰富,电影质感。
人物面部稳定不变形,保持无字幕,不要生成水印。