Skip to content

官方常见问题全 12 条

这一页是整份指南可信度最高的内容——全部来自火山引擎 Seedance 2.0 官方文档的「常见问题」章节,是字节自己承认的模型局限和官方给出的解法。

出问题时先在这张表里对症状:

症状 跳转
角色中途换脸、跟参考图不像 问题 1
画面莫名其妙冒出字幕 问题 2
出现别的平台的水印 Logo 问题 3
想要动漫风却生成了真人 问题 4
拼接处画面跳变 问题 5
同一画面出现两个一样的人 问题 6
续写后画质越来越糊 问题 7
特效不是想要的样子 问题 8
人数对不上、多人或少人 问题 9
片尾有咔哒杂音 问题 10
角色名字被读错 问题 11
配音音色跟参考的不像 问题 12

现象:生成的角色与参考图不一致,或视频中途「换脸」,甚至因撞脸明星被审核拦截。

官方根因分析

  • 人脸参考图的有效性不足
  • 参考图混用:把人脸参考图与全身/半身姿态图、服装参考图合并在同一张图里
  • 人脸占比过小:混用图中人脸区域太小,模型提取特征时权重不够

官方解决方案

准备人脸特写图:在原有全身照之外,额外准备一张只包含角色头部的人脸特写图(大头照,仅保留面部,无表情最佳,尽量减少肩颈、背景等干扰元素)。

提示词中主体定义清晰:<主体1>的面部特征参考图片1(大头照),妆造参考图片2(全身照)。

重要素材前置:越需要精准参考的素材,放在提示词中越靠前的位置。

官方特别提醒

人物参考使用大头照 + 全身照即可,不建议使用人物多视图。多视图素材包含同一人物的不同角度,模型易将其识别为多个不同主体,反而加剧 ID 漂移问题。


现象:提示词没要求字幕,生成结果却带字幕。

官方解决方案(注意官方的坦诚措辞):

说明:目前无法直接做到 100% 避免生成字幕,只能通过以下方法降低其出现概率、提升抽卡成功率。

在提示词中加入明确的约束指令:“保持无字幕”、“避免生成任何文字或字幕”。

如果参考的图片/视频中包含的文字并非必要信息,建议先通过工具去除文字,再使用无文字素材作为输入。

在业务允许的前提下,优先选择横屏尺寸生成视频(横屏生成字幕的概率明显低于竖屏),后续可通过剪辑软件裁剪为竖屏。


现象:提示词没提水印,结果带了其他视频平台的 Logo。

官方解决方案

在提示词中加入明确的约束指令:“不要生成水印”、“不要生成Logo”。


现象:想要 2D/3D 动漫风,但参考图偏写实、提示词又没强调风格,结果漂成真人写实。

官方解决方案

在提示词中加入明确的风格约束词,例如“2D日漫风格”、“3D国风漫画”。如果需要更精准的风格控制,建议将参考图先变为目标风格再进行生视频。

对漫剧的含义:如果你用真人照片当角色参考,一定要先把照片转成动漫风的图,再拿去生成视频。


现象:用视频延长功能生成新片段后拼接,衔接处画面跳变、回退。

官方解决方案(很具体,可直接照做):

当前建议通过后期剪辑修补,对齐关键帧。

  1. 将待拼接的视频导入剪映或其他专业视频剪辑软件
  2. 在第一个衔接处,将前一段视频的末尾删减 6 帧
  3. 同时,将后一段视频的开头删减 1 帧
  4. 对所有的拼接点重复以上操作
  5. 导出并检查拼接后视频的流畅度

官方补充

视频帧对齐后,仍可能存在细微跳变,建议在续写生成视频的时候以转场切镜的时刻结尾,下一段视频以结尾切镜后的新场景为起始。


现象:画面人物较多且传了三视图作参考时,同一画面出现两个完全相同的人。

官方根因:提示词对人物主体定义不清晰;三视图/多视图造成模型识别混淆。

官方解决方案

说明:目前无法直接做到 100% 避免双胞胎问题,只能通过以下方法降低其出现概率。

明确人物主体关联:在提示词中清晰定义每个人物角色,明确角色与参考图的对应关系。建议在人物名称后标注对应参考图,并保持格式统一。

示例:张三(对应图片 1)将绿色存折扔向站立的李四(对应图片 2)。

添加全局约束指令:在提示词末尾增加固定约束:视频全程禁止出现外形、着装、配饰完全一致的人物,禁止生成同款分身、双胞胎效果,同一画面中仅保留单个对应人物,不出现人物重复复刻。

优化参考素材:人物参考图优先使用单人独立照片,不建议使用三视图、多视图素材。

精简优化提示词:请勿直接将完整剧本作为提示词使用,文案内容过度冗余易造成模型理解混乱。


现象:拿模型生成的视频再去续写,画质变差;多次续写会叠加劣化,人脸区域出现斑驳色块。

官方解决方案

将原始视频通过 Seedance 2.0 转为白模视频,再作为续写输入素材。

参考提示词:将视频转为白色 3D 模型,人物统一为纯白 3D 模型,无色彩、无纹理、无阴影,纯白背景,结构稳定、运动流畅。

优先选用高清图片作为参考素材。

合理控制视频续写次数,避免多次叠加续写。


现象:用文字描述特效时结果跑偏。官方举的例子是——要求「数字 2999 以倒计时动画出场」,实际生成的数字滚动特效无序跳变。

官方解决方案

建议采用参考视频定义特效:将目标特效视频作为参考素材输入模型,让模型精准理解特效形态与运动逻辑。例如:数字“2999”出场方式参考视频1。


现象:参考人物超过 4 人时,输出稳定性下降,出现人数不符或人物重复。

官方解决方案

分步生成图片:将人物分组,确保每组生成的图片中人物数量不超过 4 人。例如,6 个人可分成 2 组,每组 3 人,分别生成图片。

图片生成视频:使用第一步生成的多张分组图片作为参考素材,再生成最终视频。


现象:视频含旁白时,片尾出现突兀的咔哒声、截断杂音。

官方解决方案(剪映操作步骤):

  1. 将生成的视频导入剪映
  2. 在时间轴上选中视频轨道,点击工具栏中的音频
  3. 选择音量包络线功能(部分版本位于基础/调节菜单内),并选择关键点
  4. 在视频临近结尾处,将末尾音量关键点下拉至音量为 0,形成一个向下的斜坡
  5. 预览确认片尾音频自然淡出

现象:多音字、生僻字、形近字被读错。

官方解决方案

可将易读错文字替换为发音一致的常用同音字。注意该方案仅为优化手段,无法完全规避所有发音问题。

示例:可将提示词中“螭龙山”改写为同音字“吃龙山”。


现象:用参考音频指定音色,生成结果的音色偏差明显。

官方解决方案

在提示词中补充细致的音色特征描述,可参考 Seedance 1.5 pro 提示词指南。

保持视频台词风格与参考音频的语气、表述风格相近,有助于提升音色还原度与稳定性。

音色描述公式见符号语法那一页