官方常见问题全 12 条
这一页是整份指南可信度最高的内容——全部来自火山引擎 Seedance 2.0 官方文档的「常见问题」章节,是字节自己承认的模型局限和官方给出的解法。
出问题时先在这张表里对症状:
| 症状 | 跳转 |
|---|---|
| 角色中途换脸、跟参考图不像 | 问题 1 |
| 画面莫名其妙冒出字幕 | 问题 2 |
| 出现别的平台的水印 Logo | 问题 3 |
| 想要动漫风却生成了真人 | 问题 4 |
| 拼接处画面跳变 | 问题 5 |
| 同一画面出现两个一样的人 | 问题 6 |
| 续写后画质越来越糊 | 问题 7 |
| 特效不是想要的样子 | 问题 8 |
| 人数对不上、多人或少人 | 问题 9 |
| 片尾有咔哒杂音 | 问题 10 |
| 角色名字被读错 | 问题 11 |
| 配音音色跟参考的不像 | 问题 12 |
问题 1:人物 ID 漂移
Section titled “问题 1:人物 ID 漂移”现象:生成的角色与参考图不一致,或视频中途「换脸」,甚至因撞脸明星被审核拦截。
官方根因分析:
- 人脸参考图的有效性不足
- 参考图混用:把人脸参考图与全身/半身姿态图、服装参考图合并在同一张图里
- 人脸占比过小:混用图中人脸区域太小,模型提取特征时权重不够
官方解决方案:
准备人脸特写图:在原有全身照之外,额外准备一张只包含角色头部的人脸特写图(大头照,仅保留面部,无表情最佳,尽量减少肩颈、背景等干扰元素)。
提示词中主体定义清晰:
<主体1>的面部特征参考图片1(大头照),妆造参考图片2(全身照)。重要素材前置:越需要精准参考的素材,放在提示词中越靠前的位置。
官方特别提醒:
人物参考使用大头照 + 全身照即可,不建议使用人物多视图。多视图素材包含同一人物的不同角度,模型易将其识别为多个不同主体,反而加剧 ID 漂移问题。
问题 2:视频里出现字幕
Section titled “问题 2:视频里出现字幕”现象:提示词没要求字幕,生成结果却带字幕。
官方解决方案(注意官方的坦诚措辞):
说明:目前无法直接做到 100% 避免生成字幕,只能通过以下方法降低其出现概率、提升抽卡成功率。
在提示词中加入明确的约束指令:“保持无字幕”、“避免生成任何文字或字幕”。
如果参考的图片/视频中包含的文字并非必要信息,建议先通过工具去除文字,再使用无文字素材作为输入。
在业务允许的前提下,优先选择横屏尺寸生成视频(横屏生成字幕的概率明显低于竖屏),后续可通过剪辑软件裁剪为竖屏。
问题 3:出现 Logo / 水印
Section titled “问题 3:出现 Logo / 水印”现象:提示词没提水印,结果带了其他视频平台的 Logo。
官方解决方案:
在提示词中加入明确的约束指令:“不要生成水印”、“不要生成Logo”。
问题 4:风格漂移
Section titled “问题 4:风格漂移”现象:想要 2D/3D 动漫风,但参考图偏写实、提示词又没强调风格,结果漂成真人写实。
官方解决方案:
在提示词中加入明确的风格约束词,例如“2D日漫风格”、“3D国风漫画”。如果需要更精准的风格控制,建议将参考图先变为目标风格再进行生视频。
对漫剧的含义:如果你用真人照片当角色参考,一定要先把照片转成动漫风的图,再拿去生成视频。
问题 5:延长视频衔接处跳变
Section titled “问题 5:延长视频衔接处跳变”现象:用视频延长功能生成新片段后拼接,衔接处画面跳变、回退。
官方解决方案(很具体,可直接照做):
当前建议通过后期剪辑修补,对齐关键帧。
- 将待拼接的视频导入剪映或其他专业视频剪辑软件
- 在第一个衔接处,将前一段视频的末尾删减 6 帧
- 同时,将后一段视频的开头删减 1 帧
- 对所有的拼接点重复以上操作
- 导出并检查拼接后视频的流畅度
官方补充:
视频帧对齐后,仍可能存在细微跳变,建议在续写生成视频的时候以转场切镜的时刻结尾,下一段视频以结尾切镜后的新场景为起始。
问题 6:双胞胎问题
Section titled “问题 6:双胞胎问题”现象:画面人物较多且传了三视图作参考时,同一画面出现两个完全相同的人。
官方根因:提示词对人物主体定义不清晰;三视图/多视图造成模型识别混淆。
官方解决方案:
说明:目前无法直接做到 100% 避免双胞胎问题,只能通过以下方法降低其出现概率。
明确人物主体关联:在提示词中清晰定义每个人物角色,明确角色与参考图的对应关系。建议在人物名称后标注对应参考图,并保持格式统一。
示例:张三(对应图片 1)将绿色存折扔向站立的李四(对应图片 2)。
添加全局约束指令:在提示词末尾增加固定约束:视频全程禁止出现外形、着装、配饰完全一致的人物,禁止生成同款分身、双胞胎效果,同一画面中仅保留单个对应人物,不出现人物重复复刻。
优化参考素材:人物参考图优先使用单人独立照片,不建议使用三视图、多视图素材。
精简优化提示词:请勿直接将完整剧本作为提示词使用,文案内容过度冗余易造成模型理解混乱。
问题 7:延长视频画质劣化
Section titled “问题 7:延长视频画质劣化”现象:拿模型生成的视频再去续写,画质变差;多次续写会叠加劣化,人脸区域出现斑驳色块。
官方解决方案:
将原始视频通过 Seedance 2.0 转为白模视频,再作为续写输入素材。
参考提示词:将视频转为白色 3D 模型,人物统一为纯白 3D 模型,无色彩、无纹理、无阴影,纯白背景,结构稳定、运动流畅。
优先选用高清图片作为参考素材。
合理控制视频续写次数,避免多次叠加续写。
问题 8:特效效果不符合预期
Section titled “问题 8:特效效果不符合预期”现象:用文字描述特效时结果跑偏。官方举的例子是——要求「数字 2999 以倒计时动画出场」,实际生成的数字滚动特效无序跳变。
官方解决方案:
建议采用参考视频定义特效:将目标特效视频作为参考素材输入模型,让模型精准理解特效形态与运动逻辑。例如:数字“2999”出场方式参考视频1。
问题 9:参考人物过多
Section titled “问题 9:参考人物过多”现象:参考人物超过 4 人时,输出稳定性下降,出现人数不符或人物重复。
官方解决方案:
分步生成图片:将人物分组,确保每组生成的图片中人物数量不超过 4 人。例如,6 个人可分成 2 组,每组 3 人,分别生成图片。
图片生成视频:使用第一步生成的多张分组图片作为参考素材,再生成最终视频。
问题 10:视频结尾有噪音
Section titled “问题 10:视频结尾有噪音”现象:视频含旁白时,片尾出现突兀的咔哒声、截断杂音。
官方解决方案(剪映操作步骤):
- 将生成的视频导入剪映
- 在时间轴上选中视频轨道,点击工具栏中的音频
- 选择音量包络线功能(部分版本位于基础/调节菜单内),并选择关键点
- 在视频临近结尾处,将末尾音量关键点下拉至音量为 0,形成一个向下的斜坡
- 预览确认片尾音频自然淡出
问题 11:中文发音不准
Section titled “问题 11:中文发音不准”现象:多音字、生僻字、形近字被读错。
官方解决方案:
可将易读错文字替换为发音一致的常用同音字。注意该方案仅为优化手段,无法完全规避所有发音问题。
示例:可将提示词中“螭龙山”改写为同音字“吃龙山”。
问题 12:音色参考不准
Section titled “问题 12:音色参考不准”现象:用参考音频指定音色,生成结果的音色偏差明显。
官方解决方案:
在提示词中补充细致的音色特征描述,可参考 Seedance 1.5 pro 提示词指南。
保持视频台词风格与参考音频的语气、表述风格相近,有助于提升音色还原度与稳定性。
音色描述公式见符号语法那一页。