Seedance 性能指南

在 Flick 中使用 Seedance 来指导表演、对话、声音和时机。

将表演描述为按发生顺序排列的可见或可听动作

  • 不要仅依赖抽象的情绪标签。
  • 不要在短镜头中加载过多动作。
  • 不要假设模型会自行推断动作顺序、说话顺序或音频层次。

将这些示例作为起点。检查每个结果并逐一调整指令。


核心规则

将表演描述为模型可以在视觉或听觉上执行的事物

不要这样写:

  • 她很悲伤
  • 他看起来可疑
  • 表达感觉充满情感

而要这样写:

  • 她的眼睛停止移动一拍
  • 他的下巴微微收紧
  • 她在开口前轻吸一口气
  • 声音低沉、带呼吸感且克制
  • 听到台词后,她没有立即回答

具体的动作和时间顺序比单纯的情绪标签更能为模型提供清晰的指导。


一个短镜头 = 一个主要表演节奏

当每个镜头只包含一个主要表演任务时,短片段会更容易控制。

与其在一个短片段中同时包含行走、坐下和打开书本,不如选择一个节奏:

他走到桌边坐下。

用另一个镜头来表现打开书本的动作。


按发生顺序描写动作

不要将动作堆砌成列表,并期望模型能正确解析时间顺序。

使用清晰的顺序词:

  • 首先
  • 然后
  • 在……之后
  • 只有在……之后
  • 在……之前
  • 全程
  • 同时保持

这在以下情况中尤其重要:

  • 情绪转变
  • 道具使用
  • 对白时机
  • 动作连贯性
  • 口型同步
  • 多角色场景

良好的结构:

她最初保持静止。

听到他的话后,她的眼神停住了。

她的下巴微微绷紧。

她回看着他,但没有说话。


将角色动作与镜头动作分开

不要将表演和摄影机运动合并成一个模糊的句子。

将它们写成两个不同的层次:

角色:

她缓缓将头转向声音的方向。

镜头:

锁定中景镜头。镜头不移动。

如果镜头移动,只给它一个明确的任务。

好的示例:

角色:

两个角色以稳定的步速向前走。

镜头:

镜头保持在他们前方,以他们行走的速度向后移动。

在整个过程中保持相同的距离、平视构图和景别。


在时间节奏重要时使用时间窗口

时间码不是必需的,但在以下情况下会很有用:

  • 镜头时长超过几秒钟
  • 动作有多个阶段
  • 情绪随时间变化
  • 音频和表演需要节奏控制

示例:

  • 0-3 秒
  • 3-6 秒
  • 首先...然后...
  • 短暂停顿后...

时间窗口是大致的指示,而非精确的剪辑关键帧。

用它们来描述节奏,然后检查生成的时间。


将语音表演拆解为可控维度

不要只写悲伤的声音或愤怒的声音。

将声音表演拆解为多个部分:

  • 音量:轻声或几乎是耳语。
  • 节奏:稳重、急促或缓慢并带有停顿。
  • 停顿:在短语后短暂停顿。
  • 呼吸:说话前轻轻吸气一次。
  • 强调:在最后一个词上稍加重音。
  • 表达方式:克制的紧迫感、警惕的温暖或冷淡的怀疑。

示例:

他说:"谁看见他离开了?"

低沉、直接且克制。

自然的对话节奏。

在"离开"之前短暂停顿,最后一个词稍加强调。

他没有提高音量。


  • 语音一致性用于创建角色说话的声音。
  • 生成视频用于提示词相关设置。
  • 角色对话用于将静态图像和音轨转换为说话片段。
  • in 'twixt vows 幕后花絮展示导演如何在真实影片中应用这些规则。