如何使用 Seedance 2.5:2026 年 7 月完整指南

· Flick 内部影片制作人 · LinkedIn

Jul 2026

Seedance 2.5 是字节跳动的下一代 AI 视频模型,于 2026 年 6 月 23 日在火山引擎 FORCE 大会上发布。其值得密切关注的核心数据包括:30 秒单次生成、原生 4K 及 10 位色彩、最多 50 个标记参考素材、协同生成音频以及区域级编辑。

截至 2026 年 7 月下旬,Seedance 2.5 仍处于封闭企业测试阶段。Seedance 2.0 是目前在大多数工作流程中实际可用的版本,包括在 Flick 画布上使用。本指南将说明关于 Seedance 2.5 的已确认信息、如何现在就准备参考素材包、如何在 Flick 上使用 Seedance 生成内容,以及当模型可用时如何保持角色一致性。

Image

快速解答:如何使用 Seedance 2.5?

目前 Seedance 2.5 尚未公开使用。截至 2026 年 7 月 23 日,它仍处于封闭企业测试阶段。实际可行的做法是构建 Seedance 2.5 所设计的完整工作流程:有组织的参考素材、锁定的角色、场景静帧、动作说明和音频参考。然后在你的参考素材包为 2.5 做好准备的同时,使用 Seedance 2.0、Kling、Veo 或其他当前可用的视频模型。

问题答案
Seedance 2.5 可用吗?未公开发布;处于封闭企业测试阶段
Seedance 2.5 能生成视频吗?能,单次最长可生成 30 秒
分辨率原生 4K,10 位色彩
参考素材最多 50 个多模态参考素材
音频协同生成并同步
编辑区域级编辑
模式文本生成视频和图像生成视频
最佳准备方式构建有组织的角色、视觉、动作和音频参考素材包
现在使用什么Flick 上的 Seedance 2.0,以及根据镜头需求使用 Kling/Veo/其他模型

构建你的 Seedance 参考包

角色表、外观帧和动作参考,在 2.5 开放前准备就绪。

Image

Seedance 2.5 概览

规格Seedance 2.5
片段长度最长 30 秒,单次连续生成
分辨率原生 4K,3840×2160,10 位色彩
参考素材最多 50 个多模态素材:图像、短片段和音频
参考标记每个参考素材可标记角色
音频在同一次生成中协同生成并同步
编辑区域级编辑,其余画面保持稳定
模式文本生成视频和图像生成视频
可用性封闭企业测试阶段
推出路径首先在豆包和火山引擎推出,随后在 BytePlus ModelArk 和 Dreamina 国际版推出
定价未公布
参考价格Seedance 2.0 在标准套餐约为 $0.06/秒

重要的转变不仅仅是"更好的视频",而是更长的连续生成和更结构化的参考素材。这正是 AI 影片创作者所需要的:更少的强制剪辑、更多的连贯性,以及对哪些输入重要的更多控制。

Image

为什么 30 秒改变了工作方式

当前大多数 AI 视频工作都是围绕短时生成构建的。你生成 5-10 秒,选择最佳镜头,生成下一个镜头,然后希望面孔、服装、光线、镜头和氛围仍然匹配。

每次新生成都是一次重置。每次重置都是偏移的机会。

30 秒单次生成改变了工作方式,因为模型可以在内部保持更多状态:

  • 角色身份有更多时间在一个片段内保持稳定。
  • 镜头运动可以完整展开而不是突然结束。
  • 对话或声音时刻可以自然呈现。
  • 场面调度可以包含开始、发展和结束。
  • 剪辑师不会仅仅因为工具用尽时长而被迫剪切。

这并不意味着每个镜头都应该是 30 秒。这意味着你可以选择剪切点,而不是让模型替你选择。

50个参考的真正含义

对于影片制作者来说,Seedance 2.5 最重要的功能是50个参考的工作流程。

在较早的视频模型中,参考往往像一堆图像,模型会对其进行松散的平均处理。Seedance 2.5 的角色标记参考则更加明确:这个资产是角色,这个资产是服装,这个片段是镜头运动,这个轨道是节奏,这一帧是光照目标。

这将参考从"感觉"转变为制作输入。

将这50个槽位作为结构化资源包使用,而不是随意堆放的文件夹。

Image

Seedance 2.5 参考包

在编写提示词之前先构建你的参考包。

1. 身份模块

使用这些参考来固定角色:

  • 正面肖像。
  • 3/4角度肖像。
  • 侧面轮廓。
  • 全身服装图像。
  • 如果镜头包含转身或离开的动作,需要背面视图。
  • 头发、配饰、疤痕、纹身或标志性道具的特写。
  • 之前镜头中已批准的静帧。

对于重复出现的角色,身份模块是工作流程中最具影响力的部分。它减少了你需要在每个提示词中填充的角色描述量。

2. 服装和道具模块

不要假设模型会保留细小的服装细节,除非你展示给它看。

包括:

  • 服装的正面和背面。
  • 鞋子。
  • 珠宝首饰。
  • 武器或工具。
  • 包、腰带、帽子、盔甲、制服或主要道具。
  • 任何必须在镜头之间保持一致的细节。

如果角色携带剑、相机、项链或乐器,请为其单独添加参考。

3. 视觉块

用于保持调色、光照和镜头语言的一致性。

包括:

  • 项目中的 2-3 个关键帧。
  • 光照参考。
  • 色彩参考。
  • 镜头或景深参考。
  • 代表最终影片视觉效果的画面。

视觉块能确保整个序列不会让每个镜头看起来都像来自不同的模型会话。

4. 动作块

使用短片段或动作参考来描述运动。

示例:

  • 手持行走镜头。
  • 慢速推轨。
  • 摇臂下降。
  • 侧向跟踪运动。
  • 打斗动作参考。
  • 布料或头发运动。
  • 人群运动。
  • 车辆运动。

如果 Seedance 2.5 支持按角色标记的动作片段(如描述所述),这将比"电影感镜头运动"这样的纯文本指令更有用。

5. 音频块

当节奏很重要时,使用音频参考。

示例:

  • 对白台词。
  • 临时配音表演。
  • 脚步节奏。
  • 音乐节奏。
  • 环境室内音。
  • 机械声音。
  • 生物声音。
  • 拟音参考。

由于 Seedance 2.5 可以同步生成音频,音频参考可能会成为导演镜头的一部分,而不是事后添加的内容。

如何在 Flick 上使用 Seedance 生成视频

Flick 在这里很有用,因为画布可以容纳整个制作地图:角色参考、静态图、动作创意、提示词笔记、音频和生成的片段。

为在 Flick 上使用 Seedance 2.5 做准备:

  1. 打开一个新画布。创建一个新的 Flick 项目并选择宽高比:16:9 用于影片/YouTube,9:16 用于竖屏,或 1:1 用于方形社交媒体。
  2. 首先创建角色。生成或上传一个干净的角色图像,然后为重复出现的角色构建正面/侧面/背面或三视图参考。
  3. 使用角色参考。在生成场景静止图像之前锁定角色。这可以在不同的背景、角度和光照下保持身份的稳定。
    Image
  4. 创建场景静止图像。生成你希望 Seedance 稍后动画化的关键帧:建立镜头、特写、动作节拍和最终帧。
  5. 将参考视觉化分组。将身份、服装、外观、动作和音频参考放入画布上带标签的分组中。
  6. 在文本节点中编写提示词。使用文本节点作为可重用的镜头注释,这样提示词、参考和生成的结果就会保持关联。
  7. 使用当前可用的模型生成。在 Seedance 2.5 仍处于测试阶段时,使用 Seedance 2.0、Kling、Veo 或其他视频模型。
    Image
  8. 可用时切换到 2.5。即使模型更改,参考包仍然有用。

Seedance 2.5 提示词模板

使用以下结构:

Use [reference/block] for [role].
[Shot type / camera movement] of [subject] in [setting].
[Subject action over time].
[Environmental motion over time].
Audio: [dialogue, ambience, foley, music/pacing direction].
Style: [lighting, lens, grade, texture].
Constraints: [preserve identity, preserve wardrobe, no text, no logos, no extra characters].

示例:

Use the identity references for the main character's face and wardrobe.
Use the look references for the cool blue night grade.
Use the motion reference for the slow handheld camera rhythm.

Medium tracking shot of the character walking through a narrow train platform at midnight.
They move cautiously, pause when a train passes behind them, then turn toward camera at the end.
Steam drifts across the platform, fluorescent lights flicker, rain runs down the metal roof.
Audio: train rumble, wet footsteps, distant station announcement, no music.
Cinematic realism, shallow depth of field, 35mm film texture.
Preserve the character's face, coat, hair, and bag. No readable text, no extra people.

Seedance 2.5 提示词示例

角色一致的对话节拍

Use the character reference pack for the protagonist's face, hairstyle, and jacket.
Close-up of the protagonist sitting in a parked car at night during heavy rain.
They look at the phone in their hand, hesitate, then whisper: "I found the address."
Raindrops streak down the windshield, passing headlights move across their face.
Audio: rain on glass, soft car interior hum, intimate dialogue, no music.
Moody thriller lighting, shallow depth of field, realistic skin texture.
Preserve identity and wardrobe. No readable phone text.

长连续动作镜头

Use the character references for the runner's identity and outfit.
Wide-to-medium handheld tracking shot following the runner through a crowded night market.
The runner pushes through hanging fabric, turns down a narrow alley, then stops under a flickering sign.
Steam rises from food stalls, crowds move around the camera, lanterns sway in the wind.
Audio: footsteps, crowd murmur, fabric brushing, distant scooters, no music.
Energetic documentary realism, natural motion blur, neon color grade.
Preserve character face, red jacket, and black backpack. No readable text.

区域编辑用例

Keep the original camera movement, lighting, background, and character motion unchanged.
Replace only the product on the table with a matte black handheld camera.
Keep the actor's hands, face, wardrobe, and the room exactly the same.
Audio remains room tone and soft table contact only.
No new objects, no text, no logo.

音频主导的氛围

Locked-off wide shot of an empty seaside road before sunrise.
Fog rolls across the asphalt, grass moves in the wind, and a single car approaches slowly from the distance.
Audio: ocean waves, low wind, faint engine growing closer, no music.
Muted blue dawn light, cinematic realism, quiet suspense.
No people, no readable signs, no logos.

30 秒微场景

Use the identity references for the two characters and the look references for the warm interior grade.
Single continuous 30-second shot inside a small kitchen at dawn.
Character A pours coffee, Character B enters quietly, and they share a short tense conversation without moving from the room.
The camera slowly tracks from the doorway to the table as sunlight grows brighter through the window.
Audio: coffee pouring, ceramic cup sound, low refrigerator hum, natural dialogue, no music.
Naturalistic indie drama, soft morning light, realistic motion.
Preserve both characters' faces, wardrobe, and relative positions. No extra people.

区域级编辑:不重新生成

Seedance 2.5 的区域级编辑功能可能是其最重要的制作功能之一。

AI 视频常常会以令人沮丧的方式出错:镜头 90% 都是对的,但某只手、产品、道具、背景细节或服装元素出现了问题。重新生成整个片段可能会修复那个问题,但也可能破坏让镜头成功的镜头运动、面部、光线或时机。

区域级编辑与完全重新生成相反。其目标是只改变某个元素,而其余部分保持稳定。

用途包括:

  • 替换产品。
  • 修复标志或背景物体。
  • 更换道具。
  • 修正服装细节。
  • 移除意外出现的额外物体。
  • 修复手部或面部区域。
  • 调整画面的小部分而不失去整个镜头。

对于电影制作者来说,这不是一个美化功能。而是一个成本控制功能。它能挽救镜头。

Image

Seedance 2.5 对比 Seedance 2.0 及其他竞品

模型最大时长原生音频分辨率参考图区域编辑当前可用性
------:---------------
Seedance 2.5最长 30 秒是,协同生成4K 10-bit最多 50 张,支持角色标记企业封闭测试
Seedance 2.0约 15 秒音频参考影响节奏1080p约 12 张
FLUX 3最长 20 秒是,同步生成未完全公开正式版时确认声称支持局部重绘早期访问
Kling O3请确认当前限制请确认当前支持待确认全方位参考待确认
Grok Imagine 1.5最长 15 秒未记录待确认参考转视频基于提示词的编辑
Veo取决于模型/版本支持版本中包含原生音频取决于模型/版本素材 / 参考取决于版本访问权限不同

真实情况:Seedance 2.5 在长片段、大量参考的 AI 电影制作方面拥有最强的纸面规格,但公开访问程度最低。现在可以使用 Seedance 2.0 和其他可用模型,并构建好工作流程,以便 2.5 开放时能够无缝接入。

Seedance 2.5 最佳实践

  • 在编写提示词之前先构建参考图。
  • 分离身份、服装、外观、动作和音频参考。
  • 有意识地使用角色标记。
  • 让提示词专注于单个镜头。
  • 仅在动作需要时才使用完整的 30 秒。
  • 对于反复出现的角色,创建正面/侧面/背面参考。
  • 当声音影响节奏时添加音频指导。
  • 将审核通过的静帧保存为未来的参考。
  • 使用区域编辑来挽救优质镜头。
  • 在 Flick 画布上保持所有片段和参考的组织性。

常见错误

  • 将 50 张随机参考图堆给模型。只有当参考图具有明确角色时,更多的参考才有帮助。
  • 在提示词中过度描述角色。让参考图承载身份信息;用提示词来指导动作。
  • 仅仅因为可以就使用 30 秒。一个干净的 8 秒镜头可能比一个漂移的 30 秒镜头更好。
  • 忽略音频。如果模型协同生成声音,提示词就应该指导声音。
  • 为小问题而重新生成好镜头。当镜头基本正确时使用区域编辑。
  • 等待 2.5 发布才开始构建素材。参考包现在就可以创建。
  • 孤立地评判镜头。最好的镜头是能与序列完美剪辑的镜头。

常见问题

Seedance 2.5 可用了吗?

还没有。截至 2026 年 7 月下旬,Seedance 2.5 仍处于封闭企业测试阶段。预计将首先通过豆包和火山引擎推出,然后通过 BytePlus ModelArk 和 Dreamina 在国际上发布。Seedance 2.0 已普遍可用。

Seedance 2.5 视频可以多长?

单次连续生成最长 30 秒,大约是 Seedance 2.0 的 15 秒范围的两倍。

Seedance 2.5 支持什么分辨率?

字节跳动宣布原生 4K,分辨率为 3840×2160,支持 10 位色彩。

Seedance 2.5 支持多少个参考?

最多 50 个多模态参考资源,包括图像、短片段和音频。每个都可以标记角色,如角色身份、相机风格、照明、运动或节奏。

Seedance 2.5 会生成音频吗?

是的。音频与视频在同一过程中共同生成并与之同步。

Seedance 2.5 的费用是多少?

价格尚未公布。Seedance 2.0 是唯一的公开参考点,在标准层级上每生成秒约为 $0.06。

我可以在 Flick 上使用 Seedance 吗?

可以,在支持的 Flick 画布上使用当前可用的 Seedance 模型。构建您的参考包、从场景静态图像生成视频、与其他模型比较输出,并将序列整理在一个项目中。

在 Seedance 2.5 公开发布前我应该准备什么?

准备角色设定表、已批准的静帧、服装参考、造型参考、动作参考、音频参考和提示词笔记。将它们整理在 Flick 画布上,这样当 2.5 推出时你就能快速测试。