拆解 30 秒叙事
把创意拆成开场、动作、转场、对白与结尾;需要精准发生的变化可直接标注时间点。
单次生成 30 秒叙事视频,最多支持 50 个多模态参考
Seedance 2.5 面向更长的音视频创作,强化镜头连续性,支持灵活引用图片、视频与音频,并提供多轮延长和时间轴定点编辑,适合参考素材丰富的制作流程。
用 3 步规划一段更长的多模态视频
把创意拆成开场、动作、转场、对白与结尾;需要精准发生的变化可直接标注时间点。
只保留真正决定角色、动作、风格与声音的图片、视频和音频,并清楚写明每个素材的用途。
把镜头、运镜、对白、环境声与转场写进同一条时间线,帮助模型协调完整的音视频序列。
检查角色一致性、运动、转场、对白节奏和声音连续性。每次只修改一个时间范围,或从最自然的结尾继续延长下一段。
更长叙事、更多参考、更顺畅的连续性与精细编辑
一次生成最长 30 秒的完整音视频,让对白、动作、转场与氛围拥有更充分的发展空间。
单次可使用最多 30 张图片、10 段视频和 10 段音频。可分别指定角色、场景、动作、节奏与声音参考。
在保留叙事走向的前提下继续延长已有结果。更自然的转场让连续镜头更像一个完整段落,而不是拼接片段。
直接修改时间轴上的特定片段,无需推翻整个创意。官方示例涵盖机位、绿幕和基于参考素材的编辑。
Seedance 2.5 旨在让角色、环境、镜头语言、对白和氛围在更长序列中保持连接,而不是把每个段落当作孤立片段。
用视觉、动作和声音参考传递所需特征,同时避免提示词过载。明确每个素材的职责与优先级,有助于保持角色和风格一致。
生成之前,先写清楚一份可执行的创作简报
Seedance 2.5 的高质量结果始于清晰的时间线和克制的参考素材。先定义每个情节节点,再为每张图片、每段视频与音频指定用途,并检查完整序列的连续性。
先确定受众、画幅、核心动作、情绪走向和结尾节点,再判断哪些参考素材与时间轴指令真正有必要。
按角色、地点、镜头语言、动作、音乐、对白或环境声标注每个文件,并删除彼此冲突的参考。
说明每个段落何时变化,确保动作符合物理逻辑,并写清声音如何跨越转场。初稿完成后,再逐段延长或修改。
先带声音看完整结果,不要只判断单帧。记录角色漂移、转场突兀或对白不同步的位置。
保留效果最好的内容,只针对薄弱时间段修改,并在续写故事时沿用同一套参考素材优先级。
为角色入场、机位变化、对白或转场标注时间范围,让每项指令在序列中都有明确位置。
确定一个主要角色或产品参考,再分别补充服装、环境、动作和声音参考,减少画面漂移。
把拥挤的互动拆成清晰节点,说明谁先移动、何处发生接触,以及镜头如何跟随动作。
从头到尾检查脸部、手部、产品、视线方向、文字、转场、对白和环境声。
更长、更依赖参考素材的音视频工作流
在 30 秒内完成对白、机位变化和连续情节,减少把多个独立生成片段硬拼在一起的需要。
组合产品、人物、场景、动作和配乐参考,让更长的广告概念保持一致。
拍摄前测试走位、镜头覆盖、转场与声音,再在后续轮次中修改特定片段或继续延长。
同时使用音频、节奏、视觉风格与表演者参考,规划声画同步的表演片段和情绪剪辑。
官方能力、版本差异与制作建议
Seedance 2.5 是字节跳动面向长镜头创作、多模态参考、视频延长与定点编辑推出的音视频生成模型,官方发布于 2026 年 7 月 31 日。
Seedance 2.0 侧重最长 15 秒的统一多模态生成;2.5 将单次生成延长到 30 秒,支持更大的参考素材集合,并强化长叙事连续性和精细音视频编辑。
字节跳动官方说明,Seedance 2.5 单次可生成最长 30 秒的音视频片段,并可通过多轮延长继续发展叙事。
官方发布信息显示,单次最多支持 50 个参考:30 张图片、10 段视频和 10 段音频。各平台的实际限制仍取决于具体接入方式。
模型层面可以。官方介绍了多轮延长,以及针对画面和声音的时间点级编辑,包括基于参考素材、机位和绿幕的工作流。
按时间线描述主体、动作、场景、运镜、对白、环境声、转场和结尾,并为每个参考素材指定唯一职责,避免相互冲突的指令。
分辨率、价格和实际上传上限取决于具体平台或 API 接入。生成时请以当前模型设置和费用预览为准,不要直接采信第三方宣传。
字节跳动仍提示复杂运动的物理效果和多主体互动可能不稳定。发布前应检查角色一致性、手部、碰撞、节奏、文字和音频,并确认适用的平台与商用条款。
商用权限取决于生成时适用的平台、账户和模型条款。发布前请确认人物、品牌、音乐、声音、视频和其他参考素材的使用权。
字节跳动于 2026 年 7 月 31 日发布 Seedance 2.5,并介绍了在自有创作产品中的上线安排;API 可用性取决于具体平台和供应商。生成前请确认当前模型名称。