面向真正的制作结构
这次升级的重点不是一句模糊的“画质更好”。更长时间、更大参考包和局部重绘,直接针对专业 AI 视频中反复生成、拼接、返工和一致性丢失的问题。
使用文本、图片、视频与音频参考导演最长 30 秒镜头,完成文生视频、图生视频和多参考创作。
选择生成模式,添加必需素材,写下导演指令,然后生成 Seedance 2.5 视频。
Seedance 2.5 是面向制作级视频创作的新一代生成模型。它将最长 30 秒单段视频、最多 50 个联合创作输入、R2V 参考控制、长镜头一致性与视频局部编辑整合到同一套导演工作流中。
简单来说,它把“生成一个漂亮镜头”升级为“提交一套小型制作方案”:脚本节拍、人物和产品参考、动作视频、镜头意图、声音提示与局部修改要求,都可以成为同一份创作简报的一部分。
这次升级的重点不是一句模糊的“画质更好”。更长时间、更大参考包和局部重绘,直接针对专业 AI 视频中反复生成、拼接、返工和一致性丢失的问题。
在同一份创作简报中组合脚本、角色、产品、场景、动作、摄影机运动、声音与局部修改要求,让每个输入都服务于明确的镜头目标。
每项能力都对应一个具体瓶颈:叙事窗口太短、参考素材割裂、动作难表达、返工成本高、声音脱节,或跨语言内容不稳定。
单段最长 30 秒,让广告、产品演示、短剧片段或培训视频有空间完成铺垫、动作、转场和结果,不必把每个瞬间都拆成独立生成任务。
可以组合脚本、图片、视频、音频、分镜、角色设定、风格帧、镜头说明和品牌资产。真正重要的不是塞满 50 个文件,而是给每个参考明确分工。
参考视频可以展示人物怎么动、主体位于哪里、角色如何互动、摄影机怎样行进。绿幕或中性模特素材能把动作信息与最终人物、服装、场景和美术风格分离。
只修改出错的物体、区域或时间点,同时尽量保留其他位置的构图、光线、运动、声音与时间连续性,让返工从整段重抽变成范围明确的修改指令。
在同一份简报中组织对白、环境声、动作音效、音乐方向、节奏和可见表演,让声音与画面从一开始就共享同一条叙事曲线。
面向多语言视频创作组织对白、口型、字幕约束与声音方向,并减少意外文字和无关背景音乐对成片的干扰。
最有价值的不是随机炫技,而是人物身份、产品结构、动作、镜头语言、光线和声音必须在一个有目的的序列中稳定延续。

锁定包装形状、材质反应、安全构图、反射逻辑和产品揭示顺序。通过参考分工,把产品真实性与灯光、动作灵感明确分开。

明确哪些内容变化、哪些必须保持:同一个角色、服装、天气、画面方向、情绪状态,以及每个段落之间有动机的摄影机运动。

用表演视频控制肢体动作,用静态参考控制身份和服装结构,用音频提示控制节奏,并让布料物理与镜头速度服务于统一的编辑氛围。
把模型当成制作协作者:先确定交付物,再整理参考素材,用时间轴导演镜头,最后根据客观验收标准检查结果。
先写清使用场景:9:16 社媒开场、16:9 产品片、1:1 电商循环、培训片段或剧情段落。说明时长、受众、结尾动作以及哪些错误会让成片不可用,再添加风格描述。
例如参考 1 控制产品几何,2 控制人物身份,3 控制服装,4 控制摄影机运动,5 控制声音节奏,6 控制调色。不要为了凑满上限而添加重复或互相冲突的素材。
把长镜头拆成 0–8 秒、8–20 秒、20–30 秒等区间。每段写明主体动作、摄影机位置与移动、空间关系、转场逻辑、灯光连续性、对白、环境声和音乐强度。
第一轮先看人物身份、产品形状、画面方向、节奏、接触物理、镜头动机和音画同步;通过后再判断纹理和精致度。如果支持局部编辑,只提交一个范围明确的修改,并重复所有不可改变项。
Seedance 2.5 将系列能力推进到更长、更密集、更可编辑的制作流程,适合需要连续叙事和精细控制的项目。
| 工作流 | Seedance 2.5 | Seedance 2.0 | 制作影响 |
|---|---|---|---|
| 单段视频时长 | 单段最长 30 秒 | 4–15 秒短片工作流 | 在剪辑拼接之前,有更充足空间完成一段完整广告或叙事。 |
| 参考素材包 | 最多 50 个多模态联合输入 | 图片、视频与音频参考组合 | 多人角色、品牌系统、分镜、动作指南和声音参考可以进入同一份简报。 |
| 修改方式 | 支持视频局部编辑 | 重新生成、优化简报或使用返回尾帧续作 | 有机会只修复一个问题,同时保留其余已经成功的镜头。 |
| 动作控制 | 扩展 R2V、表演与空间参考控制 | 文本、关键帧、图片、视频和音频参考引导 | 复杂动作可以通过示范素材传达,不必完全依赖文字描述。 |
| 创作重点 | 长镜头、多参考、R2V 与局部修改 | 快速短片、关键帧与多参考生成 | 根据项目的镜头长度、参考密度和返工方式选择合适工作流。 |
Seedance 2.5 更适合长镜头、复杂参考和精细修改;Seedance 2.0 更适合快速迭代短片与关键帧驱动的创作。
优秀提示词应解释:画面随时间如何发展、每个参考控制什么、摄影机为什么移动、观众应该听到什么,以及哪些内容绝对不能漂移。
首先说明时长、画幅、平台、受众和目标。“30 秒 16:9 产品发布片,结尾明确展示产品”会让后续每个创作选择都有可衡量的作用。
明确列出不可改变项:脸部、年龄、发型、服装、产品比例、包装细节、室内布局、车辆造型,或任何不能在镜头段落间被重新设计的元素。
用秒数区间描述铺垫、动作、转场和结果,并写清画面方向与最后一帧,让模型知道每段如何衔接,而不是把整段视频理解成一个模糊事件。
说明机位高度、景别、镜头质感、运动方式、速度和移动原因。“人物转身时向左跟拍并揭示产品”比“使用电影感镜头”更清晰。
分开写对白、环境声、动作音效与音乐,给出出现时间和强度;说明嘴部是否可见,并在需要时明确要求静音。不要让一条参考音轨同时控制所有声音决策。
明确禁止意外字幕、无关音乐、多余产品、人物替换、Logo 变形、摄影机瞬移,以及局部编辑区域以外的任何改变。
这个结构强调可观察性:每一条要求都能在结果中被检查,也可以单独调整,而不需要重写整个创意。
交付物 30 秒 16:9 高端产品短片;克制、真实,可用于新品发布页。 参考素材分工 @图片 1 控制瓶身几何和瓶盖比例。@图片 2 控制石墨场景与琥珀—青蓝配色。@视频 1 只控制缓慢转台动作。@音频 1 只控制音乐速度。 时间轴 0–7 秒 — 85mm 微距,沿凝结水珠和钴蓝玻璃缓慢横移;安静室内环境声。 7–18 秒 — 拉远到产品中景,一只手进入画面,将瓶身旋转 30 度后离开;保持正面标签安全区域。 18–26 秒 — 从蓝色倒影匹配剪辑到雨夜街面,再通过相同倒影返回。 26–30 秒 — 固定产品英雄镜头,琥珀色轮廓光,音乐收束,画面静止两秒。 不可改变项 保持瓶身形状、瓶盖高度、玻璃颜色、摄影机轴线和光线方向不变。不要额外文字,不要字幕,不要虚构 Logo,不要无关背景音乐。
当视频必须保持品牌真实性、时序逻辑、人物一致性或明确节奏时,更长镜头和更丰富参考才真正有价值,而不仅仅是制造新奇画面。
在 15–30 秒内完成开场钩子、产品演示、异议处理和结果,同时保持商品、出镜人物与卖点表达在整个序列中一致。
在微距细节、手持展示、转台运动、使用场景和最终产品定帧之间保持包装几何与材质反应稳定。
给一场戏留出意图、反应、镜头运动与情绪变化的空间,并用身份、服装、地点和分镜参考维持连续性。
为竖屏短片、创作者系列、视觉化音乐与叙事社媒内容协调表演、镜头节奏、转场、环境声和音乐节点。
结合脚本、产品操作参考、已批准环境和声音方向,制作更清晰的操作讲解、入职培训或产品教学片段。
保持同一套品牌系统和视觉叙事,同时调整口语语言、节奏、出镜人物、环境或特定市场的创意方向。
了解 30 秒视频、多模态参考、R2V、局部编辑、角色一致性、声音控制与 Seedance 2.5 提示词写法。
