角色身份
在新场景中保持脸部、发型、身体比例和辨识特征稳定。
Reference to Video AI
上传图片、视频或音频参考,生成流畅连贯的视频——角色说话、表演时面部始终一致、动作自然。再也不用反复重拍!
选择模型,添加它支持的图片、视频或音频参考,并在提示词中引用这些素材。
参考素材
9 张图片 · 3 个视频 · 3 个音频
选择模板后会自动载入提示词和参考方向。
8 类 Reference to Video 案例
查看 Reference to Video 如何在剧情、UGC、动漫、时尚、音乐和游戏场景中保持身份、穿搭、商品与视觉世界一致。
在原有 8 个 Reference to Video 案例中继续查看时尚、商品、表演者与吉祥物的一致性。
参考优先生成
Reference to Video 是一种使用一个或多个来源素材作为创意依据的 AI 视频生成流程。它不要求一段文字同时记住脸部、商品、穿搭、动作、运镜和声音,而是让每个参考素材负责定义新镜头中的一个明确部分。
优秀的 Reference to Video 结果不会逐帧复制来源。它会保留形成连续性的关键细节,同时允许场景、动作、构图和剧情节点发生变化,因此适合短剧、AI influencer、商品广告、动漫角色、时尚片、音乐视频和品牌角色世界。
真正的差异是控制:参考素材会在整个镜头中持续生效,明确哪些内容必须保持可识别,哪些内容可以变化。
让每个来源只负责一个制作决策,结果会更容易导演、检查和迭代。
在新场景中保持脸部、发型、身体比例和辨识特征稳定。
在新镜头中保留商品形状、颜色、材质、包装和标签位置。
用短视频引导手势、节奏、身体运动和表演状态。
参考平移、环绕、推进、手持或其他难以用文字准确描述的运镜。
把地点、光线语言、配色或视觉世界带入重新构图的新镜头。
在支持音频参考的模型中控制对白、声线、音乐、节拍和动作时序。
从最小但足够的素材组合开始。下面两种工作流把外观、动作和音频分开,让每个参考来源只承担一个明确任务。
用图片固定人物、商品、穿搭或视觉风格,用视频引导动作、表演节奏、构图和运镜。计划中的示例将以 720P 交付。
@Image1 定义主体和外观。参考 @Video1 的动作与运镜,同时创作一个新场景。
当声音、音乐、节奏或同步属于创意简报时加入音频。图片负责外观,视频负责表演,音频负责声音与时间。计划中的示例将使用 H3 的 768P 输出。
保持 @Image1 中的主体,跟随 @Video1 的表演,并让揭示动作与 @Audio1 同步。
Reference to Video 的一致性失败往往来自相互冲突的参考素材,而不是提示词形容词不够多。简化证据,明确哪些内容必须固定,并且每次只测试一个创意变化。
使用一张清晰正面或四分之三角度身份图,删除相互冲突的肖像,并且只描述人物一次。只有第二个角度能提供新信息时才加入。
为每个人分配独立参考令牌,并在动作句中重复映射关系。穿搭描述必须紧跟正确的角色名称。
提供一张干净的商品主图和一个能展示几何、品牌与材质的补充角度,并明确要求保持形状、标签位置、颜色和比例。
把视频或音频裁剪到需要的动作与节拍。为每个来源指定一个任务,并删除不能提供新信息的素材。
使用能完整看清穿搭的全身参考图,把服装、材质、颜色和配饰明确写成固定细节,并删除相互冲突的穿搭图片。
使用一段展示准确平移、环绕、推进或手持运动的短视频,并让这个素材只负责运镜,不要同时用它定义主体。
根据哪些内容必须受到控制来选择模式。Text to Video 从描述开始,Image to Video 让现有画面动起来,Reference to Video 则用多个来源约束重新构图的新镜头。
Text to Video一段文字描述
Image to Video一张图片作为视频第一帧
Reference to Video多个素材,各自承担不同创意任务
Text to Video概念、主体、动作和氛围
Image to Video靠近第一帧的构图与外观
Reference to Video身份、商品、动作、运镜、风格和音频
Text to Video开放式创意和全新场景
Image to Video从一张静态图生成单条短动画
Reference to Video剧情、广告、UGC 系列、角色 IP 和表演型镜头
Text to Video描述模型需要创建的全部内容
Image to Video描述画面离开首帧后如何运动
Reference to Video为 @Image、@Video 和 @Audio 指定职责
生成新场景前,先为每个参考素材指定明确的制作任务,建立可控的 Reference to Video 简报。
用清晰图片定义身份、商品、穿搭或风格。需要补充动作、运镜、声音或节奏时,再加入短视频和音频。
说明 @Image1、@Video1 和 @Audio1 分别控制什么,再写清动作、场景、运镜和必须保持不变的细节。
检查脸部、穿搭、商品几何、角色关系、动作和音频节奏。每次只修改一项指令,才能判断一致性是否改善。
最合适的 Reference to Video 模型取决于你的参考素材和最重要的细节。生成器会在提交任务前检查素材类型与数量限制。
完整的 Seedance 产品线
可选 Seedance 2.0 Mini、2.0 Fast 和 2.5。Mini 支持 480P/720P,Fast 支持 720P,2.5 支持 480P/720P,并可扩展到 30 秒生成。
高分辨率多模态参考
MiniMax H3 支持 768P 和 2K,可组合图片、直接视频与音频参考。图片和音频不额外收费;直接视频按输入总时长加输出时长计费。
快速的 Gemini 视频生成
Omni Flash 1.1 支持 720P、1080P 和 4K,可生成 8 秒或 10 秒视频。最多使用 7 个加权参考位,其中一个视频占 2 位。
每年支付 US$144
最多生成 37 个视频
积分每月发放,不转结至下月。
每年支付 US$348
最多生成 100 个视频
积分每月发放,不转结至下月。
每年支付 US$1,068
最多生成 325 个视频
积分每月发放,不转结至下月。
无视频参考
| 模型 / 规格 | Lite1,500 积分 | Pro4,000 积分 | Ultra13,000 积分 |
|---|---|---|---|
| Seedance 2.0 Mini · 480P40 积分 / 5s | 最多生成 37 个视频 | 最多生成 100 个视频 | 最多生成 325 个视频 |
| Seedance 2.0 Mini · 720P80 积分 / 5s | 最多生成 18 个视频 | 最多生成 50 个视频 | 最多生成 162 个视频 |
| Seedance 2.0 Fast · 720P180 积分 / 5s | 最多生成 8 个视频 | 最多生成 22 个视频 | 最多生成 72 个视频 |
| Seedance 2.5 · 480P190 积分 / 5s | 最多生成 7 个视频 | 最多生成 21 个视频 | 最多生成 68 个视频 |
| Seedance 2.5 · 720P380 积分 / 5s | 最多生成 3 个视频 | 最多生成 10 个视频 | 最多生成 34 个视频 |
| MiniMax H3 · 768P110 积分 / 5s | 最多生成 13 个视频 | 最多生成 36 个视频 | 最多生成 118 个视频 |
| MiniMax H3 · 2K160 积分 / 5s | 最多生成 9 个视频 | 最多生成 25 个视频 | 最多生成 81 个视频 |
| Omni Flash 1.1 · 720P120 积分 / 8s | 最多生成 12 个视频 | 最多生成 33 个视频 | 最多生成 108 个视频 |
| Omni Flash 1.1 · 1080P180 积分 / 8s | 最多生成 8 个视频 | 最多生成 22 个视频 | 最多生成 72 个视频 |
| Omni Flash 1.1 · 4K350 积分 / 8s | 最多生成 4 个视频 | 最多生成 11 个视频 | 最多生成 37 个视频 |
总积分 = 基础生成积分 + 视频参考附加积分
无原生视频参考
基础积分 = 输出每秒费率 × 输出秒数
仅使用文字、参考图片或参考音频时,按输出视频时长计算。
有原生视频参考
总积分 = 基础生成积分 + 视频参考附加积分
Seedance 和 H3 的视频参考按秒收费,多个参考视频先累加时长再向上取整;图片和音频不额外收费。Omni 使用固定视频参考附加费,不按参考秒数累加。
| 模型 | 规格 | 5 秒输出 · 无视频参考 | 5 秒参考 + 5 秒输出 |
|---|---|---|---|
| Seedance 2.0 Mini | 480P | 40 | 40 + 5 × 2 = 50 |
| Seedance 2.0 Mini | 720P | 80 | 80 + 5 × 4 = 100 |
| Seedance 2.0 Fast | 720P | 180 | 180 + 5 × 8 = 220 |
| Seedance 2.5 | 480P | 190 | 190 + 5 × 10 = 240 |
| Seedance 2.5 | 720P | 380 | 380 + 5 × 20 = 480 |
| MiniMax H3 | 768P | 110 | 110 + 5 × 22 = 220 |
| MiniMax H3 | 2K | 160 | 160 + 5 × 32 = 320 |
| 规格 | 8 秒输出 · 无视频参考 | 3 秒参考 + 8 秒输出 |
|---|---|---|
| 720P | 120 | 120 + 50 = 170 |
| 1080P | 180 | 180 + 60 = 240 |
| 4K | 350 | 350 + 70 = 420 |
Seedance 和 H3 的视频参考按秒收费,多个参考视频先累加时长再向上取整;图片和音频不额外收费。Omni 使用固定视频参考附加费,不按参考秒数累加。
Reference to Video
图片负责外观,视频负责动作,音频负责声音与时间。 给每个来源一个明确职责,再说明下一个镜头需要改变什么。