Reference to Video AI

Reference to Video AI 视频生成器

上传图片、视频或音频参考,生成流畅连贯的视频——角色说话、表演时面部始终一致、动作自然。再也不用反复重拍!

Reference to Video

选择模型,添加它支持的图片、视频或音频参考,并在提示词中引用这些素材。

参考素材

9 张图片 · 3 个视频 · 3 个音频

0/15
0/4000
模型
格式

案例视频

选择模板后会自动载入提示词和参考方向。

8 类 Reference to Video 案例

故事需要连续性。 不能依靠碰运气。

查看 Reference to Video 如何在剧情、UGC、动漫、时尚、音乐和游戏场景中保持身份、穿搭、商品与视觉世界一致。

更多一致性工作流

在原有 8 个 Reference to Video 案例中继续查看时尚、商品、表演者与吉祥物的一致性。

参考优先生成

什么是 Reference to Video?

Reference to Video 是一种使用一个或多个来源素材作为创意依据的 AI 视频生成流程。它不要求一段文字同时记住脸部、商品、穿搭、动作、运镜和声音,而是让每个参考素材负责定义新镜头中的一个明确部分。

优秀的 Reference to Video 结果不会逐帧复制来源。它会保留形成连续性的关键细节,同时允许场景、动作、构图和剧情节点发生变化,因此适合短剧、AI influencer、商品广告、动漫角色、时尚片、音乐视频和品牌角色世界。

真正的差异是控制:参考素材会在整个镜头中持续生效,明确哪些内容必须保持可识别,哪些内容可以变化。

参考素材可以控制什么?

让每个来源只负责一个制作决策,结果会更容易导演、检查和迭代。

角色身份

在新场景中保持脸部、发型、身体比例和辨识特征稳定。

商品外观

在新镜头中保留商品形状、颜色、材质、包装和标签位置。

动作与表演

用短视频引导手势、节奏、身体运动和表演状态。

镜头运动

参考平移、环绕、推进、手持或其他难以用文字准确描述的运镜。

场景与风格

把地点、光线语言、配色或视觉世界带入重新构图的新镜头。

音频与时间

在支持音频参考的模型中控制对白、声线、音乐、节拍和动作时序。

两种多模态参考工作流

从最小但足够的素材组合开始。下面两种工作流把外观、动作和音频分开,让每个参考来源只承担一个明确任务。

Seedance 2.0 Fast720P 示例规格

图片 + 视频参考

用图片固定人物、商品、穿搭或视觉风格,用视频引导动作、表演节奏、构图和运镜。计划中的示例将以 720P 交付。

@Image1 · 外观@Video1 · 动作

@Image1 定义主体和外观。参考 @Video1 的动作与运镜,同时创作一个新场景。

MiniMax H3 Reference768P 示例规格

图片 + 视频 + 音频参考

当声音、音乐、节奏或同步属于创意简报时加入音频。图片负责外观,视频负责表演,音频负责声音与时间。计划中的示例将使用 H3 的 768P 输出。

@Image1 · 外观@Video1 · 表演@Audio1 · 时序

保持 @Image1 中的主体,跟随 @Video1 的表演,并让揭示动作与 @Audio1 同步。

解决常见的 Reference to Video 一致性问题

Reference to Video 的一致性失败往往来自相互冲突的参考素材,而不是提示词形容词不够多。简化证据,明确哪些内容必须固定,并且每次只测试一个创意变化。

不同镜头里的脸发生变化

使用一张清晰正面或四分之三角度身份图,删除相互冲突的肖像,并且只描述人物一次。只有第二个角度能提供新信息时才加入。

两个角色互换服装或身份

为每个人分配独立参考令牌,并在动作句中重复映射关系。穿搭描述必须紧跟正确的角色名称。

商品被重新设计

提供一张干净的商品主图和一个能展示几何、品牌与材质的补充角度,并明确要求保持形状、标签位置、颜色和比例。

动作或音频被忽略

把视频或音频裁剪到需要的动作与节拍。为每个来源指定一个任务,并删除不能提供新信息的素材。

不同场景中的穿搭发生变化

使用能完整看清穿搭的全身参考图,把服装、材质、颜色和配饰明确写成固定细节,并删除相互冲突的穿搭图片。

镜头没有按照提示词运动

使用一段展示准确平移、环绕、推进或手持运动的短视频,并让这个素材只负责运镜,不要同时用它定义主体。

文字、图片还是参考素材生成视频?

根据哪些内容必须受到控制来选择模式。Text to Video 从描述开始,Image to Video 让现有画面动起来,Reference to Video 则用多个来源约束重新构图的新镜头。

起点

Text to Video一段文字描述

Image to Video一张图片作为视频第一帧

Reference to Video多个素材,各自承担不同创意任务

最适合控制

Text to Video概念、主体、动作和氛围

Image to Video靠近第一帧的构图与外观

Reference to Video身份、商品、动作、运镜、风格和音频

最适合用途

Text to Video开放式创意和全新场景

Image to Video从一张静态图生成单条短动画

Reference to Video剧情、广告、UGC 系列、角色 IP 和表演型镜头

提示词方法

Text to Video描述模型需要创建的全部内容

Image to Video描述画面离开首帧后如何运动

Reference to Video为 @Image、@Video 和 @Audio 指定职责

Reference to Video 如何工作

生成新场景前,先为每个参考素材指定明确的制作任务,建立可控的 Reference to Video 简报。

上传清晰参考素材

用清晰图片定义身份、商品、穿搭或风格。需要补充动作、运镜、声音或节奏时,再加入短视频和音频。

为每个参考素材指定角色

说明 @Image1、@Video1 和 @Audio1 分别控制什么,再写清动作、场景、运镜和必须保持不变的细节。

生成并检查一致性

检查脸部、穿搭、商品几何、角色关系、动作和音频节奏。每次只修改一项指令,才能判断一致性是否改善。

选择合适的 Reference to Video 模型

最合适的 Reference to Video 模型取决于你的参考素材和最重要的细节。生成器会在提交任务前检查素材类型与数量限制。

Seedance

完整的 Seedance 产品线

可选 Seedance 2.0 Mini、2.0 Fast 和 2.5。Mini 支持 480P/720P,Fast 支持 720P,2.5 支持 480P/720P,并可扩展到 30 秒生成。

MiniMax H3

高分辨率多模态参考

MiniMax H3 支持 768P 和 2K,可组合图片、直接视频与音频参考。图片和音频不额外收费;直接视频按输入总时长加输出时长计费。

Gemini Omni

快速的 Gemini 视频生成

Omni Flash 1.1 支持 720P、1080P 和 4K,可生成 8 秒或 10 秒视频。最多使用 7 个加权参考位,其中一个视频占 2 位。

学习 Reference to Video 工作流

如何保持同一个角色的一致性

准备清晰的身份参考,指出不能改变的细节,并逐个镜头检查脸部、穿搭和人物比例。

阅读角色一致性教程

图片、视频和音频参考如何配合

图片负责外观,视频负责动作,音频负责节奏,再通过明确的参考令牌连接所有素材。

阅读多模态教程

Reference to Video 术语与概念

了解身份一致性、场景连续性、Image to Video、多模态提示词及相关制作术语。

打开术语表
价格方案

选择你的视频生成方案

Lite

US$12/月

每年支付 US$144

每月 1,500 积分

最多生成 37 个视频

  • 支持 720P、1080P 和 4K 输出
  • 单个视频最长 30 秒,取决于生成设置
  • 支持图片、视频和音频参考

积分每月发放,不转结至下月。

最受欢迎

Pro

US$29/月

每年支付 US$348

每月 4,000 积分

最多生成 100 个视频

  • 支持 720P、1080P 和 4K 输出
  • 单个视频最长 30 秒,取决于生成设置
  • 支持图片、视频和音频参考

积分每月发放,不转结至下月。

Ultra

US$89/月

每年支付 US$1,068

每月 13,000 积分

最多生成 325 个视频

  • 支持 720P、1080P 和 4K 输出
  • 单个视频最长 30 秒,取决于生成设置
  • 支持图片、视频和音频参考

积分每月发放,不转结至下月。

对比套餐

无视频参考

模型 / 规格Lite1,500 积分Pro4,000 积分Ultra13,000 积分
Seedance 2.0 Mini · 480P40 积分 / 5s最多生成 37 个视频最多生成 100 个视频最多生成 325 个视频
Seedance 2.0 Mini · 720P80 积分 / 5s最多生成 18 个视频最多生成 50 个视频最多生成 162 个视频
Seedance 2.0 Fast · 720P180 积分 / 5s最多生成 8 个视频最多生成 22 个视频最多生成 72 个视频
Seedance 2.5 · 480P190 积分 / 5s最多生成 7 个视频最多生成 21 个视频最多生成 68 个视频
Seedance 2.5 · 720P380 积分 / 5s最多生成 3 个视频最多生成 10 个视频最多生成 34 个视频
MiniMax H3 · 768P110 积分 / 5s最多生成 13 个视频最多生成 36 个视频最多生成 118 个视频
MiniMax H3 · 2K160 积分 / 5s最多生成 9 个视频最多生成 25 个视频最多生成 81 个视频
Omni Flash 1.1 · 720P120 积分 / 8s最多生成 12 个视频最多生成 33 个视频最多生成 108 个视频
Omni Flash 1.1 · 1080P180 积分 / 8s最多生成 8 个视频最多生成 22 个视频最多生成 72 个视频
Omni Flash 1.1 · 4K350 积分 / 8s最多生成 4 个视频最多生成 11 个视频最多生成 37 个视频

视频生成积分如何计算

总积分 = 基础生成积分 + 视频参考附加积分

无原生视频参考

基础积分 = 输出每秒费率 × 输出秒数

仅使用文字、参考图片或参考音频时,按输出视频时长计算。

有原生视频参考

总积分 = 基础生成积分 + 视频参考附加积分

Seedance 和 H3 的视频参考按秒收费,多个参考视频先累加时长再向上取整;图片和音频不额外收费。Omni 使用固定视频参考附加费,不按参考秒数累加。

Seedance 与 MiniMax H3 费率

模型规格5 秒输出 · 无视频参考5 秒参考 + 5 秒输出
Seedance 2.0 Mini480P4040 + 5 × 2 = 50
Seedance 2.0 Mini720P8080 + 5 × 4 = 100
Seedance 2.0 Fast720P180180 + 5 × 8 = 220
Seedance 2.5480P190190 + 5 × 10 = 240
Seedance 2.5720P380380 + 5 × 20 = 480
MiniMax H3768P110110 + 5 × 22 = 220
MiniMax H32K160160 + 5 × 32 = 320

Omni Flash 1.1 固定积分

不按参考素材秒数累加
规格8 秒输出 · 无视频参考3 秒参考 + 8 秒输出
720P120120 + 50 = 170
1080P180180 + 60 = 240
4K350350 + 70 = 420

Seedance 和 H3 的视频参考按秒收费,多个参考视频先累加时长再向上取整;图片和音频不额外收费。Omni 使用固定视频参考附加费,不按参考秒数累加。

Reference to Video 常见问题

Reference to Video

用你已有的参考素材创作一个新镜头

图片负责外观,视频负责动作,音频负责声音与时间。 给每个来源一个明确职责,再说明下一个镜头需要改变什么。