キャラクターの人物性
新しい場面でも顔、髪型、体格、特徴を同じ人物として認識できる状態に保ちます。
Reference to Video AI
参照画像・動画・音声をアップロードして、キャラクターが話し、演技する、なめらかで一貫性のある動画を生成します。顔は一貫、動きは自然。撮り直しはもう不要です!
モデルを選び、対応する画像・動画・音声素材を追加して、プロンプト内で参照します。
参照素材
画像 9枚 · 動画 3本 · 音声 3個
テンプレートを選ぶとプロンプトと参照方向が読み込まれます。
8種類のReference to Video活用例
ドラマ、UGC、アニメ、ファッション、音楽、ゲームで、人物、衣装、商品、世界観を一貫させる方法を紹介します。
既存の8つのReference to Video活用例から、ファッション、商品、パフォーマー、マスコットの一貫性も確認できます。
参照を中心にした生成
Reference to Videoは、ひとつ以上の画像、動画、音声を創作上の根拠として使うAI動画生成手法です。文章だけで顔、商品、衣装、動き、カメラ、音を同時に覚えさせるのではなく、それぞれの素材に新しいカットの一部分を担当させます。
優れた結果は元素材をそのまま複製するのではなく、連続性を生む特徴を保ちながら、場所、動作、構図、物語を変えます。短編ドラマ、AIインフルエンサー、商品広告、アニメ、ファッション、MV、ブランドキャラクターに適しています。
違いは制御です。参照素材はカット全体を通して働き、維持すべき特徴と変えてよい部分を分けます。
素材ごとにひとつの制作判断を担当させると、結果を演出・確認・調整しやすくなります。
新しい場面でも顔、髪型、体格、特徴を同じ人物として認識できる状態に保ちます。
商品の形、色、素材、パッケージ、ラベル位置を新しいカットでも維持します。
短い動画からジェスチャー、タイミング、身体の動き、演技の強さを伝えます。
パン、周回、プッシュイン、手持ちなど、文章では伝えにくい動きを参照します。
場所、光、配色、世界観を、新しく構成したカットへ引き継ぎます。
音声参照に対応するモデルで、台詞、声、音楽、ビート、動作の時系列を導きます。
必要十分な最小構成から始めます。外観、動き、音声を分け、各参照素材にひとつの明確な役割を持たせます。
画像で人物、商品、衣装、スタイルを固定し、動画で動き、演技のタイミング、構図、カメラ方向を導きます。予定しているサンプルは720Pで提供します。
@Image1で被写体と外観を定義し、@Video1の動きとカメラワークに従って新しい場面を作る。
声、音楽、リズム、同期が必要な場合に音声を追加します。画像は外観、動画は演技、音声は音と時間を担当します。予定しているサンプルはH3の768P出力を使用します。
@Image1の被写体を保ち、@Video1の演技に従い、見せ場を@Audio1に同期する。
一貫性の失敗は、形容詞の不足より参照素材の競合から起きやすいものです。素材を整理し、固定する特徴を明記して、一度にひとつだけ変更します。
正面または斜め前の鮮明な人物画像を一枚使い、矛盾する肖像を削除します。新しい情報がある場合だけ別角度を追加します。
人物ごとに別の参照トークンを割り当て、動作文でも対応関係を繰り返します。衣装説明を正しい名前の直後に置きます。
清潔な正面画像と、形、ブランド、素材を示す補助角度を使い、ラベル位置、色、比率の維持を明記します。
必要な動作やビートだけに動画・音声を切り詰め、各素材にひとつの役割を与えます。新しい情報のない素材は削除します。
衣装全体が見える全身画像を使い、服、素材、色、アクセサリーを固定項目として明記します。矛盾する衣装画像は削除します。
パン、周回、プッシュイン、手持ちなど目的の動きを示す短い動画を使い、その素材は被写体ではなくカメラワークだけに割り当てます。
何を制御し続ける必要があるかで選びます。Text to Videoは文章から作り、Image to Videoは既存フレームを動かし、Reference to Videoは複数素材を新しいカットの制約として使います。
Text to Video文章による説明
Image to Video冒頭フレームとなる一枚の画像
Reference to Video役割が異なる複数素材
Text to Videoコンセプト、被写体、動作、雰囲気
Image to Video最初のフレーム付近の構図と外観
Reference to Video人物、商品、動き、カメラ、スタイル、音声
Text to Video自由な発想と新しい場面
Image to Video一枚の静止画から作る短いアニメーション
Reference to Video物語、広告、UGC、キャラクターIP、演技中心のカット
Text to Videoモデルが作る内容をすべて文章で説明する
Image to Videoアップロード画像からの動きを説明する
Reference to Video@Image、@Video、@Audioへ役割を割り当てる
生成前に各参照素材へ明確な制作上の役割を割り当て、制御しやすい指示を作ります。
人物、商品、衣装、スタイルには鮮明な画像を使い、動き、カメラ、声、タイミングが必要な場合だけ短い動画や音声を追加します。
@Image1、@Video1、@Audio1が何を制御するか明記し、動作、場所、カメラ、変えてはいけない特徴を説明します。
顔、衣装、商品の形、人物の役割、動き、音のタイミングを確認し、一度にひとつの指示だけ変更します。
最適なモデルは参照素材と重視する特徴で変わります。生成前に対応する素材形式と上限を確認できます。
Seedanceの全ラインナップ
Seedance 2.0 Mini、2.0 Fast、2.5から選択できます。Miniは480P/720P、Fastは720P、2.5は480P/720Pと最大30秒の生成に対応します。
高解像度の複合参照
MiniMax H3は768Pと2Kに対応し、画像、直接動画、音声参照を組み合わせられます。画像と音声は追加料金なし、直接動画は入力合計と出力時間で課金されます。
高速なGemini動画生成
Omni Flash 1.1は720P、1080P、4Kの8秒または10秒出力に対応します。参照は最大7加重スロットで、動画1本は2スロットとして数えます。
明確な人物参照を準備し、変えてはいけない特徴を指定して、各カットの顔、衣装、体格を確認します。
キャラクターガイドを読む画像に外観、動画に動き、音声にタイミングを担当させ、参照トークンで各素材を明確に結びます。
マルチモーダルガイドを読む人物の一貫性、シーン連続性、Image to Video、マルチモーダルプロンプトなどの用語を確認できます。
用語集を開く年額 $144
最大 37 本の動画
クレジットは毎月付与。繰り越し不可。
年額 $348
最大 100 本の動画
クレジットは毎月付与。繰り越し不可。
年額 $1,068
最大 325 本の動画
クレジットは毎月付与。繰り越し不可。
動画参照なし
| モデル / 解像度 | Lite1,500 クレジット | Pro4,000 クレジット | Ultra13,000 クレジット |
|---|---|---|---|
| Seedance 2.0 Mini · 480P40 クレジット / 5s | 最大 37 本の動画 | 最大 100 本の動画 | 最大 325 本の動画 |
| Seedance 2.0 Mini · 720P80 クレジット / 5s | 最大 18 本の動画 | 最大 50 本の動画 | 最大 162 本の動画 |
| Seedance 2.0 Fast · 720P180 クレジット / 5s | 最大 8 本の動画 | 最大 22 本の動画 | 最大 72 本の動画 |
| Seedance 2.5 · 480P190 クレジット / 5s | 最大 7 本の動画 | 最大 21 本の動画 | 最大 68 本の動画 |
| Seedance 2.5 · 720P380 クレジット / 5s | 最大 3 本の動画 | 最大 10 本の動画 | 最大 34 本の動画 |
| MiniMax H3 · 768P110 クレジット / 5s | 最大 13 本の動画 | 最大 36 本の動画 | 最大 118 本の動画 |
| MiniMax H3 · 2K160 クレジット / 5s | 最大 9 本の動画 | 最大 25 本の動画 | 最大 81 本の動画 |
| Omni Flash 1.1 · 720P120 クレジット / 8s | 最大 12 本の動画 | 最大 33 本の動画 | 最大 108 本の動画 |
| Omni Flash 1.1 · 1080P180 クレジット / 8s | 最大 8 本の動画 | 最大 22 本の動画 | 最大 72 本の動画 |
| Omni Flash 1.1 · 4K350 クレジット / 8s | 最大 4 本の動画 | 最大 11 本の動画 | 最大 37 本の動画 |
合計 = 生成の基本クレジット + 動画参照の追加クレジット
ネイティブ参照動画なし
基本クレジット = 出力の秒単価 × 出力秒数
テキスト、参照画像、参照音声のみの場合は、生成動画の長さだけで計算します。
ネイティブ参照動画あり
合計 = 生成の基本クレジット + 動画参照の追加クレジット
Seedance と H3 は参照動画の合計秒数を切り上げて課金。画像・音声は追加料金なし。Omni の動画参照は秒数によらない固定追加料金です。
| モデル | 解像度 | 5秒出力・動画参照なし | 5秒参照 + 5秒出力 |
|---|---|---|---|
| Seedance 2.0 Mini | 480P | 40 | 40 + 5 × 2 = 50 |
| Seedance 2.0 Mini | 720P | 80 | 80 + 5 × 4 = 100 |
| Seedance 2.0 Fast | 720P | 180 | 180 + 5 × 8 = 220 |
| Seedance 2.5 | 480P | 190 | 190 + 5 × 10 = 240 |
| Seedance 2.5 | 720P | 380 | 380 + 5 × 20 = 480 |
| MiniMax H3 | 768P | 110 | 110 + 5 × 22 = 220 |
| MiniMax H3 | 2K | 160 | 160 + 5 × 32 = 320 |
| 解像度 | 8秒出力・動画参照なし | 3秒参照 + 8秒出力 |
|---|---|---|
| 720P | 120 | 120 + 50 = 170 |
| 1080P | 180 | 180 + 60 = 240 |
| 4K | 350 | 350 + 70 = 420 |
Seedance と H3 は参照動画の合計秒数を切り上げて課金。画像・音声は追加料金なし。Omni の動画参照は秒数によらない固定追加料金です。
Reference to Video
画像は外観、動画は動き、音声は音とタイミングを担当します。 素材ごとに明確な役割を与え、次のカットで変える内容を指示しましょう。