Identité du personnage
Gardez les visages, les cheveux, les proportions du corps et les traits distinctifs reconnaissables dans de nouvelles scènes.
Reference to Video AI
Téléversez des images, vidéos ou audios de référence et générez des vidéos fluides et cohérentes dans lesquelles votre personnage parle et agit avec une parfaite cohérence du visage et un mouvement naturel. Fini les reprises !
Choisissez un modèle, ajoutez des références image, vidéo ou audio compatibles, puis mentionnez-les dans votre prompt.
Assets de référence
9 images · 3 vidéos · 3 fichiers audio
Choisissez un modèle pour charger son prompt et sa direction de référence.
08 cas d'usage de la référence vers vidéo
Découvrez comment la référence vers vidéo garde identité, garde-robe, produits et univers visuels reconnaissables à travers des scènes de drama, d'UGC, d'anime, de mode, de musique et de jeu.
Explorez la continuité mode, produit, interprète et mascotte dans les huit cas d'origine de la référence vers vidéo.
Génération par la référence d'abord
La référence vers vidéo est un flux de génération IA qui utilise un ou plusieurs assets sources comme preuves créatives. Au lieu de demander à un prompt texte de retenir à la fois un visage, un produit, une tenue, un mouvement, un style de caméra et un son, la référence vers vidéo laisse chaque source définir une partie précise du nouveau plan.
Un bon résultat de référence vers vidéo ne reproduit pas une source image par image. Il préserve les détails qui créent la continuité tout en permettant au décor, à l'action, au cadrage et au moment narratif de changer. C'est ce qui rend la référence vers vidéo utile aux créateurs de séries, aux influenceurs IA, aux campagnes produit, aux personnages anime, aux séquences de mode, aux clips musicaux et aux univers de marque.
La différence, c'est le contrôle : les références restent actives pendant tout le plan et définissent ce qui doit rester reconnaissable et ce qui peut changer.
Chaque source devrait détenir une décision de production. Des rôles clairs rendent le résultat plus facile à diriger, à vérifier et à affiner.
Gardez les visages, les cheveux, les proportions du corps et les traits distinctifs reconnaissables dans de nouvelles scènes.
Préservez la forme, la couleur, les matières, l'emballage et le placement de l'étiquette du produit dans les nouveaux plans.
Utilisez une courte vidéo pour guider les gestes, le rythme, le mouvement du corps et l'énergie de la prestation.
Référencez un panoramique, une orbite, un travelling avant, un mouvement à l'épaule ou tout autre comportement de caméra difficile à décrire.
Transportez un lieu, un langage lumineux, une palette ou un univers visuel vers un plan nouvellement composé.
Guidez les dialogues, la voix, la musique, les temps forts et le calage de l'action sur les modèles qui acceptent les références audio.
Commencez par le plus petit ensemble utile de sources. Ces deux flux séparent l'apparence, le mouvement et l'audio pour que chaque référence ait un rôle unique et clair.
Utilisez l'image pour ancrer une personne, un produit, une tenue ou un style visuel. Utilisez la vidéo pour guider le mouvement, le rythme de la prestation, le cadrage et la direction caméra. L'exemple prévu sera livré en 720P.
@Image1 définit le sujet et l'apparence. Suivez l'action et le mouvement de caméra de @Video1 tout en créant une nouvelle scène.
Ajoutez de l'audio quand la voix, la musique, le rythme ou la synchronisation font partie du brief. L'image possède l'apparence, la vidéo la prestation et l'audio le son et le rythme. L'exemple prévu utilisera la sortie 768P de H3.
Conservez le sujet de @Image1, suivez la prestation dans @Video1 et synchronisez la révélation sur @Audio1.
Les échecs de cohérence en référence vers vidéo viennent souvent de sources contradictoires, pas d'un manque d'adjectifs dans le prompt. Simplifiez les preuves, indiquez ce qui doit rester fixe et ne testez qu'un changement créatif à la fois.
Pour le contrôle d'identité en référence vers vidéo, utilisez une seule image nette de face ou aux trois quarts, supprimez les portraits contradictoires et décrivez la personne une seule fois. N'ajoutez un second angle que s'il apporte une nouvelle information.
Assignez à chaque personne un jeton de référence distinct et répétez l'association dans la phrase d'action. Gardez les descriptions de garde-robe attachées au bon nom.
Donnez à la référence vers vidéo une image produit héroïque nette, plus un angle montrant la géométrie, la marque et la matière. Demandez-lui de préserver la forme, le placement de l'étiquette, la couleur et l'échelle.
Trimmez les médias sources exactement sur le mouvement ou le temps fort. Dans un prompt de référence vers vidéo, énoncez un rôle par source et supprimez les assets redondants.
Utilisez une référence en pied avec la tenue complète visible. Nommez le vêtement, la matière, la couleur et les accessoires comme détails fixes, et évitez les images de garde-robe contradictoires.
Utilisez une courte vidéo montrant exactement le panoramique, l'orbite, le travelling avant ou le mouvement à l'épaule voulu. Assignez ce clip uniquement au comportement de la caméra au lieu de lui demander aussi de définir le sujet.
Choisissez selon ce qui doit rester sous contrôle. Le texte crée à partir d'une description, l'image vers vidéo anime une image existante, et la référence vers vidéo utilise plusieurs sources comme contraintes pour un plan nouvellement composé.
Texte vers vidéoUne description écrite
Image vers vidéoUne image traitée comme premier cadre
Référence vers vidéoPlusieurs assets avec des rôles créatifs séparés
Texte vers vidéoConcept, sujet, action et ambiance
Image vers vidéoComposition et apparence proches du premier cadre
Référence vers vidéoIdentité, produit, mouvement, caméra, style et audio
Texte vers vidéoIdéation ouverte et nouvelles scènes
Image vers vidéoUne seule animation courte à partir d'une image fixe
Référence vers vidéoHistoires, campagnes, séries UGC, IP de personnages et plans centrés sur la prestation
Texte vers vidéoDécrire tout ce que le modèle doit créer
Image vers vidéoDécrire le mouvement à partir de l'image téléversée
Référence vers vidéoAssigner des rôles aux sources @Image, @Video et @Audio
Construisez un brief de référence vers vidéo contrôlé en assignant à chaque source un rôle de production précis avant de générer une nouvelle scène.
Un projet de référence vers vidéo commence par des images claires pour l'identité, les produits, les tenues ou le style. Ajoutez de courtes références vidéo et audio quand elles apportent mouvement, caméra, voix ou rythme.
Dites au modèle ce que contrôlent @Image1, @Video1 et @Audio1, puis décrivez l'action, le décor, la caméra et les détails qui ne doivent pas changer.
Vérifiez dans le résultat de la référence vers vidéo les visages, la garde-robe, la géométrie du produit, les rôles, le mouvement et le calage audio. Ne modifiez qu'une instruction à la fois.
Le meilleur modèle de référence vers vidéo dépend de vos sources et des détails qui comptent le plus. Le compositeur valide les types d'assets et les limites pris en charge avant d'envoyer une tâche.
La gamme Seedance complète
Choisissez Seedance 2.0 Mini, 2.0 Fast ou 2.5. Mini prend en charge 480P/720P, Fast prend en charge 720P et 2.5 prend en charge 480P/720P avec une génération jusqu'à 30 secondes.
Référence multimodale haute résolution
MiniMax H3 prend en charge 768P et 2K avec des références image, vidéo directe et audio. Les images et l'audio n'entraînent aucun frais supplémentaire ; les vidéos directes sont facturées selon la durée totale d'entrée plus de sortie.
Génération vidéo Gemini rapide
Omni Flash 1.1 prend en charge les sorties 720P, 1080P et 4K en 8 ou 10 secondes. Il accepte jusqu'à sept emplacements de référence pondérés, une vidéo occupant deux emplacements.
Préparez des références d'identité, nommez les détails qui ne peuvent pas changer et vérifiez le visage, la tenue et les proportions dans chaque plan.
Lire le guide personnageDonnez l'apparence aux images, le mouvement à la vidéo, le rythme à l'audio, et reliez chaque source avec des jetons de référence explicites.
Lire le guide multimodalParcourez la cohérence d'identité, la continuité de scène, l'image vers vidéo, le prompting multimodal et d'autres termes de production.
Ouvrir le glossaire144 $US facturés par an
Jusqu’à 37 vidéos
Crédits mensuels, sans report.
348 $US facturés par an
Jusqu’à 100 vidéos
Crédits mensuels, sans report.
1 068 $US facturés par an
Jusqu’à 325 vidéos
Crédits mensuels, sans report.
Sans référence vidéo
| Modèle / Résolution | Lite1 500 crédits | Pro4 000 crédits | Ultra13 000 crédits |
|---|---|---|---|
| Seedance 2.0 Mini · 480P40 crédits / 5s | Jusqu’à 37 vidéos | Jusqu’à 100 vidéos | Jusqu’à 325 vidéos |
| Seedance 2.0 Mini · 720P80 crédits / 5s | Jusqu’à 18 vidéos | Jusqu’à 50 vidéos | Jusqu’à 162 vidéos |
| Seedance 2.0 Fast · 720P180 crédits / 5s | Jusqu’à 8 vidéos | Jusqu’à 22 vidéos | Jusqu’à 72 vidéos |
| Seedance 2.5 · 480P190 crédits / 5s | Jusqu’à 7 vidéos | Jusqu’à 21 vidéos | Jusqu’à 68 vidéos |
| Seedance 2.5 · 720P380 crédits / 5s | Jusqu’à 3 vidéos | Jusqu’à 10 vidéos | Jusqu’à 34 vidéos |
| MiniMax H3 · 768P110 crédits / 5s | Jusqu’à 13 vidéos | Jusqu’à 36 vidéos | Jusqu’à 118 vidéos |
| MiniMax H3 · 2K160 crédits / 5s | Jusqu’à 9 vidéos | Jusqu’à 25 vidéos | Jusqu’à 81 vidéos |
| Omni Flash 1.1 · 720P120 crédits / 8s | Jusqu’à 12 vidéos | Jusqu’à 33 vidéos | Jusqu’à 108 vidéos |
| Omni Flash 1.1 · 1080P180 crédits / 8s | Jusqu’à 8 vidéos | Jusqu’à 22 vidéos | Jusqu’à 72 vidéos |
| Omni Flash 1.1 · 4K350 crédits / 8s | Jusqu’à 4 vidéos | Jusqu’à 11 vidéos | Jusqu’à 37 vidéos |
Total = crédits de génération de base + crédits de référence vidéo
Sans référence vidéo native
Crédits de base = tarif de sortie par seconde × secondes de sortie
Les prompts texte, images de référence et audio de référence sont facturés uniquement sur la durée générée.
Avec références vidéo natives
Total = crédits de génération de base + crédits de référence vidéo
Seedance et H3 facturent les références à la seconde, après addition des durées et arrondi supérieur. Images et audio sans supplément. Omni applique un supplément fixe, pas à la seconde.
| Modèle | Résolution | Sortie de 5s · sans vidéo de référence | Référence de 5s + sortie de 5s |
|---|---|---|---|
| Seedance 2.0 Mini | 480P | 40 | 40 + 5 × 2 = 50 |
| Seedance 2.0 Mini | 720P | 80 | 80 + 5 × 4 = 100 |
| Seedance 2.0 Fast | 720P | 180 | 180 + 5 × 8 = 220 |
| Seedance 2.5 | 480P | 190 | 190 + 5 × 10 = 240 |
| Seedance 2.5 | 720P | 380 | 380 + 5 × 20 = 480 |
| MiniMax H3 | 768P | 110 | 110 + 5 × 22 = 220 |
| MiniMax H3 | 2K | 160 | 160 + 5 × 32 = 320 |
| Résolution | Sortie de 8s · sans vidéo de référence | Référence de 3s + sortie de 8s |
|---|---|---|
| 720P | 120 | 120 + 50 = 170 |
| 1080P | 180 | 180 + 60 = 240 |
| 4K | 350 | 350 + 70 = 420 |
Seedance et H3 facturent les références à la seconde, après addition des durées et arrondi supérieur. Images et audio sans supplément. Omni applique un supplément fixe, pas à la seconde.
Reference to Video
Utilisez les images pour l'apparence, la vidéo pour le mouvement et l'audio pour le son et le rythme. Donnez à chaque source un rôle clair, puis dirigez ce que le prochain plan doit changer.