Reference to Video AI

Reference to Video Generatore AI

Carica immagini, video o audio di riferimento e genera video fluidi e coerenti in cui il tuo personaggio parla e agisce con una coerenza perfetta del volto e movimenti naturali. Basta rifare le riprese!

Reference to Video

Scegli un modello, aggiungi riferimenti immagine, video o audio compatibili, poi citali nel tuo prompt.

Asset di riferimento

9 immagini · 3 video · 3 file audio

0/15
0/4000
Modello
Formato

Video di esempio

Scegli un template per caricarne prompt e indicazioni sui riferimenti.

08 casi d'uso del reference to video

Le storie hanno bisogno di continuità. Non di generazioni fortunate.

Scopri come il reference to video mantiene riconoscibili identità, guardaroba, prodotti e mondi visivi in scene drammatiche, UGC, anime, moda, musica e videogiochi.

Altri workflow di coerenza

Esplora la continuità di moda, prodotto, performer e mascotte negli otto casi reference to video originali.

Generazione reference-first

Cos'è il reference to video?

Il reference to video è un workflow di generazione AI che usa uno o più asset sorgente come prove creative. Invece di chiedere a un prompt testuale di ricordare allo stesso tempo volto, prodotto, outfit, movimento, stile di camera e suono, il reference to video lascia che ogni fonte definisca una parte specifica della nuova ripresa.

Un buon risultato reference to video non riproduce una fonte fotogramma per fotogramma. Preserva i dettagli che creano continuità lasciando cambiare ambientazione, azione, inquadratura e momento narrativo. Questo rende il reference to video utile per creator episodici, influencer AI, campagne di prodotto, personaggi anime, sequenze di moda, videoclip e mondi a marchio.

La differenza è il controllo: i riferimenti restano attivi per tutta la ripresa, definendo cosa deve rimanere riconoscibile e cosa può cambiare.

Cosa puoi controllare con i riferimenti?

Ogni fonte dovrebbe possedere una sola decisione di produzione. Ruoli chiari rendono il risultato più facile da dirigere, verificare e rifinire.

Identità del personaggio

Mantieni riconoscibili volti, capelli, proporzioni del corpo e tratti distintivi in nuove scene.

Aspetto del prodotto

Preserva forma, colore, materiali, confezione e posizione dell'etichetta del prodotto nelle nuove riprese.

Movimento e performance

Usa un breve video per guidare gesti, timing, movimento del corpo ed energia della performance.

Movimento di camera

Referenzia una panoramica, un'orbita, una carrellata in avanti, un movimento a mano libera o altro comportamento di camera difficile da descrivere.

Scena e stile

Porta una location, un linguaggio di luce, una palette o un mondo visivo in una ripresa composta ex novo.

Audio e timing

Guida dialoghi, voce, musica, battute e timing delle azioni sui modelli che accettano riferimenti audio.

Due workflow multimodali con riferimenti

Parti dall'insieme minimo di fonti utile. Questi due workflow separano aspetto, movimento e audio così che ogni riferimento abbia un solo compito chiaro.

Seedance 2.0 Fastformato di esempio 720P

Riferimento immagine + video

Usa l'immagine per ancorare una persona, un prodotto, un outfit o uno stile visivo. Usa il video per guidare movimento, timing della performance, inquadratura e direzione della camera. L'esempio previsto sarà consegnato a 720P.

@Image1 · aspetto@Video1 · movimento

@Image1 definisce il soggetto e l'aspetto. Segui l'azione e il movimento di camera di @Video1 creando una nuova scena.

MiniMax H3 Referenceformato di esempio 768P

Riferimento immagine + video + audio

Aggiungi l'audio quando voce, musica, ritmo o sincronizzazione fanno parte del brief. L'immagine possiede l'aspetto, il video possiede la performance e l'audio possiede suono e timing. L'esempio previsto userà l'output 768P di H3.

@Image1 · aspetto@Video1 · performance@Audio1 · timing

Mantieni il soggetto di @Image1, segui la performance in @Video1 e sincronizza la rivelazione con @Audio1.

Risolvi i problemi di coerenza reference-to-video più comuni

I fallimenti di coerenza del reference to video derivano spesso da fonti in conflitto, non dalla mancanza di aggettivi nel prompt. Semplifica le prove, dichiara cosa deve restare fisso e testa un cambio creativo alla volta.

Il volto cambia tra le riprese

Per il controllo d'identità nel reference to video, usa una sola immagine pulita frontale o tre quarti, rimuovi i ritratti in conflitto e descrivi la persona una sola volta. Aggiungi una seconda angolazione solo se porta nuove informazioni.

Due personaggi si scambiano abiti o ruoli

Assegna a ogni persona un token di riferimento separato e ripeti la mappatura nella frase d'azione. Mantieni le descrizioni del guardaroba legate al nome corretto.

Il prodotto viene ridisegnato

Dai al reference to video un'immagine pulita del prodotto hero più un'angolazione che mostri geometria, branding e materiale. Chiedi di preservare forma, posizione dell'etichetta, colore e scala.

Movimento o audio ignorati

Taglia i media sorgente esattamente sul movimento o sulla battuta. In un prompt reference to video, dichiara un solo compito per ogni fonte e rimuovi gli asset ridondanti.

L'outfit cambia tra le scene

Usa un riferimento a corpo intero con l'outfit completo visibile. Indica indumento, materiale, colore e accessori come dettagli fissi ed evita immagini di guardaroba in conflitto.

La camera non segue il prompt

Usa un breve video che mostri l'esatta panoramica, orbita, carrellata o movimento a mano libera. Assegna quella clip solo al comportamento della camera invece di chiederle di definire anche il soggetto.

Testo, immagine o reference to video?

Scegli in base a cosa deve restare sotto controllo. Il testo crea partendo da una descrizione, l'immagine to video anima un fotogramma esistente e il reference to video usa più fonti come vincoli per una ripresa composta ex novo.

Punto di partenza

Text to VideoUna descrizione scritta

Image to VideoUna singola immagine trattata come fotogramma di apertura

Reference to VideoPiù asset con compiti creativi separati

Controllo migliore

Text to VideoConcept, soggetto, azione e atmosfera

Image to VideoComposizione e aspetto vicini al primo fotogramma

Reference to VideoIdentità, prodotto, movimento, camera, stile e audio

Uso ideale

Text to VideoIdeazione aperta e nuove scene

Image to VideoUna singola animazione breve da un'unica immagine ferma

Reference to VideoStorie, campagne, serie UGC, IP di personaggi e riprese guidate dalla performance

Metodo di prompt

Text to VideoDescrivi tutto ciò che il modello deve creare

Image to VideoDescrivi il movimento a partire dal fotogramma caricato

Reference to VideoAssegna ruoli alle fonti @Image, @Video e @Audio

Come funziona il reference to video

Costruisci un brief reference to video controllato assegnando a ogni fonte un compito di produzione specifico prima di generare una nuova scena.

Carica riferimenti puliti

Un progetto reference to video inizia con immagini chiare per identità, prodotti, outfit o stile. Aggiungi brevi riferimenti video e audio quando contribuiscono movimento, camera, voce o timing.

Assegna un ruolo a ogni riferimento

Dì al modello cosa controllano @Image1, @Video1 e @Audio1, poi descrivi l'azione, l'ambientazione, la camera e i dettagli che non devono cambiare.

Genera e verifica la coerenza

Controlla nel risultato reference to video volti, guardaroba, geometria del prodotto, ruoli, movimenti e timing audio. Modifica un'istruzione alla volta.

Scegli il modello reference to video giusto

Il miglior modello reference to video dipende dalle tue fonti e dal dettaglio che conta di più. Il compositore convalida tipi di asset e limiti supportati prima di inviare un job.

Seedance

La gamma completa Seedance

Scegli Seedance 2.0 Mini, 2.0 Fast o 2.5. Mini supporta 480P/720P, Fast supporta 720P e 2.5 supporta 480P/720P con generazione fino a 30 secondi.

MiniMax H3

Riferimento multimodale ad alta risoluzione

MiniMax H3 supporta 768P e 2K con riferimenti immagine, video diretto e audio. Immagini e audio non hanno costi extra; i video diretti vengono fatturati in base alla durata totale di input più output.

Gemini Omni

Generazione video Gemini veloce

Omni Flash 1.1 supporta output 720P, 1080P e 4K da 8 o 10 secondi. Accetta fino a sette slot di riferimento pesati, con un video che ne usa due.

Impara il workflow reference to video

Come mantenere coerente lo stesso personaggio

Prepara riferimenti d'identità, indica i dettagli che non possono cambiare e verifica volto, outfit e proporzioni in ogni ripresa.

Leggi la guida ai personaggi

Come collaborano riferimenti immagine, video e audio

Affida l'aspetto alle immagini, il movimento al video, il timing all'audio e collega ogni fonte con token di riferimento espliciti.

Leggi la guida multimodale

Termini e concetti del reference to video

Rivedi coerenza d'identità, continuità di scena, image to video, prompting multimodale e termini di produzione correlati.

Apri il glossario
PREZZI

Scegli il tuo piano di generazione video

Lite

12 USD/mese

144 USD fatturati all’anno

1500 crediti al mese

Fino a 37 video

  • Output in 720P, 1080P e 4K
  • Fino a 30 s per video in base alle impostazioni
  • Riferimenti immagine, video e audio

Crediti mensili, non cumulabili.

Più popolare

Pro

29 USD/mese

348 USD fatturati all’anno

4000 crediti al mese

Fino a 100 video

  • Output in 720P, 1080P e 4K
  • Fino a 30 s per video in base alle impostazioni
  • Riferimenti immagine, video e audio

Crediti mensili, non cumulabili.

Ultra

89 USD/mese

1068 USD fatturati all’anno

13.000 crediti al mese

Fino a 325 video

  • Output in 720P, 1080P e 4K
  • Fino a 30 s per video in base alle impostazioni
  • Riferimenti immagine, video e audio

Crediti mensili, non cumulabili.

Confronta i piani

Nessun video di riferimento

Modello / RisoluzioneLite1500 creditiPro4000 creditiUltra13.000 crediti
Seedance 2.0 Mini · 480P40 crediti / 5sFino a 37 videoFino a 100 videoFino a 325 video
Seedance 2.0 Mini · 720P80 crediti / 5sFino a 18 videoFino a 50 videoFino a 162 video
Seedance 2.0 Fast · 720P180 crediti / 5sFino a 8 videoFino a 22 videoFino a 72 video
Seedance 2.5 · 480P190 crediti / 5sFino a 7 videoFino a 21 videoFino a 68 video
Seedance 2.5 · 720P380 crediti / 5sFino a 3 videoFino a 10 videoFino a 34 video
MiniMax H3 · 768P110 crediti / 5sFino a 13 videoFino a 36 videoFino a 118 video
MiniMax H3 · 2K160 crediti / 5sFino a 9 videoFino a 25 videoFino a 81 video
Omni Flash 1.1 · 720P120 crediti / 8sFino a 12 videoFino a 33 videoFino a 108 video
Omni Flash 1.1 · 1080P180 crediti / 8sFino a 8 videoFino a 22 videoFino a 72 video
Omni Flash 1.1 · 4K350 crediti / 8sFino a 4 videoFino a 11 videoFino a 37 video

Come vengono calcolati i crediti di generazione video

Totale = crediti base di generazione + crediti del video di riferimento

Senza un video di riferimento nativo

Crediti base = tariffa di output al secondo × secondi di output

Prompt testuali, immagini di riferimento e audio di riferimento vengono addebitati solo per la durata generata.

Con video di riferimento nativi

Totale = crediti base di generazione + crediti del video di riferimento

Seedance e H3 addebitano i riferimenti al secondo, sommando le durate prima di arrotondare per eccesso. Immagini e audio senza supplemento. Omni applica un supplemento fisso, non al secondo.

Tariffe Seedance e MiniMax H3

ModelloRisoluzioneOutput di 5s · senza video di riferimentoRiferimento di 5s + output di 5s
Seedance 2.0 Mini480P4040 + 5 × 2 = 50
Seedance 2.0 Mini720P8080 + 5 × 4 = 100
Seedance 2.0 Fast720P180180 + 5 × 8 = 220
Seedance 2.5480P190190 + 5 × 10 = 240
Seedance 2.5720P380380 + 5 × 20 = 480
MiniMax H3768P110110 + 5 × 22 = 220
MiniMax H32K160160 + 5 × 32 = 320

Crediti fissi Omni Flash 1.1

La durata dei riferimenti non aumenta l'addebito
RisoluzioneOutput di 8s · senza video di riferimentoRiferimento di 3s + output di 8s
720P120120 + 50 = 170
1080P180180 + 60 = 240
4K350350 + 70 = 420

Seedance e H3 addebitano i riferimenti al secondo, sommando le durate prima di arrotondare per eccesso. Immagini e audio senza supplemento. Omni applica un supplemento fisso, non al secondo.

FAQ sul reference to video

Reference to Video

Crea una nuova ripresa dai riferimenti che hai già

Usa le immagini per l'aspetto, il video per il movimento e l'audio per suono e timing. Dai a ogni fonte un ruolo chiaro, poi dirigi cosa dovrebbe cambiare nella prossima ripresa.