Identidad del personaje
Mantén rostros, cabello, proporciones corporales y rasgos distintivos reconocibles en escenas nuevas.
Reference to Video AI
Sube imágenes, videos o audio de referencia y genera videos fluidos y coherentes donde tu personaje habla y actúa con una consistencia facial perfecta y movimientos naturales. ¡Se acabaron las repeticiones!
Elige un modelo, añade referencias compatibles de imagen, video o audio y menciónalas en tu prompt.
Recursos de referencia
9 imágenes · 3 videos · 3 archivos de audio
Elige una plantilla para cargar su prompt y su dirección de referencia.
08 casos de uso de Reference to Video
Descubre cómo la referencia a video mantiene reconocibles la identidad, el vestuario, los productos y los mundos visuales en drama, UGC, anime, moda, música y escenas de juegos.
Explora la continuidad de moda, producto, intérprete y mascota en los ocho casos originales de referencia a video.
Generación basada en referencias
La referencia a video es un flujo de generación con IA que usa uno o más recursos de origen como evidencia creativa. En lugar de pedirle a un prompt de texto que recuerde a la vez un rostro, un producto, un vestuario, un movimiento, un estilo de cámara y un sonido, la referencia a video permite que cada fuente defina una parte específica de la nueva toma.
Un buen resultado de referencia a video no reproduce una fuente fotograma a fotograma. Preserva los detalles que crean continuidad mientras permite que el entorno, la acción, el encuadre y el momento narrativo cambien. Esto hace que la referencia a video sea útil para creadores episódicos, influencers de IA, campañas de producto, personajes anime, secuencias de moda, videoclips y mundos de marca.
La diferencia es el control: las referencias permanecen activas durante toda la toma, definiendo qué debe seguir siendo reconocible y qué puede cambiar.
Cada fuente debe ser la dueña de una decisión de producción. Los roles claros hacen que el resultado sea más fácil de dirigir, revisar y refinar.
Mantén rostros, cabello, proporciones corporales y rasgos distintivos reconocibles en escenas nuevas.
Preserva la forma, el color, los materiales, el empaque y la ubicación de la etiqueta del producto en nuevas tomas.
Usa un video corto para guiar gestos, ritmo, movimiento corporal y energía de actuación.
Referencia una panorámica, una órbita, un acercamiento, un movimiento en mano u otro comportamiento de cámara difícil de describir.
Lleva una ubicación, un lenguaje de iluminación, una paleta o un mundo visual a una toma recién compuesta.
Guía el diálogo, la voz, la música, los beats y el ritmo de la acción en modelos que aceptan referencias de audio.
Empieza con el conjunto mínimo útil de fuentes. Estos dos flujos separan apariencia, movimiento y audio para que cada referencia tenga una única función clara.
Usa la imagen para fijar a una persona, un producto, un vestuario o un estilo visual. Usa el video para guiar el movimiento, el ritmo de actuación, el encuadre y la dirección de cámara. El ejemplo previsto se entregará en 720P.
@Image1 define el sujeto y la apariencia. Sigue la acción y el movimiento de cámara de @Video1 mientras creas una escena nueva.
Añade audio cuando la voz, la música, el ritmo o la sincronización sean parte del brief. La imagen es la dueña de la apariencia, el video de la actuación y el audio del sonido y el ritmo. El ejemplo previsto usará la salida 768P de H3.
Conserva el sujeto de @Image1, sigue la actuación de @Video1 y sincroniza el momento revelador con @Audio1.
Los fallos de consistencia en la referencia a video suelen venir de fuentes contradictorias, no de la falta de adjetivos en el prompt. Simplifica la evidencia, declara qué debe permanecer fijo y prueba un cambio creativo a la vez.
Para el control de identidad en la referencia a video, usa una única imagen limpia frontal o de tres cuartos, elimina retratos contradictorios y describe a la persona una sola vez. Añade un segundo ángulo solo cuando aporte información nueva.
Asigna a cada persona un token de referencia separado y repite el mapeo en la frase de acción. Mantén las descripciones de vestuario adjuntas al nombre correcto.
Dale a la referencia a video una imagen limpia del producto como protagonista más un ángulo que muestre la geometría, la marca y el material. Pídele preservar la forma, la posición de la etiqueta, el color y la escala.
Recorta el material de origen al movimiento o al beat exacto. En un prompt de referencia a video, declara una función para cada fuente y elimina los recursos redundantes.
Usa una referencia de cuerpo completo con todo el vestuario visible. Nombra la prenda, el material, el color y los accesorios como detalles fijos, y evita imágenes de vestuario contradictorias.
Usa un video corto que muestre la panorámica, la órbita, el acercamiento o el movimiento en mano exactos. Asigna ese clip solo al comportamiento de cámara en lugar de pedirle que también defina al sujeto.
Elige según lo que deba permanecer bajo control. El texto crea a partir de una descripción, imagen a video anima un fotograma existente y la referencia a video usa varias fuentes como restricciones para una toma recién compuesta.
Text to VideoUna descripción escrita
Image to VideoUna imagen tratada como fotograma inicial
Reference to VideoVarios recursos con funciones creativas separadas
Text to VideoConcepto, sujeto, acción y atmósfera
Image to VideoComposición y apariencia cercanas al primer fotograma
Reference to VideoIdentidad, producto, movimiento, cámara, estilo y audio
Text to VideoIdeación abierta y escenas nuevas
Image to VideoUna animación corta a partir de una sola imagen fija
Reference to VideoHistorias, campañas, series UGC, IP de personajes y tomas guiadas por la actuación
Text to VideoDescribe todo lo que el modelo debe crear
Image to VideoDescribe el movimiento a partir del fotograma subido
Reference to VideoAsigna roles a las fuentes @Image, @Video y @Audio
Construye un brief controlado de referencia a video asignando a cada fuente una función de producción específica antes de generar una escena nueva.
Un proyecto de referencia a video comienza con imágenes claras para identidad, productos, vestuario o estilo. Añade referencias cortas de video y audio cuando aporten movimiento, cámara, voz o ritmo.
Dile al modelo qué controlan @Image1, @Video1 y @Audio1, y describe después la acción, el entorno, la cámara y los detalles que no deben cambiar.
Revisa el resultado de la referencia a video: rostros, vestuario, geometría del producto, roles, movimiento y sincronía de audio. Cambia una instrucción a la vez.
El mejor modelo de referencia a video depende de tus fuentes y del detalle que más importe. El compositor valida los tipos de recurso admitidos y los límites antes de enviar un trabajo.
La gama completa de Seedance
Elige Seedance 2.0 Mini, 2.0 Fast o 2.5. Mini admite 480P/720P, Fast admite 720P y 2.5 admite 480P/720P con generación de hasta 30 segundos.
Referencia multimodal de alta resolución
MiniMax H3 admite 768P y 2K con referencias de imagen, video directo y audio. Las imágenes y el audio no tienen costo adicional; los videos directos se facturan por la duración total de entrada más la de salida.
Generación de video rápida con Gemini
Omni Flash 1.1 admite salida en 720P, 1080P y 4K con duraciones de 8 o 10 segundos. Acepta hasta siete ranuras de referencia ponderadas, y un video ocupa dos ranuras.
Prepara referencias de identidad, nombra los detalles que no pueden cambiar y revisa rostro, vestuario y proporciones en cada toma.
Leer la guía de personajesDa la apariencia a las imágenes, el movimiento al video y el ritmo al audio, y conecta cada fuente con tokens de referencia explícitos.
Leer la guía multimodalRepasa la consistencia de identidad, la continuidad de escena, imagen a video, el prompting multimodal y otros términos de producción relacionados.
Abrir el glosario144 US$ facturados al año
Hasta 37 vídeos
Créditos mensuales, sin acumulación.
348 US$ facturados al año
Hasta 100 vídeos
Créditos mensuales, sin acumulación.
1068 US$ facturados al año
Hasta 325 vídeos
Créditos mensuales, sin acumulación.
Sin referencia de video
| Modelo / Resolución | Lite1500 créditos | Pro4000 créditos | Ultra13.000 créditos |
|---|---|---|---|
| Seedance 2.0 Mini · 480P40 créditos / 5s | Hasta 37 vídeos | Hasta 100 vídeos | Hasta 325 vídeos |
| Seedance 2.0 Mini · 720P80 créditos / 5s | Hasta 18 vídeos | Hasta 50 vídeos | Hasta 162 vídeos |
| Seedance 2.0 Fast · 720P180 créditos / 5s | Hasta 8 vídeos | Hasta 22 vídeos | Hasta 72 vídeos |
| Seedance 2.5 · 480P190 créditos / 5s | Hasta 7 vídeos | Hasta 21 vídeos | Hasta 68 vídeos |
| Seedance 2.5 · 720P380 créditos / 5s | Hasta 3 vídeos | Hasta 10 vídeos | Hasta 34 vídeos |
| MiniMax H3 · 768P110 créditos / 5s | Hasta 13 vídeos | Hasta 36 vídeos | Hasta 118 vídeos |
| MiniMax H3 · 2K160 créditos / 5s | Hasta 9 vídeos | Hasta 25 vídeos | Hasta 81 vídeos |
| Omni Flash 1.1 · 720P120 créditos / 8s | Hasta 12 vídeos | Hasta 33 vídeos | Hasta 108 vídeos |
| Omni Flash 1.1 · 1080P180 créditos / 8s | Hasta 8 vídeos | Hasta 22 vídeos | Hasta 72 vídeos |
| Omni Flash 1.1 · 4K350 créditos / 8s | Hasta 4 vídeos | Hasta 11 vídeos | Hasta 37 vídeos |
Total = créditos base de generación + créditos del vídeo de referencia
Sin referencia nativa de video
Créditos base = tarifa de salida por segundo × segundos de salida
Los prompts de texto, las imágenes de referencia y el audio de referencia se cobran solo por la duración generada.
Con referencias nativas de video
Total = créditos base de generación + créditos del vídeo de referencia
Seedance y H3 cobran las referencias por segundo; se suman las duraciones antes de redondear hacia arriba. Imágenes y audio sin recargo. Omni aplica un recargo fijo, no por segundo.
| Modelo | Resolución | Salida de 5s · sin video de referencia | Referencia de 5s + salida de 5s |
|---|---|---|---|
| Seedance 2.0 Mini | 480P | 40 | 40 + 5 × 2 = 50 |
| Seedance 2.0 Mini | 720P | 80 | 80 + 5 × 4 = 100 |
| Seedance 2.0 Fast | 720P | 180 | 180 + 5 × 8 = 220 |
| Seedance 2.5 | 480P | 190 | 190 + 5 × 10 = 240 |
| Seedance 2.5 | 720P | 380 | 380 + 5 × 20 = 480 |
| MiniMax H3 | 768P | 110 | 110 + 5 × 22 = 220 |
| MiniMax H3 | 2K | 160 | 160 + 5 × 32 = 320 |
| Resolución | Salida de 8s · sin video de referencia | Referencia de 3s + salida de 8s |
|---|---|---|
| 720P | 120 | 120 + 50 = 170 |
| 1080P | 180 | 180 + 60 = 240 |
| 4K | 350 | 350 + 70 = 420 |
Seedance y H3 cobran las referencias por segundo; se suman las duraciones antes de redondear hacia arriba. Imágenes y audio sin recargo. Omni aplica un recargo fijo, no por segundo.
Reference to Video
Usa imágenes para la apariencia, video para el movimiento y audio para el sonido y el ritmo. Da a cada fuente un rol claro y dirige después lo que la próxima toma debe cambiar.