Charakter-Identität
Halte Gesichter, Haare, Körperproportionen und markante Merkmale über neue Szenen hinweg erkennbar.
Reference to Video AI
Lade Referenzbilder, -videos oder -audio hoch und erzeuge flüssige, kohärente Videos, in denen dein Charakter mit perfekter Gesichtskonsistenz und natürlicher Bewegung spricht und handelt. Keine Nachdrehs mehr!
Wähle ein Modell, füge kompatible Bild-, Video- oder Audio-Referenzen hinzu und erwähne sie dann in deinem Prompt.
Referenz-Assets
9 Bilder · 3 Videos · 3 Audiodateien
Wähle ein Template, um dessen Prompt und Referenzrichtung zu laden.
08 Referenz-zu-Video-Anwendungsfälle
Sieh, wie Referenz-zu-Video Identität, Garderobe, Produkte und visuelle Welten über Drama, UGC, Anime, Fashion, Musik und Gameszenen hinweg erkennbar hält.
Entdecke Fashion-, Produkt-, Performer- und Maskottchen-Kontinuität in den ursprünglichen acht Referenz-zu-Video-Fällen.
Referenz-zuerst-Generierung
Referenz-zu-Video ist ein KI-Generierungs-Workflow, der eine oder mehrere Quell-Assets als kreative Belege nutzt. Statt einen Text-Prompt zu bitten, sich gleichzeitig ein Gesicht, ein Produkt, ein Outfit, eine Bewegung, einen Kamerastil und einen Klang zu merken, lässt Referenz-zu-Video jede Quelle einen bestimmten Teil der neuen Einstellung definieren.
Ein starkes Referenz-zu-Video-Ergebnis reproduziert eine Quelle nicht Bild für Bild. Es bewahrt die Details, die Kontinuität erzeugen, und erlaubt zugleich, dass Setting, Handlung, Bildausschnitt und Story-Beat sich ändern. Das macht Referenz-zu-Video nützlich für episodische Creator, KI-Influencer, Produktkampagnen, Anime-Charaktere, Fashion-Sequenzen, Musikvideos und Markenwelten.
Der Unterschied ist Kontrolle: Referenzen bleiben über die gesamte Einstellung hinweg aktiv und definieren, was erkennbar bleiben muss und was sich ändern darf.
Jede Quelle sollte eine Produktionsentscheidung besitzen. Klare Rollen machen das Ergebnis leichter zu lenken, zu prüfen und zu verfeinern.
Halte Gesichter, Haare, Körperproportionen und markante Merkmale über neue Szenen hinweg erkennbar.
Bewahre Produktform, Farbe, Materialien, Verpackung und Etikettenplatzierung in neuen Einstellungen.
Nutze ein kurzes Video, um Gesten, Timing, Körperbewegung und Performance-Energie zu leiten.
Referenziere einen Schwenk, eine Orbit-Bewegung, eine Heranfahrt, eine Handkamera-Führung oder ein anderes Kameraverhalten, das schwer zu beschreiben ist.
Trage eine Location, Lichtsprache, Farbpalette oder visuelle Welt in eine neu komponierte Einstellung hinüber.
Führe Dialog, Stimme, Musik, Beats und Action-Timing auf Modellen, die Audio-Referenzen akzeptieren.
Starte mit dem kleinsten sinnvollen Quell-Set. Diese zwei Workflows trennen Erscheinung, Bewegung und Audio, damit jede Referenz eine klare Aufgabe hat.
Nutze das Bild, um eine Person, ein Produkt, ein Outfit oder einen visuellen Stil zu verankern. Nutze das Video, um Bewegung, Performance-Timing, Bildausschnitt und Kameraführung zu leiten. Das geplante Beispiel wird in 720P geliefert.
@Image1 definiert das Subjekt und die Erscheinung. Folge der Handlung und der Kamerabewegung aus @Video1 und erschaffe dabei eine neue Szene.
Ergänze Audio, wenn Stimme, Musik, Rhythmus oder Synchronisation Teil des Briefs sind. Das Bild besitzt die Erscheinung, das Video die Performance und das Audio den Klang und das Timing. Das geplante Beispiel nutzt die 768P-Ausgabe von H3.
Behalte das Subjekt aus @Image1, folge der Performance in @Video1 und synchronisiere die Enthüllung auf @Audio1.
Referenz-zu-Video-Konsistenzfehler entstehen oft durch widersprüchliche Quellen, nicht durch fehlende Prompt-Adjektive. Vereinfache die Belege, benenne, was fix bleiben muss, und teste immer nur eine kreative Änderung gleichzeitig.
Nutze für die Referenz-zu-Video-Identitätskontrolle ein sauberes Frontal- oder Dreiviertelbild, entferne widersprüchliche Porträts und beschreibe die Person einmal. Ergänze einen zweiten Winkel nur, wenn er neue Informationen beiträgt.
Weise jeder Person ein eigenes Referenz-Token zu und wiederhole die Zuordnung im Handlungs-Satz. Halte Garderoben-Beschreibungen beim richtigen Namen.
Gib Referenz-zu-Video ein sauberes Produkt-Hero-Bild plus einen Winkel, der Geometrie, Branding und Material zeigt. Bitte darum, Form, Etikettenplatzierung, Farbe und Maßstab zu bewahren.
Trimme die Quellmedien exakt auf die Bewegung oder den Beat. Formuliere in einem Referenz-zu-Video-Prompt eine Aufgabe pro Quelle und entferne redundante Assets.
Nutze eine Ganzkörper-Referenz mit vollständig sichtbarem Outfit. Nenne Kleidungsstück, Material, Farbe und Accessoires als feste Details und vermeide widersprüchliche Garderoben-Bilder.
Nutze ein kurzes Video, das genau den Schwenk, die Orbit-Bewegung, die Heranfahrt oder die Handkamera-Bewegung zeigt. Weise diesen Clip nur dem Kameraverhalten zu, statt ihn auch das Subjekt definieren zu lassen.
Wähle nach dem, was unter Kontrolle bleiben muss. Text erschafft aus einer Beschreibung, Bild-zu-Video animiert ein vorhandenes Standbild, und Referenz-zu-Video nutzt mehrere Quellen als Vorgaben für eine neu komponierte Einstellung.
Text-zu-VideoEine schriftliche Beschreibung
Bild-zu-VideoEin Bild als Eröffnungsframe
Referenz-zu-VideoMehrere Assets mit getrennten kreativen Aufgaben
Text-zu-VideoKonzept, Subjekt, Handlung und Stimmung
Bild-zu-VideoKomposition und Erscheinung nahe am ersten Frame
Referenz-zu-VideoIdentität, Produkt, Bewegung, Kamera, Stil und Audio
Text-zu-VideoOffene Ideensuche und neue Szenen
Bild-zu-VideoEine einzelne kurze Animation aus einem Standbild
Referenz-zu-VideoStories, Kampagnen, UGC-Serien, Charakter-IP und Performance-getriebene Einstellungen
Text-zu-VideoBeschreibe alles, was das Modell erschaffen muss
Bild-zu-VideoBeschreibe die Bewegung weg vom hochgeladenen Frame
Referenz-zu-VideoWeise @Image-, @Video- und @Audio-Quellen Rollen zu
Baue einen kontrollierten Referenz-zu-Video-Brief, indem du jeder Quelle eine bestimmte Produktionsaufgabe zuweist, bevor du eine neue Szene generierst.
Ein Referenz-zu-Video-Projekt beginnt mit klaren Bildern für Identität, Produkte, Outfits oder Stil. Ergänze kurze Video- und Audio-Referenzen, wenn sie Bewegung, Kamera, Stimme oder Timing beitragen.
Sag dem Modell, was @Image1, @Video1 und @Audio1 steuern, und beschreibe dann die Handlung, das Setting, die Kamera und die Details, die sich nicht ändern dürfen.
Prüfe das Referenz-zu-Video-Ergebnis auf Gesichter, Garderobe, Produktgeometrie, Rollen, Bewegung und Audio-Timing. Ändre immer nur eine Anweisung gleichzeitig.
Das beste Referenz-zu-Video-Modell hängt von deinen Quellen und den Details ab, die am meisten zählen. Der Composer prüft unterstützte Asset-Typen und Limits, bevor er einen Auftrag abschickt.
Die komplette Seedance-Palette
Wähle Seedance 2.0 Mini, 2.0 Fast oder 2.5. Mini unterstützt 480P/720P, Fast unterstützt 720P und 2.5 unterstützt 480P/720P mit Generierungen bis zu 30 Sekunden.
Hochauflösende multimodale Referenz
MiniMax H3 unterstützt 768P und 2K mit Bild-, Direktvideo- und Audio-Referenzen. Bilder und Audio kosten keinen Aufpreis; direkte Videos werden nach Eingabe- plus Ausgabe-Dauer insgesamt abgerechnet.
Schnelle Gemini-Videogenerierung
Omni Flash 1.1 unterstützt 720P, 1080P und 4K mit 8 oder 10 Sekunden Ausgabe. Es akzeptiert bis zu sieben gewichtete Referenz-Slots, wobei ein Video zwei Slots belegt.
Bereite Identitätsreferenzen vor, nenne die Details, die sich nicht ändern dürfen, und prüfe Gesicht, Outfit und Proportionen in jeder Einstellung.
Charakter-Guide lesenGib der Erscheinung Bilder, der Bewegung Video und dem Timing Audio, und verbinde jede Quelle mit expliziten Referenz-Tokens.
Multimodal-Guide lesenPrüfe Identitäts-Konsistenz, Szenen-Kontinuität, Bild-zu-Video, multimodales Prompting und verwandte Produktionsbegriffe.
Glossar öffnen144 $ jährlich abgerechnet
Bis zu 37 Videos
Monatliche Credits, kein Übertrag.
348 $ jährlich abgerechnet
Bis zu 100 Videos
Monatliche Credits, kein Übertrag.
1.068 $ jährlich abgerechnet
Bis zu 325 Videos
Monatliche Credits, kein Übertrag.
Keine Video-Referenz
| Modell / Auflösung | Lite1.500 Credits | Pro4.000 Credits | Ultra13.000 Credits |
|---|---|---|---|
| Seedance 2.0 Mini · 480P40 Credits / 5s | Bis zu 37 Videos | Bis zu 100 Videos | Bis zu 325 Videos |
| Seedance 2.0 Mini · 720P80 Credits / 5s | Bis zu 18 Videos | Bis zu 50 Videos | Bis zu 162 Videos |
| Seedance 2.0 Fast · 720P180 Credits / 5s | Bis zu 8 Videos | Bis zu 22 Videos | Bis zu 72 Videos |
| Seedance 2.5 · 480P190 Credits / 5s | Bis zu 7 Videos | Bis zu 21 Videos | Bis zu 68 Videos |
| Seedance 2.5 · 720P380 Credits / 5s | Bis zu 3 Videos | Bis zu 10 Videos | Bis zu 34 Videos |
| MiniMax H3 · 768P110 Credits / 5s | Bis zu 13 Videos | Bis zu 36 Videos | Bis zu 118 Videos |
| MiniMax H3 · 2K160 Credits / 5s | Bis zu 9 Videos | Bis zu 25 Videos | Bis zu 81 Videos |
| Omni Flash 1.1 · 720P120 Credits / 8s | Bis zu 12 Videos | Bis zu 33 Videos | Bis zu 108 Videos |
| Omni Flash 1.1 · 1080P180 Credits / 8s | Bis zu 8 Videos | Bis zu 22 Videos | Bis zu 72 Videos |
| Omni Flash 1.1 · 4K350 Credits / 8s | Bis zu 4 Videos | Bis zu 11 Videos | Bis zu 37 Videos |
Gesamt = Basis-Credits der Generierung + Videoreferenz-Credits
Ohne native Video-Referenz
Basis-Credits = Ausgaberate pro Sekunde × Ausgabesekunden
Text-Prompts, Referenzbilder und Referenz-Audio werden nur für die generierte Dauer abgerechnet.
Mit nativen Video-Referenzen
Gesamt = Basis-Credits der Generierung + Videoreferenz-Credits
Seedance und H3 berechnen Referenzen pro Sekunde; die Gesamtdauer wird aufgerundet. Bilder und Audio kosten nichts extra. Omni nutzt einen festen Zuschlag statt einer Sekundenabrechnung.
| Modell | Auflösung | 5s Ausgabe · ohne Videoreferenz | 5s Referenz + 5s Ausgabe |
|---|---|---|---|
| Seedance 2.0 Mini | 480P | 40 | 40 + 5 × 2 = 50 |
| Seedance 2.0 Mini | 720P | 80 | 80 + 5 × 4 = 100 |
| Seedance 2.0 Fast | 720P | 180 | 180 + 5 × 8 = 220 |
| Seedance 2.5 | 480P | 190 | 190 + 5 × 10 = 240 |
| Seedance 2.5 | 720P | 380 | 380 + 5 × 20 = 480 |
| MiniMax H3 | 768P | 110 | 110 + 5 × 22 = 220 |
| MiniMax H3 | 2K | 160 | 160 + 5 × 32 = 320 |
| Auflösung | 8s Ausgabe · ohne Videoreferenz | 3s Referenz + 8s Ausgabe |
|---|---|---|
| 720P | 120 | 120 + 50 = 170 |
| 1080P | 180 | 180 + 60 = 240 |
| 4K | 350 | 350 + 70 = 420 |
Seedance und H3 berechnen Referenzen pro Sekunde; die Gesamtdauer wird aufgerundet. Bilder und Audio kosten nichts extra. Omni nutzt einen festen Zuschlag statt einer Sekundenabrechnung.
Reference to Video
Nutze Bilder für die Erscheinung, Video für Bewegung und Audio für Klang und Timing. Gib jeder Quelle eine klare Rolle und lege dann fest, was die nächste Einstellung ändern soll.