Referenz-zu-Video (R2V)

Referenz zu Video (R2V) ist eine KI-Technik, die Figuren, Produkte oder Stile per Referenzbild konsistent hält. So unterscheidet sie sich von Bild zu Video.

Vollständigen Generator öffnen

So sieht es in Aktion aus

Ein echter Prompt und das Ergebnis, das er auf Molyin erzeugt hat. Mit Remix startest du genau hier.

  • Seedance 2.5
  • Reference to video
  • 30s
  • 720P

Eine hochwertige, äußerst cineastische 30-sekündige 3D-Motion-Graphics-Sequenz im verschlungenen Steampunk- und Vintage-Miniatur-Diorama-Stil, mit kontinuierlichen, fließenden Orbit- und Durchflug-Kamerabewegungen. [0-10s]: Makro-Nahaufnahme eines antiken Messing-Zifferblatts, das sich Schicht für Schicht auf wundersame Weise zu ineinandergreifenden Ringen rotierender Zahnräder und volumetrischem Nebel entfaltet. Die Kamera stürzt durch die Zahnräder hinab und enthüllt einen mechanischen Ornithopter, der sich spiralförmig aus einer Miniatur-Schlucht aus verwitterten antiken Büchern emporschraubt. [10-20s]: Die Kamera gleitet entlang der Flugbahn des Ornithopters vorwärts und geht nahtlos in ein sich schnell drehendes, verziertes Messing-Zoetrop über, in dessen Innerem das dynamische Licht und die Schatten galoppierender mechanischer Pferde projiziert werden. Die Projektion springt aus der Trommel heraus, und die Szene verwandelt sich augenblicklich in eine messingbeschlagene Schwebebahn, die sich entlang schwach glühender Kupferschienen durch einen Wald mechanischer Zahnräder fädelt, getaucht in cineastisches Goldene-Stunde-Licht. [20-30s]: Die Kamera schwenkt elegant nach unten und enthüllt unterhalb der Schwebebahn ein exquisites hölzernes Uhrwerk-Segelschiff, das sich durch rollende Wellen aus tiefblauem Glas schneidet. Am fernen Ende der Wellen verwandelt sich das Meer nahtlos in einen riesigen leuchtenden Mond, und eine Gruppe silhouettierter Entdecker mit schwingenden Laternen zieht mühsam unter dem Sternenhimmel entlang eines Kristallader-Kamms. Die Kamera fährt in einer sanften Spirale durch ätherische Wolken zurück und kehrt zum großen tickenden Messing-Zifferblatt zurück. In der letzten Sekunde erscheint das Logo, gemäß @Bild1. Technische Daten: Ultradetaillierte mechanische Texturen, satte Messing- und Goldtöne, cineastisch geringe Schärfentiefe. Sanfte, kohärente, nahtlose Durchflug-Kameraführung mit einem überwältigenden Gefühl epischen Fantasy-Abenteuers.

Referenz zu Video (R2V) ist eine generative KI-Technik, die ein oder mehrere Referenzbilder zur Steuerung der Videogenerierung nutzt — nicht als wörtliches erstes Frame, sondern als Identitätsanker. Das Modell studiert deine Referenzen (das Gesicht einer Figur, das Design eines Produkts, einen Kunststil) und generiert neue Szenen, in denen diese Identität konsistent bleibt.

Referenz vs. erstes Frame

Das ist der entscheidende Unterschied zu Bild zu Video:

  • Bild zu Video behandelt dein Bild als Eröffnungsframe. Das Video startet exakt dort.

  • Referenz zu Video behandelt deine Bilder als Definition dessen, wie die Dinge aussehen. Das Modell kann diese Figur oder dieses Produkt dann in eine völlig neue Szene, einen neuen Winkel oder eine neue Aktion versetzen — so, wie dein Prompt es beschreibt.

Kurz gesagt: I2V setzt ein Bild fort; R2V castet es.

Warum das wichtig ist

Konsistenz ist das härteste Problem der KI-Videogenerierung. Generiere „das rothaarige Mädchen im gelben Regenmantel“ zweimal nur aus Text, und du bekommst zwei verschiedene Mädchen. Referenz zu Video löst das:

  • Figurenkonsistenz — behalte dieselbe Hauptfigur über Shots, Szenen und Episoden hinweg.

  • Produkttreue — zeig dein echtes Produkt aus neuen Winkeln, in neuen Umgebungen.

  • Stilkontinuität — trag einen Illustrationsstil oder Brand-Look durch eine ganze Serie.

Prompt-Tipps

Gib dem Modell saubere, gut ausgeleuchtete Referenzen, die das Subjekt klar zeigen. Dann lass den Prompt Regie führen: neues Setting, neue Aktion, neue Kamera. Sag, was sich ändern soll — die Referenzen sagen bereits, was bleiben soll. Mehr dazu in unserem Prompt-Guide.

Fragen zu Referenz-zu-Video (R2V)

Worin unterscheidet sich Referenz-zu-Video von Bild-zu-Video?

Bild-zu-Video animiert ein Bild als buchstäblich erstes Frame. Referenz-zu-Video nimmt mehrere Bilder, Clips oder Audios als Referenz für Identität, Stil oder Bewegung und komponiert daraus eine neue Szene, die an keines davon gebunden ist.

Wie viele Referenzen kann ich verwenden?

Das hängt vom Modell ab; der Generator zeigt das Limit, während du sie hinzufügst. Sekunden aus Referenzvideos werden bei den meisten Modellen zu einem reduzierten Satz abgerechnet, und die Schätzung aktualisiert sich live vor der Generierung.

Weiter in die Tiefe

Was ist Referenz-zu-Video (R2V)? | Molyin