Video-zu-Video (V2V) ist eine generative KI-Technik, die ein vorhandenes Video als Eingabe nimmt und daraus ein neues erzeugt — umgestylt, bearbeitet oder verlängert — gesteuert durch einen Text-Prompt. Statt auf einer Timeline zu schneiden und zu überlagern, rendert das Modell jedes Frame neu, sodass die Bearbeitung auch bei Bewegung, Kamerafahrten und Lichtwechseln stabil bleibt.
So funktioniert es
Das Modell nutzt deinen Ausgangsclip als strukturelles Rückgrat des Diffusionsprozesses: Bewegung, Komposition und Timing des Originals bleiben erhalten, während der Prompt vorgibt, was sich ändern soll. Weil der gesamte Clip in einem gemeinsamen zeitlichen Kontext neu generiert wird — statt Frame für Frame geflickt —, bleibt das Ergebnis konsistent: kein Flackern, keine driftenden Bearbeitungen.
Was es am besten kann
- Stilübertragung — verwandle Realaufnahmen in einem Durchgang in Aquarell-Animation, Anime oder ein filmisches Color-Grading.
- Objekt- und Outfit-Austausch — tausche Kleidung, ersetze ein Produkt oder ändere ein Hintergrundelement, während alles andere unverändert bleibt.
- Clips verlängern — führe ein Video über sein letztes Frame hinaus fort, mit kohärenten Subjekten und Bewegungen.
- Material aufwerten — gib altem oder rohem Material einen neuen Look, ganz ohne Nachdreh.
Was ein guter Bearbeitungs-Prompt enthält
Beschreibe die Änderung, nicht die ganze Szene. Benenne, was bleiben muss (das Subjekt, die Kamerafahrt, das Tempo) und was sich ändern soll (der Stil, ein Outfit, der Hintergrund). Referenzbilder helfen, den gewünschten Look exakt festzulegen.