La vidéo vers vidéo (Video-to-Video, ou V2V) est une technique d’IA générative qui prend une vidéo existante en entrée et en produit une nouvelle — restylée, retouchée ou prolongée — guidée par un prompt. Au lieu de couper et d’empiler des calques sur une timeline, le modèle re-rend chaque image : les modifications tiennent à travers le mouvement, les déplacements de caméra et les changements de lumière.
Comment ça fonctionne
Le modèle utilise votre clip source comme squelette structurel du processus de diffusion : il préserve le mouvement, la composition et le rythme de l’original pendant que le prompt lui dit quoi changer. Comme le clip entier est régénéré dans un seul contexte temporel plutôt que rapiécé image par image, le résultat reste stable — pas de scintillement, pas de retouche qui dérive.
Ce qu’elle réussit le mieux
- Transfert de style — transformez un plan réel en animation aquarelle, en anime ou en étalonnage cinéma en une seule passe.
- Remplacement d’objets et de tenues — changez un vêtement, remplacez un produit ou un élément du décor pendant que tout le reste reste en place.
- Prolongation de clips — continuez une vidéo au-delà de sa dernière image en gardant sujets et mouvement cohérents.
- Recyclage de rushes — donnez un nouveau look à des images anciennes ou brutes sans retournage.
Ce que contient un bon prompt de retouche
Décrivez le changement, pas toute la scène. Précisez ce qui doit rester (le sujet, le mouvement de caméra, le rythme) et ce qui doit changer (le style, une tenue, le fond). Des images de référence aident à verrouiller le rendu exact que vous visez.