Image vers vidéo (Image-to-Video)

L’image vers vidéo (I2V) anime une image fixe en clip vidéo en l’utilisant comme première image. Découvrez comment il fonctionne et quand l’utiliser.

Ouvrir le générateur complet

Voyez-le à l’œuvre

Un prompt réel et le résultat qu’il a produit sur Molyin. Cliquez sur Remix pour partir de là.

  • Kling 3.0
  • Image to video
  • 15s
  • 1080P

S’ouvrant sur un plan moyen-long en ultra grand-angle en travelling latéral, le stabilisateur au ras du sol, avec une tonalité cinématique romantique fortement contrastée de nuit bleue froide et de ciel étoilé blanc argenté, dégageant un fort réalisme poétique et un tempérament épique classique. La protagoniste est une jeune femme en longue robe vert sombre, courant de toutes ses forces sur la pelouse du jardin éclairée par le clair de lune ; sa jupe ondule au vent en courbes dynamiques déferlantes, elle serre une petite fleur blanche dans sa main droite et relève l’ourlet de sa robe de la main gauche, respirant vite mais le regard ferme. À la 4e seconde, la caméra accélère avec elle, et plusieurs hommes et femmes en robes de bal d’une autre époque font irruption dans le cadre l’un après l’autre depuis les côtés gauche et droit de l’arrière-plan, courant à ses côtés — certains tentent de s’approcher, d’autres se retournent pour crier, mais aucun ne la touche vraiment, suggérant une poursuite et une fuite. À la 8e seconde, la caméra zoome progressivement vers un plan moyen, effectue un panoramique de suivi vers l’avant devant la protagoniste et se lève légèrement ; elle jette un bref regard derrière elle vers un jeune personnage masculin, leurs regards se croisent une fraction de seconde, les émotions explosent en pleine course, et la femme et l’homme se donnent la main pour courir ensemble. À la 12e seconde, la musique et le mouvement atteignent un climax ; la caméra avance près de son profil et de ses cheveux au vent, elle lâche la fleur blanche et la lance en l’air, la fleur retombant au ralenti tandis que la foule derrière la dépasse. Dans les 3 dernières secondes, la caméra continue d’avancer, la femme et l’homme traversent la foule et foncent vers le ciel étoilé au bout du jardin, leurs silhouettes prenant peu à peu le centre du cadre. L’atmosphère générale est flamboyante, romantique et déterminée, une bouffée narrative sur le destin, le choix et la liberté.

L’image vers vidéo (Image-to-Video, ou I2V) est une technique d’IA générative qui donne vie à une image fixe. Vous fournissez une image — photo produit, portrait, illustration — et le modèle génère une vidéo qui démarre exactement sur cette image et la met en mouvement, guidé par un prompt facultatif.

Comment ça fonctionne

En image vers vidéo, votre image sert de première image — un ancrage visuel que le modèle doit respecter. À partir de là, un modèle de diffusion vidéo prédit comment la scène doit évoluer : les cheveux bougent dans le vent, la vapeur monte de la tasse, la caméra avance lentement. Le prompt n’a plus besoin de décrire à quoi ressemblent les choses (l’image le dit déjà) ; il décrit ce qui se passe ensuite.

Pourquoi partir d’une image ?

Comparé au texte vers vidéo, partir d’une image vous donne quelque chose de précieux : le contrôle exact du rendu. La composition, les couleurs, le visage, l’étiquette du produit — tout est verrouillé dès la première image. L’I2V devient le mode de référence quand :

  • Vous avez des assets de marque — animez une photo produit sans que le modèle réinvente votre packaging.
  • Le sujet doit être exact — une vraie personne, un vrai lieu, une œuvre ou une illustration existante.
  • Vous voulez de la prévisibilité — la première image est fixe, les itérations ne font varier que le mouvement.

Conseils de prompt

Puisque l’image gère le « quoi », consacrez le prompt au « comment » : décrivez le mouvement (subtil, spectaculaire, en boucle), la caméra (fixe, lent travelling avant, orbite) et l’atmosphère à faire naître. Ici, des prompts courts et centrés sur le mouvement battent généralement les longues descriptions de scène. Plus de techniques dans notre guide d’écriture de prompts.

Questions sur Image vers vidéo (Image-to-Video)

Quelle image téléverser pour l’image vers vidéo ?

Utilisez la copie la plus nette que vous avez, au format de la vidéo souhaitée. La plupart des modèles conservent la première image exactement telle qu’elle a été téléversée : ce qui est flou ou recadré le reste sur chaque image.

Puis-je contrôler ce qui se passe après la première image ?

Oui. Le prompt décrit le mouvement, le déplacement de caméra et le son ; certains modèles acceptent aussi une dernière image ou une piste vocale directrice. Ne décrivez pas le sujet — l’image le dit déjà — et consacrez vos mots au mouvement.

Aller plus loin

Image vers vidéo (Image-to-Video) | Molyin