**圖生影片(Image-to-Video,簡稱 I2V)**是一種讓靜態圖片「活過來」的生成式 AI 技術。你提供一張圖——產品圖、人像、插畫——模型以這張圖為起點生成影片,讓畫面動起來,並可用文字提示詞引導運動方向。
工作原理
在圖生影片中,你的圖片會被用作首幀——一個模型必須遵守的視覺錨點。從首幀出發,影片擴散模型預測場景應如何演化:髮絲隨風飄動、咖啡杯升起熱氣、鏡頭緩緩推近。此時提示詞不再需要描述畫面長什麼樣(圖片已經說明了),而是描述接下來發生什麼。
為什麼從圖片出發?
與文生影片相比,從圖片出發給了你一樣寶貴的東西:對畫面的精確控制。構圖、色彩、臉孔、產品標籤——從第一幀起全部鎖定。以下場景中 I2V 是首選:
- 手裡有品牌素材 —— 讓產品圖動起來,而不用擔心模型「重新發明」你的包裝。
- 主體必須精確 —— 真實的人、真實的地點、既有的藝術作品或插畫。
- 追求可預測性 —— 首幀固定,每次疊代只改變運動方式。
提示詞技巧
圖片已經解決了「是什麼」,提示詞就該專注「怎麼動」:描述運動(細微、劇烈、循環)、鏡頭(固定、緩推、環繞)、以及你希望發展出的氛圍。在圖生影片裡,簡短聚焦運動的提示詞通常勝過冗長的場景描述。更多技巧見提示詞寫作指南。