圖生影片(Image-to-Video)

July 11, 2026
圖生影片(I2V)是一種讓靜態圖片動起來的 AI 技術:以你的圖片作為首幀生成影片。了解它的原理和適用場景。
AI Video

**圖生影片(Image-to-Video,簡稱 I2V)**是一種讓靜態圖片「活過來」的生成式 AI 技術。你提供一張圖——產品圖、人像、插畫——模型以這張圖為起點生成影片,讓畫面動起來,並可用文字提示詞引導運動方向。

工作原理

在圖生影片中,你的圖片會被用作首幀——一個模型必須遵守的視覺錨點。從首幀出發,影片擴散模型預測場景應如何演化:髮絲隨風飄動、咖啡杯升起熱氣、鏡頭緩緩推近。此時提示詞不再需要描述畫面長什麼樣(圖片已經說明了),而是描述接下來發生什麼

為什麼從圖片出發?

文生影片相比,從圖片出發給了你一樣寶貴的東西:對畫面的精確控制。構圖、色彩、臉孔、產品標籤——從第一幀起全部鎖定。以下場景中 I2V 是首選:

  • 手裡有品牌素材 —— 讓產品圖動起來,而不用擔心模型「重新發明」你的包裝。
  • 主體必須精確 —— 真實的人、真實的地點、既有的藝術作品或插畫。
  • 追求可預測性 —— 首幀固定,每次疊代只改變運動方式。

提示詞技巧

圖片已經解決了「是什麼」,提示詞就該專注「怎麼動」:描述運動(細微、劇烈、循環)、鏡頭(固定、緩推、環繞)、以及你希望發展出的氛圍。在圖生影片裡,簡短聚焦運動的提示詞通常勝過冗長的場景描述。更多技巧見提示詞寫作指南

在 Molyin 上使用圖生影片

Molyin 的 Seedance 2.0 生成器支援圖生影片:5 秒或 10 秒時長、最高 1080p 解析度、六種長寬比、可選音訊與 seed 控制——上傳圖片、描述運動、開始生成。

相關詞條

現在就用 AI 影片生成器試試看。

圖生影片(Image-to-Video) | Molyin