參考生影片(Reference-to-Video)

參考生影片(R2V)透過參考圖約束 AI 影片生成,讓角色、產品或風格在影片中保持一致。了解它與圖生影片的區別。

打開完整生成器

看它怎麼運作

一條真實提示詞和它在 Molyin 上生成的結果。點 Remix 從這裡起步。

  • Seedance 2.5
  • Reference to video
  • 30s
  • 720P

一段高級、極具電影感的 30 秒 3D 動態圖形序列,採用精緻的蒸氣龐克與復古微縮景觀風格,搭配連續流暢的環繞與穿梭運鏡。[0-10 秒]:古董黃銅鐘面微距特寫,奇蹟般地層層展開為相互嚙合的旋轉齒輪環與體積霧。鏡頭向下穿透齒輪,一架機械撲翼機(Ornithopter)正從由做舊古籍堆疊而成的微縮峽谷中盤旋升空。[10-20 秒]:鏡頭跟隨撲翼機的軌跡向前滑行,無縫穿透入一個高速旋轉的華麗黃銅幻影箱(Zoetrope),內部投射出奔騰機械駿馬的動態光影。光影躍出箱體,場景瞬間化為一輛黃銅質感懸浮纜車,正沿著微光銅軌穿梭於機械齒輪森林,沐浴著電影級的黃金時刻光線。[20-30 秒]:鏡頭優雅地向下平移,纜車下方出現一艘精美的發條木製機械帆船,在深藍色玻璃材質的起伏海浪中破浪前行。海浪盡頭無縫演變為一輪發光巨月,一群舉著搖曳提燈的探險者剪影,正沿著星空下的水晶礦脈山脊艱難跋涉。鏡頭平滑螺旋拉遠,穿過空靈雲朵,回到滴答作響的宏偉黃銅鐘面。最後一秒出現 logo,參考@圖片1。技術規格:超寫實機械紋理,豐富黃銅與金色調,電影級淺景深。平滑連貫的無縫穿梭運鏡,極強的史詩感與奇幻冒險氛圍。

參考生影片(Reference-to-Video,簡稱 R2V)是一種用一張或多張參考圖引導影片生成的 AI 技術——參考圖不是字面意義上的首幀,而是身分錨點。模型學習你的參考圖(角色的臉、產品的設計、一種畫風),然後在全新的場景中生成保持該身分一致的影片。

參考圖 vs 首幀

這是它與圖生影片的核心區別:

  • 圖生影片把你的圖片當作開場幀,影片從那裡精確開始。
  • 參考生影片把你的圖片當作「事物長什麼樣」的定義。模型可以把這個角色或產品放進提示詞描述的全新場景、角度和動作中。

一句話:I2V 是讓一張圖「續寫」,R2V 是給一個角色「選角」。

為什麼重要

一致性是 AI 影片最難的問題。僅憑文字生成兩次「穿黃色雨衣的紅髮女孩」,你會得到兩個不同的女孩。參考生影片正是為此而生:

  • 角色一致性 —— 讓同一個主角貫穿多個鏡頭、場景乃至影集。
  • 產品保真 —— 用新角度、新環境展示你真實的產品。
  • 風格延續 —— 讓一種插畫風格或品牌視覺貫穿整個系列。

提示詞技巧

給模型乾淨、光線良好、主體清晰的參考圖,然後讓提示詞來「導演」:新場景、新動作、新鏡頭。提示詞說清要變的——參考圖已經說清了要保留的。更多技巧見提示詞寫作指南。

關於參考生影片(Reference-to-Video)的常見問題

參考生影片和圖生影片有什麼區別?

圖生影片把一張圖當作第一幀原樣動起來;參考生影片接收多張圖、多段影片或音訊,作為身份、風格或動作的參考,生成一個不被任何一張鎖死的新場景。

最多能放幾個參考?

取決於模型,加入時生成器會顯示上限。多數模型對參考影片的秒數按折扣計費,預估價在生成前即時更新。

再往下走

什麼是參考生影片(Reference-to-Video)? | Molyin