AI 文生影片

寫下你想看到的畫面,就能拿到一支成片影片——不用素材,不用照片,不用剪輯。Seedance 2.5、Kling 3.0、MiniMax H3、HappyHorse、Wan、LTX、Veo 與 FLUX 3 把一段提示詞變成附原生音訊的電影感短片,最長 30 秒、最高 4K。

  • 生成失敗自動退積分
  • 積分包永不過期
  • 每個模型都明碼標價
  • 一鍵取消訂閱
14
文生影片模型
30 秒
片長最長
4K
最高輸出
6 積分/秒
起價

文生影片樣片與完整提示詞

每條樣片都附有生成它的完整提示詞。點選任一條樣片的 Remix,提示詞與模型設定會載入創作台——改寫成你的畫面描述,即可生成自己的版本。

  • Seedance 2.5
  • Text to video
  • 8s
  • 720P

寫實自然紀錄片風格,電影級真實光影,溫暖的午後,在森林草坡上,一隻圓滾滾的熊貓幼崽從坡上滾下來。 熊貓黑白毛髮蓬鬆真實,體型小而圓胖,動作笨拙可愛。場景為綠色森林斜坡,地面覆蓋青草、苔蘚、三葉草、泥土、小石塊、枯枝和少量小黃花,失焦背景中有高大樹幹與樹林。鏡頭為低機位中遠景,輕微手持感,整體基本固定,始終保持熊貓在畫面中。 0s-3s:一隻熊貓幼崽趴在綠色草坡上,身體圓滾滾,它剛開始順著斜坡慢慢側滾,動作笨拙,草葉被身體輕輕壓彎。微風拂過,陽光從左上方穿過樹林,形成斑駁光影。 3s-8s:熊貓滾到畫面右下方,動作逐漸停止,從側躺變成趴臥。它的圓臉朝向鏡頭,前爪壓在草地上,熊貓趴在前景草叢中,身體調整到舒服的姿勢,頭部小幅抬起又放低,發出輕微的哼聲。 低機位,輕微手持感,輕微跟隨熊貓向右下方移動。景深自然,前景草葉輕微虛化,熊貓主體清晰,背景樹林柔和虛化。自然環境音——風聲,以及熊貓滾動時輕微柔軟的撲通聲。整體溫暖、真實、自然。

  • Wan 3.0
  • Text to video
  • 30s
  • 720P

這是一段30秒電影級高強度單鏡頭(One-Take)視覺奇觀短片,整體風格定位為「西海岸街頭幻想主義」,視覺語言融合了90年代街頭滑板錄影的粗糲感與現代商業大片的精緻質感。畫面整體採用極致的「加州陽光」電影級調色,高飽和度的藍色天空與陽光直射下的棕櫚樹影子形成強烈的對比,空氣中瀰漫著柏油馬路的炙熱感、購物車輪摩擦的金屬聲以及一種無所畏懼的青春叛逆氣息。空間透視隨著主角的極速滑行不斷被拉長,鏡頭透過極低角度的跟隨與極高動態的物理穿梭營造強烈的視覺衝力。 主角是一位穿著撞色條紋衫、帶著黑色棒球帽的潮酷少年,神情從最初的慵懶鬆弛瞬間切換為衝破極限的亢奮;第二個場景的主角則是同一個少年,但他以一種「審視者」的姿態出現在現實維度。 第一個鏡頭 0-6s: 起幅為特寫鏡頭,少年慵懶地躺在一輛紅色鐵質購物車內,背景是加州標誌性的筆直大道與高聳入雲的棕櫚樹。隨著音樂節奏爆發,攝影機執行一個極速的向後拉遠並下沉至地面,以極低角度緊貼車輪。少年開始在陡峭的公路上俯衝,購物車在路面上劇烈顛簸,兩側的汽車急速倒退,鏡頭捕捉到一種近乎瘋狂的加速感。 第二個鏡頭 7-15s: 不切鏡,攝影機像一個滑板手般緊緊貼地跟隨,鏡頭在少年越過一個簡易木質斜坡的瞬間,順勢執行一個優美的拋物線拉昇。購物車騰空而起,攝影機從購物車底部穿過。此時,前方的巨型商業廣告牌迅速佔據整個視野,鏡頭以一種不可思議的「準心式」推進,直指廣告牌中心。 第三個鏡頭 16-24s: 不切鏡,少年連同購物車以一種「破裂次元壁」的方式直接嵌入了巨大的廣告牌中。原本三維的身體在接觸海報的瞬間發生「扁平化」質變,畫面中出現真實的紙張撕裂紋理與彩色故障墨跡。少年保持著滑行的姿態,卻化為了廣告牌上的一幅平面藝術作品。攝影機在此時執行一個180度的水平環繞,並在高空進行一個俯衝降落,重回地面。 第四個鏡頭 25-30s: 不切鏡,鏡頭平滑降落至廣告牌正下方的街道,畫面中出現另一個「真實」的少年。他停下腳步,緩緩壓低帽簷,帶著一絲玩味的微笑抬頭望向廣告牌上那個「被定格」的自己。攝影機順著他的視線執行一個快速的變焦推近,最終定格在廣告牌上「WAN」字樣旁那個被撕裂的洞口。背景音樂融合了高能的嘻哈節奏與底片捲動的物理聲,視覺資訊高度凝練且充滿時尚反叛力。

  • HappyHorse 1.1
  • Text to video
  • 10s
  • 1080P

現代攝影棚裡,一位專業新聞主播端坐於流線型主播台後的中景鏡頭,冷藍色打光,身後螢幕柔和發光。0-5 秒:他直視鏡頭,以清晰而沉穩的聲音說道:"Good evening. Tonight, a breakthrough that could change how millions of us work." 5-10 秒:他微微轉向第二台攝影機:"We'll have the full story, and what it means for you, right after this." 精準對嘴,細微的攝影棚環境底噪,清晰的廣播級畫質,淺景深。

  • MiniMax H3
  • Text to video
  • 15s
  • 2K

生成一段 15 秒、16:9 寬銀幕的輕懸疑犯罪片開場序列。整體風格參考以下概念的視覺語言:復古日式動畫片頭、硬邊剪影、漫畫風拼貼、不對稱分屏、強烈的幾何色塊、英文片頭字幕、少量作裝飾的日文片假名,以及爵士犯罪氛圍。氛圍為六成懸疑、四成爵士:神秘、冷峻、靈動,帶都市犯罪感——既不恐怖也不沉重,更絕不是歡快的爵士 MV。開場的動態效果要像動態圖形拼貼:先出現黑色線框,分屏邊框快速繪出,色塊與畫框逐塊貼入;角色剪影、道具特寫與英文片頭字幕隨鼓點滑入、彈出或經遮罩顯現。避免寫實的敘事動畫——要有片頭序列的精緻感。英文字幕必須清晰可讀,允許動畫效果:細線框先繪出,名字滑入框內,字母逐個出現並由移動色塊揭示,最後短暫停頓。不要新增中文文字,避免亂碼,確保英文人名無拼寫錯誤。序列規則:每條英文字幕與頭銜只出現一次。不要重複相同頭銜,不要重複相同名字,不要給同一個人分配多個職務。轉場必須多樣:黑膠唱片圓形遮罩、車門豎切、角色影子作劃像、紅線切割、大號英文字母遮罩、分屏邊框重組、硬幾何色塊切換,以及逐幀拼貼顯現。所有轉場都與鼓點同步——精準、懸疑、靈動,帶漫畫拼貼氣質。避免柔和疊化與流體轉場。BGM:創作一段原創 BGM。

  • FLUX 3
  • Text to video
  • 15s
  • 720P

黏土定格動畫故事:一個男人總是被闖進畫面的巨大手掌壓扁,壓得他沒法好好過日子

什麼是 AI 文生影片?

AI 文生影片只靠一段文字描述就能生成影片。你打出主體、動作、場景、運鏡和聲音,模型憑這些文字創造出每一幀畫面——多數模型還會同時生成音軌。全程不用拍攝、不用上傳素材、不用剪輯。文生影片詞條介紹這個詞本身,這個頁面則是讓你親手生成一支的地方。

Molyin 把每個主流文生影片模型都整合進同一個創作台,提示詞寫一次,換哪個模型渲染都行。Seedance 2.5 與 Wan 3.0 能把一句話拉成 30 秒的長序列;Kling 3.0 能撐住一個最高 4K 的電影感鏡頭,附對白與對嘴;HappyHorse 擅長對嘴精準的說話人像;MiniMax H3 在 2K 解析度下做風格化運動設計與清晰的螢幕字體;LTX 2.5 能跑最長 20 秒、多角色對話的劇本場景;Veo 3.1 與 FLUX 3 補齊了這份陣容。每一個都在生成畫面的同一次渲染裡生成聲音。

文生影片是AI 影片生成器四種模式之一:圖生影片、參考生影片與影片編輯共用同一個提示詞輸入框和積分餘額,想從一張特定圖片開始時切換模式就好,不用換工具。每支影片按秒計費,生成失敗自動退還積分,價目頁上的每個付費方案都包含商業使用權。

寫哪種提示詞,配哪個模型

Molyin 上每一個文生影片模型,單靠文字各自最擅長什麼。先依你要寫的鏡頭類型來挑,再看片長與解析度。

模型最擅長片長輸出
Seedance 2.5單條提示詞就能拍出照片級真實運動與多鏡頭敘事,最長 30 秒序列4–30 秒480P/720P/1080P,附音訊
Seedance 2.0(Standard/Fast/Mini)同一套提示詞公式分三檔——Standard 衝到 4K,Fast 與 Mini 用解析度換速度4–15 秒Standard 最高 4K,Fast 與 Mini 為 480P/720P,附音訊
Kling 3.0長鏡頭電影感對白與對嘴,畫面文字在運動中依然清晰3–15 秒720P/1080P/4K,原生音訊與對嘴
MiniMax H3風格化運動設計、片頭字幕與清晰排版,原創配樂一次到位4–15 秒768P/2K,恆附音訊
HappyHorse 1.1說話人像對白,對嘴精準;九種長寬比含 4:5、5:4 與 9:213–15 秒720P/1080P,恆附音訊
Wan 3.0依時間戳腳本導演的 30 秒一鏡到底,音訊可選2–30 秒480P/720P/1080P,音訊可選
Wan 2.7穩定可靠的日常短片,每次渲染都附聲音2–15 秒720P/1080P,恆附音訊
LTX 2.5(Fast/Pro)附運鏡、音效設計和多個說話角色的劇本場景,最長 20 秒;Fast 衝到 4K6–20 秒(Pro:6–10 秒)Fast 最高 4K,Pro 為 720P/1080P,附音訊
Veo 3.1(Standard/Fast)16:9 或 9:16 下打磨精緻的 8 秒電影感短片8 秒720P/1080P/4K,恆附音訊
FLUX 3極短提示詞也能出豐富成片——獨白、紀錄片式段落、定格黏土動畫,原生音訊5–20 秒720P/1080P,附音訊

片長與輸出依文生影片列出。同樣這些模型在創作台的其他模式下也接受圖片或參考圖輸入。

如何用一段文字生成影片

從一個想法到成片 MP4 只要三步——大多數影片幾分鐘內完成渲染。

寫提示詞

描述一個鏡頭:主體是什麼、在做什麼、在哪裡、一個運鏡,以及聲音或台詞。具體的名詞加一個動作要點,永遠比堆形容詞管用。想要一個驗證過的起點,就從上方樣片裡挑一條提示詞。

選模型與參數

依鏡頭類型挑模型——長鏡頭、對白、風格化字體,還是照片級自然風光——再設定片長、長寬比與解析度。積分預估會在送出前即時更新。

生成並下載

模型會在幾分鐘內渲染出每一幀畫面和音軌。先預覽結果,下載無浮水印的 MP4,或微調提示詞用 Remix 再試一版。

文生影片 vs. 圖生影片

同樣的模型,不同的起點:一個只靠文字,另一個從你手邊已有的圖片開始。

文生影片圖生影片
起點一段文字描述——不需要圖片、素材或任何檔案一張照片、渲染圖或畫作,會成為第一幀
你能控制什麼一切都靠文字——主體、場景、風格、動作、聲音精確的第一幀;提示詞負責指揮動作與聲音
一致性每次生成都會重新詮釋這段描述——適合發想,不適合反覆出同一個鏡頭主體、取景與色調從第一幀起就鎖定在你的圖片上
最適合還不存在的概念與場景、風格化世界、對白與旁白商品照、人像、品牌素材、分鏡關鍵幀

很多創作者會把兩者結合:先用文生影片起草場景,生成一張滿意的定格畫面,再用圖生影片讓它動起來。

文生影片積分,按秒計費

每個模型都依你選的解析度、以秒計費,生成失敗會自動退還積分。

AI 影片模型按解析度分級的積分費率——每秒積分與整支影片範例
模型解析度積分/秒5 秒影片5 秒影片 + 3 秒參考
480p25125 積分170 積分
720p56280 積分381 積分
1080p139695 積分946 積分
480p1155 積分75 積分
720p28140 積分191 積分
1080p65325 積分442 積分
4k135675 積分918 積分
480p945 積分62 積分
720p20100 積分136 積分
480p630 積分41 積分
720p1260 積分82 積分
768p1890 積分144 積分
2k29145 積分232 積分
720p1890 積分僅參考圖片
1080p24120 積分僅參考圖片
Wan 2.7
720p1890 積分144 積分
1080p30150 積分240 積分
480p1050 積分80 積分
720p1890 積分144 積分
1080p36180 積分288 積分
720p22110 積分僅參考圖片
1080p29145 積分僅參考圖片
4k71355 積分僅參考圖片
720p20100 積分
1080p29145 積分
1440p43215 積分
4k67335 積分
720p27135 積分
1080p38190 積分
Veo 3.1
720p41205 積分
1080p42210 積分
4k60300 積分
Veo 3.1 Fast
720p1050 積分僅參考圖片
1080p1155 積分僅參考圖片
4k30150 積分僅參考圖片
720p38190 積分僅參考圖片
1080p65325 積分僅參考圖片
  • 上傳的參考影片以 60% 費率計費——生成 5 秒、帶上 10 秒參考影片時,計 11 秒而非 15 秒。
  • 例外:MiniMax H3 / Wan 2.7 / Wan 3.0 的參考影片秒數以全額每秒費率計費。
  • MiniMax H3:前 5 張參考圖片免費,之後每多一張加收 9 積分。

訂閱方案與一次性積分包的完整對比見定價頁

到積分價目頁查看每個模型的價格

AI 文生影片常見問題

關於在 Molyin 用文字生成影片的一切。

今天就開始用 Molyin 創作

免費註冊,幾分鐘內把你的第一個想法變成電影感影片。