文生圖(Text-to-Image)

文生圖(T2I)是一種把文字提示詞直接生成完整圖片的 AI 技術。了解它的原理、擅長的場景,以及如何寫出有效的提示詞。

打開完整生成器

看它怎麼運作

一條真實提示詞和它在 Molyin 上生成的結果。點 Remix 從這裡起步。

Nano Banana 2 official sample — glossy magazine cover with bold Nano Banana serif title and a model playfully holding the number 2, crisp photoreal typography
  • Nano Banana 2
  • Text to image
  • 3:2
  • 2K

一張光面雜誌封面的照片,極簡的藍色封面上印著加大加粗的 Nano Banana 字樣。文字用襯線字型,撐滿整個畫面。沒有其他文字。文字前方是一位人物肖像,穿著簡潔俐落的極簡連身裙。她俏皮地舉著數字 2,這是整個畫面的焦點。 在角落放上期號與 "Feb 2026" 日期,再配一個條碼。雜誌擺在貨架上,背景是一面橙色抹灰牆,場景是一家設計師選品店。

**文生圖(Text-to-Image,簡稱 T2I)**是一種生成式 AI 技術:你用文字描述一幅畫面,模型把它「畫」出來——構圖、光影、風格、細節,全部從你的文字生成。你負責描述,模型負責作畫。

工作原理

主流的文生圖模型底層是擴散模型(Diffusion Model),在海量「圖片+文字描述」配對資料上訓練而成。生成時,模型從純雜訊出發,在提示詞的引導下逐步「去噪」成一張完整圖片。新一代模型在擴散核心之上加入了語言模型前端,能把提示詞當作指令而非關鍵字堆來理解——空間關係(「杯子在書上面」)、物體數量、甚至圖片內的文字,準確率都大幅提升。

擅長的場景

當你只有文字、需要一張圖時,文生圖最能發揮價值:

  • 概念圖與情緒板 —— 在確定方向之前,快速探索風格、配色與構圖。
  • 行銷視覺 —— 頭圖、封面、橫幅、社群配圖,任意比例,不需要攝影棚。
  • 批量插畫 —— 鎖定風格描述、只換主體,就能產出風格統一的系列插畫。

好的提示詞包含什麼

強大的 T2I 提示詞讀起來像美術指導的需求單。覆蓋四個要素:主體(畫面裡有什麼)、構圖(取景、視角、焦點)、風格(媒介、參考畫風、渲染方式)、光線與氛圍(黃昏逆光、霓虹夜色、柔和棚拍光)。具體永遠勝過籠統:「亞麻桌布上的陶瓷茶壺,俯拍,柔和窗光,極簡產品攝影」遠好於「一個好看的茶壺」。

關於文生圖(Text-to-Image)的常見問題

可以免費生成圖片嗎?

可以。註冊贈送的積分夠在最實惠的模型上先出幾張圖,單價最低 3 積分/張,生成前會顯示價格。

支援哪些解析度和比例?

最高 4K,視模型而定;比例從超寬到直式都有,部分模型支援透明背景輸出。生成器只顯示所選模型真正支援的選項。

再往下走

什麼是文生圖(Text-to-Image)? | Molyin