テキスト画像生成AI

見たい絵を言葉で書けば、そのまま画像になります。Nano Banana 2、GPT Image 2、Seedream 5.0、Grok Imagine 2.0、FLUX.2 が一文を雑誌の表紙、商品写真、ポスター、絵画に変換——読める文字組み、正確なアスペクト比、そのまま公開できるファイルで。

  • 生成失敗時はクレジット自動返還
  • クレジットパックは無期限
  • 全モデルの料金を公開
  • ワンクリックでいつでも解約
10
対応モデル数
4K
最大出力解像度
3 クレジット/枚
最低クレジット
10
登録時の無料クレジット

一文の入力から、一枚の画像へ

実際のテキストから画像の出力と、それを生んだ厳密なプロンプトを並べています——くっきりしたセリフ体タイポグラフィの雑誌表紙、文字が刻まれた4Kの米粒、一行から組み立てたネオンラウンジ、書のある水墨画の滝、そしてスタジオ商品写真。どれもRemixすれば同じ設定から始められます。

Text to image example — glossy magazine cover with a bold serif title and a model playfully holding the number 2, photoreal typography generated from a single prompt
  • Nano Banana 2
  • Text to image
  • 3:2
  • 2K

光沢のある雑誌の表紙の写真。ミニマルなブルーの表紙には、大きく太い Nano Banana の文字。文字はセリフ体で、画面いっぱいに広がっている。他の文字は入れない。文字の手前には、洗練されたミニマルなドレスをまとった人物のポートレート。彼女は遊び心たっぷりに数字の 2 を抱えていて、それが画面の焦点になっている。 隅には号数と "Feb 2026" の日付、そしてバーコードを入れること。雑誌はデザイナーズショップの中、オレンジの漆喰壁を背にした棚に置かれている。

Text to image example — 4K mound of rice with lettering etched onto a single hidden grain, precise instruction following from text alone
  • GPT Image 2
  • Text to image
  • 16:9
  • 4K

何千粒もの米が積み上がった山を引きの画角で。そのうちの一粒に "GPT Image 2" と刻まれている。文字はその一粒にちょうど収まる大きさ。この米粒は他の粒とまったく同じサイズで、大きくも小さくもなく、米の山によく馴染んでいて一目では見つけられない。

Text to image example — surreal neon-lit lounge with a title spelled in 3D building blocks and a giant blue cat, cinematic 16:9 render
  • Seedream 5.0 Pro
  • Text to image
  • 16:9
  • 2K

Seedream 5.0 Pro の遊び心あるプロダクトショーケースのように仕立てた、ネオンの灯るシュールな室内。広角のシネマティックな画角で捉えた居心地のよいモダンなラウンジ——深いブルーの壁、床と家具に沿って光る LED ストリップ、左手の丈の高いシアーカーテンから差し込む柔らかな日差し、右手にはパープルのネオンフレームがついた大きな壁掛けミラー。奥の壁一面を巨大な青いふさふさの猫の顔が占め、ウインクしながら、室内の色を映して浮かぶ透明なシャボン玉を見つめている。中央には積み上げたおもちゃのようなブロックが小さな台をつくり、カラフルな 3D 文字で「Seedream 5.0 Pro」と綴られている。手前は幾何学模様のラグの上に、丸みのある光沢ブルーのコーヒーテーブル。緑のアームチェアに草色のブランケットを掛け、床には暖かなベージュのウールボール、抽象的なフォームブロックを散らし、奥の壁には「Interactive Editing」と光るネオンサインを配置すること。ディテールの緻密なリアル 3D レンダー、風変わりなプロダクトデモの空気感、青と紫の豊かな照明、柔らかな反射、遊び心のあるシュールな構図、シネマティックなワイドショット。

Text to image example — Chinese ink wash waterfall with vertical calligraphy and red seal stamps, a traditional art style described in words
  • Grok Imagine 2.0
  • Text to image
  • 16:9
  • high

伝統的な中国水墨画:流れるような衣をまとった文人が杖を持ち、霧の中を幾重にも落ちる巨大な滝を眺めている。右には蒼劲な松の木、葉は青緑と朱で彩られる。左には縦書きの書「君不见黄河之水天上来,奔流到海不复回」と、その下に小さな赤い印章が 2 つ。和紙の質感、繊細な筆致、霞がかった雰囲気。

Text to image example — studio-lit product photograph of a matte black ceramic coffee mug with rising steam on polished concrete
  • Nano Banana 2
  • Text to image
  • 1:1
  • 1K

磨かれたコンクリートの面に置かれた、マットブラックのミニマルなセラミック製コーヒーマグの、スタジオ照明による高解像度の商品写真。照明は 3 灯のソフトボックスで、柔らかく拡散したハイライトを作り、硬い影を消す設定。カメラアングルはやや高めの 45 度で、クリーンなラインを見せる。ウルトラリアリスティックに、コーヒーから立ちのぼる湯気にシャープにフォーカス。正方形の画像。

テキスト画像生成AIとは?

テキスト画像生成AIは、書かれた説明文から画像を生成します。被写体、スタイル、構図、光をテキストで書けば、モデルはそれに合う新しい画像をゼロから描き出します——元になる写真もストック素材も、絵を描くスキルも要りません。用語そのものの解説はテキスト画像生成の用語解説にまとめています。このページは、実際に画像をつくる場所です。

Molyin は主要なテキスト画像生成モデルをすべて一つのスタジオで動かします。Nano Banana 2 は超ワイド比率で最大4K、文字組みと商品写真が得意。GPT Image 2 は精密な指示に従い、読みやすいエディトリアルテキストでページを埋めます。Seedream 5.0 は映画的なシーンと情報密度の高いレイアウトを処理。Grok Imagine 2.0 は一律料金でインフォグラフィック、ポスター、絵画調のスタイルを生成。FLUX.2 ファミリーは印刷用にカスタムのピクセルサイズを指定できます。モデルピッカーで切り替えれば、同じプロンプトが別のエンジンで動きます。

テキストから画像はAI 画像ジェネレーターの2つのモードの一つ——画像から画像は同じプロンプト欄とクレジット残高を共有するので、完成した画像をそのまま次の参照素材として戻せます。課金は1枚ごと、失敗した生成は自動返還、料金ページのすべての有料プランに商用利用権とウォーターマークなしダウンロードが含まれます。静止画では足りないときは画像から動画ジェネレーターがそれを動かします。

どの画像にどのモデルを

Molyin の全テキスト画像生成モデルを、得意なこと、出力解像度、画像から画像に切り替えたときの参照画像の上限とともに並べています。

モデル得意なこと解像度画像から画像
Nano Banana 2(Lite / Standard)文字組み、商品写真、最大8:1の超ワイド比率1K / 2K / 4K(Lite:1K)参照画像 最大14枚(Lite:10枚)
Nano Banana ProNano Bananaファミリー中、最も精細な描写1K / 2K / 4K参照画像 最大8枚
GPT Image 2精密な指示追従、密度の高い読める文字、1回で最大10枚1K / 2K / 4K、または最大3840×2160の正確なピクセルサイズ参照画像 最大16枚
Seedream 5.0(Pro / Lite)映画的なシーン、インターフェース、情報密度の高いレイアウトPro:1K / 2K;Lite:2K / 3K / 4K参照画像 最大10枚
Grok Imagine 2.0インフォグラフィック、ポスター、アート調スタイルを一律料金でネイティブ出力、5種のアスペクト比参照画像 最大5枚
FLUX.2(Dev / Pro / Max)印刷向けカスタム縦横サイズ、フォトリアルな精細さPro・Max:0.5K〜4Kティア;Dev:ネイティブサイズ参照画像 最大8枚(Dev:5枚)

ここに並ぶモデルはすべて画像から画像モードでも動きます——テキストから画像を生成し、それを参照として戻して仕上げましょう。

テキストから画像を生成する方法

一文からダウンロードできるファイルまで、3ステップ——ほとんどの画像は1分足らずで仕上がります。

画像を説明する

被写体を先に書き、次に舞台、スタイル、光、構図を続けます。画像内に入れたい文字は引用符で囲んでください。キーワードの列挙より、1つの明確な段落の方がうまくいきます。

モデルとフォーマットを選ぶ

用途に合うモデルを選び、次にアスペクト比と解像度を選びます。送信前にクレジットの見積もりが更新されるので、実行前に料金が分かります。

生成してダウンロード

画像は1分以内にライブラリに届きます。フル解像度のファイルをダウンロードするか、プロンプトを少し変えてRemixで別テイクを試すか、画像から画像に切り替えて仕上げましょう。

テキストから画像 vs. 画像から画像

同じモデル、出発点が違うだけ——一方は言葉だけから、もう一方は手元にある画像から始まります。

テキストから画像画像から画像
出発点書かれた説明文だけ1枚以上の参照画像とプロンプト
コントロールできるもの被写体・スタイル・構図・文字まで、すべて言葉で残す部分と変える部分——参照画像が被写体・レイアウト・配色を決める
一貫性生成ごとに説明文を再解釈被写体・商品・キャラクターは参照から引き継がれる
向いている用途新しいコンセプト、ポスター、イラスト、何であれ最初のドラフト既存カットのバリエーション、リスタイル、商品の差し替え、キャラクターシリーズ

多くのワークフローは両方をつなげます——まずテキストから画像で最初の1枚を作り、画像から画像で仕上げるまで調整する、という流れです。

テキストから画像のクレジット、1枚ごと

どのモデルも、選んだ解像度・品質ティアに応じて1枚ごとに課金され、失敗した生成は自動返還されます。

出力解像度による課金

出力解像度による課金
モデル解像度クレジット/枚
GPT Image 2 (Easy)1K8
2K13
4K21
Nano Banana 2 Lite1K5
Nano Banana 21K11
2K16
4K24
Nano Banana Pro1K24
2K24
4K32
Seedream 5.0 Lite2K8
3K8
4K8
Seedream 5.0 Pro1K10
2K18

GPT Image 2 (Advanced)——品質と出力サイズによる課金

GPT Image 2 (Advanced)——品質と出力サイズによる課金
品質≤ 1024×1024≤ 2048×1024≤ 2048×2048> 2048×2048
3334
11111111
30303030

auto 品質ティアは high と同じ料率で課金されます。

FLUX.2——出力サイズによる課金

FLUX.2——出力サイズによる課金
モデル出力サイズクレジット/枚参照画像
FLUX.2 Dev≤ 1MP3+3 クレジット/MP
≤ 1.5MP4
≤ 2.1MP6
FLUX.2 Pro≤ 0.5MP5+4 クレジット/MP
≤ 1MP7
≤ 2MP10
≤ 3MP14
≤ 4MP17
≤ 4.2MP18
FLUX.2 Max≤ 0.5MP13+7 クレジット/MP
≤ 1MP16
≤ 2MP23
≤ 3MP29
≤ 4MP36
≤ 4.2MP37

FLUX.2 の参照画像は実際の総ピクセル面積で課金されます——参照画像列は入力 1MP あたりの追加クレジットです。

1 枚あたり定額料金

1 枚あたり定額料金
モデルクレジット/枚参照画像
Grok Imagine 2.06+2 クレジット/枚

定額モデルはどの出力でも同じ料金です。画像から画像モードでは、参照画像 1 枚ごとに上表の追加料金がかかります。

サブスクリプションプランと買い切りクレジットパックの比較は料金ページをご覧ください。

全モデルの料金をクレジットページで見る

テキスト画像生成AI FAQ

Molyin でテキストから画像を生成することについて、知っておきたいすべて。

今すぐ Molyin で創作を始めよう

無料登録して、最初のアイデアを数分でシネマティックな動画に。