FLUX 3

FLUX 3——動画・画像・音声をひとつでこなすマルチモーダルモデル

Black Forest Labs のワールドモデルは、映像と音をワンパスで同時に生成します。下にプロンプトを書けば、FLUX 3 がセリフと効果音を織り込んだ 5〜20 秒の映像を返します。

  • 生成失敗時はクレジット自動返還
  • クレジットパックは無期限
  • 全モデルの料金を公開
  • ワンクリックでいつでも解約
5〜20 秒
クリップの長さ
720P / 1080P
解像度
ネイティブ、オン/オフ可
音声
3〜10 枚
ストーリーボードキーフレーム

実際のプロンプト、実際の FLUX 3 映像

以下のクリップはすべて、表示されているプロンプトそのままで FLUX 3 が生成したものです——公式サンプルとコミュニティ作品、音まで含めて。Remix を押せば、そのプロンプトが上のジェネレーターに読み込まれ、あなたの作品の出発点になります。

  • FLUX 3
  • Text to video
  • 10s
  • 1080P

雨の降る東京の夜、居心地のよいラーメン店:スープから湯気が立ちのぼり、窓の外の水たまりにネオンが反射し、店主が落ち着いた手つきで調理している。カメラはカウンターに沿ってゆっくり流れる。雨音と、静かな厨房の物音。

  • FLUX 3
  • Text to video
  • 20s
  • 720P

AIについて愚痴をまくし立てる

  • FLUX 3
  • Text to video
  • 20s
  • 720P

ピラミッドはどうやって作られた?それを映像で可視化して。

  • FLUX 3
  • Text to video
  • 15s
  • 720P

クレイアニメの物語:画面に入ってくる巨大な手に男が何度も押しつぶされ、まともに生活できない

  • FLUX 3
  • Text to video
  • 20s
  • 720P

アステカ人の日常生活

写真 1 枚から、花火のフィナーレへ

FLUX 3 の画像→動画モードは、1 枚の静止画を動きのある映像に変えます。公式サンプルの全工程がこちら:花火の写真 1 枚と 1 行のプロンプトが、10 秒の 1080P フィナーレになりました——観衆のざわめきと爆発音は、映像と同時にネイティブ生成されています。

開始フレーム——花火の写真
開始フレーム——花火の写真

プロンプト

7月4日(アメリカ独立記念日)の花火大会が、赤・白・青の花火のまばゆいフィナーレで幕を閉じる。

10 秒 · 1080P · ネイティブ音声——FLUX 3 の画像→動画で生成

FLUX 3 とは?

FLUX 3 は、FLUX 画像ファミリーを生んだ Black Forest Labs が 2026 年 7 月 23 日に発表したマルチモーダル基盤モデルです。FLUX 1 と FLUX.2 が画像を生成していたのに対し、FLUX 3 はひとつのアーキテクチャの中で画像・動画・音声を同時に学習します。賭けはシンプルです:物体がどう動き、ぶつかり、音を立てるかを描かなければならないモデルは、世界の実際の振る舞いを学ばざるを得ない——そして生成するすべてのモダリティが、その共有された理解の恩恵を受けるのです。

そのワールドモデルの土台は、映像にそのまま表れます。FLUX 3 は最長 20 秒のクリップをネイティブ音声付きでワンパス生成します——口の動きにシンクした多言語のセリフ、原因となる物理的な出来事に結び付いた効果音、手持ちのホームビデオ風からクレイアニメ、シネマティックなショットまで及ぶスタイル。3 語のプロンプトでも一貫したシーンを組み立て、ストーリーボードのキーフレームを渡せば、あなたのフレームとフレームの間のトランジションを演出します。画像側でも、複雑なプロンプトの処理は歴代の FLUX を大きく上回り、多言語テキストも正確に描画します。

FLUX 3 の動画は今日、Molyin で稼働しています——上のAI 動画ジェネレーターの動画側が直接これを動かし、ストーリーボードのキーフレームとクリップ延長も含まれます。画像側はまだアーリーアクセス段階のため、AI 画像ジェネレーターでは FLUX 3 は近日公開のままです——スロットは準備済みで、両側とも全モデル共通のクレジットシステムで動きます。

FLUX 3 vs Seedance 2.5

Molyin の最新フラッグシップ動画モデル 2 本を並べて比較。両者は置き換えではなく補完の関係です:FLUX 3 はネイティブのセリフとキーフレーム演出で、Seedance 2.5 は 30 秒テイクと参照容量でリード——クレジット残高はひとつで両方をカバーします。

機能FLUX 3Seedance 2.5
ネイティブ音声セリフ + 効果音を同じワンパスで生成、同価格でオン/オフ可映像と音声の同時生成、常時オン
クリップの長さ5〜20 秒、範囲内で自由4〜30 秒、範囲内で自由
解像度720P / 1080P480P / 720P / 1080P
参照入力3〜10 枚のストーリーボードキーフレームでショットの流れを制御最大 50 の参照素材——画像・動画・音声
クリップ延長FLUX 3 Extend モデル——既存クリップを継続、5〜20 秒Seedance 2.5 Extend モデルで対応——最終フレームから継続、4〜30 秒
多言語のセリフキャラクターが複数言語を話し、リップシンク付き多言語リップシンク——8 言語を実証済み

どちらのモデルも Molyin で利用でき、クレジットは共通です。

FLUX 3 vs Molyin で公開中のモデル

モデルポジションリリース日Molyin では
FLUX 3Black Forest Labs のワールドモデル——ネイティブ音声 + ストーリーボードキーフレーム2026-08-07(動画API)· ウェイト公開予告公開中——上のジェネレーターへ
Seedance 2.5ByteDance の旗艦——30 秒テイクを秒単位で演出2026-08-07(API)公開中——上のジェネレーターへ
Wan 3.0Alibaba のオールインワンモデル、ワンテイク最長30秒2026-08-06公開中——上のジェネレーターへ
MiniMax H3オムニモーダル旗艦、ネイティブ 2K + ステレオ2026-07-31 · ウェイト公開予告公開中——上のジェネレーターへ
HappyHorse表現力の高い生成 + 指示型動画編集2026年6月(1.1)公開中——上のジェネレーターへ
Seedance 2.0 ファミリーStandard / Fast / Mini の主力、最大 4K2026年4月(API)公開中——上のジェネレーターへ
Kling 3.0エレメント参照 + ネイティブ音声、最大 4K2026-02-04公開中——上のジェネレーターへ
Veo 3.1Google のシネマティックモデル、音声付き2025年10月公開中——上のジェネレーターへ

サブスクリプションもクレジットもひとつ——上記で利用できるモデルはすべて含まれます。

FLUX 3 フルスペック

FLUX 3 フルスペック
パラメータ補足
生成モードテキスト→動画 · 画像→動画(先頭/最終フレーム)· ストーリーボードキーフレーム · クリップ延長ストーリーボードキーフレームはリファレンスモードで動作します。クリップ延長は独立したモデル——動画延長モードで FLUX 3 Extend を選択してください。
解像度720P / 1080Pどちらのティアもネイティブ音声付きで生成。ティアごとに秒単価が設定されています。
クリップの長さ5〜20 秒範囲内の任意の長さ——課金は出力秒数ごとです。
アスペクト比auto · 16:9 · 9:16 · 4:3 · 3:4 · 1:1 · 21:9 · 2:1auto はプロンプトと入力からモデルが選択。2:1 のワイドスクリーンは、Molyin では FLUX 3 だけの独占です。
音声ネイティブ——セリフと効果音、オン/オフ可映像と同じワンパスで生成。音声のオン/オフで価格は変わりません。
言語多言語のセリフと画面内テキストキャラクターは複数言語をリップシンク付きで話し、描画された看板やタイトルも読める状態を保ちます。
ストーリーボードキーフレーム3〜10 枚キーフレームはタイムライン全体に配置され、モデルがあなたのフレームとフレームの間のモーションを生成します。
クリップ延長ソースクリップ 1 本FLUX 3 Extend モデルが既存クリップを継続。新規生成分は下の延長レートで課金されます。
Seed非対応言い回しを変えてバリエーションを探ってください——同一プロンプトでも実行ごとに結果は変わります。
クレジット/秒38(720P)· 65(1080P)テキスト→動画、画像→動画、ストーリーボードキーフレームはすべてこのレートで課金されます。
延長クレジット/秒91(720P)· 118(1080P)クリップ延長時に新規生成された映像にのみ適用——ソースクリップ自体は無料です。

この表に載っている仕様はすべてサイト側で対応済みのもので、モデル公式の最新機能に追随して更新しています。

Molyin での FLUX 3 の料金

ジェネレーターに課金しているのと同じ課金エンジンによる、秒単位の透明な価格です——音声を付けても追加料金はなく、生成失敗時はクレジットが自動返還されます。

AI 動画モデルのクレジット料金表(解像度別)——秒単価とクリップ例
モデル解像度クレジット/秒5秒の動画5秒の動画 + 参照動画3秒
720p38190 クレジット参照画像のみ対応
1080p65325 クレジット参照画像のみ対応
720p91455 クレジット455 クレジット(元動画は無料)
1080p118590 クレジット590 クレジット(元動画は無料)
  • 動画延長モデル(FLUX 3 Extend)は元動画を課金しません——新規生成分の秒数のみ、上表の延長レートで課金されます。

サブスクリプションプランと買い切りクレジットパックの比較は料金ページをご覧ください。

全モデルのクレジット価格を見る

FLUX 3 で生成する方法

プロンプトから音付きの映像まで、3 ステップ

FLUX 3 とモードを選ぶ

テキスト→動画、画像→動画、またはストーリーボードキーフレームのためのリファレンスモードを選びます。クリップを延長するなら FLUX 3 Extend モデルを選択してください。

音まで含めてシーンを書く

ショットを描写し、セリフは引用符に入れてください——書いた音声を FLUX 3 が描画します。リファレンスモードでキーフレームを、FLUX 3 Extend でソースクリップを添付してタイムラインを演出します。

生成してエクスポート

FLUX 3 は映像と音をワンパスで生成、5〜20 秒、720P または 1080P。その場でプレビューし、原本をダウンロードできます。

サウンドをプロンプトに書き込む

FLUX 3 はあなたが描写した音声をそのまま描画します——それぞれの音のキューを、原因となる物理的な出来事に結び付ければ、ミックスは自然に映像へ従います。私たちの FLUX 3 フルプロンプトガイドからの抜粋です。

[視覚イベント] とともに [その音] + 任意 [環境音のベッド]

必須

視覚イベント

画面内で音を立てるアクション:ドアがバタンと閉まる、グラスがカチリと鳴る、足音が水しぶきを上げる。

必須

効果音

そのイベントにピン留めされた音——具体的に名指しし、アクションと同じ文の中に書く。

任意

環境音

背景のベッド:風、群衆のざわめき、ルームトーン。ひとことで十分。

FLUX 3 プロンプトガイドを読む

FLUX 3 よくある質問

Black Forest Labs のマルチモーダルモデルについて、クリエイターがよく尋ねること。

今すぐ Molyin で創作を始めよう

無料登録して、最初のアイデアを数分でシネマティックな動画に。