FLUX 3——動画・画像・音声をひとつでこなすマルチモーダルモデル
Black Forest Labs のワールドモデルは、映像と音をワンパスで同時に生成します。下にプロンプトを書けば、FLUX 3 がセリフと効果音を織り込んだ 5〜20 秒の映像を返します。
- 生成失敗時はクレジット自動返還
- クレジットパックは無期限
- 全モデルの料金を公開
- ワンクリックでいつでも解約
- 5〜20 秒
- クリップの長さ
- 720P / 1080P
- 解像度
- ネイティブ、オン/オフ可
- 音声
- 3〜10 枚
- ストーリーボードキーフレーム
実際のプロンプト、実際の FLUX 3 映像
以下のクリップはすべて、表示されているプロンプトそのままで FLUX 3 が生成したものです——公式サンプルとコミュニティ作品、音まで含めて。Remix を押せば、そのプロンプトが上のジェネレーターに読み込まれ、あなたの作品の出発点になります。
- FLUX 3
- Text to video
- 10s
- 1080P
雨の降る東京の夜、居心地のよいラーメン店:スープから湯気が立ちのぼり、窓の外の水たまりにネオンが反射し、店主が落ち着いた手つきで調理している。カメラはカウンターに沿ってゆっくり流れる。雨音と、静かな厨房の物音。
- FLUX 3
- Text to video
- 20s
- 720P
AIについて愚痴をまくし立てる
- FLUX 3
- Text to video
- 20s
- 720P
ピラミッドはどうやって作られた?それを映像で可視化して。
- FLUX 3
- Text to video
- 15s
- 720P
クレイアニメの物語:画面に入ってくる巨大な手に男が何度も押しつぶされ、まともに生活できない
- FLUX 3
- Text to video
- 20s
- 720P
アステカ人の日常生活
写真 1 枚から、花火のフィナーレへ
FLUX 3 の画像→動画モードは、1 枚の静止画を動きのある映像に変えます。公式サンプルの全工程がこちら:花火の写真 1 枚と 1 行のプロンプトが、10 秒の 1080P フィナーレになりました——観衆のざわめきと爆発音は、映像と同時にネイティブ生成されています。

プロンプト
7月4日(アメリカ独立記念日)の花火大会が、赤・白・青の花火のまばゆいフィナーレで幕を閉じる。
FLUX 3 とは?
FLUX 3 は、FLUX 画像ファミリーを生んだ Black Forest Labs が 2026 年 7 月 23 日に発表したマルチモーダル基盤モデルです。FLUX 1 と FLUX.2 が画像を生成していたのに対し、FLUX 3 はひとつのアーキテクチャの中で画像・動画・音声を同時に学習します。賭けはシンプルです:物体がどう動き、ぶつかり、音を立てるかを描かなければならないモデルは、世界の実際の振る舞いを学ばざるを得ない——そして生成するすべてのモダリティが、その共有された理解の恩恵を受けるのです。
そのワールドモデルの土台は、映像にそのまま表れます。FLUX 3 は最長 20 秒のクリップをネイティブ音声付きでワンパス生成します——口の動きにシンクした多言語のセリフ、原因となる物理的な出来事に結び付いた効果音、手持ちのホームビデオ風からクレイアニメ、シネマティックなショットまで及ぶスタイル。3 語のプロンプトでも一貫したシーンを組み立て、ストーリーボードのキーフレームを渡せば、あなたのフレームとフレームの間のトランジションを演出します。画像側でも、複雑なプロンプトの処理は歴代の FLUX を大きく上回り、多言語テキストも正確に描画します。
FLUX 3 の動画は今日、Molyin で稼働しています——上のAI 動画ジェネレーターの動画側が直接これを動かし、ストーリーボードのキーフレームとクリップ延長も含まれます。画像側はまだアーリーアクセス段階のため、AI 画像ジェネレーターでは FLUX 3 は近日公開のままです——スロットは準備済みで、両側とも全モデル共通のクレジットシステムで動きます。
FLUX 3 vs Seedance 2.5
Molyin の最新フラッグシップ動画モデル 2 本を並べて比較。両者は置き換えではなく補完の関係です:FLUX 3 はネイティブのセリフとキーフレーム演出で、Seedance 2.5 は 30 秒テイクと参照容量でリード——クレジット残高はひとつで両方をカバーします。
| 機能 | FLUX 3 | Seedance 2.5 |
|---|---|---|
| ネイティブ音声 | セリフ + 効果音を同じワンパスで生成、同価格でオン/オフ可 | 映像と音声の同時生成、常時オン |
| クリップの長さ | 5〜20 秒、範囲内で自由 | 4〜30 秒、範囲内で自由 |
| 解像度 | 720P / 1080P | 480P / 720P / 1080P |
| 参照入力 | 3〜10 枚のストーリーボードキーフレームでショットの流れを制御 | 最大 50 の参照素材——画像・動画・音声 |
| クリップ延長 | FLUX 3 Extend モデル——既存クリップを継続、5〜20 秒 | Seedance 2.5 Extend モデルで対応——最終フレームから継続、4〜30 秒 |
| 多言語のセリフ | キャラクターが複数言語を話し、リップシンク付き | 多言語リップシンク——8 言語を実証済み |
どちらのモデルも Molyin で利用でき、クレジットは共通です。
FLUX 3 vs Molyin で公開中のモデル
| モデル | ポジション | リリース日 | Molyin では |
|---|---|---|---|
| FLUX 3 | Black Forest Labs のワールドモデル——ネイティブ音声 + ストーリーボードキーフレーム | 2026-08-07(動画API)· ウェイト公開予告 | 公開中——上のジェネレーターへ |
| Seedance 2.5 | ByteDance の旗艦——30 秒テイクを秒単位で演出 | 2026-08-07(API) | 公開中——上のジェネレーターへ |
| Wan 3.0 | Alibaba のオールインワンモデル、ワンテイク最長30秒 | 2026-08-06 | 公開中——上のジェネレーターへ |
| MiniMax H3 | オムニモーダル旗艦、ネイティブ 2K + ステレオ | 2026-07-31 · ウェイト公開予告 | 公開中——上のジェネレーターへ |
| HappyHorse | 表現力の高い生成 + 指示型動画編集 | 2026年6月(1.1) | 公開中——上のジェネレーターへ |
| Seedance 2.0 ファミリー | Standard / Fast / Mini の主力、最大 4K | 2026年4月(API) | 公開中——上のジェネレーターへ |
| Kling 3.0 | エレメント参照 + ネイティブ音声、最大 4K | 2026-02-04 | 公開中——上のジェネレーターへ |
| Veo 3.1 | Google のシネマティックモデル、音声付き | 2025年10月 | 公開中——上のジェネレーターへ |
サブスクリプションもクレジットもひとつ——上記で利用できるモデルはすべて含まれます。
FLUX 3 フルスペック
| パラメータ | 値 | 補足 |
|---|---|---|
| 生成モード | テキスト→動画 · 画像→動画(先頭/最終フレーム)· ストーリーボードキーフレーム · クリップ延長 | ストーリーボードキーフレームはリファレンスモードで動作します。クリップ延長は独立したモデル——動画延長モードで FLUX 3 Extend を選択してください。 |
| 解像度 | 720P / 1080P | どちらのティアもネイティブ音声付きで生成。ティアごとに秒単価が設定されています。 |
| クリップの長さ | 5〜20 秒 | 範囲内の任意の長さ——課金は出力秒数ごとです。 |
| アスペクト比 | auto · 16:9 · 9:16 · 4:3 · 3:4 · 1:1 · 21:9 · 2:1 | auto はプロンプトと入力からモデルが選択。2:1 のワイドスクリーンは、Molyin では FLUX 3 だけの独占です。 |
| 音声 | ネイティブ——セリフと効果音、オン/オフ可 | 映像と同じワンパスで生成。音声のオン/オフで価格は変わりません。 |
| 言語 | 多言語のセリフと画面内テキスト | キャラクターは複数言語をリップシンク付きで話し、描画された看板やタイトルも読める状態を保ちます。 |
| ストーリーボードキーフレーム | 3〜10 枚 | キーフレームはタイムライン全体に配置され、モデルがあなたのフレームとフレームの間のモーションを生成します。 |
| クリップ延長 | ソースクリップ 1 本 | FLUX 3 Extend モデルが既存クリップを継続。新規生成分は下の延長レートで課金されます。 |
| Seed | 非対応 | 言い回しを変えてバリエーションを探ってください——同一プロンプトでも実行ごとに結果は変わります。 |
| クレジット/秒 | 38(720P)· 65(1080P) | テキスト→動画、画像→動画、ストーリーボードキーフレームはすべてこのレートで課金されます。 |
| 延長クレジット/秒 | 91(720P)· 118(1080P) | クリップ延長時に新規生成された映像にのみ適用——ソースクリップ自体は無料です。 |
この表に載っている仕様はすべてサイト側で対応済みのもので、モデル公式の最新機能に追随して更新しています。
Molyin での FLUX 3 の料金
ジェネレーターに課金しているのと同じ課金エンジンによる、秒単位の透明な価格です——音声を付けても追加料金はなく、生成失敗時はクレジットが自動返還されます。
| モデル | 解像度 | クレジット/秒 | 5秒の動画 | 5秒の動画 + 参照動画3秒 |
|---|---|---|---|---|
| 720p | 38 | 190 クレジット | 参照画像のみ対応 | |
| 1080p | 65 | 325 クレジット | 参照画像のみ対応 | |
| 720p | 91 | 455 クレジット | 455 クレジット(元動画は無料) | |
| 1080p | 118 | 590 クレジット | 590 クレジット(元動画は無料) |
- 動画延長モデル(FLUX 3 Extend)は元動画を課金しません——新規生成分の秒数のみ、上表の延長レートで課金されます。
サブスクリプションプランと買い切りクレジットパックの比較は料金ページをご覧ください。
FLUX 3 で生成する方法
プロンプトから音付きの映像まで、3 ステップ
FLUX 3 とモードを選ぶ
テキスト→動画、画像→動画、またはストーリーボードキーフレームのためのリファレンスモードを選びます。クリップを延長するなら FLUX 3 Extend モデルを選択してください。
音まで含めてシーンを書く
ショットを描写し、セリフは引用符に入れてください——書いた音声を FLUX 3 が描画します。リファレンスモードでキーフレームを、FLUX 3 Extend でソースクリップを添付してタイムラインを演出します。
生成してエクスポート
FLUX 3 は映像と音をワンパスで生成、5〜20 秒、720P または 1080P。その場でプレビューし、原本をダウンロードできます。
サウンドをプロンプトに書き込む
FLUX 3 はあなたが描写した音声をそのまま描画します——それぞれの音のキューを、原因となる物理的な出来事に結び付ければ、ミックスは自然に映像へ従います。私たちの FLUX 3 フルプロンプトガイドからの抜粋です。
[視覚イベント] とともに [その音] + 任意 [環境音のベッド]
視覚イベント
画面内で音を立てるアクション:ドアがバタンと閉まる、グラスがカチリと鳴る、足音が水しぶきを上げる。
効果音
そのイベントにピン留めされた音——具体的に名指しし、アクションと同じ文の中に書く。
環境音
背景のベッド:風、群衆のざわめき、ルームトーン。ひとことで十分。
FLUX 3 よくある質問
Black Forest Labs のマルチモーダルモデルについて、クリエイターがよく尋ねること。