FLUX 3:動画・画像・音声をひとつにするマルチモーダルモデル
FLUX 3 は Black Forest Labs の新しいマルチモーダル基盤モデル。単一のアーキテクチャがネイティブ音声付き動画を生成し、画像を合成・編集し、ロボットまで動かします。何ができるのか、いつ使えるのか、そして待つ間にライバルモデルで作成する方法をまとめました。
- 概要
- Black Forest Labs のマルチモーダル基盤モデル。動画・画像・音声を単一アーキテクチャで生成。
- 動画
- 1回の生成で最長20秒、ネイティブ音声付き — テキストから動画、画像から動画、動画から動画、キーフレーム遷移に対応。
- 画像
- 合成と編集の両対応、多言語テキストを正確に描画。画像APIは発表後数週間でアーリーアクセス開始。
- Molyin では
- 近日公開 — 下の動画・画像両方のモデル選択に既に登場。今日は Seedance 2.0 や GPT Image 2 で作成できます。
本ページの事実確認日:2026-07-25。
FLUX 3 のワークフローを今すぐ体験
下の両ジェネレーターで FLUX 3 が事前選択され、近日公開マークが付いています — API 開放当日に有効化されます。AI動画とAI画像はワンクリックで切り替え可能。FLUX 3 の公開までは、比較評価に登場したモデル — Seedance 2.0、HappyHorse 1.1、GPT Image 2 — がすぐ使えます。同じプロンプト欄、同じクレジットで。
FLUX 3 とは?
FLUX 3 は、FLUX 画像モデルファミリーを生んだ Black Forest Labs が2026年7月23日に発表したマルチモーダル基盤モデルです。FLUX 1 と FLUX.2 が画像専用だったのに対し、FLUX 3 は画像・動画・音声を単一アーキテクチャ内で同時に学習します。狙いはシンプル:物体がどう動き、ぶつかり、音を立てるかを正確に描画しなければならないモデルは、世界の実際の振る舞いを学ばざるを得ない — そして生成するすべてのモダリティがその共有された世界理解の恩恵を受けます。
その世界モデルの土台は、二つの創作面の両方に現れます。動画側では、1回の生成で最長20秒・ネイティブ音声付きのクリップを出力 — 多言語の台詞、物理イベントに同期した効果音、ハンディカム風の実写からアニメ、シネマティックまで幅広いスタイル — さらにクリップを連結してキャラクターの一貫した複数ショットのシーケンスを構成できます。画像側では、複雑なプロンプトの扱いが従来の FLUX 世代を大きく上回り、多言語テキストを正確に描画します。同じバックボーンは、自動車の生産ラインでロボットを動かす動画-アクションモデル FLUX-mimic まで支えています。
現時点で FLUX 3 Video は招待制アーリーアクセス段階にあり、画像APIは数週間後に開放予定 — 公開APIはまだありません。だからこそ FLUX 3 は Molyin のAI動画ジェネレーターとAI画像ジェネレーターに「近日公開」として登場しています。両側の枠は準備済みで、有効化までの間は FLUX 3 と比較評価された当のモデルたちで作成でき、すべてをひとつのクレジットシステムでカバーします。
FLUX 3 でできること
ひとつのモデルに、ふたつの創作面 — すべての動画機能は音声をネイティブ生成します。後付けの合成ではありません。
ネイティブ音声付き動画
すべての動画生成に音が含まれます — 口の動きに同期した多言語の台詞、原因となる物理イベントに同期した効果音。
最長20秒、さらにその先へ
1回の生成は最長20秒。クリップを連結すれば数分規模の複数ショットシーケンスに。視覚参照がシーンをまたいでキャラクターを一貫させます。
画像・動画リファレンス
開始フレームを動かす、参照画像でシーンの方向性を決める、既存クリップのキャラクターをまったく新しい舞台へ連れて行く。
キーフレーム間の遷移生成
重要な瞬間を指定すれば、モデルがその間の制御された遷移を生成 — 絵コンテレベルのモーション制御。
多言語の台詞とタイポグラフィ
キャラクターは複数言語を話し、動画・画像の両出力で画面内テキストを正確に描画 — アニメーションするタイトルデザインも。
画像の合成と編集
幅広いスタイル・アスペクト比・解像度で画像を生成・編集。複雑なプロンプトの扱いは従来の FLUX 世代を大きく上回ります。
初期テストでの FLUX 3 の比較成績
音声付き10秒720pのテキストから動画クリップによる初期の人間選好評価で、FLUX 3 は比較対象となった主要動画モデルすべて — Luma Ray 3.2、Runway Gen-4.5、Grok Imagine Video、Kling v3 Pro、Happy Horse、Seedance 2.0、Gemini Omni Flash — に対して優位でした。以下の数字は評価者が FLUX 3 を選んだ比較の割合です。
| 比較対象 | FLUX 3 選好率 |
|---|---|
| Luma Ray 3.2 | 93% |
| Runway Gen-4.5 | 77% |
| Grok Imagine Video | 69% |
| Kling v3 Pro | 60% |
| Happy Horse v1 | 59% |
| HappyHorse 1.1 | 57% |
| Seedance 2.0 | 52% |
| Gemini Omni Flash | 52% |
発表時に公表された正式リリース前の暫定結果であり、モデルの成熟に伴い変動する可能性があります。第三者による独立比較は今後の登場が待たれます。
FLUX 3 公式サンプル
Black Forest Labs が FLUX 3 発表時に公開したサンプル出力。動画はぜひ音声をオンに — ネイティブ音声生成が最大の特徴です。
動画 — ネイティブ音声付き生成
画像 — 生成と編集






FLUX 3 の現在地
確認済みの FLUX 3 の状況:何が発表され、何にアクセスでき、開発者は何を使えるのか。
発表
2026年7月23日
同じバックボーンで構築され自動車生産ラインで実証されたロボティクスモデル FLUX-mimic と同時発表。
FLUX 3 Video
アーリーアクセス(招待制)
動画+音声の生成と編集を申請制で提供。API と非公開ウェイトはアーリーアクセス後に順次展開。
FLUX 3 Image
数週間以内にアーリーアクセス開始
画像の合成・編集を API と非公開ウェイトで提供予定。初期結果は既に従来の FLUX 世代を上回っています。
FLUX 3 Dev
オープンウェイトを予告
コンテンツ制作とアクション予測のためのオープンウェイト版マルチモーダルバックボーンがリリース計画に。時期は未発表。
Black Forest Labs が FLUX 3 のアクセスを開放した瞬間、上の両ジェネレーターで有効化されます — 同じクレジット、同じワークフロー、移行は不要です。
FLUX 3 vs 今日使えるモデル
FLUX 3 の初期スコアは他をリードしていますが、まだ一般には使えません。この表の他のモデルはすべて今この瞬間 Molyin で稼働中 — FLUX 3 の比較評価で最強クラスだった Seedance 2.0 と HappyHorse 1.1 を含みます。
| モデル | モダリティ | 提供状況 | Molyin では |
|---|---|---|---|
| FLUX 3(Black Forest Labs) | 動画+音声 · 画像 | 招待制アーリーアクセス | 近日公開 — 両方のモデル選択に登場済み |
| Seedance 2.0 | 動画 | 一般提供中 | 公開中 |
| HappyHorse 1.1 | 動画 | 一般提供中 | 公開中 |
| GPT Image 2 | 画像 | 一般提供中 | 公開中 |
| Nano Banana Pro | 画像 | 一般提供中 | 公開中 |
選好率は2026年7月の FLUX 3 発表時に公表された評価に基づきます。独立した比較は今後の登場が待たれます。
FLUX 3 よくある質問
クリエイターと開発者が Black Forest Labs のマルチモーダルモデルについて知りたいこと。