7日間延長

作成を始める
Black Forest Labs · 2026年7月23日発表 · Molyin に近日登場

FLUX 3:動画・画像・音声をひとつにするマルチモーダルモデル

FLUX 3 は Black Forest Labs の新しいマルチモーダル基盤モデル。単一のアーキテクチャがネイティブ音声付き動画を生成し、画像を合成・編集し、ロボットまで動かします。何ができるのか、いつ使えるのか、そして待つ間にライバルモデルで作成する方法をまとめました。

概要
Black Forest Labs のマルチモーダル基盤モデル。動画・画像・音声を単一アーキテクチャで生成。
動画
1回の生成で最長20秒、ネイティブ音声付き — テキストから動画、画像から動画、動画から動画、キーフレーム遷移に対応。
画像
合成と編集の両対応、多言語テキストを正確に描画。画像APIは発表後数週間でアーリーアクセス開始。
Molyin では
近日公開 — 下の動画・画像両方のモデル選択に既に登場。今日は Seedance 2.0 や GPT Image 2 で作成できます。

本ページの事実確認日:2026-07-25。

FLUX 3 のワークフローを今すぐ体験

下の両ジェネレーターで FLUX 3 が事前選択され、近日公開マークが付いています — API 開放当日に有効化されます。AI動画とAI画像はワンクリックで切り替え可能。FLUX 3 の公開までは、比較評価に登場したモデル — Seedance 2.0、HappyHorse 1.1、GPT Image 2 — がすぐ使えます。同じプロンプト欄、同じクレジットで。

FLUX 3 はまだ生成できません — アクセス開放と同時に即日有効化されます。

FLUX 3 とは?

FLUX 3 は、FLUX 画像モデルファミリーを生んだ Black Forest Labs が2026年7月23日に発表したマルチモーダル基盤モデルです。FLUX 1 と FLUX.2 が画像専用だったのに対し、FLUX 3 は画像・動画・音声を単一アーキテクチャ内で同時に学習します。狙いはシンプル:物体がどう動き、ぶつかり、音を立てるかを正確に描画しなければならないモデルは、世界の実際の振る舞いを学ばざるを得ない — そして生成するすべてのモダリティがその共有された世界理解の恩恵を受けます。

その世界モデルの土台は、二つの創作面の両方に現れます。動画側では、1回の生成で最長20秒・ネイティブ音声付きのクリップを出力 — 多言語の台詞、物理イベントに同期した効果音、ハンディカム風の実写からアニメ、シネマティックまで幅広いスタイル — さらにクリップを連結してキャラクターの一貫した複数ショットのシーケンスを構成できます。画像側では、複雑なプロンプトの扱いが従来の FLUX 世代を大きく上回り、多言語テキストを正確に描画します。同じバックボーンは、自動車の生産ラインでロボットを動かす動画-アクションモデル FLUX-mimic まで支えています。

現時点で FLUX 3 Video は招待制アーリーアクセス段階にあり、画像APIは数週間後に開放予定 — 公開APIはまだありません。だからこそ FLUX 3 は Molyin のAI動画ジェネレーターAI画像ジェネレーターに「近日公開」として登場しています。両側の枠は準備済みで、有効化までの間は FLUX 3 と比較評価された当のモデルたちで作成でき、すべてをひとつのクレジットシステムでカバーします。

FLUX 3 でできること

ひとつのモデルに、ふたつの創作面 — すべての動画機能は音声をネイティブ生成します。後付けの合成ではありません。

ネイティブ音声付き動画

すべての動画生成に音が含まれます — 口の動きに同期した多言語の台詞、原因となる物理イベントに同期した効果音。

最長20秒、さらにその先へ

1回の生成は最長20秒。クリップを連結すれば数分規模の複数ショットシーケンスに。視覚参照がシーンをまたいでキャラクターを一貫させます。

画像・動画リファレンス

開始フレームを動かす、参照画像でシーンの方向性を決める、既存クリップのキャラクターをまったく新しい舞台へ連れて行く。

キーフレーム間の遷移生成

重要な瞬間を指定すれば、モデルがその間の制御された遷移を生成 — 絵コンテレベルのモーション制御。

多言語の台詞とタイポグラフィ

キャラクターは複数言語を話し、動画・画像の両出力で画面内テキストを正確に描画 — アニメーションするタイトルデザインも。

画像の合成と編集

幅広いスタイル・アスペクト比・解像度で画像を生成・編集。複雑なプロンプトの扱いは従来の FLUX 世代を大きく上回ります。

初期テストでの FLUX 3 の比較成績

音声付き10秒720pのテキストから動画クリップによる初期の人間選好評価で、FLUX 3 は比較対象となった主要動画モデルすべて — Luma Ray 3.2、Runway Gen-4.5、Grok Imagine Video、Kling v3 Pro、Happy Horse、Seedance 2.0、Gemini Omni Flash — に対して優位でした。以下の数字は評価者が FLUX 3 を選んだ比較の割合です。

比較対象FLUX 3 選好率
Luma Ray 3.293%
Runway Gen-4.577%
Grok Imagine Video69%
Kling v3 Pro60%
Happy Horse v159%
HappyHorse 1.157%
Seedance 2.052%
Gemini Omni Flash52%

発表時に公表された正式リリース前の暫定結果であり、モデルの成熟に伴い変動する可能性があります。第三者による独立比較は今後の登場が待たれます。

FLUX 3 公式サンプル

Black Forest Labs が FLUX 3 発表時に公開したサンプル出力。動画はぜひ音声をオンに — ネイティブ音声生成が最大の特徴です。

動画 — ネイティブ音声付き生成

画像 — 生成と編集

FLUX 3 example — blue tubular chair with red cushion, product design renderFLUX 3 example — lava waterfall pouring into the sea at nightFLUX 3 example — oil painting of a stool in a sunlit roomFLUX 3 example — flat illustration of a lighthouse beam under a crescent moonFLUX 3 example — macro photograph of an octopus eyeFLUX 3 example — black sedan drifting across an empty lot, photographic style

FLUX 3 の現在地

確認済みの FLUX 3 の状況:何が発表され、何にアクセスでき、開発者は何を使えるのか。

発表

2026年7月23日

同じバックボーンで構築され自動車生産ラインで実証されたロボティクスモデル FLUX-mimic と同時発表。

FLUX 3 Video

アーリーアクセス(招待制)

動画+音声の生成と編集を申請制で提供。API と非公開ウェイトはアーリーアクセス後に順次展開。

FLUX 3 Image

数週間以内にアーリーアクセス開始

画像の合成・編集を API と非公開ウェイトで提供予定。初期結果は既に従来の FLUX 世代を上回っています。

FLUX 3 Dev

オープンウェイトを予告

コンテンツ制作とアクション予測のためのオープンウェイト版マルチモーダルバックボーンがリリース計画に。時期は未発表。

Black Forest Labs が FLUX 3 のアクセスを開放した瞬間、上の両ジェネレーターで有効化されます — 同じクレジット、同じワークフロー、移行は不要です。

FLUX 3 vs 今日使えるモデル

FLUX 3 の初期スコアは他をリードしていますが、まだ一般には使えません。この表の他のモデルはすべて今この瞬間 Molyin で稼働中 — FLUX 3 の比較評価で最強クラスだった Seedance 2.0 と HappyHorse 1.1 を含みます。

モデルモダリティ提供状況Molyin では
FLUX 3(Black Forest Labs)動画+音声 · 画像招待制アーリーアクセス近日公開 — 両方のモデル選択に登場済み
Seedance 2.0動画一般提供中公開中
HappyHorse 1.1動画一般提供中公開中
GPT Image 2画像一般提供中公開中
Nano Banana Pro画像一般提供中公開中

選好率は2026年7月の FLUX 3 発表時に公表された評価に基づきます。独立した比較は今後の登場が待たれます。

FLUX 3 よくある質問

クリエイターと開発者が Black Forest Labs のマルチモーダルモデルについて知りたいこと。

今すぐ Molyin で創作を始めよう

無料登録して、最初のアイデアを数分でシネマティックな動画に。