FLUX 3:视频、图片与音频的单一多模态模型
FLUX 3 是 Black Forest Labs 的新一代多模态基座模型——同一套架构生成带原生音频的视频、合成与编辑图片,甚至驱动机器人。这一页讲清它能做什么、什么时候能用上,以及等待期间如何用它的对标模型创作。
- 它是什么
- Black Forest Labs 的多模态基座模型:视频、图片、音频由同一套架构生成。
- 视频
- 单次生成最长 20 秒、自带原生音频——文生视频、图生视频、视频生视频与关键帧转场。
- 图片
- 合成与编辑兼备,多语言文字渲染精准;图片 API 在官宣后数周内开放 early access。
- 在 Molyin
- 即将上线——已进驻下方视频与图片两个模型下拉。今天就能用 Seedance 2.0 或 GPT Image 2 创作。
本页事实核验于 2026-07-25。
现在就体验 FLUX 3 的创作流
下方两个生成器都已预选 FLUX 3(标记即将上线)——API 开放当天即激活。一键在 AI 视频与 AI 图片之间切换;在 FLUX 3 上线之前,与它同台评测的模型——Seedance 2.0、HappyHorse 1.1、GPT Image 2——都已就绪:同一个提示框,同一套积分。
FLUX 3 是什么?
FLUX 3 是 Black Forest Labs(FLUX 图像模型家族的缔造者)于 2026 年 7 月 23 日官宣的多模态基座模型。FLUX 1 和 FLUX.2 只生成图片,FLUX 3 则在同一套架构里同时学习图片、视频与音频。它押注的逻辑很简单:一个必须把物体如何运动、碰撞、发声渲染准确的模型,就被迫学会世界真实的运作方式——它生成的每一种模态都受益于这份共享的世界理解。
这份世界模型的底子体现在两个创作面上。视频侧,FLUX 3 单次生成最长 20 秒、自带原生音频的片段——多语言对白、与物理事件同步的音效、从手持 DV 实拍到动画再到电影级镜头的宽泛风格——还能把片段串接成角色一致的多镜头长序列。图片侧,它对复杂提示词的驾驭显著超越此前的 FLUX 世代,并能精准渲染多语言文字。同一个骨干甚至驱动着 FLUX-mimic——一个跑在汽车产线机器人上的视频-动作模型。
目前 FLUX 3 Video 处于邀请制 early access 阶段,图片 API 将在随后数周开放——尚无公开 API。这正是 FLUX 3 以「即将上线」身份出现在 Molyin AI 视频生成器与AI 图片生成器里的原因:两侧的位置都已就绪,在它激活之前,你可以用与 FLUX 3 同台评测的那些模型创作,一套积分体系全部通用。
FLUX 3 能做什么
一个模型,两个创作面——所有视频能力都自带原生生成的音频,不是事后拼接。
原生音频视频
每次视频生成都自带声音——多语言对白与口型同步,音效与引发它的物理事件同步。
单次 20 秒,串接更长
单次生成最长 20 秒,片段还能串接成数分钟的多镜头序列,视觉参考让角色跨场景保持一致。
图片与视频参考
让首帧动起来、用参考图定调场景,或把已有片段里的角色带进全新的情境。
关键帧转场
定义关键时刻,让模型在它们之间生成可控转场——分镜级别的运动控制。
多语言对白与文字排版
角色能说多种语言,视频与图片输出都能精准渲染画面文字——包括动态标题设计。
图片合成与编辑
跨风格、比例与分辨率生成和编辑图片,复杂提示词的驾驭显著超越此前的 FLUX 世代。
FLUX 3 早期评测表现
在 10 秒 720p 带音频文生视频的早期人评偏好测试中,FLUX 3 对每一个参与对比的主流视频模型都占优——Luma Ray 3.2、Runway Gen-4.5、Grok Imagine Video、Kling v3 Pro、Happy Horse、Seedance 2.0 与 Gemini Omni Flash。下表数字是评测者选择 FLUX 3 的比例。
| 对比对象 | FLUX 3 胜率 |
|---|---|
| Luma Ray 3.2 | 93% |
| Runway Gen-4.5 | 77% |
| Grok Imagine Video | 69% |
| Kling v3 Pro | 60% |
| Happy Horse v1 | 59% |
| HappyHorse 1.1 | 57% |
| Seedance 2.0 | 52% |
| Gemini Omni Flash | 52% |
数字为官宣时公布的初步结果(正式发布前),随模型成熟可能变化;独立第三方对比仍在陆续出现。
FLUX 3 官方样片与样张
Black Forest Labs 在 FLUX 3 官宣时发布的示例输出。看视频请打开声音——原生音频是头号卖点。
视频——原生音频同步生成
图片——合成与编辑






FLUX 3 现状速览
FLUX 3 的已核验状态:官宣了什么、能访问什么、开发者能用什么。
官宣
2026 年 7 月 23 日
与 FLUX-mimic 同日亮相——后者是基于同一骨干的机器人模型,已在汽车产线实测。
FLUX 3 Video
Early access(邀请制)
视频 + 音频生成与编辑,申请制接入。API 与私有权重在 early access 阶段后陆续开放。
FLUX 3 Image
数周内开放 early access
图片合成与编辑将经 API 与私有权重开放;早期结果已超越此前的 FLUX 世代。
FLUX 3 Dev
开放权重已列入计划
面向内容创作与动作预测的开放权重多模态骨干在发布计划内,时间未公布。
Black Forest Labs 开放 FLUX 3 接入的那一刻,它就在上方两个生成器里激活——同一套积分、同一条工作流,无需任何迁移。
FLUX 3 vs 今天就能用的模型
FLUX 3 的早期数据领跑同行,但它还不能公开使用。下表其余每一个模型此刻都在 Molyin 上线运行——包括与 FLUX 3 同台评测中最强的 Seedance 2.0 和 HappyHorse 1.1。
| 模型 | 模态 | 可用性 | 在 Molyin |
|---|---|---|---|
| FLUX 3(Black Forest Labs) | 视频 + 音频 · 图片 | 邀请制 early access | 即将上线——已进驻两个模型下拉 |
| Seedance 2.0 | 视频 | 已全面开放 | 已上线 |
| HappyHorse 1.1 | 视频 | 已全面开放 | 已上线 |
| GPT Image 2 | 图片 | 已全面开放 | 已上线 |
| Nano Banana Pro | 图片 | 已全面开放 | 已上线 |
胜率引自 2026 年 7 月 FLUX 3 官宣时公布的评测;独立对比仍在陆续出现。
FLUX 3 常见问题
创作者与开发者最关心的 FLUX 3 问题。