时间:2026年7月23日
地点:德国弗赖堡
人物:德国AI实验室Black Forest Labs(Stable Diffusion原作者团队)
事件详情:2026年7月23日,德国AI实验室Black Forest Labs以Early Access方式上线推出FLUX 3多模态基础模型。该模型采用统一架构联合学习图像、视频和音频,基于Self-Flow自监督流匹配框架扩展,在FLUX.1和FLUX.2系列基础上扩展至多模态生成与理解。FLUX 3可在单次生成中输出最长20秒的视频并附带原生音频,支持文生视频、图生视频、视频生视频、输入视频与音频续写、关键帧转视频、多语言对话及多镜头串联。
在带声音的10秒、720p视频人工评测中,FLUX 3对比Grok Imagine Video胜率69%,对比Seedance 2.0和Gemini Omni Flash胜率均为52%。在机器人方向,Black Forest Labs正与瑞士Mimic Robotics合作开发动作模型,并与奥迪(Audi AG)等制造合作伙伴测试。此外,Black Forest Labs此前已于2025年12月完成3亿美元B轮融资,估值达32.5亿美元,由Salesforce Ventures和Anjney Midha旗下AMP共同领投,NVIDIA、a16z、General Catalyst、Temasek、Bain Capital等参投。
背景:Black Forest Labs由Stable Diffusion原作者团队于2024年8月在德国创立,是欧洲最具影响力的开源多模态AI实验室之一。FLUX系列(FLUX.1/FLUX.2)累计下载量超过数千万,被Adobe、Canva、Figma、VSCO、fal.ai、Picsart、ElevenLabs等头部创意工具集成。FLUX 3的发布意味着该实验室从「图像模型王者」正式跨入视频+音频+动作预测的全模态赛道,与OpenAI Sora、谷歌Veo、Runway Gen-4等正面竞争,并率先将多模态能力延伸到机器人控制(Physical AI)领域。
影响:
- FLUX 3视频胜率69%超过Grok Imagine Video,是欧洲AI实验室首次在视频生成评测中反超马斯克旗下xAI的旗舰模型
- 「图像+视频+音频+动作」四模态统一架构代表多模态AI走向「通感」阶段,对OpenAI Sora、Runway等单模态视频模型形成技术路径挑战
- 与Mimic Robotics、奥迪等合作切入机器人控制,让开源多模态模型成为Physical AI基础设施的关键拼图,可能改变机器人学习范式
- 欧洲AI生态首次在多模态生成上取得全球领先位置,对中美AI竞争格局构成第三极变量
总结:FLUX 3的发布是2026年7月全球多模态AI最重磅的产品事件之一。该模型以统一架构融合视频、音频与动作预测能力,并以20秒视频生成和69%对Grok胜率在欧洲AI阵营创造历史。Black Forest Labs从开源图像模型王者升级为全模态多面手,意味着欧洲AI生态第一次站上视频生成全球第一梯队。配合其3亿美元B轮融资32.5亿美元估值和NVIDIA、Salesforce、a16z等顶级投资方,FLUX 3将很快与OpenAI Sora、谷歌Veo、Runway等正面争夺视频生成市场份额,并有望推动开源多模态模型在机器人控制、自动驾驶、影视制作、广告创意等多个垂直领域规模化落地。
参考来源:
- https://www.ithome.com/0/981/137.htm
- https://new.qq.com/rain/a/20260724A04ELV00
- https://so.html5.qq.com/page/real/search_news?docid=70000021_3306a630d5315152
- https://so.html5.qq.com/page/real/search_news?docid=70000021_2066a62e21144952
- https://so.html5.qq.com/page/real/search_news?docid=70000021_5976a6240ad15252
- https://so.html5.qq.com/page/real/search_news?docid=70000021_9646a62ceb894265
- https://techcrunch.com/2025/12/01/black-forest-labs-raises-300m-at-3-25b-valuation/









