时间:2026年8月5日
地点:德国弗莱堡(全球线上发布)
人物:Black Forest Labs(BFL,黑森林实验室)团队
事件详情:2026年8月5日,德国AI初创公司Black Forest Labs(BFL)宣布其多模态视频生成模型 FLUX 3 Video 正式通过 BFL API 及精选合作伙伴全面上线(Generally Available)。该模型可生成长达20秒、分辨率最高1080p的视频片段,并原生同步生成对话、音效与环境音。支持文生视频、图生视频、关键帧、视频续写、多镜头串联,以及14种以上语言的唇形同步对话。BFL官方Elo评分显示,FLUX 3 Video在文生视频与图生视频榜单上分别以1135分和1051分位列第一,超过Gemini Omni Flash、MiniMax H3与字节Seedance 2.0。价格方面,草稿模式HD按0.06-0.12美元/秒计费,Full HD全画质最高0.53美元/秒。
背景:Black Forest Labs成立于2019年,以FLUX系列图像模型闻名。FLUX 3是其于2026年3月公开Self-Flow自监督流匹配学习框架后打造的多模态基础模型,统一架构联合训练图像、视频、音频三类数据,是全球首个原生支持音视频同步生成的多模态模型。Elo排名对标的是Runway Gen-4.5、Luma Ray 3.2、Grok Imagine Video与Seedance 2.0等当前主流视频生成模型。
影响:
- 巩固BFL在视频生成赛道的领跑地位,对Runway Gen-4.5、Luma Ray 3.2形成直接竞争压力
- 音画一次成型省去音画后期对齐流程,降低短剧、广告、纪录片创作门槛
- 与Mimic Robotics合作推出FLUX-mimic动作模型并已在奥迪工厂测试,加速从内容生成向物理世界模型演进
- FLUX 3 Image与开源权重版本FLUX 3 Dev将于未来数周内陆续推出
总结:FLUX 3 Video以全面开放API的形式,将音视频同步生成的门槛拉至每秒0.06美元起的低价区间,Elo评分反超Seedance 2.0和Gemini Omni Flash等顶级闭源模型。配合即将开源的FLUX 3 Dev权重与奥迪工厂正在验证的机器人动作模型FLUX-mimic,BFL正把多模态生成从屏幕里的内容推向产线上的物理世界,进一步挤压传统视频工具链的生存空间。
参考来源:
- https://the-decoder.com/black-forest-labs-makes-flux-3-video-generally-available-and-claims-it-beats-seedance-2-0/
- https://bfl.ai/blog/flux-3-video
- https://bfl.ai/pricing
- https://m.toutiao.com/article/7669378976661504556/
- https://m.chinaz.com/ainews/29874.shtml
- https://m.toutiao.com/article/7666264088934236681/
- https://www.aprilzz.com/ai/flux-3/