位置:首页 > 热点资讯 > Black Forest Labs 发布 FLUX 3 多模态基础模型

Black Forest Labs 发布 FLUX 3 多模态基础模型

时间:2026-07-25  |  作者:夜鞌不睡  |  阅读:0

Black Forest Labs 发布新一代多模态基础模型 FLUX 3

7月24日,Black Forest Labs 正式发布了完全基于统一架构设计的新一代多模态基础模型——FLUX 3

该模型的核心亮点在于:将图像、视频与音频的联合训练融入同一个框架。目标直指对现实物理世界更深层次的认知与理解。

Black Forest Labs发布多模态基础模型FLUX 3

生成能力:扎实且多样

在生成能力上,FLUX 3 不止于“能生”,而且生得相当扎实。它支持多种任务:

  • 文本生成视频
  • 图像生成视频
  • 视频续写

单次输出最长可达 20秒,分辨率 720p,并且支持原生音画同步。

这意味着,你输入一段文字或一张图,它就能直接输出一段带声音、画面连贯的高质量视频。

初步基准测试中,其综合表现已经超过了 Grok Imagine VideoRunway Gen-4.5Luma Ray 3.2 这些当前主流的视频生成模型。同时,在图像合成与编辑任务上,FLUX 3 也取得了明显进步,不是只擅长视频那一块。

物理 AI 关键一步

更值得关注的是,Black Forest Labs 在物理 AI 方向也迈出了关键一步。它们与 mimic robotics 联手,基于 FLUX 3 的视频理解骨干网络,开发了视频驱动的机器人动作模型——FLUX-mimic

这个模型能精准预测机器人操作动作。目前已经在奥迪工厂的实际产线环境中启动验证测试。

开放计划与节奏

至于用户体验,FLUX 3 Video 版本现已开放早期体验通道。图像生成能力及开源权重也将按计划分阶段陆续放出。整个节奏安排得比较清晰,值得持续关注。

免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多