Black Forest Labs发布多模态基础模型FLUX 3

Source

品玩7月24日讯,Black Forest Labs正式发布多模态基础模型FLUX 3。该模型采用统一架构,联合学习图像、视频与音频,旨在构建对物理世界的深层理解。

FLUX 3具备强大的多模态生成能力,支持文生视频、图生视频及视频续写等功能,单次可生成最长20秒且带有原生同步音频的720p视频。在早期评测中,其表现优于Grok Imagine Video、Runway Gen-4.5及Luma Ray 3.2等主流模型。此外,FLUX 3在图像合成与编辑方面也有显著提升。

在物理AI领域,Black Forest Labs联合mimic robotics开发了视频动作模型FLUX-mimic,利用FLUX 3的视频骨干网络预测机器人动作。该模型目前已在奥迪工厂的生产线上开展测试。FLUX 3 Video现已开放早期体验,图像生成及开源权重版本也将陆续推出。