Black Forest Labs发布多模态模型FLUX 3

7月23日,Black Forest Labs以Early Access形式上线FLUX 3多模态基础模型。该模型采用统一架构,联合学习图像、视频与音频,支持文生视频、图生视频、视频续写、关键帧转视频及多语言对话等功能,单次可生成最长20秒带原生音频的720p视频。基于Self-Flow自监督框架训练,在10秒带声视频人工评测中,胜率分别为Grok Imagine Video(69%)、Seedance 2.0(52%)和Gemini Omni Flash(52%)。团队正与Mimic Robotics合作探索其在机器人行为预测中的应用。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号